Observatoire Québec
Modèles d'intelligence artificielle
La dernière version de chaque famille de modèles recensée, avec ses capacités, son fournisseur et son historique complet.
- Familles de modèles
- 567
- Versions recensées
- 805
- Fournisseurs
- 87
- Mise à jour
- 25 septembre 2026
368 modèles affichés, classés de la sortie la plus récente à la plus ancienne
Claude Opus
Modèle de texte ultra-performant d'Anthropic, conçu pour les tâches complexes exigeant un raisonnement logique rigoureux et une analyse textuelle de niveau supérieur.
Grok
Modèle de transcription de pointe développé par xAI, combinant la conversion de la parole en texte et la prise en charge de l'appel d'outils.
Antigravity Preview 09 2026
L'identifiant antigravity-preview-09-2026 de Google : origines de la fuite, architecture agentique probable, limites et statut de déploiement.
Gemini Flash
Modèle de texte rapide et économique de Google, conçu pour les tâches à haute fréquence et prenant en charge l'appel d'outils au sein de l'écosystème ProductivIA.
GPT-6
GPT-6 Astra d'OpenAI : un modèle de raisonnement révolutionnaire doté d'une fenêtre de contexte de 1,05 million de tokens.
GPT-5
Modèle textuel de pointe d'OpenAI conçu pour le traitement complexe et compatible avec l'appel d'outils externes.
GLM 5.2
Modèle de texte polyvalent de la famille GLM disponible sur OpenRouter, offrant un support natif des outils pour un coût d'exploitation maîtrisé.
Kimi K3
Le modèle de 2,8 billions de paramètres de MoonshotAI, optimisé pour le raisonnement profond et un contexte de 1 million de tokens.
Voxtral
Modèle textuel compact de Mistral AI optimisé pour l'appel d'outils, adapté aux intégrations structurées au sein de notre environnement souverain.
Antigravity Preview 05 2026
Modèle textuel expérimental de Google prenant en charge l'appel d'outils, proposé en version préliminaire pour les phases de test.
Command
Modèle textuel de Cohere optimisé pour les environnements professionnels. Il se distingue par son support natif des outils pour l'automatisation des processus.
Nemotron 3 Ultra 550B A55b
Modèle de langage ultra-large de NVIDIA disponible via OpenRouter. Il est optimisé pour les tâches complexes et l'appel d'outils, offrant un rapport performance-coût très avantageux.
Nemotron 3 Ultra 550B A55b:free
Modèle de langage de grande taille d'NVIDIA (MoE), disponible gratuitement via OpenRouter pour l'évaluation de tâches textuelles complexes et l'intégration d'outils.
Deep Research Max Preview 04 2026
Modèle textuel de Google axé sur la recherche approfondie et le support d'outils, adapté aux analyses complexes avec un tarif d'entrée de 30 $ et de sortie de 50 $.
Deep Research Preview 04 2026
Modèle de recherche approfondie de Google conçu pour l'analyse complexe et l'exécution d'outils, offrant des capacités avancées de synthèse d'informations.
Gemma
Modèle de texte intermédiaire de Google optimisé pour le suivi d'instructions et l'appel d'outils, offrant un excellent équilibre entre coût et performance.
GLM 5.1
Modèle de langage performant proposé par Z-AI sur OpenRouter, optimisé pour le traitement de texte et l'appel d'outils à un tarif très compétitif.
Mistral Medium
Modèle de texte intermédiaire performant et polyvalent de Mistral AI, idéal pour les flux de travail automatisés grâce au support des outils.
Qwen3.5 Plus
Modèle multimodal performant et très économique de la série Qwen, intégrant la vision et l'appel d'outils pour des applications d'analyse avancées.
Gemini Pro
Modèle textuel de pointe développé par Google, optimisé pour les tâches de raisonnement complexes et l'intégration d'outils externes.
GLM 5 Turbo
Modèle de texte polyvalent et performant développé par Z-AI, adapté aux tâches d'automatisation et supportant l'appel d'outils via OpenRouter.
GLM 5v Turbo
Modèle multimodal performant et économique, adapté au traitement combiné du texte et de l'image ainsi qu'à l'appel d'outils.
Mistral Moderation 2603
Modèle de texte de Mistral AI dédié à la modération de contenu, offrant une solution performante pour la sécurité des échanges textuels.
Mistral Small
Modèle de texte performant et économique de Mistral AI, idéal pour les tâches intermédiaires et l'appel d'outils, offrant une alternative de souveraineté de premier plan.
Nemotron 3 Super 120B A12b
Modèle de grande capacité conçu par NVIDIA, optimisé pour les tâches complexes et l'appel d'outils avec un coût d'inférence extrêmement compétitif.
Nemotron 3 Super 120B A12b:free
Modèle de langage haute performance d'NVIDIA disponible gratuitement sur OpenRouter, offrant des capacités de génération textuelle et de support d'outils.
Claude Sonnet
Modèle de texte de pointe conciliant haute performance et intégration d'outils, idéal pour les processus d'affaires exigeants de ProductivIA.
GLM 5
Modèle linguistique performant et très économique, idéal pour les tâches de traitement de texte et l'intégration d'outils externes via OpenRouter.
Deep Research Pro Preview 12 2025
Modèle textuel de Google spécialisé dans la recherche approfondie et l'analyse complexe, supportant l'appel d'outils avec une tarification de niveau professionnel.
Devstral
Modèle textuel de Mistral AI optimisé pour l'usage d'outils, combinant performance et souveraineté sur la plateforme ProductivIA.
GPT Realtime Mini
Modèle textuel d'OpenAI optimisé pour des interactions rapides, prenant en charge l'appel d'outils avec un tarif de 30,00 $ en entrée et 50,00 $ en sortie.
GPT-4o
Modèle textuel performant d'OpenAI, gpt-4o prend en charge l'appel d'outils (tools) avec un tarif de 2,50 $ en entrée et 10,00 $ en sortie par million de tokens.
Ministral
Modèle de texte compact de Mistral AI, optimisé pour l'appel d'outils. Il offre une alternative souveraine et performante pour les tâches intermédiaires de traitement de données.
Mistral Large
Modèle de texte souverain et performant de Mistral AI, idéal pour les tâches complexes et l'intégration d'outils externes hors de la dépendance des géants américains.
Mistral Ocr 2512
Modèle spécialisé de Mistral AI dédié à la numérisation et au traitement de documents, offrant une alternative souveraine et performante pour la reconnaissance de texte.
Claude Haiku
Modèle textuel rapide et hautement économique de la famille Claude 4.5, optimisé pour les tâches à faible latence.
Gemini 2.5 Computer Use Preview 10 2025
Version préliminaire de Gemini 2.5 optimisée pour l'interaction avec les interfaces informatiques et l'utilisation d'outils.
Codestral
Modèle de Mistral AI spécialisé dans la génération de code et l'assistance technique, offrant d'excellentes performances à coût maîtrisé avec support des outils.
GPT Realtime
Modèle textuel d'OpenAI conçu pour des réponses rapides et la prise en charge d'outils, intégré au cadre sécurisé et souverain de ProductivIA.
Qwen Plus
Modèle textuel intermédiaire d'Alibaba offrant un excellent rapport performance-coût, idéal pour les tâches multilingues et l'appel d'outils.
Qwen3 235B A22b 2507
Modèle de texte de très grande capacité de la famille Qwen, optimisé pour le raisonnement complexe et l'appel d'outils à un coût particulièrement compétitif.
Qwen3 235B A22b Thinking 2507
Modèle de raisonnement de 235B (22B actifs), optimisé pour les tâches complexes et l'appel d'outils. Une alternative performante favorisant l'indépendance technologique.
Qwen3 30B A3b Instruct 2507
Modèle textuel intermédiaire de la famille Qwen disponible sur OpenRouter, optimisé pour l'exécution d'instructions et le support d'outils à un tarif très compétitif.
Qwen3 30B A3b Thinking 2507
Modèle de raisonnement avancé de 30 milliards de paramètres, optimisé pour les tâches logiques complexes et l'appel d'outils via OpenRouter.
o3
Modèle textuel d'OpenAI conçu pour le raisonnement complexe, prenant en charge l'appel d'outils avec un tarif de 2 $ en entrée et 8 $ en sortie.
o4
Modèle textuel d'OpenAI offrant un compromis optimal entre performance et coût, avec support des outils externes.
Sonar
Modèle de texte optimisé pour la recherche d'informations en temps réel et la synthèse de données web, avec support d'outils tiers.
GPT-4.1
Modèle textuel d'OpenAI optimisé pour l'exécution d'outils, offrant un équilibre de performance avec un tarif d'entrée de 2 $ et de sortie de 8 $.
Computer Use
Modèle textuel d'OpenAI optimisé pour l'interaction avec des outils et l'automatisation de tâches, disponible en version préliminaire.
o1
Modèle textuel performant d'OpenAI prenant en charge l'appel d'outils, idéal pour les tâches complexes et les flux opérationnels structurés.
Omni Moderation
Modèle de modération textuelle conçu pour identifier et filtrer les contenus sensibles ou inappropriés au sein des flux applicatifs.
GPT-4
Modèle de langage de référence d'OpenAI conçu pour les tâches textuelles complexes nécessitant un raisonnement avancé et la prise en charge d'outils.
Mistral Embed 2312
Modèle de traitement de texte développé par Mistral AI, principalement dédié à la vectorisation sémantique et à l'analyse de documents.
Aion 2.0
Modèle de texte d'Aion Labs proposé via OpenRouter, offrant un excellent compromis coût-performance avec support des outils.
Aion 3.0
Modèle textuel polyvalent développé par Aion Labs, accessible via OpenRouter et doté d'une capacité native d'appel d'outils.
Aion 3.0 Mini
Modèle textuel léger et économique d'Aion Labs, optimisé pour l'appel d'outils et l'automatisation de tâches intermédiaires.
Aion 3.5
Aion Labs lance Aion 3.5, un modèle textuel multi-agents doté d'une fenêtre de contexte de 256K tokens et taillé pour la narration complexe.
Aion 3.5 Mini
Clarification technique sur aion-3.5-mini et analyse détaillée d'Aion-3.0-Mini, le système narratif multi-modèle d'Aion Labs basé sur DeepSeek.
Aion Rp Llama 3.1 8B
Modèle de 8 milliards de paramètres optimisé pour les interactions textuelles et le jeu de rôle, supportant l'appel d'outils avec un excellent rapport coût-performance.
All Minilm L12 V2
Le modèle d'embeddings all-minilm-l12-v2 sur OpenRouter : un outil compact, économique et performant pour la recherche sémantique.
All Minilm L6 V2
Le modèle d'embeddings all-minilm-l6-v2 : une solution ultra-rapide et économique pour la recherche sémantique et le RAG léger.
All Mpnet Base V2
Modèle de référence pour la génération d'embeddings et la recherche sémantique, offrant un excellent rapport précision-vitesse à un coût très avantageux.
Aqa
Modèle textuel spécialisé dans les réponses documentaires vérifiables. Conçu pour limiter les hallucinations grâce à l'attribution de sources et au support d'outils.
Babbage
Modèle de base d'OpenAI optimisé pour des tâches de complétion de texte simples et rapides, prenant en charge l'appel d'outils.
Bge Base En V1.5
Modèle d'intégration sémantique de taille intermédiaire pour l'anglais, optimal pour les systèmes RAG et la recherche vectorielle via OpenRouter.
Bge Large En V1.5
Modèle d'intégration (embeddings) de premier plan pour l'anglais, essentiel pour la recherche sémantique et les systèmes RAG au sein des infrastructures souveraines.
Bge M3
Un modèle d'embeddings révolutionnaire de BAAI offrant polyvalence, multilinguisme et traitement de documents longs jusqu'à 8K tokens.
Bodybuilder
Modèle de génération de texte haut de gamme disponible via OpenRouter, prenant en charge l'appel d'outils (tool use) pour des tâches d'orchestration complexes.
C4ai Aya Expanse 32B
Modèle de texte de la famille Aya de Cohere, optimisé pour le multilinguisme, prenant en charge l'appel d'outils et aligné avec l'écosystème technologique canadien.
C4ai Aya Vision 32B
Modèle multimodal et multilingue de 32B paramètres, performant pour l'analyse d'images et l'intégration d'outils externes.
Cydonia 24B V4.1
Modèle de texte polyvalent de 24 milliards de paramètres, prenant en charge l'appel d'outils et offrant un excellent compromis entre coût et performance.
Davinci
Modèle de base textuel d'OpenAI conçu pour la complétion de texte et prenant en charge l'appel d'outils.
DeepSeek Chat
Modèle de texte polyvalent et hautement économique, particulièrement performant pour la génération de contenu, le code et l'appel d'outils.
DeepSeek Chat V3 0324
Modèle de langage ultra-performant et économique disponible via OpenRouter. Idéal pour le code, la rédaction et l'appel d'outils avec un coût de traitement minimal.
DeepSeek Chat V3.1
Modèle de langage de premier plan, extrêmement économique et performant, idéal pour la génération de texte complexe et l'appel d'outils.
DeepSeek R1
Modèle de raisonnement de pointe (Chain of Thought) offrant des performances exceptionnelles en logique et en programmation à un coût extrêmement compétitif.
DeepSeek R1 0528
Modèle de raisonnement de pointe optimisé pour la logique et le développement, offrant des capacités avancées à un coût très compétitif.
DeepSeek R1 Distill Llama 70B
Modèle de raisonnement performant issu de la distillation de DeepSeek-R1 sur base LLaMA 70B, idéal pour les tâches logiques complexes et l'intégration d'outils.
DeepSeek V3.1 Terminus
Variante optimisée du modèle de langage DeepSeek-V3, offrant un rapport performance-prix exceptionnel pour le traitement de texte complexe et l'appel d'outils.
DeepSeek V3.2
Modèle de texte hautement économique et performant, idéal pour les tâches d'automatisation grâce à sa prise en charge des outils via l'API OpenRouter.
DeepSeek V4 Flash
Modèle de texte ultra-rapide et très économique, conçu pour les tâches à haut volume et prenant en charge l'appel d'outils (tool calling).
DeepSeek V4 Flash 0731
Modèle textuel ultra-rapide et hautement économique de DeepSeek, idéal pour les tâches de traitement en volume nécessitant l'appel d'outils.
DeepSeek V4 Flash 0731:batch
Notre analyse technique du modèle DeepSeek V4 Flash 0731, une architecture MoE optimisée pour l'exécution d'agents autonomes et le traitement de contextes massifs.
DeepSeek V4 Flash 0731:free
Modèle textuel conçu pour le traitement rapide du texte et la prise en charge d'outils externes, accessible sans frais d'inférence.
DeepSeek V4 Flash Vision
Le modèle expérimental DeepSeek V4 Flash Vision Exp, alliant une fenêtre de contexte de 1M de tokens et des capacités d'analyse visuelle à un tarif hautement compétitif.
DeepSeek V4 Flash Vision Exp:batch
DeepSeek V4 Flash Vision Exp (Batch) sur OpenRouter : capacités visuelles, benchmarks, tarification et cycle de vie.
DeepSeek V4 Pro
Modèle textuel performant accessible via OpenRouter, offrant un excellent rapport coût-efficacité et prenant en charge l'appel d'outils pour l'automatisation.
DeepSeek V4 Pro 0813
Modèle de texte performant et économique accessible via OpenRouter, optimisé pour l'appel d'outils et idéal pour l'automatisation de flux de travail structurés.
DeepSeek V4 Pro 0813:batch
DeepSeek-V4-Pro-0813 : un modèle textuel de 1M de contexte optimisé pour le code, le raisonnement ajustable et les flux agentiques.
DeepSeek V4.1 Flash
Un modèle MoE de 552 milliards de paramètres doté d'une fenêtre de contexte de 1 million de tokens.
DeepSeek V4.1 Flash:batch
Modèle multimodal rapide conçu pour le traitement asynchrone par lots de requêtes textuelles et visuelles, avec prise en charge d'outils externes.
Dolphin Mistral 24B Venice Edition
Modèle open-weights de 24B de paramètres, optimisé pour la flexibilité d'instruction et la confidentialité. Idéal pour l'automatisation et le traitement de texte à coût maîtrisé.
Dots 3 Note Preview:free
Modèle multimodal expérimental gratuit de Dots Studio sur OpenRouter, prenant en charge la vision et l'utilisation d'outils pour le prototypage rapide.
E5 Base V2
Les caractéristiques, performances et modalités d'intégration du modèle d'embeddings intfloat/e5-base-v2 sur OpenRouter.
E5 Large V2
Modèle d'embedding textuel performant et économique, optimisé pour la recherche sémantique, la classification et les architectures RAG.
Embed English Light V3.0
Modèle d'intégration textuelle léger de Cohere, optimisé pour la langue anglaise, idéal pour la recherche sémantique et la classification rapide.
Embed English Light V3.0 Image
Modèle d'intégration de texte allégé de Cohere, optimisé pour la langue anglaise et conçu pour un traitement rapide.
Embed English V3.0
Modèle de traitement de texte développé par Cohere, optimisé pour l'anglais et proposé par un fournisseur canadien pour répondre aux exigences de souveraineté des données.
Embed English V3.0 Image
Modèle textuel de Cohere destiné à la génération d'embeddings, disponible au tarif de 30 $ en entrée et 50 $ en sortie.
Embed Multilingual Light V3.0
Modèle d'intégration multilingue et léger de Cohere. Une solution performante pour la recherche sémantique, alignée avec les exigences canadiennes de souveraineté numérique.
Embed Multilingual Light V3.0 Image
Modèle d'intégration multilingue de Cohere configuré sous le type text, conçu pour offrir une vectorisation efficace et rapide des données.
Embed Multilingual V3.0
Modèle de vectorisation multilingue de Cohere, conçu pour la recherche sémantique et le RAG, offrant une solution canadienne performante pour la souveraineté des données.
Embed Multilingual V3.0 Image
Modèle de vectorisation de Cohere, offrant une alternative canadienne de premier plan pour la recherche sémantique et le traitement multilingue.
Ember 1
Dérivé de Kimi K3, Fireworks Ember-1 réduit jusqu'à 40 % les jetons de raisonnement pour optimiser les coûts des agents logiciels.
Ernie 4.5 VL 424B A47b
Modèle multimodal de 424B paramètres de Baidu, hautement performant pour l'analyse d'images complexes et le raisonnement avancé avec support d'outils.
Free
Passerelle gratuite regroupant divers modèles d'évaluation sur OpenRouter. Idéal pour le prototypage rapide et les tests de développement sans frais d'infrastructure.
Fugu Max
Sakana AI lance Fugu Max, un orchestrateur multi-agents multimodal doté d'un contexte de 1M de tokens, alliant performances de pointe et maîtrise des coûts.
Fugu Ultra
Modèle multimodal performant développé par Sakana AI, combinant traitement textuel, analyse d'images et exécution d'outils via la plateforme OpenRouter.
Fugu Ultra V2
Modèle multimodal traitant le texte, les documents et les images, doté de capacités d'appel d'outils pour les flux d'automatisation et d'analyse.
Fusion
Endpoint premium d'OpenRouter conçu pour la génération de texte complexe et l'orchestration d'outils externes.
Gemini Embedding
Modèle de vectorisation de texte conçu par Google, idéal pour la recherche sémantique et la classification de documents au sein de bases de connaissances.
Gemini Embedding 2
Modèle de représentation vectorielle de Google, optimisé pour la recherche sémantique, la classification de textes et les architectures de génération augmentée par récupération.
Gemini Robotics Er 1.6
Modèle textuel expérimental de Google prenant en charge l'appel d'outils, idéal pour l'orchestration de tâches et le prototypage de requêtes complexes.
Gemini Robotics Er 2
Le modèle de Google DeepMind conçu pour orchestrer les robots grâce à une analyse vidéo et spatiale avancée.
Gemini Robotics Er 2 Streaming
Le modèle d'Embodied Reasoning de Google, conçu pour orchestrer des flottes de robots via une API de streaming bidirectionnelle.
GLM 4.5
Modèle de langage performant conçu par Zhipu AI, offrant un traitement textuel avancé et le support des outils à un tarif très compétitif via OpenRouter.
GLM 4.5 Air
Modèle de texte de la génération GLM-4.5 optimisé pour le rapport performance-coût et prenant en charge l'appel d'outils via OpenRouter.
GLM 4.5v
Modèle multimodal équilibré offrant des capacités de vision et d'appel d'outils à un tarif très compétitif pour l'analyse de documents et le traitement de données visuelles.
GLM 4.6
Modèle de langage polyvalent et économique optimisé pour le traitement de texte multilingue et l'appel d'outils, proposé par Z-AI sur OpenRouter.
GLM 4.6v
Modèle multimodal performant et économique accessible via OpenRouter, adapté aux tâches d'analyse visuelle et de traitement de données avec support d'outils.
GLM 4.7
Alternative performante pour le traitement de texte et l'appel d'outils, ce modèle permet de diversifier les infrastructures d'IA hors des monopoles technologiques habituels.
GLM 4.7 Flash
Modèle ultra-rapide et hautement économique de la série GLM, idéal pour les tâches de traitement de texte à grand volume et l'intégration d'outils.
GLM 5 2
GLM-5.2 de Z.ai, un modèle open weights de premier plan conçu pour le raisonnement à long terme et l'ingénierie logicielle complexe.
GLM 5.2:batch
GLM-5.2 de Z.ai, un modèle MoE ultra-performant dédié au code et aux tâches agentiques longues, désormais disponible en variante Batch.
GLM 5.2:free
GLM-5.2, le modèle phare de Z.ai conçu pour l'ingénierie logicielle et le raisonnement multi-étapes, disponible via sa variante gratuite sur OpenRouter.
GLM 5.3
GLM-5.3 de Z.ai, un modèle spécialisé dans le code et la cybersécurité, optimisé par post-training avec un contexte d'un million de tokens.
GLM 5.3 Flash
GLM-5.3-Flash de Z.ai : un modèle Mixture-of-Experts de 320B paramètres optimisé pour le long contexte, le développement visuel et les agents.
GLM 5.3 Flash:batch
GLM-5.3-Flash (batch), le modèle MoE de 320B de Z.ai : architecture avancée, multimodalité native et capacités de raisonnement sur OpenRouter.
GLM 5.3 Flashx
Modèle multimodal traitant le texte et les images, optimisé pour la rapidité d'exécution et compatible avec l'appel d'outils.
GLM 5.3 Prime
Modèle textuel conçu pour le traitement du langage naturel et l'exécution d'appels d'outils, adapté aux tâches d'analyse et d'automatisation complexes.
GLM 5.3:batch
GLM-5.3 (batch) de Z.ai : un modèle de 753 milliards de paramètres optimisé pour les agents, le code et l'analyse de contextes longs.
GPT 3.5 Turbo
Modèle textuel d'OpenAI combinant efficacité et prise en charge des outils, adapté aux tâches de traitement de texte standards.
GPT 3.5 Turbo 0125
Modèle de traitement de texte d'OpenAI, optimisé pour l'exécution rapide et la prise en charge d'outils externes.
GPT 3.5 Turbo 1106
Modèle textuel rapide et économique d'OpenAI, optimisé pour les tâches de routine et prenant en charge l'appel d'outils tiers.
GPT 3.5 Turbo 16K
Modèle textuel d'OpenAI doté d'une fenêtre de contexte élargie, idéal pour le traitement de documents longs et la prise en charge d'outils.
GPT 3.5 Turbo Instruct
Modèle textuel d'OpenAI optimisé pour l'exécution d'instructions directes et prenant en charge l'interaction avec des outils.
GPT 3.5 Turbo Instruct 0914
Modèle de génération de texte d'OpenAI optimisé pour suivre des instructions précises et prenant en charge l'appel d'outils.
GPT Live 1
Le modèle vocal temps réel d'OpenAI doté d'une architecture full duplex et d'un système de délégation backend.
GPT Realtime 1.5
Modèle textuel d'OpenAI optimisé pour les interactions en temps réel et compatible avec l'appel d'outils externes.
GPT Realtime 2
Modèle textuel d'OpenAI conçu pour des interactions rapides et la prise en charge d'outils externes. Idéal pour les flux de travail dynamiques exigeant une faible latence.
GPT Realtime 2.1
Le nouveau modèle d'OpenAI combinant raisonnement de classe GPT-5 et interactions vocales en temps réel.
GPT Realtime 2.1 Mini
Modèle textuel d'OpenAI optimisé pour l'intégration d'outils, offrant un compromis idéal entre réactivité, performance et coût.
GPT Realtime Translate
Modèle textuel optimisé pour la traduction en temps réel, prenant en charge les outils externes avec une tarification d'entrée à 0,034 $ et la gratuité sur les flux de sortie.
Granite 4.0 H Micro
Modèle ultra-léger d'IBM, hautement économique et optimisé pour les tâches de premier niveau, la classification et l'appel d'outils à très grand volume.
Granite 4.1 8B
Modèle de langage d'entreprise de 8 milliards de paramètres, optimisé pour l'utilisation d'outils et offrant une efficacité remarquable à faible coût.
Granite 4.2 8B
Modèle open-weights d'IBM optimisé pour les tâches d'entreprise et l'appel d'outils, offrant un excellent rapport performance-coût pour les projets souverains.
Gte Base
Un modèle d'embeddings texte optimisé pour la recherche sémantique et le RAG, désormais disponible via OpenRouter.
Gte Large
GTE-Large sur OpenRouter : un modèle d'embeddings à 1024 dimensions, ultra-compétitif à 0,01 $ par million de tokens pour optimiser vos RAG.
Hermes 3 Llama 3.1 405B
Version optimisée du modèle géant de 405B par Nous Research, conçue pour le raisonnement complexe et l'utilisation avancée d'outils.
Hermes 3 Llama 3.1 70B
Modèle de 70B paramètres affiné par Nous Research, optimisé pour le raisonnement complexe, les fonctions d'agent et le support d'outils à un tarif très compétitif.
Hermes 4 405B
Modèle open-weights de 405 milliards de paramètres, optimisé par Nous Research pour le raisonnement de pointe et l'appel d'outils via OpenRouter.
Hermes 4 70B
Modèle ouvert de 70B paramètres optimisé pour les agents, le suivi d'instructions et l'appel d'outils, offrant une alternative économique et souveraine.
Hunyuan A13b Instruct
Modèle de texte économique et performant développé par Tencent, optimisé pour le suivi d'instructions et prenant en charge l'appel d'outils via OpenRouter.
Hy Mt2 1.8B
Le modèle compact de Tencent spécialisé dans la traduction sous contraintes, offrant un rapport coût-performance optimal.
Hy Mt2 30B A3b
Hy-MT2-30B-A3B, le modèle MoE de Tencent spécialisé dans la traduction professionnelle, le respect des glossaires et des structures complexes.
Hy Mt2 7B
Le modèle Hy-MT2-7B de Tencent, une solution de traduction ultra-spécialisée, économique et performante désormais disponible sur OpenRouter.
Hy3
Modèle de texte performant et très économique développé par Tencent, prenant en charge l'appel d'outils (tool calling) via OpenRouter.
Hy4
Tencent lance Hy4-preview, un modèle MoE de 770B de paramètres et 1M de tokens de contexte, axé sur l'ingénierie de précision et le raisonnement profond.
Inkling
Inkling, le modèle multimodal à poids ouverts de Thinking Machines Lab, conçu pour la personnalisation d'entreprise et le raisonnement complexe.
Inkling Small
Inkling-Small, un modèle MoE de 276B paramètres combinant raisonnement multimodal avancé, efficacité et flexibilité sur OpenRouter.
Inkling Small:batch
Inkling-Small de Thinking Machines Lab, un modèle MoE de 276B paramètres alliant raisonnement avancé, vision et traitement audio.
Inkling Small:free
Inkling-Small, le modèle MoE de 276 Md de paramètres qui allie raisonnement poussé, multimodalité et efficacité algorithmique.
Inkling:batch
Modèle multimodal et analytique disponible sur OpenRouter, combinant traitement d'images, raisonnement avancé et support d'outils.
Inkling:free
Inkling, le premier modèle à poids ouverts de Thinking Machines Lab, doté d'un raisonnement ajustable et disponible gratuitement sur OpenRouter.
Jev 1.13
Modèle textuel conçu pour le traitement du langage naturel et la prise en charge d'appels d'outils externes.
Kat Coder Air V2.5
Modèle léger et économique spécialisé dans la génération de code et l'appel d'outils, idéal pour les tâches d'ingénierie logicielle rapides.
Kat Coder Pro V2
Modèle spécialisé dans la programmation et la génération de code, offrant des capacités d'appel d'outils à un coût hautement compétitif sur OpenRouter.
Kat Coder Pro V2.5
Modèle spécialisé dans la génération de code et l'assistance à la programmation, offrant un excellent rapport performance/prix et la prise en charge des outils.
Kev 4B
Kev-4B de Jared Palmer est un modèle de décision pure basé sur Qwen3.5-4B, calculant des distributions de probabilités directes sans génération de texte libre.
Kimi K2
Modèle de texte performant développé par Moonshot AI, optimisé pour l'appel d'outils et proposé à un tarif hautement compétitif via OpenRouter.
Kimi K2 0905
Modèle textuel performant de Moonshot AI accessible via OpenRouter, prenant en charge l'appel d'outils à un coût très avantageux.
Kimi K2 Thinking
Modèle de raisonnement avancé de Moonshot AI, proposé via OpenRouter. Idéal pour les tâches de logique complexe et d'analyse de données à un coût hautement compétitif.
Kimi K2.5
Modèle multimodal performant et économique, adapté au traitement de texte avancé, à l'analyse d'images et à l'utilisation d'outils via la plateforme OpenRouter.
Kimi K2.6
Modèle multimodal performant de Moonshot AI, optimisé pour le traitement de texte, la vision et l'appel d'outils, proposé à un tarif d'entrée très compétitif sur OpenRouter.
Kimi K2.7 Code
Modèle spécialisé dans le développement logiciel et le traitement de code, associant des capacités de vision et d'appels d'outils à des tarifs d'entrée très avantageux.
Kimi K2.7 Code:batch
Le modèle Mixture-of-Experts de Moonshot AI conçu pour le développement agentique avec raisonnement obligatoire et tarification Batch.
Kimi K3:batch
Le modèle Kimi K3 (batch) de Moonshot AI : une architecture MoE de 2,8 billions de paramètres avec un contexte massif pour vos traitements asynchrones.
L3 Lunaris 8B
Modèle de 8 milliards de paramètres basé sur Llama 3 et optimisé par sao10k. Offre un excellent compromis entre agilité, créativité et support des outils à un coût très avantageux.
L3.1 Euryale 70B
Modèle de 70B de paramètres basé sur Llama 3.1, hautement optimisé pour l'écriture créative, la génération de dialogues complexes et le suivi d'instructions précises.
L3.3 Euryale 70B
Modèle de 70B de paramètres optimisé pour l'écriture créative et le suivi d'instructions complexes, disponible à tarif avantageux.
Labs Leanstral 1 5
Le modèle de Mistral AI dédié à Lean 4 : caractéristiques, performances face à Claude et intégration sur notre plateforme.
Labs Leanstral 1 5 1
Le premier agent de code open-source de Mistral AI conçu pour Lean 4 et la vérification formelle.
Laguna S 2.1
Modèle de texte ultra-économique développé par Poolside, supportant l'appel d'outils et adapté aux tâches d'assistance au développement et à l'automatisation technique.
Laguna S 2.1:free
L'analyse technique de Laguna S 2.1, le modèle MoE de Poolside optimisé pour le code et le raisonnement, désormais accessible sur OpenRouter.
Laguna Xs 2.1
Modèle ultra-rapide et économique spécialisé dans le code et l'appel d'outils, idéal pour les tâches d'assistance au développement à faible latence.
Laguna Xs 2.1:free
Modèle de texte léger et gratuit optimisé pour le code et l'appel d'outils, idéal pour le prototypage rapide sur OpenRouter.
Lfm 2.5 2.6b:free
Le LFM2.5-2.6B de Liquid AI, un modèle de 2,69 milliards de paramètres optimisé pour les agents multi-étapes et le raisonnement local.
Lfm 2.5 Embedding 350m:free
LFM2.5-Embedding-350M de Liquid AI, un bi-encodeur dense et performant conçu pour la recherche sémantique multilingue à très faible latence.
Ling 3.0 Flash
Ling-3.0-flash d'InclusionAI : un modèle MoE de 124B paramètres optimisé pour l'inférence agentique et le traitement de grands contextes.
Ling 3.0 Flash Fin
Ling-3.0-flash-Fin d'InclusionAI, un modèle MoE de 124B paramètres spécialisé dans la recherche financière de bout en bout.
Ling 3.0 Flash Fin:free
Le modèle inclusionai/ling-3.0-flash-fin, une architecture MoE de 124B paramètres optimisée pour les workflows financiers et le raisonnement agentique.
Ling 3.0 Flash Sante:free
Un modèle MoE de 124B paramètres spécialisé en santé, offrant 256K de contexte et temporairement gratuit.
Ling 3.0 Flash VL
Modèle MoE multimodal d'InclusionAI sous licence MIT, alliant vision, vidéo et raisonnement à coût réduit.
Ling 3.0 Flash Vl:free
Ling-3.0-Flash-VL d'inclusionAI : un modèle MoE vision-langage de 124B paramètres disponible gratuitement sur OpenRouter.
Ling 3.0 Flash:free
Ling-3.0-flash d'InclusionAI, un modèle MoE de 124B paramètres disponible gratuitement sur OpenRouter pour vos agents IA.
Ling 3.0 Tiny:free
L'identifiant mystère Ling-3.0-tiny, de sa parenté probable avec Ling-3.0-flash, et de ses performances en raisonnement hybride.
Llama 3.1 70B Instruct
Modèle open-weights de premier plan offrant un excellent compromis entre performance, contexte étendu et coût, idéal pour les cas d'usage de niveau entreprise.
Llama 3.1 8B Instruct
Modèle léger et performant de Meta, idéal pour les tâches textuelles rapides et économiques. Une option open-weights facilitant la transition vers des solutions souveraines.
Llama 3.2 1B Instruct
Modèle ultra-léger de Meta optimisé pour des tâches simples à très faible latence et à coût minimal, prenant en charge l'appel d'outils.
Llama 3.2 3B Instruct
Modèle ultra-léger et rapide de Meta, idéal pour les tâches de traitement simples, le suivi d'instructions et l'appel d'outils à un coût très avantageux.
Llama 3.3 70B Instruct
Modèle open-weights de référence offrant des performances de pointe comparables aux architectures propriétaires, avec un excellent rapport coût-efficacité et le support des appels d'outils.
Llama 4 Maverick
Modèle multimodal et outillé de la série Llama, proposé à un tarif très compétitif pour les traitements de volume et les flux d'agents.
Llama 4 Scout
Modèle multimodal ultra-économique de la série Llama, idéal pour les tâches d'analyse visuelle et d'automatisation légères.
Llama Guard 4 12B
Modèle de sécurité et de modération conçu par Meta, optimisé pour sécuriser les interactions textuelles et visuelles des systèmes d'IA.
Llama Nemotron Embed VL 1B V2:free
Le nouveau modèle d'embeddings multimodaux de NVIDIA, conçu pour révolutionner la recherche documentaire et le RAG sur des documents complexes.
Llama Nemotron Rerank VL 1B V2:free
Le modèle de reranking multimodal de NVIDIA, conçu pour optimiser la recherche de documents complexes associant textes, images et graphiques.
Longcat 2.0
Modèle textuel économique développé par Meituan, supportant l'appel d'outils (tool use). Idéal pour les tâches d'automatisation légères via OpenRouter.
Magnum V4 72B
Modèle de 72B paramètres sur OpenRouter, optimisé pour la génération de textes complexes, le style rédactionnel avancé et le support des outils.
Mercury 2
Modèle de traitement de texte économique développé par Inception, disponible via OpenRouter, offrant un support natif des outils pour les flux de travail automatisés.
Mercury 2.5
Mercury 2.5 d'Inception, un modèle de langage par diffusion taillé pour les flux agentiques rapides et économiques.
Mimo V2.5
Modèle multimodal et économique de Xiaomi prenant en charge la vision et l'appel d'outils, idéal pour les volumes importants à faible coût.
Mimo V2.5 Pro
Modèle de texte intermédiaire développé par Xiaomi, offrant un support natif des outils à un tarif très compétitif via l'API OpenRouter.
Mimo V2.6 Flash
Modèle multimodal compact traitant le texte et la vision, doté de capacités d'appel d'outils pour des flux de travail automatisés et économiques.
Mimo V2.6 Pro
Modèle multimodal traitant le texte et la vision, optimisé pour l'analyse visuelle et l'exécution d'appels d'outils externes.
Mimo V2.6 Pro Ultraspeed
Modèle multimodal optimisé pour le traitement rapide du texte et des images, avec prise en charge de l'appel d'outils.
Minimax 01
Modèle textuel et visuel performant et très économique, idéal pour l'analyse de documents complexes et l'automatisation de tâches via la passerelle OpenRouter.
Minimax M1
Modèle de texte performant et très économique proposé par MiniMax via OpenRouter, prenant en charge l'appel d'outils pour des intégrations avancées.
Minimax M2
Modèle de texte performant et économique proposé par MiniMax via OpenRouter, optimisé pour le traitement de texte et prenant en charge l'appel d'outils.
Minimax M2 Her
Modèle textuel économique accessible via OpenRouter, prenant en charge l'appel d'outils. Une option tierce à évaluer selon les exigences de souveraineté des données du Québec.
Minimax M2.1
Modèle linguistique de texte très économique, prenant en charge l'appel d'outils pour des intégrations applicatives flexibles via OpenRouter.
Minimax M2.5
Modèle textuel hautement performant et économique accessible via OpenRouter, prenant en charge l'appel d'outils pour des intégrations applicatives fluides.
Minimax M2.7
Modèle textuel économique prenant en charge l'appel d'outils, idéal pour l'automatisation des tâches courantes via la plateforme OpenRouter.
Minimax M2.7:free
Modèle MiniMax M2.7 : une architecture MoE orientée agents, spécialisée dans l'automatisation de tâches et le développement de logiciels.
Minimax M3
Modèle multimodal performant et très économique, idéal pour l'analyse d'images, le traitement de texte et l'appel d'outils au sein de l'écosystème ProductivIA.
Minimax M3:batch
MiniMax M3 (:batch), un modèle multimodal à poids ouverts optimisé pour les agents, le code et le traitement asynchrone à coût réduit.
Minimax M3:free
Un modèle open-weight multimodal de 428 milliards de paramètres doté d'une Sparse Attention révolutionnaire.
Mistral Embed
Modèle de vectorisation (embeddings) de Mistral AI, conçu pour la recherche sémantique, la classification de textes et les architectures RAG.
Mistral Ocr 3
Modèle de traitement textuel de Mistral AI optimisé pour la reconnaissance de documents et l'extraction de données structurées avec support d'outils.
Mistral Ocr 3 0
Modèle spécialisé de Mistral AI conçu pour le traitement de texte et la reconnaissance de documents, prenant en charge l'appel d'outils dans un cadre souverain.
Mistral Ocr 4
Modèle de Mistral AI spécialisé dans la reconnaissance de documents et l'extraction de texte, prenant en charge l'appel d'outils.
Mistral Ocr 4 0
Les indices entourant le modèle mistral-ocr-4-0, repéré en version préliminaire, et l'état de l'art des technologies de reconnaissance de Mistral AI.
Mistral Ocr 4 1
Modèle de traitement textuel développé par Mistral AI, offrant le support des outils et représentant une alternative souveraine de confiance.
Mistral Vibe Cli Fast
Modèle textuel rapide de Mistral AI, optimisé pour l'usage d'outils et intégré à l'environnement souverain de ProductivIA.
Mistral Vibe Cli With Tools
Modèle textuel de Mistral AI prenant en charge l'appel d'outils, conçu pour les tâches d'automatisation et les flux de travail techniques.
Morph V3 Fast
Modèle textuel rapide et économique, optimisé pour la faible latence et l'appel d'outils (tool use) au sein de flux automatisés.
Morph V3 Large
Modèle de traitement de texte performant et économique, disponible via OpenRouter avec support natif des appels d'outils pour les flux automatisés.
Multi Qa Mpnet Base Dot V1
Modèle open-source spécialisé dans la recherche sémantique et le repérage de documents (QA). Idéal pour les pipelines RAG souverains et l'indexation de données.
Multilingual E5 Large
Les capacités, performances et subtilités d'intégration du modèle d'embeddings de Microsoft, désormais référencé sur OpenRouter.
Muse Glimmer 30B
Le modèle distillé de Meta optimisé pour les agents autonomes locaux, désormais référencé sur OpenRouter.
Muse Glimmer 30b:batch
Le modèle multimodal Meta Muse Glimmer 30B, optimisé pour les agents autonomes locaux et le raisonnement avancé sous licence Apache 2.0.
Muse Spark 1.1
Modèle multimodal performant et polyvalent accessible via OpenRouter, combinant traitement textuel, vision et exécution d'outils à coût maîtrisé.
Muse Spark 1.2
Muse Spark 1.2 de Meta, un modèle de raisonnement multimodal doté d'un contexte d'un million de tokens, optimisé pour les agents de code.
Muse Spark 1.2 Contributor
Le modèle Meta Muse Spark 1.2 Contributor, ses capacités de raisonnement multimodales et son compromis unique entre coût et confidentialité.
Muse Spark 1.3
Modèle multimodal polyvalent de Meta disponible sur OpenRouter, performant pour le traitement de texte, l'analyse d'images et l'intégration d'outils.
Muse Spark 1.3 Contributor
Modèle multimodal ultra-économique disponible sur OpenRouter, prenant en charge la vision, l'analyse de fichiers et l'exécution d'outils.
Mythomax L2 13B
Modèle de 13 milliards de paramètres hautement optimisé pour la génération narrative et le jeu de rôle, offrant un coût de traitement extrêmement avantageux.
Nemotron 3 Embed 1b:free
Le modèle d'embeddings Nemotron-3-Embed-1B de NVIDIA : une solution ultra-performante de 1,14B de paramètres pour le RAG et la recherche sémantique.
Nemotron 3 Nano 30B A3b
Modèle textuel NVIDIA de 30B hautement optimisé, idéal pour l'appel d'outils et l'orchestration à un coût extrêmement compétitif.
Nemotron 3 Nano Omni 30B A3b Reasoning:free
Modèle multimodal gratuit de NVIDIA sur OpenRouter, optimisé pour le raisonnement complexe, la vision et l'appel d'outils. Idéal pour des flux décisionnels autonomes.
Nemotron 3 Ultra 550B A55b:batch
Modèle de très grande taille d'NVIDIA optimisé pour le raisonnement complexe et l'appel d'outils, proposé à tarif avantageux via un mode d'exécution par lot.
Nemotron 3.5 Content Safety
Modèle hautement spécialisé de NVIDIA dédié à la modération de contenu et à la sécurité des flux d'entrée et de sortie pour les architectures d'IA.
Nemotron 3.5 Content Safety:free
Modèle gratuit de NVIDIA dédié à la modération de contenu. Il sécurise les flux de données en analysant les textes et visuels selon les critères de conformité et de sécurité.
Nemotron 3.5 Lightning
Modèle textuel ultra-rapide de NVIDIA optimisé pour une latence minimale. Idéal pour les agents conversationnels et l'appel d'outils à un coût très avantageux.
Nemotron 3.5 Lightning:free
Modèle textuel ultra-rapide et gratuit développé par NVIDIA. Idéal pour le prototypage rapide et l'appel d'outils sans frais d'infrastructure.
Nex N2 Mini
Modèle multimodal compact et économique, optimal pour l'analyse visuelle et l'appel d'outils structurés.
Nex N2 Pro
Modèle multimodal et économique de Nex-AGI, prenant en charge la vision et l'appel d'outils pour des cas d'usage polyvalents via OpenRouter.
Nex N2.5 Mini
Modèle compact multimodal conçu pour le traitement conjoint du texte et de l'image, avec prise en charge de l'appel d'outils à très faible coût.
Nex N2.5 Mini:free
Nex-N2.5-Mini apporte des capacités agentiques et de vision avancées dans un format MoE de 35 milliards de paramètres disponible gratuitement sur OpenRouter.
Nex N2.5 Pro
Modèle multimodal traitant le texte et la vision, doté de fonctionnalités d'appel d'outils pour l'analyse visuelle et l'automatisation de tâches à coût modéré.
Nex N2.5 Pro:free
Nex-N2.5-Pro de Nex-AGI sur OpenRouter : un modèle agentique ouvert conçu pour l'ingénierie logicielle et le pilotage d'interfaces graphiques.
Nova 2 Lite V1
Modèle multimodal rapide et très économique d'Amazon, optimal pour le traitement de texte, la vision et l'analyse de documents à grande échelle.
Nova Lite V1
Modèle multimodal rapide et très économique d'Amazon, idéal pour le traitement de volumes importants de texte et d'images à coût réduit.
Nova Micro V1
Modèle ultra-rapide et extrêmement économique de la gamme Amazon Nova, idéal pour les tâches textuelles simples à forte volumétrie et prenant en charge l'appel d'outils.
Nova Premier V1
Le modèle le plus performant de la gamme Amazon Nova, optimisé pour le raisonnement complexe, l'analyse d'images et l'intégration d'outils.
Nova Pro V1
Modèle multimodal performant et économique d'Amazon, optimisé pour le traitement de texte, l'analyse visuelle et l'appel d'outils via OpenRouter.
Ox Alpha
Ox Alpha (stealth/ox-alpha), le modèle mystère d'OpenRouter doté d'un raisonnement obligatoire et d'un contexte d'un million de jetons.
Palmyra X5
Modèle d'entreprise optimisé pour les tâches professionnelles complexes et l'intégration d'outils, proposé à un tarif compétitif via OpenRouter.
Paraphrase Minilm L6 V2
Les caractéristiques, performances et cas d'usage du modèle d'embeddings ultra-léger paraphrase-minilm-l6-v2 désormais référencé sur OpenRouter.
Pareto
Modèle multimodal traitant les requêtes textuelles et visuelles avec prise en charge de l'appel d'outils externes.
Pareto Code
Modèle haut de gamme optimisé pour le développement logiciel et le raisonnement complexe, offrant un support avancé des outils via OpenRouter.
Perceptron Mk1
Modèle multimodal économique disponible via OpenRouter, combinant traitement textuel, vision et exécution d'outils pour des tâches d'automatisation à faible coût.
Perceptron Mk1.5
Modèle multimodal orienté perception et raisonnement spatial, Perceptron Mk1.5 traite texte et vision avec prise en charge d'outils externes pour l'analyse visuelle avancée.
Phi 4
Modèle compact de pointe développé par Microsoft, offrant d'excellentes capacités de raisonnement et de codage à un tarif extrêmement avantageux, avec support des outils.
Qwen 2.5 72B Instruct
Modèle open-weight de premier plan offrant d'excellentes capacités de raisonnement, de code et de support multilingue à un coût très avantageux.
Qwen 2.5 7B Instruct
Modèle compact et hautement performant de 7 milliards de paramètres, idéal pour les tâches de traitement de texte rapides, économiques et compatibles avec l'appel d'outils.
Qwen 2.5 Coder 32B Instruct
Modèle ouvert de 32B de paramètres spécialisé dans le développement logiciel et le raisonnement logique, offrant un excellent rapport performance-coût.
Qwen2.5 VL 72B Instruct
Modèle multimodal ouvert de pointe combinant vision et texte, idéal pour l'analyse d'images complexes et l'appel d'outils à tarif compétitif.
Qwen3 14B
Modèle textuel de 14 milliards de paramètres offrant un excellent rapport performance-coût, adapté aux tâches multilingues et à l'appel d'outils.
Qwen3 235B A22b
Grand modèle de langage de type Mixture of Experts (MoE) offrant un excellent compromis entre puissance de calcul et efficacité économique pour les tâches complexes.
Qwen3 30B A3b
Modèle de langage intermédiaire hautement performant et économique, adapté au traitement de texte généraliste et à l'appel d'outils.
Qwen3 32B
Modèle textuel intermédiaire offrant un excellent rapport coût-performance, idéal pour l'automatisation de tâches et le traitement de texte structuré avec support des outils.
Qwen3 8B
Modèle de langage léger et performant de la famille Qwen. Optimisé pour les tâches textuelles rapides et le support des outils externes à un coût très compétitif.
Qwen3 Coder
Modèle de la famille Qwen spécialisé dans le code, offrant des fonctions avancées de génération de programmation et de support d'outils à un coût très compétitif.
Qwen3 Coder 30B A3b Instruct
Modèle d'IA spécialisé dans la génération de code et l'automatisation technique, offrant un excellent rapport performance-coût via OpenRouter.
Qwen3 Coder Flash
Modèle ultra-rapide spécialisé dans le développement logiciel et l'exécution de fonctions, offrant un excellent compromis entre coût et réactivité.
Qwen3 Coder Next
Modèle de nouvelle génération optimisé pour le développement logiciel. Il offre un rapport performance-prix exceptionnel avec support des outils.
Qwen3 Coder Plus
Modèle d'IA spécialisé dans la programmation et le raisonnement technique, offrant un support natif des outils et un excellent rapport performance-coût.
Qwen3 Embedding 4B
Le modèle Qwen3-Embedding-4B : une solution d'embeddings ultra-performante de 4 milliards de paramètres, optimisée pour le RAG et le multilingue.
Qwen3 Embedding 8B
Modèle de représentation vectorielle de 8 milliards de paramètres, optimisé pour la recherche sémantique et les systèmes RAG complexes.
Qwen3 Max
Modèle de texte haut de gamme disponible via OpenRouter, combinant de fortes capacités de raisonnement et un support des outils à un tarif très compétitif.
Qwen3 Max Thinking
Modèle de raisonnement de pointe de la gamme Qwen, conçu pour les tâches logiques complexes et l'intégration d'outils à un coût très compétitif.
Qwen3 Next 80B A3b Instruct
Modèle linguistique de 80B paramètres optimisé pour les instructions et l'intégration d'outils, offrant une efficacité de calcul élevée à un coût d'inférence très compétitif.
Qwen3 Next 80B A3b Thinking
Modèle de raisonnement de la série Qwen (80B) disponible via OpenRouter, conçu pour les analyses approfondies et l'intégration d'outils à un coût très compétitif.
Qwen3 Reranker 8B
Qwen3-Reranker-8B, un cross-encoder de 8 milliards de paramètres conçu pour optimiser la pertinence des pipelines RAG et de recherche de code.
Qwen3 VL 235B A22b Instruct
Modèle multimodal de pointe de 235B paramètres, optimisé pour l'analyse d'images et l'appel d'outils à un coût extrêmement compétitif via OpenRouter.
Qwen3 VL 235B A22b Thinking
Modèle multimodal de pointe combinant vision par ordinateur et raisonnement complexe, idéal pour les analyses documentaires et techniques avancées.
Qwen3 VL 30B A3b Instruct
Modèle multimodal de 30B paramètres, optimisé pour la vision et l'appel d'outils, disponible à un tarif très compétitif via OpenRouter.
Qwen3 VL 30B A3b Thinking
Modèle de vision-langage de 30B paramètres avec capacités de raisonnement approfondi, idéal pour l'analyse visuelle complexe à coût optimisé.
Qwen3 VL 32B Instruct
Modèle vision-langage de 32B paramètres sur OpenRouter. Idéal pour l'analyse d'images complexe et le function calling à un coût très compétitif.
Qwen3 VL 8B Instruct
Modèle de vision-langage de 8B paramètres, combinant analyse d'images avancée et exécution d'outils à un tarif extrêmement compétitif via OpenRouter.
Qwen3 VL 8B Thinking
Modèle d'analyse visuelle et de raisonnement de 8B de paramètres, offrant un équilibre optimal entre coût et performance pour les tâches complexes.
Qwen3.5 122B A10b
Modèle multimodal performant de la série Qwen 3.5, offrant un excellent rapport coût-efficacité pour le traitement de texte, la vision et l'appel d'outils via OpenRouter.
Qwen3.5 27B
Modèle multimodal intermédiaire et économique offrant un excellent rapport performance-coût pour le traitement de texte, l'analyse d'images et l'utilisation d'outils.
Qwen3.5 35B A3b
Modèle multimodal hautement performant et économique, conçu pour le traitement de texte, la vision et l'appel d'outils au sein d'architectures d'agents.
Qwen3.5 397B A17b
Modèle multimodal de très grande taille basé sur une architecture MoE, offrant des capacités de vision et d'utilisation d'outils à un coût extrêmement compétitif via OpenRouter.
Qwen3.5 9B
Modèle multimodal intermédiaire ultra-économique de 9B paramètres, combinant vision et appel d'outils pour des flux de travail polyvalents.
Qwen3.5 9b:batch
Les capacités de Qwen3.5-9B, sa variante Batch et ses performances de pointe en vision et raisonnement.
Qwen3.5 Flash 02 23
Modèle textuel et vision ultra-rapide et économique de la série Qwen, idéal pour les tâches à haut volume, l'analyse d'images et l'appel d'outils via OpenRouter.
Qwen3.5 Plus 02 15
Modèle multimodal performant et économique de la gamme Qwen, idéal pour le traitement de texte, l'analyse d'images et l'appel d'outils avec un excellent rapport qualité-prix.
Qwen3.6 27B
Modèle intermédiaire et polyvalent de 27 milliards de paramètres, offrant un excellent rapport performance-prix pour le texte, la vision et l'appel d'outils.
Qwen3.6 35B A3b
Modèle multimodal performant et économique de la famille Qwen, idéal pour l'analyse d'images et l'automatisation de tâches via appels d'outils.
Qwen3.6 Flash
Modèle multimodal ultra-rapide et économique de la famille Qwen, optimisé pour les traitements à haute performance et l'analyse visuelle.
Qwen3.6 Max
Version préliminaire du modèle phare de la famille Qwen, conçue pour le raisonnement complexe et l'appel d'outils via OpenRouter.
Qwen3.6 Plus
Modèle multimodal performant et économique, prenant en charge la vision et l'appel d'outils pour des intégrations d'entreprise fluides.
Qwen3.7 Flash
Les capacités, les tarifs et le positionnement de Qwen3.7 Flash, le modèle d'Alibaba alliant vision avancée et contexte d'un million de tokens.
Qwen3.7 Max
Modèle de texte haut de gamme optimisé pour les tâches complexes et l'appel d'outils, proposé à un tarif très compétitif via OpenRouter.
Qwen3.7 Plus
Modèle multimodal performant et très économique de la gamme Qwen, prenant en charge la vision et l'appel d'outils pour des applications textuelles et visuelles avancées.
Qwen3.8 2.4t A95b
Le modèle MoE Qwen3.8-2.4T-A95B : une architecture à 2,4 billions de paramètres axée sur le raisonnement textuel complexe.
Qwen3.8 2.4t A95b:batch
Le colosse open-weight d'Alibaba doté d'une architecture MoE à 2,4 billions de paramètres et d'un raisonnement natif systématique.
Qwen3.8 27B
Un modèle vision-langage de 27 milliards de paramètres optimisé pour les agents autonomes et le traitement de contextes longs.
Qwen3.8 27b:free
Modèle multimodal de 27 milliards de paramètres capable de traiter le texte et l'analyse visuelle, prenant en charge l'appel d'outils sans frais d'utilisation.
Qwen3.8 Flash
Le modèle Qwen3.8-Flash : une architecture MoE innovante combinant un contexte de 1 million de tokens, des capacités de raisonnement avancées et un coût ultra-compétitif.
Qwen3.8 Max
Le modèle de raisonnement d'Alibaba doté de 1 million de tokens de contexte et d'une analyse multimodale avancée.
Qwen3.8 Max 0902
Modèle multimodal performant de la famille Qwen, conçu pour le traitement de texte, l'analyse d'images et l'interaction avec des outils externes.
Qwen3.8 Max Prime
Déclinaison haute vitesse de Qwen3.8-Max, la variante Prime double le débit de génération pour servir les flux agentiques et interactifs exigeants.
Qwen3.8 Omni Flash
Modèle multimodal rapide conçu pour le traitement conjoint du texte et des images, prenant en charge l'utilisation d'outils et l'appel de fonctions à faible coût.
Ra GPT 5.6 Sol
Le modèle de raisonnement d'OpenAI conçu pour l'orchestration d'agents, le développement logiciel et la recherche scientifique.
Reka Edge
Modèle multimodal compact et très économique de Reka AI, combinant traitement de texte, vision et support d'outils pour des performances rapides.
Reka Flash 3
Modèle textuel rapide et économique de Reka AI sur OpenRouter, optimisé pour l'appel d'outils et l'automatisation des tâches avec un excellent rapport performance-prix.
Relace Apply 3
Modèle ultra-spécialisé pour l'application de modifications et de corrections de code, disponible sur OpenRouter avec support des outils.
Relace Search
Modèle textuel spécialisé dans la recherche et la synthèse d'informations, optimisé pour les architectures RAG grâce à sa prise en charge native des outils.
Remm Slerp L2 13B
Modèle open-weights de 13 milliards de paramètres issu d'une fusion par interpolation (SLERP), conçu pour la génération de texte fluide et les dialogues interactifs.
Rerank 2.5
Un modèle de reranking de pointe optimisé pour le suivi d'instructions et doté d'un contexte étendu à 32 000 tokens.
Rerank 2.5 Lite
Modèle de réordonnancement (reranker) léger, conçu pour optimiser la pertinence et l'efficacité des systèmes de recherche documentaire (RAG).
Sakana Namazu
Une déclinaison de Kimi K2.6 optimisée pour le contexte japonais, ses capacités de raisonnement et sa tarification.
Schematron V2 Small
Schematron V2 Small, modèle 3B d'InferenceNet dédié à l'extraction HTML vers JSON contrainte par schéma, économique et optimisé pour le scraping.
Schematron V2 Turbo
Schematron V2 Turbo, un modèle 3B spécialisé dans l'extraction de données HTML vers JSON, alliant haut débit et décodage contraint par schéma.
Seed 1.6
Modèle multimodal développé par ByteDance, offrant des capacités de vision et d'appel d'outils à un coût très compétitif via l'API OpenRouter.
Seed 1.6 Flash
Modèle multimodal de ByteDance optimisé pour la rapidité et l'efficacité économique, prenant en charge la vision et l'appel d'outils.
Seed 2 1 Turbo
Seed 2.1 Turbo de ByteDance : un modèle multimodal ultra-compétitif à 256K de contexte, taillé pour le code et les agents autonomes.
Seed 2.0 Code
Modèle d'IA spécialisé dans la génération de code et l'analyse visuelle, offrant un excellent rapport performance-prix pour les tâches de développement.
Seed 2.0 Lite
Modèle multimodal léger et économique développé par ByteDance, disponible via OpenRouter, performant pour le traitement de texte, la vision et l'usage d'outils.
Seed 2.0 Mini
Modèle multimodal léger et très économique de ByteDance, optimisé pour le traitement rapide du texte et des images via OpenRouter.
Skyfall 36B V2
Modèle intermédiaire de 36B paramètres, optimisé pour le suivi d'instructions complexes et l'intégration d'outils, offrant un excellent rapport performance-coût.
Solar Mini4
Modèle textuel compact conçu pour le traitement du langage naturel et l'exécution d'appels d'outils, optimisé pour les déploiements à coût maîtrisé.
Solar Pro 3
Modèle de texte performant d'Upstage sur OpenRouter, offrant d'excellentes capacités d'appel d'outils à un tarif hautement compétitif.
Solar Pro4
Modèle de texte compact et performant développé par Upstage, optimisé pour l'appel d'outils et offrant un excellent rapport qualité-prix.
Space Bunny Alpha
Modèle expérimental multimodal conçu pour le traitement du texte et des images, avec prise en charge de l'appel d'outils externes.
Step 3.5 Flash
Modèle textuel ultrarapide et économique de Stepfun via OpenRouter. Idéal pour les tâches à haute fréquence et le support d'outils, à utiliser hors données sensibles.
Step 3.7 Flash
Modèle multimodal ultra-rapide et économique conçu pour les tâches de vision et d'automatisation nécessitant une faible latence à coût très réduit via la plateforme OpenRouter.
Ternary Bonsai 2 27B
Modèle multimodal de 27 milliards de paramètres capable de traiter simultanément le texte et les images, avec prise en charge de l'appel d'outils.
Text Embedding 3 Large
Modèle de vectorisation de texte haute performance d'OpenAI, conçu pour la recherche sémantique et l'analyse de similarité.
Text Embedding 3 Small
Modèle d'OpenAI de type texte, conçu pour la génération de représentations vectorielles et l'analyse sémantique.
Text Embedding Ada
Modèle de type texte d'OpenAI dédié à la génération d'embeddings, proposé sur la plateforme avec un tarif de 30 $ en entrée et 50 $ en sortie.
Trinity Large Thinking
Modèle de raisonnement avancé d'Arcee.ai conçu pour les tâches logiques complexes et l'appel d'outils, offrant un rapport performance-coût exceptionnel.
UI Tars 1.5 7B
Modèle de 7B paramètres optimisé pour l'interaction visuelle et la navigation automatisée au sein d'interfaces graphiques.
Union Alpha
Modèle multimodal expérimental conçu pour le traitement de requêtes textuelles et visuelles, avec prise en charge de l'appel d'outils.
Unslopnemo 12B
Version optimisée de Mistral NeMo 12B conçue pour éliminer les tics d'écriture de l'IA et offrir des rédactions plus naturelles et fluides.
Voyage 4
Modèle spécialisé de Voyage AI optimisé pour le traitement sémantique et l'analyse de texte, offrant un coût d'entrée extrêmement compétitif sans frais de sortie.
Voyage 4 Large
Modèle d'embedding de pointe conçu pour la recherche sémantique et le RAG, optimisé pour la vectorisation haute performance avec facturation uniquement à l'entrée.
Voyage 4 Lite
Le modèle d'embeddings de Voyage AI conçu pour optimiser le RAG et la recherche sémantique à grande échelle avec un coût minimal.
Voyage Code 4
Le modèle d'embeddings de Voyage AI optimisé pour la recherche sémantique de code et les agents de programmation.
Voyage Multimodal 3.5
Modèle d'embedding de pointe par Voyage AI, conçu pour la recherche vectorielle unifiée associant du texte et des images.
Weaver
Modèle de génération de texte économique proposé par Mancer sur OpenRouter, prenant en charge l'appel d'outils pour des intégrations dynamiques.
Wizardlm 2 8x22b
Modèle d'analyse et de génération de texte de premier plan, basé sur une architecture Mixture of Experts et optimisé pour le code et l'appel d'outils.
Zai GLM 5
Les capacités de GLM-5, modèle textuel ouvert de 744 milliards de paramètres conçu pour le raisonnement long et le développement logiciel.
Zai GLM 5 2
Modèle textuel de Mistral AI prenant en charge l'appel d'outils pour l'exécution de tâches automatisées et structurées.
Zai GLM 5 3
Hébergé sans modification par Mistral, le modèle GLM 5.3 de Z.ai propose 1 million de tokens de contexte et une spécialisation poussée en ingénierie logicielle.
Aucun modèle ne correspond à cette recherche.