Tableau comparatif 2026 Tous les grands LLMs Grok ajouté
Comparaison LLM 2026 Marché complet
Tableau pleine page pour comparer les grands modèles du marché : OpenAI, Anthropic, Google, xAI Grok, Meta Llama, Mistral, DeepSeek, Qwen, Cohere, Amazon Nova, Perplexity, Microsoft Phi, IBM Granite, NVIDIA Nemotron, AI21 Jamba, Z.ai, Kimi et MiniMax.
35
modèles / familles
2026
mise à jour marché
13
colonnes de décision
1
tableau CSV / print
Frontier propriétaire
GPT-5.2, Claude 4.6, Gemini 3, Grok 4.3 : meilleurs choix pour tâches critiques, agents, multimodal et code avancé.
Open-weight / souveraineté
Llama 4, Mistral Large 3, Qwen3, Granite, Nemotron, Phi : contrôle, coût long terme, fine-tuning et private AI.
Recherche / RAG
Perplexity Sonar, Cohere Command, Gemini avec grounding, Llama Scout et Jamba dominent selon contexte et sources.
Stratégie 2026
Ne choisir jamais un seul modèle : routeur + modèle premium + modèle économique + modèle local donne le meilleur ROI.
Note de lecture : les noms de modèles et les limites évoluent vite. Les colonnes “contexte”, “prix” et “statut” doivent être revérifiées dans les URLs officielles avant achat, intégration ou mise en production. Les lignes “ND” signalent une information non stabilisée ou non publiée clairement au moment de la préparation du guide.
| Modèle | Organisation | Famille | Sortie | Accès / Licence | Modalités | Contexte max | Prix indicatif | Atouts notables | Bon pour | Limites / défauts | Décision IDEO-Lab | URL officielle |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| GPT-5.2 A+ · rank 1 | OpenAI USA | Frontier propriétaire | 2025-12* | API + ChatGPT Propriétaire | Texte, image en entrée, outils, agents, code | 400k / sortie 128k | $1.75 in / $14 out / 1M tokens | Raisonnement général, coding, agents, tool calling, contexte, UI/front-end, tableurs | Architecture, dev complexe, agents d’entreprise, analyse documentaire, automatisation | Coût, dépendance fournisseur, données sensibles à cadrer, API/produit évolutifs | Choix premium polyvalent | platform.openai.com |
| GPT-5.2 Pro A+ · rank 2 | OpenAI USA | Frontier raisonnement | 2025-12* | API + ChatGPT Pro Propriétaire | Texte, vision, raisonnement renforcé, agents | 400k / sortie 128k | Premium / variable | Raisonnement profond, tâches difficiles, vérification, réponses plus précises | Problèmes critiques, stratégie, code risqué, analyse multi-étapes | Latence, coût, surdimensionné pour tâches simples | À réserver aux tâches à très forte valeur | platform.openai.com |
| GPT-5.2 Codex A · rank 3 | OpenAI USA | Coding agent | 2025-12* | API produits code Propriétaire | Code, texte, agents, outils | ND | Variable | Coding interactif, refactor, tests, agents de développement | IDE, PR review, debug, migration de code, génération UI | Toujours nécessiter diff review, tests et contrôle humain | Très fort pour chaînes DevOps/coding | platform.openai.com |
| Claude Opus 4.6 A+ · rank 4 | Anthropic USA | Frontier raisonnement | 2026-02 | Claude App + API + clouds Propriétaire | Texte, image, outils, computer use, agents | 1M beta | Premium | Agentic planning, coding profond, refactor, analyse, documents, prudence | Codebase énorme, agents complexes, audit, raisonnement critique | Coût, disponibilité selon plan, contexte beta à cadrer | Très fort pour tâches fragiles et longues | www.anthropic.com |
| Claude Sonnet 4.6 A+ · rank 5 | Anthropic USA | Workhorse agentique | 2026-02 | Claude App + API + clouds Propriétaire | Texte, image, outils, computer use, code | 1M beta | $3 in / $15 out / 1M tokens | Coding, computer use, instruction following, agents, coût/performance | Développement quotidien, agents métier, documents, workflows entreprise | Moins profond qu’Opus sur cas extrêmes | Meilleur compromis Claude | www.anthropic.com |
| Gemini 3 Pro A+ · rank 6 | Google DeepMind USA | Frontier multimodal | 2025-11 preview | Gemini API + Vertex AI Propriétaire | Texte, code, image, audio, vidéo, PDF | 1,048,576 / sortie 65,536 | Vertex AI / Gemini API | Multimodal natif, très long contexte, code repositories, Google Search grounding | Docs longs, vidéo/audio/PDF, data analysis, GCP, RAG Vertex | Preview, support pré-GA, parfois extraction charts/tables à vérifier | Leader multimodal + cloud Google | docs.cloud.google.com |
| Grok 4.3 A · rank 7 | xAI USA | Frontier temps réel agents | 2026 | xAI API + Grok Propriétaire | Texte, voix, images, vidéo, outils, search | ND public sur overview | ND / xAI docs | Tool calling agentique, recherche web/X, multimodal, style direct | Actualité, web/X intelligence, agents, réponse rapide, assistant grand public | Écosystème encore jeune, migration rapide des modèles, gouvernance à cadrer | À inclure absolument en 2026 | docs.x.ai |
| GPT-5 mini / nano A- · rank 8 | OpenAI USA | Frontier économique | 2025-2026 | API Propriétaire | Texte, outils selon endpoint | Famille GPT-5 | Mini/nano bas coût | Coût, latence, classification, extraction, routage | Tâches répétitives, pré-traitement, support, routage, batch | Moins bon pour ambiguïté et décision critique | Couche économique pour pipelines | platform.openai.com |
| DeepSeek V4 Pro A · rank 9 | DeepSeek China | Reasoning économique | 2026-04 | API + open ecosystem API propriétaire poids selon version | Texte, tools, JSON, FIM | 1M / sortie 384k max | $0.435 in / $0.87 out promo | Prix agressif, contexte énorme, thinking mode, agents, compatibilité API | Raisonnement à bas coût, batch, agents, coding économique | Confiance, conformité, disponibilité, dépendance Chine à évaluer | Disrupteur coût/performance | api-docs.deepseek.com |
| Gemini 3 Flash A · rank 10 | Google DeepMind USA | Workhorse multimodal | 2025-2026 | Gemini API + Vertex AI Propriétaire | Multimodal, code, agents | 1M annoncé selon docs modèles | Optimisé coût/latence | Vitesse, agents, coding, multimodal, intégration GCP | Production à fort volume, assistants, apps GCP, extraction multimodale | Moins profond que Pro sur tâches critiques | Très bon workhorse cloud | docs.cloud.google.com |
| Llama 4 Maverick A · rank 11 | Meta AI USA | Open-weight frontier | 2025-04 | Téléchargement + partenaires + cloud Llama Community License | Multimodal natif texte/image | 1M | Self-host / provider | Open-weight, MoE, contrôle, souveraineté, fine-tuning | RAG privé, self-host, custom enterprise, recherche | Ops GPU, licence non OSI, qualité variable selon serving | Pilier open-weight 2026 | github.com |
| Llama 4 Scout A · rank 12 | Meta AI USA | Open-weight long context | 2025-04 | Téléchargement + partenaires Llama Community License | Multimodal natif | 10M | Self-host / provider | Contexte massif, efficacité H100, open-weight, RAG très long | Docs énormes, repositories, archives, knowledge bases | Raisonnement moins premium que flagships fermés | Champion open long-context | ai.meta.com |
| Claude Haiku 4.5 A- · rank 13 | Anthropic USA | Rapide économique | 2025-2026 | Claude App + API Propriétaire | Texte, image, outils | ND / famille Claude | Économique | Réponses rapides, assistants simples, extraction, support | Routage, batch, support, tâches répétitives | Moins adapté aux raisonnements longs | Bon modèle d’exécution légère | www.anthropic.com |
| DeepSeek V4 Flash A- · rank 14 | DeepSeek China | Fast reasoning économique | 2026-04 | API API propriétaire | Texte, tools, JSON, FIM | 1M / sortie 384k max | $0.14 in / $0.28 out | Très bas coût, thinking/non-thinking, compatibilité OpenAI/Anthropic | Assistants à fort volume, extraction, routage, automatisation | Moins premium que Pro, conformité et data residency à analyser | Excellent moteur de volume | api-docs.deepseek.com |
| Mistral Medium 3.5 A · rank 15 | Mistral AI France | Open frontier-class | 2026 | API + self-host selon modèle Open selon docs | Multimodal, coding, agents | ND / voir docs | Mistral platform | Agentic/coding, performance européenne, flexibilité cloud/on-prem | Europe, souveraineté, coding, agents d’entreprise | Écosystème plus petit que OpenAI/Google/Anthropic | Très fort choix européen | docs.mistral.ai |
| Grok 4 / Grok 4 Fast A- · rank 16 | xAI USA | Legacy fast reasoning | 2025 | xAI API Propriétaire | Texte, outils, structured outputs, reasoning | Grok 4: 256k / Fast: 2M | $3/$15 ou $0.20/$0.50 selon modèle | Raisonnement, coût Fast, longue fenêtre, tool calling | Comparatif historique, workloads API xAI | xAI annonce la retraite de plusieurs anciens modèles au 15 mai 2026 | Comparer mais privilégier Grok 4.3 | docs.x.ai |
| Mistral Large 3 A- · rank 17 | Mistral AI France | Open-weight frontier | 2025-12 | Open-weight + Mistral platform Apache 2.0 selon annonce Mistral 3 | Multimodal, multilingual | ND / voir model card | Self-host / provider | Open-weight, MoE 675B total / 41B active, souveraineté | Self-host frontier, RAG, entreprise européenne | GPU/ops, benchmarks à valider sur cas réels | Open majeur pour 2026 | mistral.ai |
| Devstral 2 A- · rank 18 | Mistral AI France | Coding agent open | 2025-12 | Open + API Open | Code, texte, agents | ND | Self-host / API | Modèle spécialisé software engineering, agents code | IDE, refactor, tests, pipelines dev | Spécialisé code, moins généraliste | Très intéressant pour dev souverain | docs.mistral.ai |
| Qwen3-235B-A22B A · rank 19 | Alibaba / Qwen China | Open-weight MoE | 2025-04 / 2507 | Open-weight + Alibaba Cloud Open-weight | Texte, variants vision/audio | 256k à 1M selon 2507 | Self-host / provider | Multilingue 100+/119 langues, MoE, thinking/non-thinking, coding/agents | Multilingue, RAG, self-host, Asie/Europe, agents | Outillage et gouvernance fournisseurs à cadrer | Open-weight multilingual majeur | github.com |
| Cohere Command A+ A · rank 20 | Cohere Canada | Enterprise open-source MoE | 2026-05 | Open-source + Model Vault Apache 2.0 | Texte, image input, reasoning, citations, tools | 128k / sortie 64k | Gratuit jusqu’aux limites / Model Vault | Souveraineté, enterprise agents, multilingual 48 langues, citations | RAG entreprise, on-prem/VPC, agents métier, gouvernance | Contexte plus court que certains concurrents | Très fort pour souveraineté enterprise | docs.cohere.com |
| Perplexity Sonar Pro A- · rank 21 | Perplexity USA | Search-grounded LLM | 2025-2026 | Perplexity API Propriétaire | Texte + recherche web + citations | 200k | $3 in / $15 out + search context | Recherche temps réel, citations, synthèse multi-sources | Answer engine, veille, comparatifs, dossiers à sources | Pas un modèle généraliste local, dépendance recherche | Excellent pour recherche actuelle | docs.perplexity.ai |
| Perplexity Sonar Deep Research A- · rank 22 | Perplexity USA | Research model | 2025-2026 | Perplexity API Propriétaire | Texte + web + citations + reasoning | 128k | Recherche + tokens + citations | Rapports détaillés, centaines de sources, due diligence | Études de marché, veille stratégique, recherche documentaire | Coût par recherche, dépendance web, moins adapté code | Spécialiste research | docs.perplexity.ai |
| Mistral Small 4 B+ · rank 23 | Mistral AI France | Open efficient | 2026-03 | Open + API Open selon docs | Instruct, reasoning, coding | ND | Économique | Petit modèle hybride, coût, latence, déploiement | Assistants métier, batch, edge/cloud économique | Moins fort sur tâches extrêmes | Très bon modèle de production budget | docs.mistral.ai |
| Qwen3-30B-A3B A- · rank 24 | Alibaba / Qwen China | Open-weight efficient MoE | 2025-2026 | Open-weight Open-weight | Texte, tool use, agents | 256k à 1M selon variante | Self-host | Faible coût actif, multilingue, agents, coding | Production self-host économique, RAG, assistants internes | Moins puissant que 235B-A22B | Très bon compromis open | qwen.readthedocs.io |
| Cohere Command A Reasoning A- · rank 25 | Cohere Canada | Enterprise reasoning | 2025-08 | Cohere platform Model Vault Propriétaire enterprise | Texte, image input, tools, citations | 256k / sortie 32k | Enterprise | RAG, tool use, agents, multilingual, sécurité entreprise | Assistants internes, knowledge management, workflows CRM/ERP | Moins grand public, coût/contrats enterprise | Solide pour entreprises régulées | docs.cohere.com |
| Amazon Nova Premier A- · rank 26 | AWS USA | Cloud enterprise multimodal | 2025-10 | Amazon Bedrock Propriétaire | Multimodal, reasoning, agents | 1M / sortie 25k | Bedrock | Bedrock integration, enterprise scale, distillation, agents AWS | Entreprises AWS, agents, multimodal, workloads gouvernés | Lifecycle legacy/EOL 2026 selon Bedrock, cloud lock-in AWS | Fort pour AWS, vérifier lifecycle | docs.aws.amazon.com |
| NVIDIA Nemotron 3 Super 120B-A12B A- · rank 27 | NVIDIA USA | Open model infra agents | 2026-03 | Hugging Face NVIDIA NIM ecosystem NVIDIA Open Model License | Texte, tool use, reasoning | 1M | Self-host / NVIDIA infra | LatentMoE, 12B active, long context, agentic workflows, RAG | Datacenter GPU, agents, IT ticket automation, high-volume workloads | Licence spécifique, dépendance NVIDIA stack | À surveiller pour infra enterprise | huggingface.co |
| Phi-4 Reasoning Plus B+ · rank 28 | Microsoft USA | Small open reasoning | 2025-04 | Hugging Face Azure ecosystem MIT | Texte | 32k | Self-host | 14B, raisonnement math/code/science, edge-friendly | On-device, enseignement, raisonnement bas coût, recherche | Anglais prioritaire, pas modèle général multimodal, contexte court | Très bon SLM raisonnement | huggingface.co |
| AI21 Jamba Large 1.7 B+ · rank 29 | AI21 Labs Israel | Open hybrid SSM Transformer | 2025-2026 | AI21 Studio + self-deploy Open weights AI21 | Texte, tools selon stack | 256k | SaaS / self-host | Long context, architecture hybride, self-deployment, RAG enterprise | Long documents, private AI, RAG, VPC/on-prem | GPU lourds pour Large, écosystème plus niche | Très utile long-context enterprise | docs.ai21.com |
| IBM Granite 4.1 30B B+ · rank 30 | IBM USA | Enterprise open | 2026-04 | Hugging Face IBM ecosystem Apache 2.0 | Texte, FIM code | 512k | Self-host / IBM | Long context, enterprise, licence ouverte, tool/chat capabilities | Entreprises, code completion, RAG, gouvernance open | Moins flashy que frontier, qualité à mesurer par use case | Très intéressant pour enterprise open | huggingface.co |
| Amazon Nova 2 Lite B+ · rank 31 | AWS USA | Cloud efficient multimodal | 2026 | Amazon Bedrock Propriétaire | Texte, image, vidéo selon Bedrock | ND / voir Bedrock | Bedrock bas coût | Coût, intégration AWS, automation, support client | Workloads AWS à volume, documents, support, assistants | Moins premium que frontier top models | Bon moteur volume AWS | docs.aws.amazon.com |
| Z.ai GLM-4.6 A- · rank 32 | Z.ai China | Agentic coding | 2025-2026 | API ecosystem Propriétaire open selon modèles | Texte | 200k / sortie 128k | API Z.ai | Coding, long context, reasoning, search agents, tool use | Coding agents, agents de recherche, alternatives Chine | Gouvernance, data residency, documentation à suivre | Concurrent sérieux sur coding agents | docs.z.ai |
| Moonshot Kimi K2.6 A- · rank 33 | Moonshot AI China | Open multimodal agentic | 2026 | Hugging Face ecosystem Modified MIT selon modèles | Image + texte, agents, code | ND / K2 base 128k, K2 Thinking 256k | Self-host / providers | Agentic long-horizon, coding, swarm orchestration, MoE 1T+ | Agents de code, multi-agents, UI, recherche | Serving lourd, licence à lire, maturité production | Très innovant côté agents open | huggingface.co |
| MiniMax M2.7 B+ · rank 34 | MiniMax China | Productivity coding | 2026-03 | MiniMax Platform Propriétaire | Texte, multimodal selon plateforme | ND | API MiniMax | Coding, tool calling, search, productivity scenarios | Apps Chine/Asie, productivity agents, multimodal MiniMax | Documentation en chinois/anglais variable, gouvernance à analyser | À intégrer dans veille 2026 | platform.minimaxi.com |
| OpenAI gpt-oss-120b B+ · rank 35 | OpenAI USA | Open-weight | 2025-2026 | Open-weight Apache 2.0 | Texte | ND | Self-host | OpenAI open-weight, H100-friendly, permissive | Self-host, recherche, privacy-sensitive prototypes | Moins capable que GPT-5.2, ops à gérer | À comparer aux open weights majeurs | platform.openai.com |
