Panorama des grands modèles de langage (frontier et open-weight) commercialement ouverts en API ou en poids, avec version et date de sortie. Mise à jour Neurone21 au 17 septembre 2026.
Rôle
Cette fiche tient une liste de référence des LLM majeurs accessibles sur le marché (API hébergée et/ou poids téléchargeables), avec version et date de sortie . Elle ne remplace pas les fiches pricing / benchmarks des fournisseurs ; elle sert de point d'entrée éditorial Neurone21.
Sources croisées (annonces constructeurs + chronologies publiques type benchr / modeltimeline), revue au 17/09/2026 . Les dates sont celles d'annonce ou de GA API quand elles divergent légèrement selon les trackers.
Les tableaux ci-dessous sont rendus en React (data/llm-marche.ts + components/wiki/WikiDataTable.tsx) — pas de tableaux Markdown.
Tableaux React (pas Markdown) — revue Neurone21 au 17/09/2026 . Source : data/llm-marche.ts.
Frontière (API propriétaire) — famille actuelle Flagships et paliers commercialement ouverts en API.
Modèles frontier API propriétaire Fournisseur Modèle / version Sortie Notes OpenAI GPT-6 Astra 3 sept. 2026 Flagship annoncé le plus capable ; ~1,05M tokens contexte OpenAI GPT-5.6 (Sol / Terra / Luna) GA 9 juil. 2026 (preview fin juin) Famille multi-paliers ; Terra/Luna baissés de prix fin juil. OpenAI GPT-5.5 24 avr. 2026 Agentic coding / computer use OpenAI GPT-5.4 5 mars 2026 Computer Use natif ; mini/nano mi-mars OpenAI GPT-5 7 août 2025 Première génération GPT-5 unifiée Anthropic Claude Fable 5.1 / Mythos 5.1 1er sept. 2026 Fable GA ; Mythos accès restreint (Glasswing) Anthropic Claude Opus 5 24 juil. 2026 Successeur Opus 4.8 Anthropic Claude Sonnet 5 1er juil. 2026 Mid-tier 1M contexte / 128K sortie Anthropic Claude Fable 5 / Mythos 5 9 juin 2026 Fable suspendu puis restauré 1er juil. Anthropic Claude Opus 4.8 28 mai 2026 Avant Opus 5 Anthropic Claude Opus 4.6 5 févr. 2026 Premier Opus à 1M contexte (bêta) Google Gemini 3.8 Flash 2 sept. 2026 Stable ; 1M contexte Google Gemini 3.7 Flash 13 août 2026 Stable Google Gemini 3.6 Flash 21 juil. 2026 Stable (+ Flash-Lite / Cyber) Google Gemini 3.5 Flash GA 19 mai 2026 (I/O) Flash frontier Google Gemini 3.1 Pro févr. 2026 Raisonnement profond Gemini 3.x Google Gemini 3 Pro 18 nov. 2025 Lancement famille Gemini 3 xAI Grok 4.6 12–13 août 2026 Frontier ; ~500K contexte xAI Grok 4.5 8 juil. 2026 — xAI Grok 4.3 avr. 2026 — xAI Grok 4 / Grok 4 Heavy 9 juil. 2025 Première génération Grok 4
Open-weight / open-source majeurs Poids téléchargeables et/ou API open — licence indicative seulement.
Modèles open-weight majeurs Fournisseur Modèle / version Sortie Licence (indicatif) DeepSeek DeepSeek-V4.1-Flash 10 sept. 2026 API ; remplace V4-Flash DeepSeek DeepSeek V4-Pro / V4-Flash 24 avr. 2026 MIT (poids) DeepSeek DeepSeek-V3.2 déc. 2025 — DeepSeek DeepSeek-R1 20 janv. 2025 Raisonnement open Meta Llama 4 Scout & Maverick 5 avr. 2025 Community License Meta Muse Spark 1.1 9 juil. 2026 Preview API Meta Alibaba (Qwen) Qwen 3.6 22 avr. 2026 Apache 2.0 (variants) Alibaba (Qwen) Qwen 3.5 16 févr. 2026 MoE flagship puis remplacé Moonshot Kimi K3 16 juil. 2026 Open weights (licence Kimi) Moonshot Kimi K2.6 20 avr. 2026 Modified MIT Zhipu / Z.AI GLM-5.3 18 août 2026 API ; poids annoncés plus tard Zhipu / Z.AI GLM-5.2 16 juin 2026 — Mistral Mistral Medium 3.5 avr. 2026 Preview / Modified MIT Mistral Mistral Large 3 2 déc. 2025 Apache 2.0 MiniMax MiniMax M3 1er juin 2026 API hébergée Microsoft Phi-4 janv. 2025 MIT ; petit / edge Cohere North Small Translate 1.0 10 sept. 2026 Open weights CC BY-NC (traduction) Sakana AI Fugu Max / Fugu Ultra v2 11 sept. 2026 API hébergée ; 1M contexte
Points clés Le rythme 2025–2026 est mensuel sur les flagships (OpenAI, Anthropic, Google, xAI) et très dense côté open chinois (DeepSeek, Qwen, GLM, Kimi). Distinguer preview / GA API / poids open : un même nom de famille peut exister dans plusieurs canaux à des dates différentes. Les alias marketing (Sol/Terra/Luna, Fable/Mythos, Flash/Pro) coexistent ; pour l'intégration produit, privilégier l'identifiant API du fournisseur. Limites (sobres) Liste non exhaustive (pas tous les fine-tunes régionaux ni tous les endpoints cloud). Les dates peuvent varier d'un jour selon annonce blog vs changelog API. Prix et fenêtres de contexte évoluent vite ; ne pas figer de barème ici. Pas de classement de « meilleur modèle » : dépend de la tâche (code, raisonnement, multimodal, coût, latence, conformité). À relire / mettre à jour Prochaine passe : après chaque vague I/O / DevDay / lancement flagship, ou au moins mensuelle . Croiser avec les billets Actualités category: modeles-ia et les dossiers comparatifs. Mettre à jour data/llm-marche.ts (pas de tableaux pipe dans le MD).