Prospective — Modèles attendus
Sorties récentes, annonces et rumeurs
Répartition par statut
6 modèles suivisModèles attendus & tout juste sortis
Grok 4.7 — xAI
Nouveau modèle phare de xAI (codage, tâches agentiques, travail documentaire), 500 K ctx, entrées texte et image, API officielle $2.00/$6.00.
- Nouveau modèle frontière de xAI, publié le 21 septembre 2026 (notes de version officielles de l'API xAI) : codage, tâches agentiques et travail documentaire.
- Fenêtre de contexte de 500 K tokens ; entrées texte ET image, sortie texte (sans limite de sortie annoncée). Effort de raisonnement réglable : low / medium / high (défaut) / xhigh.
- Tarif officiel : $2.00 / $6.00 par 1M tokens (entrée / sortie) jusqu'à 200 K tokens de contexte, $4.00 / $12.00 au-delà ; entrée mise en cache $0.50. Variante « Grok 4.7 Fast » facturée au double, réservée à Cursor et Grok Build (pas sur l'API publique).
- La vitesse d'écriture (Artificial Analysis, colonne « median tokens/s ») est déjà publiée pour ce modèle et relevée automatiquement chaque jour par ce site.
- ELO Arena pas encore identifié au board pour ce modèle : la note Performance/Prix reste marquée « n.c. » et l'intégration aux tableaux comparatifs se fera automatiquement dès son entrée au classement.
Claude Mythos 5.1 — Anthropic
Jumeau « trusted-access » de Fable 5.1, même date et même tarif.
- Version à accès restreint (« trusted-access ») de Fable 5.1 : même base, garde-fous renforcés pour les usages sensibles.
- Sortie le même jour (1 sept. 2026), 1M contexte, tarif identique à Fable 5.1.
- La différence porte sur la politique de sécurité, pas sur la capacité brute.
- S'adresse aux équipes voulant la puissance Fable sans expositions réglementaires ou de conformité.
- Forte demande — des erreurs de disponibilité sur ce modèle (ainsi que Fable 5.1 et Opus 5) ont été signalées début septembre 2026.
Claude Fable 6 / Mythos 6 — Anthropic
Classe Mythos suivante, focus sur le fossé de raisonnement vs OpenAI.
- Successeurs attendus des 5.1 (Fable + jumeau Mythos), dans la classe au-dessus d'Opus.
- Objectif probable : combler le fossé de raisonnement avec OpenAI (Fable 5.1 ~66 vs Opus 5 ~63).
- Anticipé fin Q3 / Q4 2026, au vu de la cadence Anthropic récente (2-3 mois entre versions).
- Possible montée tarifaire compte tenu des exigences de calcul (capex lourd).
- Statut déduit du rythme de sortie et de déclarations publiques — non officiel.
Qwen3.8 Flash — Alibaba
Multimodal rapide de la famille Qwen3.8, 1M ctx, API officielle $0.15/$0.47 (Alibaba Cloud, portée Internationale).
- Modèle multimodal de la famille Qwen3.8, publié le 26 août 2026 (changelog officiel QwenCloud).
- Fenêtre de contexte d'un million de tokens ; positionné par Alibaba sur l'assistance au codage, les workflows agentiques et la compréhension visuelle (graphiques, vidéos longues).
- Tarif officiel relevé sur la grille Alibaba Cloud Model Studio (portée Internationale) : $0.15 / $0.47 par 1M tokens (entrée / sortie).
- Compatible avec les protocoles API OpenAI ET Anthropic — intégration directe dans les outils de développement (Claude Code, Codex) selon l'éditeur.
- Suivi quotidien : l'ELO Arena et la vitesse d'écriture (Artificial Analysis, median tokens/s) sont relevés automatiquement dès que ces classements publient le modèle.
Qwen3.8-2.4T-A95B — Alibaba
Version à poids ouverts du flagship Qwen3.8 : MoE 2,4 T de paramètres (95 Mds activés), 1M ctx, tarif officiel $2/$6 (Alibaba Cloud, portée Internationale).
- Version à poids ouverts de la famille Qwen3.8 (« open-source version of the latest Qwen flagship series », changelog officiel QwenCloud, entrée datée du 13 août 2026) : architecture MoE creuse de 2,4 T de paramètres totaux et environ 95 Mds activés par pas, attention hybride, contexte d'un million de tokens.
- Tarif officiel relevé sur la grille Alibaba Cloud Model Studio (portée Internationale) : $2,00 / $6,00 par 1M tokens (entrée / sortie) — même barème que le flagship fermé de cette gamme, dont elle est la variante ouverte.
- Poids publiés sur Hugging Face (Qwen/Qwen3.8-2.4T-A95B) ; mode « thinking » activé par défaut ; gains annoncés en codage, productivité, recherche et tâches agentiques de longue durée (changelog Qwen).
- Intérêt : obtenir le niveau du flagship Qwen3.8 en déploiement privé (grappe multi-GPU) plutôt que via l'API propriétaire.
- ELO Arena et vitesse d'écriture (Artificial Analysis, median tokens/s) sont relevés automatiquement chaque jour : la vitesse est désormais publiée par Artificial Analysis ; l'intégration au comparatif suivra dès que l'ELO Arena sera disponible.
Qwen3.8 Omni Flash — Alibaba
Omni-modal natif de la famille Qwen3.8 (texte, image, audio, vidéo), 1M ctx, API officielle $0.15/$0.47 (Alibaba Cloud, portée Internationale).
- Modèle omni-modal de nouvelle génération de la famille Qwen3.8, publié le 18 septembre 2026 (entrée du 18 septembre 2026 au changelog officiel QwenCloud).
- Bâti sur l'architecture Qwen3.8-Flash-Next ; il accepte nativement le texte, l'image, l'audio ET la vidéo en entrée, avec une fenêtre de contexte allant jusqu'à un million de tokens.
- Positionné par Alibaba sur les tâches agentiques en productivité réelle : codage, travail documentaire et interaction avec les interfaces graphiques (GUI).
- Tarif officiel relevé sur la grille Alibaba Cloud Model Studio (portée Internationale) : $0.15 / $0.47 par 1M tokens (entrée / sortie), entrée mise en cache $0.016 — même barème que le modèle Flash de la génération 3.8.
- Absent du classement Arena et non encore publié par Artificial Analysis à cette date : ELO, note Q/P et vitesse marqués « n.c. » ; ils sont relevés automatiquement dès que ces classements publient le modèle.
Le score ELO Arena est affiché lorsqu'un modèle est déjà présent au classement Text d'arena.ai (dernier relevé des votes : 13/09/2026) ; sinon la mention « n.c. » signifie qu'il n'y figure pas encore (modèle trop récent ou à accès restreint). Les prix, disponibilités et caractéristiques des modèles listés peuvent évoluer après la diffusion. Cette section est mise à jour à chaque édition.