Rapport Journalier des LLM Comparaison des modèles d'IA — Mise à jour quotidienne
N°20260922 Édition du 22/09/2026
Mise à jour quotidienne
Section 01 — Tableau comparatif

Tableau comparatif principal

Tous les modèles triés par ELO décroissant


Les modèles sont triés par score ELO Arena (classement Text, overall, style control) — relevé du 13/09/2026. Prix en USD / 1M tokens (entrée → sortie). Données arrêtées à la date de l'édition. Le tableau est scindé en deux blocs : les derniers modèles sortis (générations en cours), puis les générations antérieures encore en activité — toujours servies et facturées par leur éditeur.

Positionnement des modèles — ELO vs coût blendé

survolez un point pour le détail
1270131013501390143014701510$0$6$11$17$22Claude Fable 5 — Génération antérieureClaude Fable 5.1 — En coursMuse Spark 1.3 — En coursGemini 3.8 Flash — En coursClaude Opus 5 — En coursGemini 3.1 Pro — En coursGPT-5.6 Sol — Génération antérieureGLM-5.3 — En coursClaude Opus 4.8 — Génération antérieureQwen3.8-Max — En coursGPT-6 Astra — En coursGemini 3.5 Flash — Génération antérieureGLM-5.3 Flash — En coursGemini 3 Flash — Génération antérieureQwen3.7 Max — Génération antérieureClaude Sonnet 4.6 — Génération antérieureGLM-5.2 — Génération antérieureGrok 4.5 — Génération antérieureGPT-5.6 Terra — En coursGLM-5.1 (MIT) — Génération antérieureClaude Sonnet 5 — En coursDeepSeek V4 Pro — Génération antérieureQwen3.7 Plus — Génération antérieureGrok 4.6 — Génération antérieureGPT-5.6 Luna — En coursGPT-5.4 mini — Génération antérieureGrok 4.3 — Génération antérieureQwen3.8-27B — En coursDeepSeek V4.1 Flash — En coursGemini 3.1 Flash-Lite — En coursMeta Muse Glimmer — En coursQwen3 235B — Génération antérieureClaude Haiku 4.5 — En coursMistral Large 3 — En coursGPT-5.4 nano — Génération antérieureQwen3 30B — Génération antérieureGLM-4.7-FlashX — Génération antérieureGrok Build 0.1 — En coursLlama 4 Maverick — Génération antérieureMistral Small 4 — En coursLlama 4 Scout — Génération antérieureScore ELO Arena (perfection →) Coût blendé $/1M ↑
Teinte pleine = dernières générations sorties (en cours)Teinte claire = générations antérieures encore en activitéÉtats-UnisFranceChine

Plus un point est haut-droit, meilleur est le rapport performance/prix. Les modèles dont le prix ou l'ELO n'est pas communiqué (« n.c. ») n'apparaissent pas sur la figure.

Filtrer

Derniers modèles sortis — générations en cours 21 modèles

Modèles les plus récents de leur gamme. Lorsqu'un modèle remplace une génération antérieure, celle-ci est présentée dans le second tableau (elle reste servie et facturée par son éditeur).

Rang Modèle Éditeur Pays Entrée $/1M Sortie $/1M ELO Note/10 Autonomie Contexte
1 Claude Fable 5.1En cours Anthropic 🇺🇸 États-Unis $10.00 $50.00 1498.5 6.6 9 1M
2 Muse Spark 1.3En cours Meta 🇺🇸 États-Unis $1.25 $4.25 1493.1 7.9 9 1M
3 Gemini 3.8 FlashEn cours Google 🇺🇸 États-Unis $0.75 $3.75 1493 8.1 9 1M
4 Claude Opus 5En cours Anthropic 🇺🇸 États-Unis $5.00 $25.00 1492.9 6.9 8 1M
5 Gemini 3.1 ProEn cours Google 🇺🇸 États-Unis $2.00 $12.00 1486.8 7.2 8 1M
6 GLM-5.3En cours Zhipu 🇨🇳 Chine $1.40 $4.40 1483 7.5 8 1M
7 Qwen3.8-MaxEn cours Alibaba 🇨🇳 Chine $2.00 $6.00 1480.6 7.3 9 1M
8 GPT-6 AstraEn cours OpenAI 🇺🇸 États-Unis $10.00 $50.00 1479.8 6.1 10 1.05M
9 GLM-5.3 FlashEn cours Zhipu 🇨🇳 Chine $0.15 $0.50 1475.4 8.7 8 1M
10 GPT-5.6 TerraEn cours OpenAI 🇺🇸 États-Unis $2.00 $12.00 1466 6.6 7 1.1M
11 Claude Sonnet 5En cours Anthropic 🇺🇸 États-Unis $2.00 $10.00 1461.2 6.5 9 1M
12 GPT-5.6 LunaEn cours OpenAI 🇺🇸 États-Unis $0.20 $1.20 1452.5 7.6 6 1M
13 Qwen3.8-27BEn cours Alibaba 🇨🇳 Chine $0.50 $3.00 1437.1 6.5 6 1M
14 DeepSeek V4.1 FlashEn cours DeepSeek 🇨🇳 Chine $0.15 $0.60 1435.6 7.4 7 1M
15 Gemini 3.1 Flash-LiteEn cours Google 🇺🇸 États-Unis $0.25 $1.50 1432.4 6.8 5 1M
16 Meta Muse GlimmerEn cours Meta 🇺🇸 États-Unis $0.35 $1.50 1427.2 6.6 6 131K
17 Claude Haiku 4.5En cours Anthropic 🇺🇸 États-Unis $1.00 $5.00 1414.6 5.5 6 1M
18 Mistral Large 3En cours Mistral AI 🇫🇷 France $0.50 $1.50 1413 6.1 6 256K
19 Grok Build 0.1En cours xAI 🇺🇸 États-Unis $1.00 $2.00 1350 3.8 * 5 256K
20 Mistral Small 4En cours Mistral AI 🇫🇷 France $0.15 $0.60 1350 4.8 * 5 256K
21 Claude Mythos 5.1En cours Anthropic 🇺🇸 États-Unis $10.00 $50.00 n.c. n.c. * 9 1M

Générations antérieures encore en activité 21 modèles

Modèles plus anciens toujours servis et facturés par leur éditeur ; certains coexistent avec la version qui les remplace.

Rang Modèle Éditeur Pays Entrée $/1M Sortie $/1M ELO Note/10 Autonomie Contexte
1 Claude Fable 5Génération antérieure Anthropic 🇺🇸 États-Unis $10.00 $50.00 1505.7 6.9 8 1M
2 GPT-5.6 SolGénération antérieure OpenAI 🇺🇸 États-Unis $4.00 $20.00 1483.5 6.8 8 1.1M
3 Claude Opus 4.8Génération antérieure Anthropic 🇺🇸 États-Unis $5.00 $25.00 1481.4 6.6 8 1M
4 Gemini 3.5 FlashGénération antérieure Google 🇺🇸 États-Unis $1.50 $9.00 1477.7 7.1 8 1M
5 Gemini 3 FlashGénération antérieure Google 🇺🇸 États-Unis $0.50 $3.00 1473.7 7.7 6 1M
6 Qwen3.7 MaxGénération antérieure Alibaba 🇨🇳 Chine $2.50 $7.50 1473.2 6.9 10 1M
7 Claude Sonnet 4.6Génération antérieure Anthropic 🇺🇸 États-Unis $3.00 $15.00 1472.6 6.6 8 1M
8 GLM-5.2Génération antérieure Zhipu 🇨🇳 Chine $1.40 $4.40 1472.1 7.2 8 202K
9 Grok 4.5Génération antérieure xAI 🇺🇸 États-Unis $2.00 $6.00 1468.1 6.9 8 500K
10 GLM-5.1 (MIT)Génération antérieure Zhipu 🇨🇳 Chine $1.40 $4.40 1465.5 7 8 202K
11 DeepSeek V4 ProGénération antérieure⚠ Retrait programmé DeepSeek 🇨🇳 Chine $0.66 $1.98 1457.3 7.2 8 1M
12 Qwen3.7 PlusGénération antérieure Alibaba 🇨🇳 Chine $0.32 $1.28 1455.6 7.5 7 1M
13 Grok 4.6Génération antérieure xAI 🇺🇸 États-Unis $2.00 $6.00 1455.6 6.5 9 500K
14 GPT-5.4 miniGénération antérieure OpenAI 🇺🇸 États-Unis $0.75 $4.50 1448.1 6.6 6 1M
15 Grok 4.3Génération antérieure xAI 🇺🇸 États-Unis $1.25 $2.50 1442.7 6.5 7 1M
16 Qwen3 235BGénération antérieure Alibaba 🇨🇳 Chine $0.20 $0.60 1423 6.9 6 128K
17 GPT-5.4 nanoGénération antérieure OpenAI 🇺🇸 États-Unis $0.20 $1.25 1402.1 6 4 256K
18 Qwen3 30BGénération antérieure Alibaba 🇨🇳 Chine $0.50 $1.50 1382.3 5.1 5 32K
19 GLM-4.7-FlashXGénération antérieure Zhipu 🇨🇳 Chine $0.07 $0.40 1366.3 5.6 5 128K
20 Llama 4 MaverickGénération antérieure Meta 🇺🇸 États-Unis $0.60 $0.60 1350 4.3 * 6 1M
21 Llama 4 ScoutGénération antérieure Meta 🇺🇸 États-Unis $0.18 $0.18 1280 2.9 * 6 10M
💡 Cliquez sur les en-têtes (Modèle, Éditeur, Entrée, Sortie, ELO, Note, Autonomie) pour trier. Utilisez les filtres et la recherche pour affiner : les filtres s'appliquent aux deux tableaux.
🗂 Deux tableaux : le premier regroupe les derniers modèles sortis (générations en cours) ; le second les générations antérieures encore en activité, toujours servies et facturées par leur éditeur. Survolez le badge à côté du nom — En cours ou Génération antérieure — pour voir le détail du remplacement (quel modèle succède à quel autre).
📊 Note performance/prix (/10) : 70 % performance (ELO Arena, relevé chaque jour : 10 × (ELO − 1280) / (1510 − 1280)) et 30 % prix (coût blendé = (3 × entrée + 1 × sortie) ÷ 4, sur une échelle logarithmique de 0,15 $/1M à 20 $/1M). À note égale, le modèle au meilleur ELO passe devant, puis le moins cher. Avec * : ELO non rafraîchi par le relevé Arena du jour (modèle hors classement) — la note reste recalculée à partir de cet ELO. « n.c. » : prix non communiqué. L'aptitude agent est notée séparément (colonne Autonomie).
⚠ Retrait programmé (badge à côté du nom) : l'éditeur a annoncé le retrait ou le reroutage du modèle à une date connue. Survolez le badge pour le détail (date, modèle de remplacement, tarif applicable). Le modèle reste affiché avec ses tarifs et son ELO en vigueur jusqu'à cette date.
⚡ Autonomie agent (/10) : capacité d'un modèle à fonctionner en boucles (tool use, multi-étapes, auto-correction, computer use) et à tenir une tâche sur la durée (minutes → heures → jours). Note = 0,5 × boucles + 0,5 × endurance temporelle. Survolez la pastille pour voir la justification (specs / annonce officielle de l'éditeur). n.c. = non documenté.

Les scores d'autonomie sont une évaluation éditoriale de PCHWeb fondée sur les spécifications et annonces officielles des éditeurs (durée de tâche, capacité d'agent, multi-étapes, computer use) — pas un benchmark standardisé. À titre indicatif.