Rapport Journalier des LLM Comparaison des modèles d'IA — Mise à jour quotidienne
N°20260922 Édition du 22/09/2026
Mise à jour quotidienne
Section 07 — Vitesse

Estimations de vitesse

Tokens / seconde — vitesse d'écriture


Vitesses d'écriture relevées chaque jour sur Artificial Analysis (colonne « Median Tokens/s ») — relevé du 22/09/2026 ; estimations observées (OpenRouter / Artificial Analysis) pour les modèles non publiés par ce classement. Valeurs non officielles, dépendant de la charge et de la configuration. Le tableau est scindé en deux blocs : les derniers modèles sortis (générations en cours), puis les générations antérieures encore en activité — toujours servies et facturées par leur éditeur.

Vitesse d'écriture par modèle (tokens / s)

plus la barre est longue, plus c'est rapide
Gemini 3.8 FlashGemini 3.8 Flash~329 tok/sGemini 3.1 Flash-LiteGemini 3.1 Flash-Lite~300 tok/sMuse Spark 1.3Muse Spark 1.3~223 tok/sDeepSeek V4.1 FlashDeepSeek V4.1 Flash~219 tok/sGemini 3.5 FlashGemini 3.5 Flash~214 tok/sGPT-5.4 miniGPT-5.4 mini~200 tok/sGPT-5.4 nanoGPT-5.4 nano~200 tok/sGemini 3 FlashGemini 3 Flash~200 tok/sGLM-4.7-FlashXGLM-4.7-FlashX~200 tok/sGPT-5.6 LunaGPT-5.6 Luna~159 tok/sMistral Small 4Mistral Small 4~155 tok/sGrok Build 0.1Grok Build 0.1~150 tok/sGemini 3.1 ProGemini 3.1 Pro~115 tok/sGrok 4.3Grok 4.3~108 tok/sLlama 4 MaverickLlama 4 Maverick~108 tok/sGPT-5.6 TerraGPT-5.6 Terra~105 tok/sLlama 4 ScoutLlama 4 Scout~100 tok/sDeepSeek V4 ProDeepSeek V4 Pro~97 tok/sMeta Muse GlimmerMeta Muse Glimmer~93 tok/sClaude Haiku 4.5Claude Haiku 4.5~92 tok/sGLM-5.3 FlashGLM-5.3 Flash~88 tok/sGPT-5.6 SolGPT-5.6 Sol~82 tok/sClaude Sonnet 4.6Claude Sonnet 4.6~80 tok/sQwen3 30BQwen3 30B~80 tok/sClaude Sonnet 5Claude Sonnet 5~79 tok/sMistral Large 3Mistral Large 3~76 tok/sGLM-5.2GLM-5.2~72 tok/sQwen3.7 PlusQwen3.7 Plus~68 tok/sClaude Fable 5.1Claude Fable 5.1~67 tok/sClaude Fable 5Claude Fable 5~66 tok/sGPT-6 AstraGPT-6 Astra~65 tok/sGLM-5.3GLM-5.3~62 tok/sGrok 4.5Grok 4.5~60 tok/sQwen3.7 MaxQwen3.7 Max~60 tok/sGLM-5.1 (MIT)GLM-5.1 (MIT)~60 tok/sGrok 4.6Grok 4.6~60 tok/sClaude Opus 5Claude Opus 5~56 tok/sQwen3.8-27BQwen3.8-27B~46 tok/sClaude Opus 4.8Claude Opus 4.8~45 tok/sQwen3 235BQwen3 235B~40 tok/sQwen3.8-MaxQwen3.8-Max~40 tok/stokens par seconde (relevé Artificial Analysis / estimations)

Derniers modèles sortis — générations en cours 21 modèles

Modèles les plus récents de leur gamme. Lorsqu'un modèle remplace une génération antérieure, celle-ci est présentée dans le second tableau (elle reste servie et facturée par son éditeur).

Rang Modèle Vitesse Source
1 Gemini 3.8 FlashEn cours ~329 tok/s Artificial Analysis — median tokens/s
2 Gemini 3.1 Flash-LiteEn cours ~300 tok/s Estimation (OpenRouter / Artificial Analysis)
3 Muse Spark 1.3En cours ~223 tok/s Artificial Analysis — median tokens/s
4 DeepSeek V4.1 FlashEn cours ~219 tok/s Artificial Analysis — median tokens/s
5 GPT-5.6 LunaEn cours ~159 tok/s Artificial Analysis — median tokens/s
6 Mistral Small 4En cours ~155 tok/s Artificial Analysis — median tokens/s
7 Grok Build 0.1En cours ~150 tok/s Estimation (OpenRouter / Artificial Analysis)
8 Gemini 3.1 ProEn cours ~115 tok/s Artificial Analysis — median tokens/s
9 GPT-5.6 TerraEn cours ~105 tok/s Artificial Analysis — median tokens/s
10 Meta Muse GlimmerEn cours ~93 tok/s Artificial Analysis — median tokens/s
11 Claude Haiku 4.5En cours ~92 tok/s Artificial Analysis — median tokens/s
12 GLM-5.3 FlashEn cours ~88 tok/s Artificial Analysis — median tokens/s
13 Claude Sonnet 5En cours ~79 tok/s Artificial Analysis — median tokens/s
14 Mistral Large 3En cours ~76 tok/s Artificial Analysis — median tokens/s
15 Claude Fable 5.1En cours ~67 tok/s Artificial Analysis — median tokens/s
16 GPT-6 AstraEn cours ~65 tok/s Artificial Analysis — median tokens/s
17 GLM-5.3En cours ~62 tok/s Artificial Analysis — median tokens/s
18 Claude Opus 5En cours ~56 tok/s Artificial Analysis — median tokens/s
19 Qwen3.8-27BEn cours ~46 tok/s Artificial Analysis — median tokens/s
20 Qwen3.8-MaxEn cours ~40 tok/s Artificial Analysis — median tokens/s
21 Claude Mythos 5.1En cours n.c. Estimation (OpenRouter / Artificial Analysis)

Générations antérieures encore en activité 21 modèles

Modèles plus anciens toujours servis et facturés par leur éditeur ; certains coexistent avec la version qui les remplace.

Rang Modèle Vitesse Source
1 Gemini 3.5 FlashGénération antérieure ~214 tok/s Estimation (OpenRouter / Artificial Analysis)
2 GPT-5.4 miniGénération antérieure ~200 tok/s Estimation (OpenRouter / Artificial Analysis)
3 GPT-5.4 nanoGénération antérieure ~200 tok/s Estimation (OpenRouter / Artificial Analysis)
4 Gemini 3 FlashGénération antérieure ~200 tok/s Estimation (OpenRouter / Artificial Analysis)
5 GLM-4.7-FlashXGénération antérieure ~200 tok/s Estimation (OpenRouter / Artificial Analysis)
6 Grok 4.3Génération antérieure ~108 tok/s Estimation (OpenRouter / Artificial Analysis)
7 Llama 4 MaverickGénération antérieure ~108 tok/s Artificial Analysis — median tokens/s
8 Llama 4 ScoutGénération antérieure ~100 tok/s Artificial Analysis — median tokens/s
9 DeepSeek V4 ProGénération antérieure⚠ Retrait programmé ~97 tok/s Artificial Analysis — median tokens/s
10 GPT-5.6 SolGénération antérieure ~82 tok/s Artificial Analysis — median tokens/s
11 Claude Sonnet 4.6Génération antérieure ~80 tok/s Estimation (OpenRouter / Artificial Analysis)
12 Qwen3 30BGénération antérieure ~80 tok/s Estimation (OpenRouter / Artificial Analysis)
13 GLM-5.2Génération antérieure ~72 tok/s Estimation (OpenRouter / Artificial Analysis)
14 Qwen3.7 PlusGénération antérieure ~68 tok/s Artificial Analysis — median tokens/s
15 Claude Fable 5Génération antérieure ~66 tok/s Estimation (OpenRouter / Artificial Analysis)
16 Grok 4.5Génération antérieure ~60 tok/s Estimation (OpenRouter / Artificial Analysis)
17 Qwen3.7 MaxGénération antérieure ~60 tok/s Estimation (OpenRouter / Artificial Analysis)
18 GLM-5.1 (MIT)Génération antérieure ~60 tok/s Estimation (OpenRouter / Artificial Analysis)
19 Grok 4.6Génération antérieure ~60 tok/s Artificial Analysis — median tokens/s
20 Claude Opus 4.8Génération antérieure ~45 tok/s Estimation (OpenRouter / Artificial Analysis)
21 Qwen3 235BGénération antérieure ~40 tok/s Estimation (OpenRouter / Artificial Analysis)
🗂 Premier tableau : derniers modèles sortis (générations en cours). Second tableau : générations antérieures encore en activité. Le classement de vitesse est établi à l'intérieur de chaque bloc.
⚠️ Vitesses d'écriture relevées chaque jour sur Artificial Analysis (colonne « Median Tokens/s ») ; estimations observées (OpenRouter / Artificial Analysis) pour les modèles non publiés par ce classement. Valeurs non officielles, dépendant de la charge et de la configuration.