Section 07 — Vitesse
Estimations de vitesse
Tokens / seconde — vitesse d'écriture
Vitesses d'écriture relevées chaque jour sur Artificial Analysis (colonne « Median Tokens/s ») — relevé du 22/09/2026 ; estimations observées (OpenRouter / Artificial Analysis) pour les modèles non publiés par ce classement. Valeurs non officielles, dépendant de la charge et de la configuration. Le tableau est scindé en deux blocs : les derniers modèles sortis (générations en cours), puis les générations antérieures encore en activité — toujours servies et facturées par leur éditeur.
Vitesse d'écriture par modèle (tokens / s)
plus la barre est longue, plus c'est rapideDerniers modèles sortis — générations en cours 21 modèles
Modèles les plus récents de leur gamme. Lorsqu'un modèle remplace une génération antérieure, celle-ci est présentée dans le second tableau (elle reste servie et facturée par son éditeur).
| Rang | Modèle | Vitesse | Source |
|---|---|---|---|
| 1 | Gemini 3.8 FlashEn cours | ~329 tok/s | Artificial Analysis — median tokens/s |
| 2 | Gemini 3.1 Flash-LiteEn cours | ~300 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 3 | Muse Spark 1.3En cours | ~223 tok/s | Artificial Analysis — median tokens/s |
| 4 | DeepSeek V4.1 FlashEn cours | ~219 tok/s | Artificial Analysis — median tokens/s |
| 5 | GPT-5.6 LunaEn cours | ~159 tok/s | Artificial Analysis — median tokens/s |
| 6 | Mistral Small 4En cours | ~155 tok/s | Artificial Analysis — median tokens/s |
| 7 | Grok Build 0.1En cours | ~150 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 8 | Gemini 3.1 ProEn cours | ~115 tok/s | Artificial Analysis — median tokens/s |
| 9 | GPT-5.6 TerraEn cours | ~105 tok/s | Artificial Analysis — median tokens/s |
| 10 | Meta Muse GlimmerEn cours | ~93 tok/s | Artificial Analysis — median tokens/s |
| 11 | Claude Haiku 4.5En cours | ~92 tok/s | Artificial Analysis — median tokens/s |
| 12 | GLM-5.3 FlashEn cours | ~88 tok/s | Artificial Analysis — median tokens/s |
| 13 | Claude Sonnet 5En cours | ~79 tok/s | Artificial Analysis — median tokens/s |
| 14 | Mistral Large 3En cours | ~76 tok/s | Artificial Analysis — median tokens/s |
| 15 | Claude Fable 5.1En cours | ~67 tok/s | Artificial Analysis — median tokens/s |
| 16 | GPT-6 AstraEn cours | ~65 tok/s | Artificial Analysis — median tokens/s |
| 17 | GLM-5.3En cours | ~62 tok/s | Artificial Analysis — median tokens/s |
| 18 | Claude Opus 5En cours | ~56 tok/s | Artificial Analysis — median tokens/s |
| 19 | Qwen3.8-27BEn cours | ~46 tok/s | Artificial Analysis — median tokens/s |
| 20 | Qwen3.8-MaxEn cours | ~40 tok/s | Artificial Analysis — median tokens/s |
| 21 | Claude Mythos 5.1En cours | n.c. | Estimation (OpenRouter / Artificial Analysis) |
Générations antérieures encore en activité 21 modèles
Modèles plus anciens toujours servis et facturés par leur éditeur ; certains coexistent avec la version qui les remplace.
| Rang | Modèle | Vitesse | Source |
|---|---|---|---|
| 1 | Gemini 3.5 FlashGénération antérieure | ~214 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 2 | GPT-5.4 miniGénération antérieure | ~200 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 3 | GPT-5.4 nanoGénération antérieure | ~200 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 4 | Gemini 3 FlashGénération antérieure | ~200 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 5 | GLM-4.7-FlashXGénération antérieure | ~200 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 6 | Grok 4.3Génération antérieure | ~108 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 7 | Llama 4 MaverickGénération antérieure | ~108 tok/s | Artificial Analysis — median tokens/s |
| 8 | Llama 4 ScoutGénération antérieure | ~100 tok/s | Artificial Analysis — median tokens/s |
| 9 | DeepSeek V4 ProGénération antérieure⚠ Retrait programmé | ~97 tok/s | Artificial Analysis — median tokens/s |
| 10 | GPT-5.6 SolGénération antérieure | ~82 tok/s | Artificial Analysis — median tokens/s |
| 11 | Claude Sonnet 4.6Génération antérieure | ~80 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 12 | Qwen3 30BGénération antérieure | ~80 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 13 | GLM-5.2Génération antérieure | ~72 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 14 | Qwen3.7 PlusGénération antérieure | ~68 tok/s | Artificial Analysis — median tokens/s |
| 15 | Claude Fable 5Génération antérieure | ~66 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 16 | Grok 4.5Génération antérieure | ~60 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 17 | Qwen3.7 MaxGénération antérieure | ~60 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 18 | GLM-5.1 (MIT)Génération antérieure | ~60 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 19 | Grok 4.6Génération antérieure | ~60 tok/s | Artificial Analysis — median tokens/s |
| 20 | Claude Opus 4.8Génération antérieure | ~45 tok/s | Estimation (OpenRouter / Artificial Analysis) |
| 21 | Qwen3 235BGénération antérieure | ~40 tok/s | Estimation (OpenRouter / Artificial Analysis) |
🗂 Premier tableau : derniers modèles sortis (générations en cours). Second tableau : générations antérieures encore en activité. Le classement de vitesse est établi à l'intérieur de chaque bloc.
⚠️ Vitesses d'écriture relevées chaque jour sur Artificial Analysis (colonne « Median Tokens/s ») ; estimations observées (OpenRouter / Artificial Analysis) pour les modèles non publiés par ce classement. Valeurs non officielles, dépendant de la charge et de la configuration.