Artificial Analysis Output Speed
Median output tokens per second on the first-party API, measured over the past two weeks.
Gemini 3.8 Flash
#1 right now
291 tok/s
Output speed
24
Models ranked
Sep 24, 2026
Board published
Ranking
Best variant per model, as published. Higher is better.
- 1291 tok/s
Gemini 3.8 Flash
as “Gemini 3.8 Flash (high)” - 2232 tok/s
DeepSeek V4.1 Flash
as “DeepSeek V4.1 Flash (Reasoning, Max Effort)” - 3228 tok/s
Muse Spark 1.3
as “Muse Spark 1.3 (xhigh)” - 4218 tok/s
DeepSeek V4 Flash Vision
as “DeepSeek V4 Flash Vision (Reasoning, Max Effort)” - 5145 tok/s
GPT-5.3 Codex
as “GPT-5.3 Codex (xhigh)” - 6134 tok/s
GPT-6 Luna
as “GPT-6 Luna (high)” - 7114 tok/s
GPT-6 Sol
as “GPT-6 Sol (medium)” - 892 tok/s
Claude Opus 5.5
as “Claude Opus 5.5 (Adaptive Reasoning, Xhigh Effort, Default Fallback)” - 985 tok/s
- 1083 tok/s
GPT-5.6 Terra
as “GPT-5.6 Terra (max)” - 1179 tok/s
Claude Sonnet 5
as “Claude Sonnet 5 (Adaptive Reasoning, Max Effort)” - 1266 tok/s
DeepSeek V4 Pro 0813
as “DeepSeek V4 Pro 0813 (Reasoning, Max Effort)” - 1366 tok/s
Claude Fable 5.1
as “Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)” - 1461 tok/s
Grok 4.6
as “Grok 4.6 (high)” - 1557 tok/s
GLM-5.3
as “GLM-5.3 (max)” - 1654 tok/s
- 1752 tok/s
GPT-6 Astra
as “GPT-6 Astra (max)” - 1852 tok/s
Grok 4.7
as “Grok 4.7 (high)” - 1949 tok/s
- 2046 tok/s
- 2143 tok/s
Qwen3.8 27B
as “Qwen3.8 27B (xhigh)” - 2239 tok/s
- 2338 tok/s
Kimi K3
as “Kimi K3 (low)” - 2438 tok/s
Rank over time
History builds with every daily capture. One capture so far.
Scores as published by Artificial Analysis on the capture date (2026-09-24). Source: artificialanalysis.ai models page data.