Daily snapshot · immutable permalink
AI model usage rankings - August 29, 2026
As published on August 29, 2026, DeepSeek: DeepSeek V4 Flash 0423 led real OpenRouter usage share at 15.4%. NVIDIA: Nemotron 3.5 Lightning (free), Qwen: Qwen3.8 Flash, Qwen: Qwen3.7 Flash entered the leaderboard for the first time. inclusionAI: Ling 3.0 Flash Fin (free) moved 17 places up since August 28, 2026.
- #1 DeepSeek: DeepSeek V4 Flash 0423 - 15.4% usage share
- #2 Tencent: Hy4 preview - 11.7% usage share
- #3 Z.ai: GLM 5.3 Flash (batch) - 10.0% usage share
- #4 OpenAI: GPT-5.6 Luna (batch) - 8.5% usage share
- #5 MiniMax: MiniMax M3 (batch) - 6.7% usage share
- #6 NVIDIA: Nemotron 3 Ultra (free) - 5.9% usage share
- #7 Tencent: Hy3 - 5.3% usage share
- #8 Xiaomi: MiMo-V2.5 - 4.0% usage share
- #9 DeepSeek: DeepSeek V4 Pro 0423 - 2.7% usage share
- #10 Google: Gemini 3.7 Flash (batch) - 2.6% usage share
| # | Model | Usage share | Rank change |
|---|---|---|---|
| 01 | DeepSeek: DeepSeek V4 Flash 0423 | 15.4% | no change |
| 02 | Tencent: Hy4 preview | 11.7% | +7 (+9.2pts) |
| 03 | Z.ai: GLM 5.3 Flash (batch) | 10.0% | +1 (-0.3pts) |
| 04 | OpenAI: GPT-5.6 Luna (batch) | 8.5% | -2 (-2.7pts) |
| 05 | MiniMax: MiniMax M3 (batch) | 6.7% | +1 (+1.4pts) |
| 06 | NVIDIA: Nemotron 3 Ultra (free) | 5.9% | +1 (+0.9pts) |
| 07 | Tencent: Hy3 | 5.3% | -2 (-1.1pts) |
| 08 | Xiaomi: MiMo-V2.5 | 4.0% | -5 (-6.4pts) |
| 09 | DeepSeek: DeepSeek V4 Pro 0423 | 2.7% | -1 (+0.1pts) |
| 10 | Google: Gemini 3.7 Flash (batch) | 2.6% | no change |
| 11 | Z.ai: GLM 5.2 (batch) | 2.1% | no change |
| 12 | Z.ai: GLM 5.3 (batch) | 1.4% | +3 (0pts) |
| 13 | Poolside: Laguna S 2.1 (free) | 1.4% | +4 (+0.1pts) |
| 14 | MoonshotAI: Kimi K3 (batch) | 1.3% | -1 (-0.2pts) |
| 15 | NVIDIA: Nemotron 3.5 Lightning (free) New | 1.2% | - |
| 16 | OpenAI: GPT-5.6 Sol (batch) | 1.1% | -4 (-0.6pts) |
| 17 | Claude Opus 5 (batch) | 1.0% | -3 (-0.4pts) |
| 18 | Google: Gemini 2.5 Flash Lite (batch) | 1.0% | no change |
| 19 | Anthropic: Claude Sonnet 5 (batch) | 0.9% | -3 (-0.4pts) |
| 20 | Upstage: Solar Pro 4 | 0.7% | +1 (+0.1pts) |
| 21 | Google: Gemini 3 Flash Preview (batch) | 0.7% | -2 (0pts) |
| 22 | Anthropic: Claude Sonnet 4.6 (batch) | 0.7% | -2 (0pts) |
| 23 | inclusionAI: Ling 3.0 Flash Fin (free) | 0.6% | +17 (+0.3pts) |
| 24 | OpenAI: gpt-oss-20b (batch) | 0.5% | +3 (+0.1pts) |
| 25 | NVIDIA: Nemotron 3 Super (free) | 0.5% | -1 (0pts) |
| 26 | MiniMax: MiniMax M2.7 | 0.4% | +11 (+0.1pts) |
| 27 | DeepSeek: DeepSeek V3.2 | 0.4% | +5 (+0.1pts) |
| 28 | OpenAI: GPT-5.6 Terra (batch) | 0.4% | -6 (-0.1pts) |
| 29 | StepFun: Step 3.7 Flash | 0.4% | +2 (0pts) |
| 30 | Anthropic: Claude Opus 4.8 (batch) | 0.4% | no change |
| 31 | Google: Gemini 3.1 Flash Lite (batch) | 0.4% | -3 (0pts) |
| 32 | Google: Gemini 2.5 Flash (batch) | 0.4% | -3 (0pts) |
| 33 | Google: Gemini 3.1 Pro Preview (batch) | 0.3% | +3 (0pts) |
| 34 | Google: Gemma 4 31B (free) | 0.3% | +1 (0pts) |
| 35 | Qwen: Qwen3.8 Max | 0.3% | +4 (0pts) |
| 36 | Xiaomi: MiMo-V2.5-Pro | 0.3% | -2 (-0.1pts) |
| 37 | SpaceXAI: Grok 4.6 | 0.3% | -11 (-0.2pts) |
| 38 | OpenAI: GPT-5.6 Luna Pro (batch) | 0.3% | -5 (-0.1pts) |
| 39 | Google: Gemma 4 26B A4B (free) | 0.3% | +2 (0pts) |
| 40 | OpenAI: gpt-oss-120b (batch) | 0.3% | -17 (-0.2pts) |
| 41 | Meta: Muse Spark 1.2 Contributor | 0.3% | +2 (0pts) |
| 42 | Thinking Machines: Inkling (free) | 0.2% | no change |
| 43 | Anthropic: Claude Haiku 4.5 (batch) | 0.2% | +1 (0pts) |
| 44 | Qwen: Qwen3.8 Flash New | 0.2% | - |
| 45 | DeepSeek: DeepSeek V4 Flash Vision Exp (batch) | 0.2% | +2 (0pts) |
| 46 | Qwen: Qwen3.7 Flash New | 0.2% | - |
This page is a permanent, unchanging record of real OpenRouter usage share as it stood on August 29, 2026. Later corrections to the data pipeline appear as new dated snapshots - this page's figures never change.
Source: OpenRouter (openrouter.ai/rankings), as of August 29, 2026.
Benchmark scores: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings).
Methodology: www.smophy.ai/benchmark/methodology
Token counts originate from each provider's own tokenizer and are not directly comparable across providers.
