See how models perform in the real world.
Usage, speed, value, and intelligence scores—grounded in how CodingFleet users actually work, not marketing claims.
Token usage over time
Model usage across CodingFleet.
Model leaderboard
Sort any metric, then narrow the list without reloading.
| Model | Speed | Usage | Credits | User score | Intelligence |
|---|---|---|---|---|---|
1
DeepSeek V4 Pro
|
82.5 tok/s | 13.9B | 2–4 | 0.6 | 36.0 |
2
DeepSeek V4 Flash
|
155.4 tok/s | 13.4B | 1 | 0.8 | 40.8 |
3
GPT-5.6 Luna
|
81.7 tok/s | 8.5B | 0.5–0.9 Unlimited | 0.5 | 37.3 |
4
Claude Haiku 4.5
|
115.5 tok/s | 5.2B | 2–3 | 0.1 | — |
5
DeepSeek V4.1 Flash
|
181.9 tok/s | 5.2B | 1 Unlimited | 0.8 | 39.5 |
6
Claude Sonnet 4.5
|
56.0 tok/s | 4.6B | 7–8 | 0.5 | — |
7
Claude Sonnet 4.6
|
57.1 tok/s | 3.2B | 9–10 | 1.0 | 36.8 |
8
GPT-5.2
|
47.8 tok/s | 2.9B | 4–8 | 0.8 | 43.3 |
9
Claude Opus 4.6
|
48.4 tok/s | 2.6B | 15–17 | 1.0 | 38.8 |
10
GPT-5.6 Terra
|
70.7 tok/s | 2.3B 1 | 5–7.5 | 0.8 | 42.1 |
11
GPT-5.4
|
65.1 tok/s | 2.3B 1 | 8–12 | 0.9 | 53.1 |
12
GPT-5 Mini
|
63.7 tok/s | 2.1B 2 | 1–2 | 0.7 | 31.6 |
13
Gemini 3 Flash
|
141.2 tok/s | 2.1B | 1 | 0.2 | 17.9 |
14
Claude Opus 4.5
|
57.0 tok/s | 2.0B | 15–17 | — | 41.9 |
15
GPT-5.4 Mini
|
121.4 tok/s | 1.8B | 1–2 | 0.3 | 40.9 |
16
Claude Sonnet 5
|
90.0 tok/s | 1.8B | 6.8–10 | — | 38.2 |
17
Claude Opus 4.8
|
66.0 tok/s | 1.5B 2 | 15–17 | — | 41.8 |
18
Claude Opus 4.7
|
67.4 tok/s | 1.0B 2 | 15–17 | — | 55.0 |
19
GPT-5
|
49.9 tok/s | 954.2M 1 | 3–5 | 1.0 | 35.3 |
20
GPT-5.1
|
69.9 tok/s | 760.8M 2 | 3–5 | 0.9 | 37.5 |
21
GLM 5.3 Flash
|
51.5 tok/s | 719.8M 2 | 1 Unlimited | — | 41.8 |
22
GPT-5.5
|
58.8 tok/s | 667.2M 2 | 14–24 | — | 56.3 |
23
Gemini 3.1 Pro
|
89.5 tok/s | 657.7M 3 | 7 | 1.0 | 29.7 |
24
GPT-5.2 Codex
|
50.5 tok/s | 654.6M 3 | 5–9 | 0.8 | 41.2 |
25
Qwen 3.8 Flash
|
57.8 tok/s | 603.7M 4 | 1 Unlimited | — | — |
26
GPT-5.1 Codex Mini
|
101.4 tok/s | 555.0M 6 | 1 | 0.7 | 31.3 |
27
GPT-5.3 Codex
|
59.0 tok/s | 497.3M 8 | 5–9 | — | 45.5 |
28
Gemini 3 Pro
|
77.3 tok/s | 410.9M 9 | 4 | 1.0 | 40.6 |
29
GPT-5.6 Sol
|
45.5 tok/s | 392.0M 9 | 11–18 | 1.0 | 47.0 |
30
Qwen 3.7 Flash
|
111.2 tok/s | 373.7M 9 | 1 Unlimited | — | — |
31
GPT-6 Luna
|
89.3 tok/s | 371.5M 9 | 0 Unlimited | — | 37.3 |
32
DeepSeek V3.2
|
27.2 tok/s | 299.6M 7 | 1 | — | 25.1 |
33
MiniMax M2.7
|
62.9 tok/s | 287.6M 11 | 1 | — | 22.8 |
34
Claude Opus 5
|
69.7 tok/s | 276.2M 11 | 15–22 | — | 50.8 |
35
GLM 5.1
|
42.5 tok/s | 249.9M 11 | 2 | — | 41.0 |
36
Claude Fable 5 Thinking
|
68.4 tok/s | 231.2M 13 | 36 | — | 62.1 |
37
GPT-4.1
|
45.6 tok/s | 202.9M 6 | 6 | — | 19.6 |
38
MiniMax M3
|
69.0 tok/s | 199.2M 14 | 1 | — | 29.2 |
39
Gemini 3.8 Flash
|
112.6 tok/s | 191.3M 14 | 1.5–2.5 | — | 40.9 |
40
Gemini 2.5 Flash
|
187.3 tok/s | 188.0M 2 | 1 | 0.3 | 14.2 |
41
Qwen 3.6 Plus
|
50.2 tok/s | 179.9M 14 | 1 Unlimited | — | 27.0 |
42
GLM 5.2
|
60.7 tok/s | 171.2M 14 | 2 | — | 33.7 |
43
Qwen 3.7 Max
|
45.9 tok/s | 169.5M 15 | 3 | — | 46.7 |
44
Muse Spark 1.3 Contributor
|
107.4 tok/s | 152.8M 15 | 1 Unlimited | — | — |
45
Claude 4 Sonnet
|
58.5 tok/s | 152.2M 28 | 6–7 | 1.0 | 29.8 |
46
Kimi K2.5
|
43.0 tok/s | 150.4M 14 | 1 | — | 36.0 |
47
Hy3
|
74.0 tok/s | 148.9M 14 | 1 Unlimited | — | 25.3 |
48
Gemini 3.5 Flash
|
143.2 tok/s | 137.1M 15 | 4 | 1.0 | 52.0 |
|
49
|
78.4 tok/s | 132.2M 15 | 0 | — | 12.9 |
50
Qwen 3.6 Flash
|
165.0 tok/s | 121.2M 15 | 1 | — | — |
51
GLM 5
|
57.6 tok/s | 120.2M 15 | 1 | — | 40.6 |
52
Kimi K2.7 Code
|
67.8 tok/s | 118.6M 16 | 1 | — | 25.8 |
53
GPT-5.1 Codex Max
|
72.2 tok/s | 98.6M 17 | 4–5 | — | — |
54
Claude 4.1 Opus
|
37.7 tok/s | 96.4M 8 | 50–60 | — | 34.5 |
55
Gemini 2.5 Pro
|
93.0 tok/s | 92.7M 14 | 4 | — | 25.9 |
56
GLM 5 Turbo
|
54.7 tok/s | 86.2M 15 | 1 | — | 39.1 |
57
GLM 5V Turbo
|
67.3 tok/s | 84.7M 15 | 1 | — | 35.3 |
58
GPT-4.1 mini
|
47.5 tok/s | 82.1M 24 | 1 | — | 14.8 |
59
Grok-4.1 Fast
|
112.7 tok/s | 80.1M 14 | 1 | — | 17.0 |
60
MiMo V2.5 Pro
|
64.3 tok/s | 79.1M 14 | 1 | — | 26.0 |
61
Grok-4 Fast
|
156.2 tok/s | 76.7M 14 | 1 | 0.4 | 16.6 |
62
Gemini 3.6 Flash
|
160.6 tok/s | 73.7M 14 | 3 | — | 51.6 |
63
Kimi K2.6
|
51.8 tok/s | 72.7M 15 | 1 | — | 45.1 |
64
Muse Spark 1.2 Contributor
|
131.9 tok/s | 71.9M 15 | 1 Unlimited | — | — |
65
Qwen 3.5 Flash
|
95.1 tok/s | 68.0M 15 | 1 | — | — |
66
Qwen 3.8 Max
|
33.9 tok/s | 67.4M 16 | 3 | — | 45.4 |
67
Qwen 3.5 Plus
|
57.6 tok/s | 63.5M 16 | 1 | — | — |
68
GLM 5.3
|
67.7 tok/s | 62.4M 16 | 2–3 | 0.9 | 44.8 |
69
Gemini 3.7 Flash
|
136.9 tok/s | 57.2M 16 | 2 | — | 39.1 |
70
Claude 3.5 Haiku
|
55.8 tok/s | 46.0M 49 | 1 | — | 12.2 |
71
Grok Build 0.1
|
125.7 tok/s | 41.5M 20 | 1 | — | — |
|
72
|
28.4 tok/s | 40.0M 21 | 0 | — | — |
73
MiniMax M2.5
|
50.9 tok/s | 39.5M 21 | 1 | — | 34.5 |
|
74
|
239.1 tok/s | 35.6M 21 | 1 Unlimited | — | 24.9 |
75
Hy4 Preview
|
55.5 tok/s | 34.1M 21 | 1–2 | — | — |
76
Grok 4.6
|
53.3 tok/s | 33.9M 21 | 2–4 | — | 44.3 |
77
Kimi K3
|
32.6 tok/s | 30.3M 22 | 7 | — | 43.6 |
78
Claude Fable 5.1
|
71.4 tok/s | 28.0M 22 | 30–44 | — | 53.4 |
|
79
|
65.3 tok/s | 23.6M 23 | 0 | — | — |
80
Qwen3 235B A22B
|
42.2 tok/s | 21.1M 21 | 1 | — | — |
81
MiMo V2 Pro
|
82.2 tok/s | 18.6M 24 | 1 | — | 41.4 |
82
Qwen 3.7 Plus
|
44.6 tok/s | 17.6M 24 | 1 | — | 25.2 |
83
Grok 4.5
|
54.3 tok/s | 17.4M 24 | 4 | — | 55.8 |
84
Qwen 3.6 Max Preview
|
38.5 tok/s | 16.8M 24 | 4 | — | 41.1 |
85
DeepSeek V3.2 Thinking
|
32.8 tok/s | 15.5M 4 | 1 | — | — |
|
86
|
29.7 tok/s | 15.1M 25 | 0 | — | — |
87
Grok-4.20 Beta
|
163.1 tok/s | 13.6M 26 | 4 | — | — |
88
MiMo V2.6 Flash
|
41.2 tok/s | 13.2M 26 | 0 Unlimited | — | — |
89
GLM 4.6
|
45.2 tok/s | 13.0M 26 | 1 | — | 23.4 |
90
GPT-5 Pro
|
15.1 tok/s | 12.9M 26 | 70 | — | — |
91
Claude Opus 5.5
|
70.5 tok/s | 12.8M 26 | 10–18 | — | 57.6 |
92
GPT-6 Sol
|
47.1 tok/s | 12.4M 26 | 5.5–9 | — | 47.5 |
93
Grok-4
|
40.8 tok/s | 10.0M 16 | 5 | — | 34.1 |
|
94
|
21.1 tok/s | 8.1M 26 | 0 | — | 33.7 |
95
OpenAI o3
|
61.0 tok/s | 8.0M 45 | 4–5 | — | 31.1 |
96
GPT-6 Astra
|
30.0 tok/s | 7.7M 26 | 30–42 | — | 52.7 |
97
Codestral (2508)
|
109.3 tok/s | 7.4M 27 | 1 | — | — |
98
GLM 4.7
|
46.3 tok/s | 7.2M 27 | 1 | — | 34.5 |
99
Mistral Medium 3
|
69.0 tok/s | 7.2M 20 | 1 | — | 12.5 |
100
Mistral Medium 3.5
|
100.6 tok/s | 6.0M 27 | 2 | — | 14.2 |
101
GPT-5.2 Codex
|
66.3 tok/s | 5.2M 27 | 8 | — | 41.2 |
102
Muse Spark 1.3
|
136.9 tok/s | 5.0M 27 | 1–3 | — | 45.1 |
103
MiMo V2.6 Pro
|
30.3 tok/s | 4.5M 28 | 1 Unlimited | — | 46.3 |
104
Grok 4.7
|
52.0 tok/s | 4.4M 28 | 1–2 | — | 46.4 |
105
Llama 4 Maverick
|
55.9 tok/s | 3.4M 7 | 1 | — | 14.5 |
106
Kimi K2 Thinking
|
73.4 tok/s | 3.0M 31 | 1 | — | 33.5 |
107
Grok-4.20
|
175.7 tok/s | 2.8M 31 | 4 | — | 38.0 |
108
Qwen3 Coder
|
84.2 tok/s | 1.4M 26 | 2 | — | — |
109
Grok-4.3
|
110.3 tok/s | 1.4M 32 | 3 | — | 37.9 |
110
Gemini 2.0 Flash
|
137.2 tok/s | 1.2M 67 | 1 | — | 12.2 |
111
Muse Spark 1.2
|
145.9 tok/s | 1.1M 31 | 1 | — | 46.8 |
112
Mistral Large 3
|
60.4 tok/s | 911.2K 31 | 1 | — | 4.1 |
113
Kimi K2 (0905)
|
49.7 tok/s | 866.1K 27 | 1 | — | 19.7 |
114
Claude 4 Opus
|
25.3 tok/s | 389.5K 27 | 50–60 | — | 31.7 |
115
Claude 3.7 Sonnet
|
55.1 tok/s | 375.5K 85 | 6 | — | 23.9 |
116
GPT-4o Mini
|
64.8 tok/s | 187.1K 83 | 1 | — | 6.7 |
117
GPT-4o
|
12.2 tok/s | 122.3K 81 | 2 | — | 9.4 |
118
Llama 3.1 405B
|
0.0 tok/s | 45.1K 30 | 2 | — | — |
119
OpenAI o4-mini
|
51.3 tok/s | 13.8K 72 | 2 | — | 26.1 |
120
GPT-3.5 Turbo
|
22.5 tok/s | 10.2K 69 | 1 | — | 3.2 |
|
121
|
8.7 tok/s | 5.1K 23 | 0 | — | 16.7 |
122
DeepSeek R1
|
64.1 tok/s | 1.4K 4 | 1 | — | 20.4 |
123
DeepSeek V3
|
51.5 tok/s | 1.1K 13 | 1 | — | 14.2 |
124
Claude 3.5 Sonnet
|
39.3 tok/s | 319 96 | 2 | — | 9.8 |
125
Grok-3 (Beta)
|
21.9 tok/s | 142 8 | 3 | — | — |
126
Llama 3.3 70B
|
30.4 tok/s | 107 34 | 1 | — | — |
127
GPT-4 Turbo
|
9.2 tok/s | 62 41 | 10 | — | 7.7 |
How to read these statistics
Real usageUsage combines prompt and completion tokens generated by CodingFleet users during the selected period.
Credits and availabilityCredits are charged per request, pro-rata to the tokens used. Models tagged Unlimited cost no credits on the Unlimited plan and above (Unlimited, Elite, Ultimate, Ultimate Max); every other model is charged the credits shown, on every plan. Legacy models are no longer selectable.
IntelligenceA composite score out of 100 covering reasoning, coding and knowledge — the same number the Auto model router weighs against price when it picks a model for you.