BenchLeader

Fast and good

At least 100 tokens per second with an index above 55.

25 models qualify · data as of 9 Sept 2026

25 of 25
#
1Muse Spark 1.1Meta64.9194 tok/s$2.00194
2Gemini 3.7 FlashmediumGoogle64.4282 tok/s$1.50282
3Gemini 3.5 FlashmediumGoogle63.9209 tok/s$3.38209
4Muse Spark 1.3xhighMeta63.9193 tok/s$2.00193
5Gemini 3.1 ProGoogle63.9110 tok/s$4.50110
6Gemini 3.8 FlashmediumGoogle63.5273 tok/s$1.50273
7GPT-5.4OpenAI63.4130 tok/s$5.63130
8Muse Spark 1.2Meta62.6219 tok/s$2.00219
9GPT-5.3 CodexOpenAI62.4126 tok/s$4.81126
10Gemini 3 FlashthinkingGoogle61.5200 tok/s$1.13200
11Gemini 3.6 FlashGoogle60.7190 tok/s$1.50190
12Grok 4.3mediumxAI60.7113 tok/s$1.56113
13GPT-5.5 InstantOpenAI60.4135 tok/s$11.25135
14o3OpenAI60.3139 tok/s$3.50139
15GPT-5.1OpenAI59.4105 tok/s$3.44105
16DeepSeek V4 FlashhighDeepSeekopen ↗59.3118 tok/s$0.168118
17GPT-5.6 LunaxhighOpenAI59.3106 tok/s$0.450106
18Qwen3 7maxAlibaba58.9199 tok/s$3.75199
19Nemotron 3 Ultra 550B A55BNVIDIAopen ↗58.3156 tok/s$1.00156
20Grok 4.20xAI57.9104 tok/s$1.56104
21Deepseek v4 Flash VisionDeepSeek57.4119 tok/s$0.175119
22MiniMax-M3MiniMaxopen ↗56.9100 tok/s$0.525100
23Qwen3.5 122B-A10BAlibabaopen ↗56129 tok/s$1.10129
24GPT-5 miniOpenAI55.8103 tok/s$0.688103
25Muse Glimmer (high)Metaopen55.1104 tok/s$0.638104