Skip to content

Benchmarks

Leaderboard

All active models ranked by P50 latency — the median response time for a standard 500-token output, measured from EU (Amsterdam). Green < 500 ms, yellow 500–1000 ms, red > 1000 ms.

Filter:
#
1FLUX.1 Kontext [pro] — Multi-Image FusionB0
2FLUX.1 Kontext [max] — Multi-Image FusionA0
3NVIDIA Nemotron Super 49B v1.5A32
4Qwen3-Coder-30B-A3B-InstructB89
5SDXL 1.0C101
6Mistral-Nemo-Instruct-2407C108
7Mistral-Small-3.2-24B-Instruct-2506B129
8Meta-Llama-3_3-70B-InstructB135
9Qwen2.5-VL-72B-InstructB149
10Mistral-7B-Instruct-v0.3C173
11Llama 4 ScoutA191
12Nous Hermes 3 70BA200
13Mistral Voxtral Small 24BA210
14gpt-oss-20bC236
15MiniMax M2.5A284
16Qwen 2.5 VL 72B InstructA285
17gpt-oss-120bC294
18FLUX.1 SchnellB403
19Gemini 2.5 FlashA418
20Gemini 2.5 Flash-LiteB428
21gpt-4.1-nanoC435
22gpt-5.4-miniA483
23Qwen3.5-9BB491
24gpt-4.1B493
25gpt-4o-miniC502
26Qwen3-32BB509
27Qwen3.5-397B-A17BA516
28DeepSeek v4 ProA552
29o3-miniC553
30Llama 3.3 70B InstructA559
31gpt-4.1-miniC561
32o4-miniC563
33gpt-4oC618
34o3C618
35gpt-5.4A627
36gpt-5.4-nanoC656
37Qwen 3.6 PlusA690
38Qwen 3.7 MaxA708
39gpt-4.1-nano-2025-04-14C721
40gpt-5.1B735
41gpt-5.2-chat-latestC750
42gpt-5C760
43Gemini 3.1 Flash LiteB812
44gpt-5.3-chat-latestC813
45gpt-5.2B822
46gpt-5-miniC832
47Cohere Command-AA845
48Llama 4 MaverickA899
49DeepSeek v3.2A922
50Claude Haiku 4.5A938
51gpt-5-nanoC987
52gpt-4o-2024-11-20C1003
53Gemini Flash-Lite LatestC1008
54gpt-5.4-mini-2026-03-17A1046
55gpt-5.5C1050
56gpt-3.5-turboC1078
57Claude Opus 4.8A1094
58gpt-4o-mini-2024-07-18C1097
59Gemini 2.5 ProA1195
60gpt-4o-2024-08-06C1232
61gpt-3.5-turbo-1106C1249
62gpt-4o-mini-search-previewC1276
63gpt-5.1-2025-11-13B1317
64Claude Opus 5A1319
65Claude Sonnet 4.6A1331
66gpt-5.4-2026-03-05B1375
67Qwen3.7 PlusB1406
68o3-2025-04-16B1425
69gpt-4.1-2025-04-14C1445
70gpt-5.4-nano-2026-03-17A1461
71Claude Opus 4.7B1466
72gpt-3.5-turbo-0125C1486
73gpt-5.2-2025-12-11B1507
74gpt-4-0613C1524
75Claude Sonnet 4.5B1547
76gpt-5-search-api-2025-10-14B1551
77GLM-4.5V (vision)A1580
78Claude Opus 4.1C1682
79gpt-4o-2024-05-13C1695
80gpt-3.5-turbo-16kC1697
81gpt-5.5-2026-04-23A1728
82o3-mini-2025-01-31C1738
83Claude Opus 4.6B1739
84GLM-4.6V (vision)A1863
85GLM-5A1952
86gpt-4o-search-previewC2032
87o4-mini-2025-04-16B2161
88gpt-4.1-mini-2025-04-14C2219
89GLM-5 TurboB2239
90gpt-5-mini-2025-08-07B2427
91o1C2530
92Qwen3.7 MaxA2657
93Nano BananaB2873
94o1-2024-12-17C2940
95Gemini 3 Flash PreviewC2946
96gpt-5-nano-2025-08-07B2962
97Gemini 3.5 FlashA2990
98gpt-4C3002
99GLM-5.1A3299
100Gemini Flash LatestB3571
101gpt-5-search-apiC3713
102Claude Fable 5A4094
103Gemini Robotics-ER 1.6 PreviewB4190
104Nano Banana 2B4330
105Gemini Pro LatestC4359
106GLM-5.2A4708
107gpt-5-2025-08-07B4774
108gpt-4-turboC4835
109Gemini 3.1 Pro PreviewC4955
110GLM-4.5 AirB5458
111GLM-4.7A5931
112gpt-4-turbo-2024-04-09C6778
113Gemini 3.1 Pro Preview Custom ToolsC7298
114CogView-4B8088
115Claude Opus 4.5B8737
116Nano Banana ProA11201
117GLM-4.5A11576
118GLM-4.6A12254
119GLM ImageB30000

119 of 119 models · click column headers to sort

Fast (< 500 ms)
Medium (500–1000 ms)
Slow (> 1000 ms)
Updated every 6 hours · P50 = median latency · P95 = tail latency