Benchmarks
Leaderboard
Jedes aktive Textmodell, das wir erreichen können — mit der Antwortzeit und der Trefferquote im direkten Vergleich. Nichts wird versteckt: Ein ungemessenes Modell bekommt trotzdem eine Zeile, und die Zeile sagt, warum.
- Normalfall
- Wie lange eine normale Antwort dauert. Die Hälfte der Aufrufe kam schneller zurück, die Hälfte langsamer — das ist also, was bei einer gewöhnlichen Anfrage zu erwarten ist.
- Langsamfall
- Wie schlimm es an einem schlechten Tag wird. Etwa jeder zwanzigste Aufruf ist langsamer als das. Ein Modell mit niedrigem Normalfall, aber hohem Langsamfall ist schnell — bis es das nicht mehr ist.
- Siegquote
- Von 100 direkten Vergleichen gegen ein durchschnittliches Modell dieser Tabelle: wie viele dieses Modell gewinnt. 50 ist Durchschnitt, höher ist besser. Errechnet aus jedem bewerteten Vergleich, nicht aus einer Einzelnote.
104 von 109 Modellen vollständig gemessen · 0 einmal gestoppt · 0 warten auf den ersten Lauf · 5 können wir nicht messen.
| # | |||||||
|---|---|---|---|---|---|---|---|
| 1 | Mistral-Nemo-Instruct-2407C | OVH AI Endpoints (GRA) | C | 90 ms | 286 ms | 35% | 2026-09-04 |
| 2 | Mistral-Small-3.2-24B-Instruct-2506B | OVH AI Endpoints (GRA) | B | 115 ms | 337 ms | 54% | 2026-09-04 |
| 3 | Meta-Llama-3_3-70B-InstructB | OVH AI Endpoints (GRA) | B | 121 ms | 136 ms | 57% | 2026-09-04 |
| 4 | Mistral-7B-Instruct-v0.3C | OVH AI Endpoints (GRA) | C | 122 ms | 262 ms | 27% | 2026-09-04 |
| 5 | Qwen2.5-VL-72B-InstructB | OVH AI Endpoints (GRA) | B | 138 ms | 143 ms | 54% | 2026-09-04 |
| 6 | NVIDIA Nemotron Super 49B v1.5A | OpenRouter | A | 173 ms | 199 ms | nicht verglichen | 2026-07-17 |
| 7 | Nous Hermes 3 70BA | OpenRouter | A | 193 ms | 446 ms | nicht verglichen | 2026-09-04 |
| 8 | Llama 3.3 70B InstructA | OpenRouter | A | 219 ms | 263 ms | nicht verglichen | 2026-09-04 |
| 9 | Cohere Command-AA | OpenRouter | A | 242 ms | 603 ms | nicht verglichen | 2026-09-04 |
| 10 | gpt-oss-20bC | OVH AI Endpoints (GRA) | C | 248 ms | 279 ms | 38% | 2026-09-04 |
| 11 | gpt-oss-120bC | OVH AI Endpoints (GRA) | C | 254 ms | 613 ms | 62% | 2026-09-04 |
| 12 | Qwen3.5-397B-A17BA | OVH AI Endpoints (GRA) | A | 254 ms | 1.4 s | 25% | 2026-09-04 |
| 13 | Gemini 2.5 Flash-LiteB | Google Gemini | B | 371 ms | 397 ms | 50% | 2026-09-04 |
| 14 | Gemini 2.5 FlashA | Google Gemini | A | 415 ms | 527 ms | 15% | 2026-09-04 |
| 15 | Qwen 2.5 VL 72B InstructA | OpenRouter | A | 418 ms | 572 ms | nicht verglichen | 2026-09-04 |
| 16 | Llama 4 ScoutA | OpenRouter | A | 452 ms | 569 ms | nicht verglichen | 2026-09-04 |
| 17 | Qwen3-32BB | OVH AI Endpoints (GRA) | B | 465 ms | 465 ms | 25% | 2026-09-04 |
| 18 | gpt-4.1B | OpenAI | B | 468 ms | 727 ms | 69% | 2026-09-04 |
| 19 | Gemini Flash-Lite LatestC | Google Gemini | C | 469 ms | 723 ms | 65% | 2026-09-04 |
| 20 | gpt-4o-mini-2024-07-18C | OpenAI | C | 489 ms | 583 ms | 59% | 2026-09-04 |
| 21 | gpt-4.1-miniC | OpenAI | C | 493 ms | 745 ms | 71% | 2026-09-04 |
| 22 | gpt-4o-2024-05-13C | OpenAI | C | 493 ms | 622 ms | 67% | 2026-09-04 |
| 23 | Qwen3.5-9BB | OVH AI Endpoints (GRA) | B | 502 ms | 507 ms | 20% | 2026-09-04 |
| 24 | gpt-4.1-nano-2025-04-14C | OpenAI | C | 506 ms | 963 ms | 61% | 2026-09-04 |
| 25 | Qwen3-Coder-30B-A3B-InstructB | OVH AI Endpoints (GRA) | B | 506 ms | 753 ms | 54% | 2026-09-04 |
| 26 | gpt-4C | OpenAI | C | 509 ms | 804 ms | 48% | 2026-09-04 |
| 27 | gpt-4.1-nanoC | OpenAI | C | 509 ms | 704 ms | 61% | 2026-09-04 |
| 28 | gpt-4.1-2025-04-14C | OpenAI | C | 515 ms | 521 ms | 71% | 2026-09-04 |
| 29 | gpt-4o-miniC | OpenAI | C | 522 ms | 536 ms | 62% | 2026-09-04 |
| 30 | gpt-4o-2024-11-20C | OpenAI | C | 524 ms | 622 ms | 62% | 2026-09-04 |
| 31 | gpt-5.1B | OpenAI | B | 535 ms | 559 ms | 74% | 2026-09-04 |
| 32 | Gemini 3.1 Flash LiteB | Google Gemini | B | 540 ms | 967 ms | 59% | 2026-09-04 |
| 33 | gpt-4.1-mini-2025-04-14C | OpenAI | C | 545 ms | 581 ms | 68% | 2026-09-04 |
| 34 | o3-mini-2025-01-31C | OpenAI | C | 550 ms | 1.2 s | 58% | 2026-09-04 |
| 35 | gpt-5.4-nano-2026-03-17A | OpenAI | A | 555 ms | 641 ms | 61% | 2026-09-04 |
| 36 | Qwen 3.7 MaxA | OpenRouter | A | 565 ms | 601 ms | nicht verglichen | 2026-09-04 |
| 37 | gpt-5-mini-2025-08-07B | OpenAI | B | 572 ms | 602 ms | 42% | 2026-09-04 |
| 38 | gpt-4o-2024-08-06C | OpenAI | C | 575 ms | 584 ms | 61% | 2026-09-04 |
| 39 | gpt-4oC | OpenAI | C | 585 ms | 695 ms | 66% | 2026-09-04 |
| 40 | o3-miniC | OpenAI | C | 599 ms | 745 ms | 51% | 2026-09-04 |
| 41 | gpt-3.5-turbo-1106C | OpenAI | C | 611 ms | 673 ms | 45% | 2026-09-04 |
| 42 | gpt-5-nanoC | OpenAI | C | 612 ms | 617 ms | 24% | 2026-09-04 |
| 43 | o4-mini-2025-04-16B | OpenAI | B | 616 ms | 693 ms | 59% | 2026-09-04 |
| 44 | gpt-5.4-miniA | OpenAI | A | 621 ms | 716 ms | 70% | 2026-09-04 |
| 45 | gpt-5.2-2025-12-11B | OpenAI | B | 626 ms | 886 ms | 68% | 2026-09-04 |
| 46 | gpt-5-nano-2025-08-07B | OpenAI | B | 635 ms | 979 ms | 26% | 2026-09-04 |
| 47 | Qwen 3.6 PlusA | OpenRouter | A | 637 ms | 649 ms | nicht verglichen | 2026-09-04 |
| 48 | gpt-5.4-nanoC | OpenAI | C | 641 ms | 956 ms | 52% | 2026-09-04 |
| 49 | gpt-5.1-2025-11-13B | OpenAI | B | 643 ms | 750 ms | 68% | 2026-09-04 |
| 50 | o4-miniC | OpenAI | C | 646 ms | 699 ms | 58% | 2026-09-04 |
| 51 | Claude Haiku 4.5A | Anthropic | A | 672 ms | 750 ms | 54% | 2026-09-04 |
| 52 | gpt-5-miniC | OpenAI | C | 682 ms | 686 ms | 46% | 2026-09-04 |
| 53 | gpt-5-2025-08-07B | OpenAI | B | 687 ms | 751 ms | 34% | 2026-09-04 |
| 54 | o3-2025-04-16B | OpenAI | B | 689 ms | 989 ms | 57% | 2026-09-04 |
| 55 | gpt-4-0613C | OpenAI | C | 692 ms | 724 ms | 48% | 2026-09-04 |
| 56 | gpt-3.5-turbo-0125C | OpenAI | C | 694 ms | 2.2 s | 45% | 2026-09-04 |
| 57 | gpt-5.4A | OpenAI | A | 701 ms | 792 ms | 67% | 2026-09-04 |
| 58 | gpt-3.5-turboC | OpenAI | C | 709 ms | 1.0 s | 42% | 2026-09-04 |
| 59 | gpt-5.4-mini-2026-03-17A | OpenAI | A | 711 ms | 853 ms | 65% | 2026-09-04 |
| 60 | gpt-5C | OpenAI | C | 724 ms | 1.0 s | 36% | 2026-09-04 |
| 61 | o1C | OpenAI | C | 734 ms | 773 ms | 61% | 2026-09-04 |
| 62 | gpt-3.5-turbo-16kC | OpenAI | C | 757 ms | 913 ms | 41% | 2026-09-04 |
| 63 | o3C | OpenAI | C | 770 ms | 897 ms | 57% | 2026-09-04 |
| 64 | MiniMax M2.5A | OpenRouter | A | 773 ms | 896 ms | nicht verglichen | 2026-09-04 |
| 65 | o1-2024-12-17C | OpenAI | C | 776 ms | 816 ms | 59% | 2026-09-04 |
| 66 | gpt-5.4-2026-03-05B | OpenAI | B | 800 ms | 924 ms | 69% | 2026-09-04 |
| 67 | Claude Opus 4.5B | Anthropic | B | 820 ms | 840 ms | 67% | 2026-09-04 |
| 68 | Gemini 3.5 FlashA | Google Gemini | A | 831 ms | 928 ms | 26% | 2026-09-04 |
| 69 | Gemini Flash LatestB | Google Gemini | B | 848 ms | 3.8 s | 34% | 2026-09-04 |
| 70 | gpt-4-turboC | OpenAI | C | 883 ms | 1.7 s | 60% | 2026-09-04 |
| 71 | gpt-5.2B | OpenAI | B | 894 ms | 1.0 s | 70% | 2026-09-04 |
| 72 | Qwen3.7 MaxA | Alibaba Cloud Qwen (DashScope Intl) | A | 906 ms | 1.5 s | nicht verglichen | 2026-09-04 |
| 73 | gpt-5.5C | OpenAI | C | 959 ms | 1.1 s | 69% | 2026-09-04 |
| 74 | Gemini 3 Flash PreviewC | Google Gemini | C | 1.0 s | 1.1 s | 41% | 2026-09-04 |
| 75 | Claude Sonnet 4.5B | Anthropic | B | 1.1 s | 1.2 s | 63% | 2026-09-04 |
| 76 | Claude Opus 4.8A | Anthropic | A | 1.1 s | 1.1 s | 60% | 2026-09-04 |
| 77 | Claude Opus 4.7B | Anthropic | B | 1.1 s | 1.3 s | 65% | 2026-09-04 |
| 78 | gpt-5.5-2026-04-23A | OpenAI | A | 1.1 s | 2.0 s | 72% | 2026-09-04 |
| 79 | Llama 4 MaverickA | OpenRouter | A | 1.1 s | 1.5 s | nicht verglichen | 2026-09-04 |
| 80 | Claude Sonnet 5A | Anthropic | A | 1.2 s | 1.3 s | 64% | 2026-09-04 |
| 81 | Qwen3.7 PlusB | Alibaba Cloud Qwen (DashScope Intl) | B | 1.2 s | 1.2 s | nicht verglichen | 2026-09-04 |
| 82 | Claude Sonnet 4.6A | Anthropic | A | 1.3 s | 1.5 s | 62% | 2026-09-04 |
| 83 | Gemini 3.1 Pro Preview Custom ToolsC | Google Gemini | C | 1.3 s | 1.8 s | 22% | 2026-05-31 |
| 84 | DeepSeek v3.2A | OpenRouter | A | 1.4 s | 1.4 s | nicht verglichen | 2026-09-04 |
| 85 | gpt-4-turbo-2024-04-09C | OpenAI | C | 1.4 s | 1.6 s | 62% | 2026-09-04 |
| 86 | gpt-5-search-apiC | OpenAI | C | 1.4 s | 3.1 s | 64% | 2026-09-04 |
| 87 | Claude Opus 5A | Anthropic | A | 1.4 s | 1.6 s | 49% | 2026-09-04 |
| 88 | gpt-5-search-api-2025-10-14B | OpenAI | B | 1.5 s | 2.0 s | 66% | 2026-09-04 |
| 89 | Gemini 2.5 ProA | Google Gemini | A | 1.5 s | 1.5 s | 17% | 2026-09-04 |
| 90 | DeepSeek v4 ProA | OpenRouter | A | 1.6 s | 2.9 s | nicht verglichen | 2026-09-04 |
| 91 | GLM-4.5V (vision)A | Z.ai (GLM / Zhipu) | A | 1.6 s | 3.1 s | 32% | 2026-09-04 |
| 92 | Gemini Pro LatestC | Google Gemini | C | 1.9 s | 1.9 s | 21% | 2026-09-04 |
| 93 | Claude Opus 4.6B | Anthropic | B | 2.0 s | 2.2 s | 70% | 2026-09-04 |
| 94 | Gemini 3.1 Pro PreviewC | Google Gemini | C | 2.0 s | 2.0 s | 22% | 2026-09-04 |
| 95 | GLM-4.5 AirB | Z.ai (GLM / Zhipu) | B | 2.0 s | 2.5 s | 39% | 2026-09-04 |
| 96 | GLM-5A | Z.ai (GLM / Zhipu) | A | 2.1 s | 2.3 s | 64% | 2026-09-04 |
| 97 | GLM-5.2A | Z.ai (GLM / Zhipu) | A | 2.3 s | 2.7 s | 39% | 2026-09-04 |
| 98 | GLM-4.6V (vision)A | Z.ai (GLM / Zhipu) | A | 2.7 s | 2.9 s | 25% | 2026-09-04 |
| 99 | GLM-4.7A | Z.ai (GLM / Zhipu) | A | 3.3 s | 26.8 s | 74% | 2026-09-04 |
| 100 | GLM-4.5A | Z.ai (GLM / Zhipu) | A | 3.3 s | 3.5 s | 65% | 2026-09-04 |
| 101 | Claude Fable 5A | Anthropic | A | 3.4 s | 3.6 s | 61% | 2026-09-04 |
| 102 | GLM-5.1A | Z.ai (GLM / Zhipu) | A | 4.8 s | 6.1 s | 39% | 2026-09-04 |
| 103 | GLM-5 TurboB | Z.ai (GLM / Zhipu) | B | 6.2 s | 6.6 s | 40% | 2026-09-04 |
| 104 | GLM-4.6A | Z.ai (GLM / Zhipu) | A | 9.9 s | 11.1 s | 26% | 2026-09-04 |
| · | Deep Research Max Preview (Apr-21-2026)B | Google Gemini | B | Nicht messbar — antwortet über eine andere API | nicht gemessen | nicht verglichen | — |
| · | Deep Research Preview (Apr-21-2026)B | Google Gemini | B | Nicht messbar — antwortet über eine andere API | nicht gemessen | nicht verglichen | — |
| · | Deep Research Pro Preview (Dec-12-2025)B | Google Gemini | B | Nicht messbar — antwortet über eine andere API | nicht gemessen | nicht verglichen | — |
| · | Gemini 2.5 Computer Use Preview 10-2025B | Google Gemini | B | Nicht messbar — antwortet über eine andere API | nicht gemessen | nicht verglichen | — |
| · | gpt-5.6-terra | Azure OpenAI (EU - Sweden) | keine Stufe | Nicht messbar — keine Messung für diesen Anbieter | nicht gemessen | nicht verglichen | — |
109 von 109 Modellen · Spalte anklicken zum Sortieren
„Nicht messbar“ heißt: Das Modell antwortet nicht über die Chat-API, die wir stoppen, oder sein Anbieter nutzt ein Protokoll, das unsere Messung noch nicht spricht. Warten hilft hier nicht.