Live-Test
Modelle direkt testen
Senden Sie einen Prompt an ein beliebiges Modell und sehen Sie die Antwort in Echtzeit streamen. Vergleichen Sie zwei Modelle nebeneinander nach Geschwindigkeit und Qualität.
Interaktiver Modell-Tester
Der Tester läuft im Browser und benötigt JavaScript. Wählen Sie ein Modell aus dem Live-Katalog, senden Sie einen Prompt und sehen Sie die Antwort Token für Token streamen — mit live gemessener Latenz und Token-Zahlen.
- Single — Ein Modell, ein Prompt, eine gestreamte Antwort mit Timing-Statistiken.
- Compare — Zwei Modelle beantworten denselben Prompt nebeneinander und streamen gleichzeitig — Unterschiede in Tempo und Stil sind direkt sichtbar.
- Consensus — Mehrere Modelle antworten parallel, ein Judge-Modell fasst eine Konsensantwort zusammen — derselbe Mechanismus wie hinter unserer Consensus-API.
So funktioniert der Live-Test
Modell wählen
Wählen Sie aus den unten gelisteten Modellen, gruppiert nach Anbieter. Die Liste ist der Live-Katalog — sie ändert sich, wenn Modelle hinzukommen oder ausgemustert werden.
Prompt senden
Tippen Sie einen eigenen Prompt oder starten Sie mit einer von der Community vorgeschlagenen Testfrage. Die Anfrage geht über unser API-Gateway an den Anbieter — derselbe Pfad wie bei unserer bezahlten API.
Streaming beobachten
Tokens erscheinen, sobald sie eintreffen, mit Live-Latenz und Token-Zahlen — Sie sehen, wie ein Modell antwortet, nicht nur eine einzelne Endzahl.
Drei Testmodi
Single
Ein Modell, ein Prompt, eine gestreamte Antwort mit Timing-Statistiken.
Compare
Zwei Modelle beantworten denselben Prompt nebeneinander und streamen gleichzeitig — Unterschiede in Tempo und Stil sind direkt sichtbar.
Consensus
Mehrere Modelle antworten parallel, ein Judge-Modell fasst eine Konsensantwort zusammen — derselbe Mechanismus wie hinter unserer Consensus-API.
Modellabdeckung
30 Modelle von 5 Anbietern sind derzeit für Live-Tests freigeschaltet:
- Google Gemini: Gemini 3.5 Flash, Gemini 2.5 Flash, Gemini Flash Latest, Gemini 2.5 Pro
- OpenAI: o3-mini-2025-01-31, gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14, gpt-4o, o4-mini-2025-04-16, gpt-4o-mini, gpt-4.1-nano-2025-04-14, gpt-4o-mini-2024-07-18
- OVH AI Endpoints (GRA): gpt-oss-120b, gpt-oss-20b
- OpenRouter: Cohere Command-A, Nous Hermes 3 70B, Llama 4 Scout, MiniMax M2.5, DeepSeek v3.2, Qwen 2.5 VL 72B Instruct, DeepSeek v4 Pro, Mistral Voxtral Small 24B, Qwen 3.6 Plus, NVIDIA Nemotron Super 49B v1.5, Llama 4 Maverick, Llama 3.3 70B Instruct, Qwen 3.7 Max
- Anthropic: Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Haiku 4.5
Bedingungen der Gratis-Demo
Der Live-Test ist kostenlos und erfordert keine Anmeldung. Gäste erhalten eine begrenzte Zahl an Läufen pro Tag; ein kostenloses Konto erhöht dieses Tageskontingent. Limits setzen sich alle 24 Stunden zurück und halten die Demo für alle verfügbar.
Woher die Zahlen kommen
- Benchmark-Methodik — Wie wir Modelle wöchentlich testen — Scoring, Judges und Datensätze.
- Consensus-API — Der Multi-Modell-Konsensmodus als Produktions-API.
- Leaderboard — Aktuelle Geschwindigkeits- und Qualitätsranglisten aus denselben Testläufen.