Zum Inhalt

Benchmarks

Language performance

How well does each AI model perform when prompted in different languages? Within each language, models are ranked by head-to-head comparison on the same native prompts — 1000 is the average of the models measured in that language.

Tests run weekly · Models with image/audio/TTS capabilities excluded

🇬🇧

English

Prompts: 2 · 430 gewertete Läufe · English

🇳🇱

Nederlands

Prompts: 2 · 253 gewertete Läufe · Dutch

🇩🇪

Deutsch

Prompts: 1 · 169 gewertete Läufe · German

Bisher nur 1 Prompt in dieser Sprache — dies zeigt die gesammelte Datenlage, keine Rangliste. Für eine aussagekräftige Reihenfolge braucht es mehr Prompts.

🇫🇷

Français

Prompts: 1 · 365 gewertete Läufe · French

Bisher nur 1 Prompt in dieser Sprache — dies zeigt die gesammelte Datenlage, keine Rangliste. Für eine aussagekräftige Reihenfolge braucht es mehr Prompts.

🇪🇸

Español

Prompts: 1 · 363 gewertete Läufe · Spanish

Bisher nur 1 Prompt in dieser Sprache — dies zeigt die gesammelte Datenlage, keine Rangliste. Für eine aussagekräftige Reihenfolge braucht es mehr Prompts.

🇹🇷

Türkçe

Prompts: 1 · 120 gewertete Läufe · Turkish

Bisher nur 1 Prompt in dieser Sprache — dies zeigt die gesammelte Datenlage, keine Rangliste. Für eine aussagekräftige Reihenfolge braucht es mehr Prompts.