Naar inhoud

Benchmarks

Language performance

How well does each AI model perform when prompted in different languages? Within each language, models are ranked by head-to-head comparison on the same native prompts — 1000 is the average of the models measured in that language.

Tests run weekly · Models with image/audio/TTS capabilities excluded

🇬🇧

English

prompts: 2 · 430 gescoorde runs · English

🇳🇱

Nederlands

prompts: 2 · 253 gescoorde runs · Dutch

🇩🇪

Deutsch

prompts: 1 · 169 gescoorde runs · German

Tot nu toe slechts 1 prompt in deze taal — dit toont het verzamelde bewijs, geen rangschikking. Er zijn meer prompts nodig voordat de volgorde iets betekent.

🇫🇷

Français

prompts: 1 · 365 gescoorde runs · French

Tot nu toe slechts 1 prompt in deze taal — dit toont het verzamelde bewijs, geen rangschikking. Er zijn meer prompts nodig voordat de volgorde iets betekent.

🇪🇸

Español

prompts: 1 · 363 gescoorde runs · Spanish

Tot nu toe slechts 1 prompt in deze taal — dit toont het verzamelde bewijs, geen rangschikking. Er zijn meer prompts nodig voordat de volgorde iets betekent.

🇹🇷

Türkçe

prompts: 1 · 120 gescoorde runs · Turkish

Tot nu toe slechts 1 prompt in deze taal — dit toont het verzamelde bewijs, geen rangschikking. Er zijn meer prompts nodig voordat de volgorde iets betekent.