İçeriğe geç

Benchmarks

Language performance

How well does each AI model perform when prompted in different languages? Within each language, models are ranked by head-to-head comparison on the same native prompts — 1000 is the average of the models measured in that language.

Tests run weekly · Models with image/audio/TTS capabilities excluded

🇬🇧

English

prompt: 2 · 430 puanlanan çalıştırma · English

🇳🇱

Nederlands

prompt: 2 · 253 puanlanan çalıştırma · Dutch

🇩🇪

Deutsch

prompt: 1 · 169 puanlanan çalıştırma · German

Bu dilde şimdilik yalnızca 1 prompt var — bu, toplanan kanıtı gösterir, bir sıralamayı değil. Sıralamanın anlam taşıması için daha fazla prompt gerekiyor.

🇫🇷

Français

prompt: 1 · 365 puanlanan çalıştırma · French

Bu dilde şimdilik yalnızca 1 prompt var — bu, toplanan kanıtı gösterir, bir sıralamayı değil. Sıralamanın anlam taşıması için daha fazla prompt gerekiyor.

🇪🇸

Español

prompt: 1 · 363 puanlanan çalıştırma · Spanish

Bu dilde şimdilik yalnızca 1 prompt var — bu, toplanan kanıtı gösterir, bir sıralamayı değil. Sıralamanın anlam taşıması için daha fazla prompt gerekiyor.

🇹🇷

Türkçe

prompt: 1 · 120 puanlanan çalıştırma · Turkish

Bu dilde şimdilik yalnızca 1 prompt var — bu, toplanan kanıtı gösterir, bir sıralamayı değil. Sıralamanın anlam taşıması için daha fazla prompt gerekiyor.