Aller au contenu

Benchmarks

Test d'intelligence

Les modèles sont classés par comparaison deux à deux, non par une note absolue. Sur chaque prompt, chaque paire de modèles est comparée en duel, et un modèle de Bradley-Terry en déduit une cote. Le taux de victoire ci-dessous traduit cette cote en la question à laquelle elle répond : à quelle fréquence ce modèle bat un modèle moyen de ce tableau. 50 % est la moyenne.

Comment la note est calculée

8 603

exécutions notées

117 970

comparaisons deux à deux

24

prompts

4 699

exécutions sans note (erreur du fournisseur)

22 des 24 prompts distinguent réellement les modèles. Les autres reçoivent la même qualité de réponse de presque tout le monde et n’apportent aucun signal de classement — c’est ce qu’un score absolu proche de 100 mesurait en réalité.

  • Code 4/4
  • Créatif 2/2
  • Factuel 3/4
  • Multilingue 7/8
  • Raisonnement 4/4
  • Santé 2/2
Rang 1OpenAI
73%±2

Taux de victoire

Elo 1175

Gagné / perdu / à égalité
1296 / 172 / 1402
prompts
24
comparaisons
2870
Moyenne du juge
96.0

Par catégorie

Code80%
Créatif91%
Factuel74%
Multilingue60%
Raisonnement77%
Santé75%
Rang 1OpenAI
73%±2

Taux de victoire

Elo 1172

gpt-5.1
Tier B
Gagné / perdu / à égalité
1125 / 101 / 1443
prompts
20
comparaisons
2669
Moyenne du juge
95.0

Par catégorie

Code76%
Créatif79%
Factuel71%
Multilingue70%
Raisonnement78%
Rang 1OpenAI
73%±2

Taux de victoire

Elo 1171

Gagné / perdu / à égalité
1149 / 132 / 1388
prompts
20
comparaisons
2669
Moyenne du juge
95.9

Par catégorie

Code78%
Créatif89%
Factuel76%
Multilingue67%
Raisonnement66%
Rang 1OpenAI
70%±2

Taux de victoire

Elo 1149

gpt-5.5
Tier C
Gagné / perdu / à égalité
1074 / 193 / 1402
prompts
20
comparaisons
2669
Moyenne du juge
93.9

Par catégorie

Code70%
Créatif82%
Factuel72%
Multilingue66%
Raisonnement74%
Rang 1OpenAI
70%±2

Taux de victoire

Elo 1149

Gagné / perdu / à égalité
1142 / 193 / 1535
prompts
24
comparaisons
2870
Moyenne du juge
96.0

Par catégorie

Code72%
Créatif92%
Factuel72%
Multilingue65%
Raisonnement66%
Santé84%
Rang 2OpenAI
70%±2

Taux de victoire

Elo 1144

Gagné / perdu / à égalité
1062 / 216 / 1391
prompts
20
comparaisons
2669
Moyenne du juge
93.9

Par catégorie

Code75%
Créatif78%
Factuel57%
Multilingue69%
Raisonnement78%
Rang 3OpenAI
69%±2

Taux de victoire

Elo 1142

gpt-5.4
Tier A
Gagné / perdu / à égalité
1047 / 214 / 1408
prompts
20
comparaisons
2669
Moyenne du juge
94.8

Par catégorie

Code68%
Créatif90%
Factuel63%
Multilingue68%
Raisonnement74%
Rang 4OpenAI
69%±2

Taux de victoire

Elo 1141

gpt-5.2
Tier B
Gagné / perdu / à égalité
1062 / 235 / 1372
prompts
20
comparaisons
2669
Moyenne du juge
94.2

Par catégorie

Code66%
Créatif92%
Factuel67%
Multilingue66%
Raisonnement74%
Rang 4OpenAI
69%±2

Taux de victoire

Elo 1139

gpt-4.1
Tier B
Gagné / perdu / à égalité
1128 / 249 / 1493
prompts
24
comparaisons
2870
Moyenne du juge
95.7

Par catégorie

Code74%
Créatif83%
Factuel69%
Multilingue64%
Raisonnement66%
Santé79%
Rang 4OpenAI
69%±2

Taux de victoire

Elo 1139

Gagné / perdu / à égalité
1099 / 220 / 1551
prompts
24
comparaisons
2870
Moyenne du juge
95.1

Par catégorie

Code69%
Créatif82%
Factuel67%
Multilingue68%
Raisonnement73%
Santé70%
Rang 4Anthropic
69%±2

Taux de victoire

Elo 1135

Gagné / perdu / à égalité
1162 / 309 / 1399
prompts
24
comparaisons
2870
Moyenne du juge
97.0

Par catégorie

Code63%
Créatif93%
Factuel73%
Multilingue64%
Raisonnement67%
Santé90%
Rang 4OpenAI
68%±2

Taux de victoire

Elo 1133

Gagné / perdu / à égalité
1067 / 292 / 1310
prompts
20
comparaisons
2669
Moyenne du juge
94.1

Par catégorie

Code71%
Créatif92%
Factuel61%
Multilingue63%
Raisonnement71%
Rang 4Z.ai (GLM / Zhipu)
68%±2

Taux de victoire

Elo 1132

GLM-4.7
Tier A
Gagné / perdu / à égalité
838 / 259 / 882
prompts
14
comparaisons
1979
Moyenne du juge
91.1

Par catégorie

Code61%
Créatif85%
Factuel70%
Raisonnement74%
Rang 4OpenAI
68%±2

Taux de victoire

Elo 1129

Gagné / perdu / à égalité
1035 / 289 / 1345
prompts
20
comparaisons
2669
Moyenne du juge
94.6

Par catégorie

Code74%
Créatif89%
Factuel55%
Multilingue64%
Raisonnement74%
Rang 4OpenAI
67%±2

Taux de victoire

Elo 1127

Gagné / perdu / à égalité
987 / 252 / 1430
prompts
20
comparaisons
2669
Moyenne du juge
94.0

Par catégorie

Code75%
Créatif73%
Factuel59%
Multilingue64%
Raisonnement74%
Rang 6OpenAI
66%±2

Taux de victoire

Elo 1117

Gagné / perdu / à égalité
981 / 315 / 1373
prompts
20
comparaisons
2669
Moyenne du juge
93.0

Par catégorie

Code65%
Créatif89%
Factuel59%
Multilingue63%
Raisonnement74%
Rang 6Z.ai (GLM / Zhipu)
66%±2

Taux de victoire

Elo 1115

GLM-4.5
Tier A
Gagné / perdu / à égalité
843 / 337 / 862
prompts
14
comparaisons
2042
Moyenne du juge
90.0

Par catégorie

Code71%
Créatif85%
Factuel66%
Raisonnement55%
Rang 12OpenAI
65%±2

Taux de victoire

Elo 1106

gpt-4o
Tier C
Gagné / perdu / à égalité
1034 / 390 / 1446
prompts
24
comparaisons
2870
Moyenne du juge
94.8

Par catégorie

Code58%
Créatif73%
Factuel68%
Multilingue64%
Raisonnement73%
Santé67%
Rang 14OpenAI
64%±2

Taux de victoire

Elo 1101

Gagné / perdu / à égalité
1026 / 421 / 1423
prompts
24
comparaisons
2870
Moyenne du juge
94.5

Par catégorie

Code66%
Créatif86%
Factuel61%
Multilingue53%
Raisonnement70%
Santé87%
Rang 14OpenAI
64%±2

Taux de victoire

Elo 1101

Gagné / perdu / à égalité
1060 / 455 / 1355
prompts
24
comparaisons
2870
Moyenne du juge
94.0

Par catégorie

Code62%
Créatif82%
Factuel62%
Multilingue52%
Raisonnement77%
Santé89%
Rang 14OpenAI
64%±2

Taux de victoire

Elo 1101

Gagné / perdu / à égalité
1004 / 401 / 1465
prompts
24
comparaisons
2870
Moyenne du juge
95.2

Par catégorie

Code62%
Créatif82%
Factuel62%
Multilingue64%
Raisonnement66%
Santé75%
Rang 15Anthropic
64%±2

Taux de victoire

Elo 1100

Gagné / perdu / à égalité
1038 / 437 / 1395
prompts
24
comparaisons
2870
Moyenne du juge
95.1

Par catégorie

Code51%
Créatif60%
Factuel79%
Multilingue60%
Raisonnement73%
Santé81%
Rang 16Google Gemini
64%±2

Taux de victoire

Elo 1098

Gagné / perdu / à égalité
1069 / 483 / 1318
prompts
24
comparaisons
2870
Moyenne du juge
94.8

Par catégorie

Code67%
Créatif45%
Factuel71%
Multilingue61%
Raisonnement64%
Santé85%
Rang 16Anthropic
63%±2

Taux de victoire

Elo 1094

Gagné / perdu / à égalité
919 / 401 / 1390
prompts
20
comparaisons
2710
Moyenne du juge
88.9

Par catégorie

Code64%
Créatif67%
Factuel59%
Multilingue65%
Raisonnement69%
Rang 16OpenAI
63%±2

Taux de victoire

Elo 1092

o1
Tier C
Gagné / perdu / à égalité
879 / 398 / 1262
prompts
20
comparaisons
2539
Moyenne du juge
90.4

Par catégorie

Code77%
Créatif55%
Factuel48%
Multilingue65%
Raisonnement63%
Rang 16Anthropic
63%±2

Taux de victoire

Elo 1090

Gagné / perdu / à égalité
1008 / 484 / 1378
prompts
24
comparaisons
2870
Moyenne du juge
95.8

Par catégorie

Code54%
Créatif58%
Factuel71%
Multilingue63%
Raisonnement67%
Santé88%
Rang 16Z.ai (GLM / Zhipu)
63%±2

Taux de victoire

Elo 1089

GLM-5
Tier A
Gagné / perdu / à égalité
553 / 252 / 733
prompts
14
comparaisons
1538
Moyenne du juge
94.6

Par catégorie

Code57%
Créatif89%
Factuel64%
Raisonnement61%
Rang 16Google Gemini
62%±2

Taux de victoire

Elo 1087

Gagné / perdu / à égalité
615 / 274 / 910
prompts
23
comparaisons
1799
Moyenne du juge
93.5

Par catégorie

Code51%
Créatif70%
Factuel61%
Multilingue65%
Raisonnement73%
Santé58%
Rang 17OpenAI
62%±2

Taux de victoire

Elo 1086

Gagné / perdu / à égalité
826 / 396 / 1246
prompts
20
comparaisons
2468
Moyenne du juge
86.8

Par catégorie

Code77%
Créatif6%
Factuel61%
Multilingue68%
Raisonnement63%
Rang 17OVH AI Endpoints (GRA)
62%±2

Taux de victoire

Elo 1085

Gagné / perdu / à égalité
901 / 450 / 1318
prompts
20
comparaisons
2669
Moyenne du juge
92.0

Par catégorie

Code60%
Créatif84%
Factuel61%
Multilingue54%
Raisonnement70%
Rang 18OpenAI
62%±2

Taux de victoire

Elo 1083

Gagné / perdu / à égalité
987 / 519 / 1364
prompts
24
comparaisons
2870
Moyenne du juge
92.8

Par catégorie

Code51%
Créatif73%
Factuel72%
Multilingue62%
Raisonnement62%
Santé72%
Rang 18OpenAI
62%±2

Taux de victoire

Elo 1082

Gagné / perdu / à égalité
940 / 479 / 1451
prompts
24
comparaisons
2870
Moyenne du juge
94.3

Par catégorie

Code53%
Créatif50%
Factuel71%
Multilingue58%
Raisonnement71%
Santé86%
Rang 18Google Gemini
61%±2

Taux de victoire

Elo 1079

Gagné / perdu / à égalité
853 / 444 / 1372
prompts
20
comparaisons
2669
Moyenne du juge
92.8

Par catégorie

Code55%
Créatif42%
Factuel70%
Multilingue59%
Raisonnement74%
Rang 19OpenAI
61%±2

Taux de victoire

Elo 1076

o3
Tier C
Gagné / perdu / à égalité
792 / 432 / 1169
prompts
20
comparaisons
2393
Moyenne du juge
83.3

Par catégorie

Code65%
Créatif88%
Factuel57%
Multilingue53%
Raisonnement58%
Rang 19Anthropic
61%±2

Taux de victoire

Elo 1075

Gagné / perdu / à égalité
935 / 521 / 1414
prompts
24
comparaisons
2870
Moyenne du juge
94.5

Par catégorie

Code56%
Créatif54%
Factuel64%
Multilingue60%
Raisonnement67%
Santé82%
Rang 19OpenAI
61%±2

Taux de victoire

Elo 1075

Gagné / perdu / à égalité
927 / 516 / 1427
prompts
24
comparaisons
2870
Moyenne du juge
89.1

Par catégorie

Code60%
Créatif72%
Factuel46%
Multilingue67%
Raisonnement69%
Santé54%
Rang 19OpenAI
61%±2

Taux de victoire

Elo 1074

Gagné / perdu / à égalité
926 / 520 / 1424
prompts
24
comparaisons
2870
Moyenne du juge
92.3

Par catégorie

Code66%
Créatif66%
Factuel59%
Multilingue54%
Raisonnement69%
Santé35%
Rang 19OpenAI
60%±2

Taux de victoire

Elo 1074

Gagné / perdu / à égalité
788 / 437 / 1239
prompts
20
comparaisons
2464
Moyenne du juge
81.6

Par catégorie

Code58%
Créatif69%
Factuel50%
Multilingue70%
Raisonnement63%
Rang 23Anthropic
60%±2

Taux de victoire

Elo 1073

Gagné / perdu / à égalité
961 / 564 / 1345
prompts
24
comparaisons
2870
Moyenne du juge
94.0

Par catégorie

Code40%
Créatif57%
Factuel70%
Multilingue61%
Raisonnement77%
Santé78%
Rang 22OpenAI
60%±2

Taux de victoire

Elo 1073

o4-mini
Tier C
Gagné / perdu / à égalité
850 / 497 / 1192
prompts
20
comparaisons
2539
Moyenne du juge
81.3

Par catégorie

Code71%
Créatif79%
Factuel54%
Multilingue57%
Raisonnement49%
Rang 23OpenAI
60%±2

Taux de victoire

Elo 1072

Gagné / perdu / à égalité
965 / 573 / 1332
prompts
24
comparaisons
2870
Moyenne du juge
93.6

Par catégorie

Code56%
Créatif77%
Factuel57%
Multilingue55%
Raisonnement73%
Santé72%
Rang 19Google Gemini
60%±3

Taux de victoire

Elo 1070

Gagné / perdu / à égalité
501 / 290 / 608
prompts
18
comparaisons
1399
Moyenne du juge
92.6

Par catégorie

Code70%
Créatif61%
Factuel53%
Multilingue67%
Raisonnement64%
Santé36%
Rang 23Anthropic
60%±2

Taux de victoire

Elo 1069

Gagné / perdu / à égalité
598 / 400 / 700
prompts
17
comparaisons
1698
Moyenne du juge
86.9

Par catégorie

Code54%
Créatif89%
Factuel53%
Multilingue65%
Raisonnement59%
Rang 24OpenAI
60%±2

Taux de victoire

Elo 1068

Gagné / perdu / à égalité
714 / 414 / 1246
prompts
19
comparaisons
2374
Moyenne du juge
82.1

Par catégorie

Code65%
Créatif84%
Factuel49%
Multilingue56%
Raisonnement58%
Rang 25OpenAI
59%±2

Taux de victoire

Elo 1064

Gagné / perdu / à égalité
817 / 516 / 1269
prompts
20
comparaisons
2602
Moyenne du juge
90.5

Par catégorie

Code67%
Créatif72%
Factuel41%
Multilingue64%
Raisonnement60%
Rang 25OpenAI
59%±2

Taux de victoire

Elo 1064

Gagné / perdu / à égalité
848 / 544 / 1277
prompts
20
comparaisons
2669
Moyenne du juge
85.2

Par catégorie

Code63%
Créatif30%
Factuel44%
Multilingue69%
Raisonnement74%
Rang 27OpenAI
59%±2

Taux de victoire

Elo 1060

Gagné / perdu / à égalité
899 / 601 / 1370
prompts
24
comparaisons
2870
Moyenne du juge
93.4

Par catégorie

Code49%
Créatif71%
Factuel69%
Multilingue56%
Raisonnement59%
Santé78%
Rang 27Anthropic
58%±2

Taux de victoire

Elo 1058

Gagné / perdu / à égalité
840 / 578 / 1251
prompts
20
comparaisons
2669
Moyenne du juge
93.8

Par catégorie

Code48%
Créatif44%
Factuel72%
Multilingue58%
Raisonnement67%
Rang 34OpenAI
57%±2

Taux de victoire

Elo 1052

Gagné / perdu / à égalité
876 / 641 / 1353
prompts
24
comparaisons
2870
Moyenne du juge
91.1

Par catégorie

Code56%
Créatif60%
Factuel64%
Multilingue53%
Raisonnement65%
Santé21%
Rang 34OpenAI
57%±2

Taux de victoire

Elo 1050

Gagné / perdu / à égalité
904 / 681 / 1285
prompts
24
comparaisons
2870
Moyenne du juge
88.5

Par catégorie

Code61%
Créatif70%
Factuel44%
Multilingue58%
Raisonnement65%
Santé49%
Rang 34OVH AI Endpoints (GRA)
57%±2

Taux de victoire

Elo 1048

Gagné / perdu / à égalité
778 / 584 / 1307
prompts
20
comparaisons
2669
Moyenne du juge
91.9

Par catégorie

Code46%
Créatif69%
Factuel60%
Multilingue51%
Raisonnement74%
Rang 47Anthropic
55%±2

Taux de victoire

Elo 1035

Gagné / perdu / à égalité
862 / 754 / 1254
prompts
24
comparaisons
2870
Moyenne du juge
91.7

Par catégorie

Code58%
Créatif55%
Factuel53%
Multilingue55%
Raisonnement61%
Santé33%
Rang 47OVH AI Endpoints (GRA)
55%±2

Taux de victoire

Elo 1033

Gagné / perdu / à égalité
828 / 744 / 1097
prompts
20
comparaisons
2669
Moyenne du juge
89.2

Par catégorie

Code55%
Créatif36%
Factuel57%
Multilingue53%
Raisonnement64%
Rang 49OVH AI Endpoints (GRA)
54%±2

Taux de victoire

Elo 1027

Gagné / perdu / à égalité
792 / 746 / 1131
prompts
20
comparaisons
2669
Moyenne du juge
90.9

Par catégorie

Code66%
Créatif41%
Factuel46%
Multilingue50%
Raisonnement61%
Rang 50OVH AI Endpoints (GRA)
53%±2

Taux de victoire

Elo 1024

Gagné / perdu / à égalité
791 / 767 / 1111
prompts
20
comparaisons
2669
Moyenne du juge
91.5

Par catégorie

Code56%
Créatif65%
Factuel33%
Multilingue52%
Raisonnement74%
Rang 52OpenAI
53%±2

Taux de victoire

Elo 1019

Gagné / perdu / à égalité
835 / 845 / 989
prompts
20
comparaisons
2669
Moyenne du juge
84.3

Par catégorie

Code55%
Créatif32%
Factuel32%
Multilingue68%
Raisonnement66%
Rang 52OpenAI
51%±2

Taux de victoire

Elo 1009

gpt-4
Tier C
Gagné / perdu / à égalité
867 / 957 / 1046
prompts
24
comparaisons
2870
Moyenne du juge
88.6

Par catégorie

Code58%
Créatif33%
Factuel41%
Multilingue54%
Raisonnement60%
Santé43%
Rang 53OpenAI
51%±2

Taux de victoire

Elo 1005

o3-mini
Tier C
Gagné / perdu / à égalité
627 / 722 / 1119
prompts
20
comparaisons
2468
Moyenne du juge
84.8

Par catégorie

Code58%
Créatif30%
Factuel31%
Multilingue57%
Raisonnement64%
Rang 53Google Gemini
50%±2

Taux de victoire

Elo 1003

Gagné / perdu / à égalité
485 / 536 / 778
prompts
23
comparaisons
1799
Moyenne du juge
79.3

Par catégorie

Code44%
Créatif82%
Factuel43%
Multilingue55%
Raisonnement43%
Santé43%
Rang 54OpenAI
50%±2

Taux de victoire

Elo 1003

Gagné / perdu / à égalité
549 / 641 / 1130
prompts
20
comparaisons
2320
Moyenne du juge
75.1

Par catégorie

Code60%
Créatif50%
Factuel40%
Multilingue45%
Raisonnement58%
Rang 54Anthropic
50%±2

Taux de victoire

Elo 999

Gagné / perdu / à égalité
586 / 716 / 868
prompts
18
comparaisons
2170
Moyenne du juge
82.7

Par catégorie

Code31%
Créatif86%
Factuel53%
Multilingue41%
Raisonnement55%
Rang 56Google Gemini
49%±2

Taux de victoire

Elo 996

Gagné / perdu / à égalité
801 / 988 / 1081
prompts
24
comparaisons
2870
Moyenne du juge
90.7

Par catégorie

Code38%
Créatif51%
Factuel45%
Multilingue57%
Raisonnement60%
Santé53%
Rang 59OpenAI
47%±2

Taux de victoire

Elo 977

Gagné / perdu / à égalité
730 / 1061 / 1079
prompts
24
comparaisons
2870
Moyenne du juge
82.2

Par catégorie

Code55%
Créatif54%
Factuel23%
Multilingue56%
Raisonnement52%
Santé18%
Rang 59OpenAI
47%±2

Taux de victoire

Elo 977

gpt-4-0613
Tier Carchived
Gagné / perdu / à égalité
754 / 1085 / 1031
prompts
24
comparaisons
2870
Moyenne du juge
90.0

Par catégorie

Code45%
Créatif53%
Factuel37%
Multilingue48%
Raisonnement56%
Santé51%
Rang 58OpenAI
47%±2

Taux de victoire

Elo 976

Gagné / perdu / à égalité
549 / 818 / 1026
prompts
20
comparaisons
2393
Moyenne du juge
71.9

Par catégorie

Code64%
Créatif35%
Factuel40%
Multilingue32%
Raisonnement58%
Rang 63OpenAI
43%±2

Taux de victoire

Elo 952

Gagné / perdu / à égalité
691 / 1203 / 976
prompts
24
comparaisons
2870
Moyenne du juge
82.4

Par catégorie

Code58%
Créatif46%
Factuel18%
Multilingue51%
Raisonnement43%
Santé25%
Rang 66Google Gemini
42%±2

Taux de victoire

Elo 944

Gagné / perdu / à égalité
686 / 1258 / 926
prompts
24
comparaisons
2870
Moyenne du juge
77.5

Par catégorie

Code35%
Créatif21%
Factuel52%
Multilingue42%
Raisonnement50%
Santé23%
Rang 66OpenAI
42%±2

Taux de victoire

Elo 942

gpt-5
Tier C
Gagné / perdu / à égalité
407 / 813 / 861
prompts
19
comparaisons
2081
Moyenne du juge
62.0

Par catégorie

Code56%
Créatif7%
Factuel39%
Multilingue38%
Raisonnement45%
Rang 66OpenAI
41%±2

Taux de victoire

Elo 939

Gagné / perdu / à égalité
688 / 1291 / 891
prompts
24
comparaisons
2870
Moyenne du juge
82.3

Par catégorie

Code49%
Créatif54%
Factuel18%
Multilingue43%
Raisonnement53%
Santé22%
Rang 66OpenAI
41%±2

Taux de victoire

Elo 936

Gagné / perdu / à égalité
681 / 1307 / 882
prompts
24
comparaisons
2870
Moyenne du juge
81.1

Par catégorie

Code63%
Créatif30%
Factuel21%
Multilingue47%
Raisonnement33%
Santé20%
Rang 66OpenAI
40%±2

Taux de victoire

Elo 933

Gagné / perdu / à égalité
466 / 977 / 877
prompts
20
comparaisons
2320
Moyenne du juge
59.1

Par catégorie

Code56%
Créatif3%
Factuel24%
Multilingue37%
Raisonnement58%
Rang 67OVH AI Endpoints (GRA)
39%±2

Taux de victoire

Elo 922

Gagné / perdu / à égalité
559 / 1195 / 781
prompts
20
comparaisons
2535
Moyenne du juge
79.8

Par catégorie

Code50%
Créatif45%
Factuel31%
Multilingue25%
Raisonnement49%
Rang 68Z.ai (GLM / Zhipu)
38%±2

Taux de victoire

Elo 912

Gagné / perdu / à égalité
358 / 847 / 611
prompts
14
comparaisons
1816
Moyenne du juge
54.5

Par catégorie

Code43%
Créatif31%
Factuel44%
Raisonnement24%
Rang 68Z.ai (GLM / Zhipu)
37%±2

Taux de victoire

Elo 909

GLM-5.2
Tier A
Gagné / perdu / à égalité
367 / 846 / 538
prompts
14
comparaisons
1751
Moyenne du juge
54.0

Par catégorie

Code50%
Créatif4%
Factuel42%
Raisonnement20%
Rang 70Z.ai (GLM / Zhipu)
37%±2

Taux de victoire

Elo 907

Gagné / perdu / à égalité
367 / 881 / 578
prompts
14
comparaisons
1826
Moyenne du juge
64.5

Par catégorie

Code50%
Créatif46%
Factuel31%
Raisonnement15%
Rang 71Z.ai (GLM / Zhipu)
37%±2

Taux de victoire

Elo 904

GLM-5.1
Tier A
Gagné / perdu / à égalité
375 / 831 / 412
prompts
14
comparaisons
1618
Moyenne du juge
69.1

Par catégorie

Code32%
Créatif13%
Factuel50%
Raisonnement34%
Rang 73OVH AI Endpoints (GRA)
35%±2

Taux de victoire

Elo 890

Gagné / perdu / à égalité
555 / 1438 / 676
prompts
20
comparaisons
2669
Moyenne du juge
75.9

Par catégorie

Code42%
Créatif10%
Factuel29%
Multilingue39%
Raisonnement36%
Rang 73Google Gemini
34%±2

Taux de victoire

Elo 887

Gagné / perdu / à égalité
605 / 1574 / 691
prompts
24
comparaisons
2870
Moyenne du juge
63.9

Par catégorie

Code32%
Créatif31%
Factuel49%
Multilingue29%
Raisonnement28%
Santé9%
Rang 77Z.ai (GLM / Zhipu)
31%±2

Taux de victoire

Elo 864

Gagné / perdu / à égalité
303 / 941 / 449
prompts
14
comparaisons
1693
Moyenne du juge
54.4

Par catégorie

Code50%
Créatif8%
Factuel39%
Raisonnement6%
Rang 77Z.ai (GLM / Zhipu)
31%±2

Taux de victoire

Elo 862

GLM-4.6
Tier A
Gagné / perdu / à égalité
303 / 974 / 463
prompts
13
comparaisons
1740
Moyenne du juge
55.8

Par catégorie

Code46%
Créatif1%
Factuel37%
Raisonnement16%
Rang 78OpenAI
30%±2

Taux de victoire

Elo 856

Gagné / perdu / à égalité
268 / 990 / 568
prompts
18
comparaisons
1826
Moyenne du juge
39.6

Par catégorie

Code27%
Créatif7%
Factuel48%
Multilingue27%
Raisonnement21%
Rang 79OVH AI Endpoints (GRA)
28%±2

Taux de victoire

Elo 835

Gagné / perdu / à égalité
476 / 1684 / 509
prompts
20
comparaisons
2669
Moyenne du juge
71.7

Par catégorie

Code35%
Créatif11%
Factuel27%
Multilingue27%
Raisonnement24%
Rang 81Z.ai (GLM / Zhipu)
26%±2

Taux de victoire

Elo 818

Gagné / perdu / à égalité
230 / 1025 / 421
prompts
14
comparaisons
1676
Moyenne du juge
46.4

Par catégorie

Code43%
Créatif4%
Factuel29%
Raisonnement5%
Rang 82Google Gemini
25%±2

Taux de victoire

Elo 812

Gagné / perdu / à égalité
418 / 1752 / 499
prompts
20
comparaisons
2669
Moyenne du juge
50.5

Par catégorie

Code9%
Créatif48%
Factuel43%
Multilingue25%
Raisonnement10%
Rang 83OpenAI
24%±2

Taux de victoire

Elo 799

Gagné / perdu / à égalité
219 / 1207 / 501
prompts
20
comparaisons
1927
Moyenne du juge
38.0

Par catégorie

Code18%
Créatif4%
Factuel50%
Multilingue18%
Raisonnement10%
Rang 83Google Gemini
23%±2

Taux de victoire

Elo 792

Gagné / perdu / à égalité
192 / 915 / 292
prompts
18
comparaisons
1399
Moyenne du juge
41.4

Par catégorie

Code19%
Créatif14%
Factuel44%
Multilingue4%
Raisonnement3%
Santé54%
Rang 83OVH AI Endpoints (GRA)
23%±2

Taux de victoire

Elo 790

Gagné / perdu / à égalité
255 / 1313 / 428
prompts
19
comparaisons
1996
Moyenne du juge
43.4

Par catégorie

Code42%
Créatif6%
Factuel6%
Multilingue28%
Raisonnement5%
Rang 83OVH AI Endpoints (GRA)
23%±2

Taux de victoire

Elo 789

Qwen3-32B
Tier B
Gagné / perdu / à égalité
440 / 1893 / 336
prompts
20
comparaisons
2669
Moyenne du juge
75.8

Par catégorie

Code18%
Créatif14%
Factuel21%
Multilingue27%
Raisonnement24%
Rang 83Google Gemini
22%±2

Taux de victoire

Elo 780

Gagné / perdu / à égalité
250 / 1275 / 353
prompts
24
comparaisons
1878
Moyenne du juge
44.1

Par catégorie

Code4%
Créatif38%
Factuel42%
Multilingue19%
Raisonnement13%
Santé3%
Rang 85OVH AI Endpoints (GRA)
21%±2

Taux de victoire

Elo 770

Gagné / perdu / à égalité
211 / 1343 / 442
prompts
19
comparaisons
1996
Moyenne du juge
44.1

Par catégorie

Code36%
Créatif5%
Factuel11%
Multilingue24%
Raisonnement3%
Rang 85Google Gemini
21%±2

Taux de victoire

Elo 767

Gagné / perdu / à égalité
404 / 2080 / 386
prompts
24
comparaisons
2870
Moyenne du juge
47.4

Par catégorie

Code5%
Créatif51%
Factuel43%
Multilingue16%
Raisonnement7%
Santé5%
Rang 86Google Gemini
20%±2

Taux de victoire

Elo 761

Gagné / perdu / à égalité
371 / 2077 / 422
prompts
24
comparaisons
2870
Moyenne du juge
43.9

Par catégorie

Code4%
Créatif23%
Factuel49%
Multilingue17%
Raisonnement7%
Santé2%
Rang 92Google Gemini
17%±2

Taux de victoire

Elo 726

Gagné / perdu / à égalité
182 / 1437 / 345
prompts
24
comparaisons
1964
Moyenne du juge
30.7

Par catégorie

Code17%
Créatif3%
Factuel34%
Multilingue8%
Raisonnement3%
Santé54%
Rang 93Google Gemini
14%±1

Taux de victoire

Elo 687

Gagné / perdu / à égalité
295 / 2327 / 248
prompts
24
comparaisons
2870
Moyenne du juge
36.6

Par catégorie

Code3%
Créatif24%
Factuel25%
Multilingue11%
Raisonnement10%
Santé2%

94 modèles classés à partir de 117 970 comparaisons deux à deux sur 24 prompts.

Provisoire

Trop peu d'éléments pour classer : il faut au moins 5 prompts et 30 comparaisons.

ProvisoireZ.ai (GLM / Zhipu)
1%±1

Taux de victoire

Elo 155

CogView-4
Tier B
Gagné / perdu / à égalité
0 / 361 / 6
prompts
4
comparaisons
367
Moyenne du juge
0.0

Par catégorie

Code1%
Créatif<1% · mince