Naar inhoud

Benchmarks

Intelligentietest

Model quality scored 0–100 by an impartial judge LLM (Claude Sonnet 4.6, blind). Six categories: reasoning, coding, creativity, factual accuracy, instruction-following, and safety.

#1Anthropic
100
Reasoning95
Coding90
Factual100
#2Anthropic
100
Reasoning95
Coding90
Factual100
#3Anthropic
100
Reasoning95
Coding90
Factual100
#4Anthropic
100
Reasoning95
Coding90
Factual100
#5Anthropic
100
Reasoning95
Coding90
Factual100
#6Anthropic
100
Reasoning95
Coding90
Factual100
#7Anthropic
100
Claude Opus 4.1
Tier Carchived
Reasoning95
Coding90
Factual100
#8OpenAI
100
Reasoning95
Coding90
Factual100
#9OpenAI
100
Reasoning95
Coding90
Factual100
#10OpenAI
100
Reasoning95
Coding90
Factual100
#11OpenAI
100
gpt-4
Tier C
Reasoning95
Coding90
Factual100
#12OpenAI
100
Reasoning95
Coding90
Factual100
#13OpenAI
100
Reasoning95
Coding90
Factual100
#14OpenAI
100
Reasoning95
Coding90
Factual100
#15OpenAI
100
Reasoning95
Coding90
Factual100
#16OpenAI
100
gpt-4o
Tier C
Reasoning95
Coding90
Factual100
#17OpenAI
100
Reasoning95
Coding90
Factual100
#18OpenAI
100
Reasoning95
Coding90
Factual100
#19OpenAI
100
Reasoning95
Coding90
Factual100
#20OpenAI
100
Reasoning95
Coding90
Factual100
#21OpenAI
100
Reasoning95
Coding90
Factual100
#22OpenAI
100
o1
Tier C
Reasoning95
Coding90
Factual100
#23OpenAI
100
o3-mini
Tier C
Reasoning95
Coding90
Factual100
#24OpenAI
100
Reasoning95
Coding90
Factual100
#25OpenAI
100
Reasoning95
Coding90
Factual100
#26OpenAI
100
Reasoning95
Coding90
Factual100
#27OpenAI
100
Reasoning95
Coding90
Factual100
#28OpenAI
100
o3
Tier C
Reasoning95
Coding90
Factual100
#29OpenAI
100
o4-mini
Tier C
Reasoning95
Coding90
Factual100
#30OpenAI
100
Reasoning95
Coding90
Factual100
#31OpenAI
100
gpt-4.1
Tier B
Reasoning95
Coding90
Factual100
#32OpenAI
100
Reasoning95
Coding90
Factual100
#33OpenAI
100
Reasoning95
Coding90
Factual100
#34OpenAI
100
Reasoning95
Coding90
Factual100
#35OpenAI
100
Reasoning95
Coding90
Factual100
#36OpenAI
100
gpt-5
Tier C
Reasoning95
Coding90
Factual100
#37OpenAI
100
Reasoning95
Coding90
Factual100
#38OpenAI
100
Reasoning95
Coding90
Factual100
#39OpenAI
100
Reasoning95
Coding90
Factual100
#40OpenAI
100
Reasoning95
Coding90
Factual100
#41OpenAI
100
Reasoning95
Coding90
Factual100
#42OpenAI
100
Reasoning95
Coding90
Factual100
#43OpenAI
100
gpt-5.1
Tier B
Reasoning95
Coding90
Factual100
#44OpenAI
100
Reasoning95
Coding90
Factual100
#45OpenAI
100
gpt-5.2
Tier B
Reasoning95
Coding90
Factual100
#46OpenAI
100
Reasoning95
Coding90
Factual100
#47OpenAI
100
Reasoning95
Coding90
Factual100
#48OpenAI
100
Reasoning95
Coding90
Factual100
#49OpenAI
100
Reasoning95
Coding90
Factual100
#50OpenAI
100
gpt-5.4
Tier A
Reasoning95
Coding90
Factual100
#51OpenAI
100
Reasoning95
Coding90
Factual100
#52OpenAI
100
Reasoning95
Coding90
Factual100
#53OpenAI
100
Reasoning95
Coding90
Factual100
#54OpenAI
100
Reasoning95
Coding90
Factual100
#55OpenAI
100
gpt-5.5
Tier C
Reasoning95
Coding90
Factual100
#56OpenAI
100
Reasoning95
Coding90
Factual100
#57Google Gemini
100
Reasoning95
Coding90
Factual100
#58Google Gemini
100
Reasoning95
Coding90
Factual100
#59Google Gemini
100
Reasoning95
Coding90
Factual100
#60Google Gemini
100
Reasoning95
Coding90
Factual100
#61Google Gemini
100
Reasoning95
Coding90
Factual100
#62Google Gemini
100
Reasoning95
Coding90
Factual100
#63OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#64OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#65Google Gemini
100
Reasoning95
Coding90
Factual100
#66OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#67OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#68OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#69OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#70OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#71OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#72OVH AI Endpoints (GRA)
100
Reasoning95
Coding90
Factual100
#73Google Gemini
100
Reasoning95
Coding90
Factual100
#74Anthropic
100
Reasoning95
Coding90
Factual100
#75Anthropic
100
Reasoning95
Coding90
Factual100
#76Anthropic
100
Reasoning95
Coding90
Factual100
#77OpenAI
98
Reasoning93
Coding88
Factual98
#78Google Gemini
97
Reasoning92
Coding87
Factual97
#79OpenAI
95
Reasoning90
Coding86
Factual95
#80OVH AI Endpoints (GRA)
95
Qwen3-32B
Tier B
Reasoning90
Coding86
Factual95
#81Z.ai (GLM / Zhipu)
95
GLM-4.7
Tier A
Reasoning90
Coding86
Factual95
#82Z.ai (GLM / Zhipu)
95
GLM-4.5
Tier A
Reasoning90
Coding86
Factual95
#83Z.ai (GLM / Zhipu)
93
GLM-5
Tier A
Reasoning88
Coding84
Factual93
#84Google Gemini
91
Reasoning86
Coding82
Factual91
#85Google Gemini
86
Reasoning82
Coding77
Factual86
#86Z.ai (GLM / Zhipu)
80
GLM-5.1
Tier A
Reasoning76
Coding72
Factual80
#87Z.ai (GLM / Zhipu)
75
GLM-5.2
Tier A
Reasoning71
Coding68
Factual75
#88OpenAI
70
Reasoning67
Coding63
Factual70
#89Z.ai (GLM / Zhipu)
62
Reasoning59
Coding56
Factual62
#90OVH AI Endpoints (GRA)
26
Reasoning25
Coding23
Factual26
#91Z.ai (GLM / Zhipu)
22
Reasoning21
Coding20
Factual22
#92Google Gemini
5
Reasoning5
Coding5
Factual5
#93Z.ai (GLM / Zhipu)
2
GLM-4.6
Tier A
Reasoning2
Coding2
Factual2
#94Google Gemini
0
Reasoning0
Coding0
Factual0
#95Google Gemini
0
Reasoning0
Coding0
Factual0
#96Google Gemini
0
Reasoning0
Coding0
Factual0
#97Z.ai (GLM / Zhipu)
0
Reasoning0
Coding0
Factual0
#98Z.ai (GLM / Zhipu)
0
Reasoning0
Coding0
Factual0
#99Z.ai (GLM / Zhipu)
0
CogView-4
Tier B
Reasoning0
Coding0
Factual0

99 models scored · category breakdown estimated (full per-category scoring in Q3 2026)