Skip to content

Compare AI models

Head-to-head benchmark, pricing & capability breakdown across providers

openaigpt-5openaigpt-5-miniopenaio3-mini-2025-01-31

PRICE

gpt-5$11.25/1M
gpt-5-mini$2.25/1M
🏆 WINNER
o3-mini-2025-01-31$5.50/1M

Combined input + output cost per 1M tokens

CONTEXT WINDOW

gpt-5
no data
gpt-5-mini
no data
o3-mini-2025-01-31
no data

Maximum tokens the model can process in a single request

CAPABILITIES

gpt-52 / 5
🏆 WINNER
gpt-5-mini2 / 5
🏆 WINNER
o3-mini-2025-01-311 / 5

gpt-5

vision tool use prompt caching batch api streaming

gpt-5-mini

vision tool use prompt caching batch api streaming

o3-mini-2025-01-31

vision tool use prompt caching batch api streaming

INTELLIGENCE

7-day avg quality scores
gpt-540.4%
gpt-5-mini49.3%
o3-mini-2025-01-3159.7%
🏆 WINNER

gpt-5

factual: 39%coding: 56%reasoning: 37%healthcare: —creative: 7%multilingual: 38%

gpt-5-mini

factual: 40%coding: 59%reasoning: 54%healthcare: —creative: 50%multilingual: 45%

o3-mini-2025-01-31

factual: 42%coding: 68%reasoning: 57%healthcare: —creative: 72%multilingual: 64%

SPEED

p50 latency, 7-day avg
gpt-57941ms
gpt-5-mini6149ms
o3-mini-2025-01-313092ms
🏆 WINNER

Provenance

gpt-5

Runs in:USMade in:United States

gpt-5-mini

Runs in:USMade in:United States

o3-mini-2025-01-31

Runs in:USMade in:United States

🏆 CATEGORY LEADERS

Price
🏆 WINNERgpt-5-mini· $2.25/1M
Intelligence
🏆 WINNERo3-mini-2025-01-31· 59.7%
Coding
🏆 WINNERo3-mini-2025-01-31· 68.0%
Reasoning
🏆 WINNERo3-mini-2025-01-31· 57.3%
Creative
🏆 WINNERo3-mini-2025-01-31· 71.6%
Multilingual
🏆 WINNERo3-mini-2025-01-31· 63.8%
Speed
🏆 WINNERo3-mini-2025-01-31· 3092ms
Multimodal
🏆 WINNERgpt-5· 2/5 caps(also: gpt-5-mini)

SCORE TALLY

o3-mini-2025-01-31
6🏆
gpt-5-mini
1🏆1🤝
gpt-5
1🏆

RECOMMENDATIONS

gpt-5

Pick gpt-5 for:

  • image + tool-use workflows
  • vision-grounded reasoning

why: full multimodal (2/5 capabilities)

gpt-5-mini

Pick gpt-5-mini for:

  • budget-conscious deployments
  • high-volume API usage

why: cheapest by 80%, full multimodal (2/5 capabilities)

o3-mini-2025-01-31

Pick o3-mini-2025-01-31 for:

  • pure coding workflows
  • code review automation
  • pair-programming tools

why: 2.6× faster, intelligence score 59.7 / 100, coding score 68, creative score 71.6, reasoning score 57.3 — best at chain-of-thought logic, multilingual score 63.8 — strong cross-locale performance