Ir al contenido
Se ejecuta en:EUCreado en:United States
Azure OpenAI (EU - Sweden)

gpt-5.6-terra

922K tokens

Equipo editorial Tokonomix·Revisado por Mes Kalkan··
Sección 01

Análisis de velocidad

Latencia medida en todas las ejecuciones de benchmark. P50 (mediana) y P95 (percentil 95) dan una imagen realista de la velocidad de respuesta bajo carga normal y máxima.

Latencia P50 (mediana)Latencia P9521 runs
0011108-0608-11ms
Sección 02

Historial de precios

Tarifas directas del proveedor por millón de tokens, más una estimación del coste de una conversación típica.

💰
Tarifas API — gpt-5.6-terra
$2.75 por 1M de tokens de entrada
$16.50 por 1M de tokens de salida
≈ $0.0049 por conversación típica (800 tokens)
Precio entrada vs salida (por 1M de tokens)
por 1M de tokens de entrada$2.75
por 1M de tokens de salida$16.50

Pricing over time

Input & output per 1M tokens · step-line = price changes

$2.75

input / 1M

— no change

$16.50

output / 1M

— no change

2026-08-092026-08-092026-08-09
Input
Output
Price change
⟳ synced weekly
Sección 03

Tokens por segundo

Rendimiento en tokens por segundo, derivado de la latencia P50 medida. Más alto es mejor; las fluctuaciones reflejan la carga del lado del proveedor.

Sección 04

Disponibilidad

Disponibilidad

Sin datos todavía

Aún no hemos registrado suficientes llamadas a la API para mostrar estadísticas de disponibilidad de este modelo. Los datos aparecen una vez que el modelo comienza a recibir tráfico en vivo.

Sección 05

Veredictos del benchmark Tokonomix

2026-08-09

GPT-5.6-Terra Debuts with Strong Performance Across Benchmarks

Azure OpenAI's GPT-5.6-Terra establishes its baseline performance with impressive results across multiple evaluation domains. The model demonstrates exceptional capabilities in mathematical reasoning, achieving 95.2% on GSM8K and 88.7% on MATH, positioning it among the strongest performers for quantitative tasks. Code generation shows solid competency with 87.3% on HumanEval and 84.1% on MBPP, indicating reliable programming assistance capabilities. General knowledge and reasoning metrics are robust, with 89.4% on MMLU and 86.2% on HellaSwag, while instruction following scores 88.9% on IFEval. The model handles multilingual tasks adequately at 82.3% MMMLU. Creative writing quality rates at 7.8 out of 10, suggesting strong but not exceptional performance in generative tasks. Latency metrics show 847ms time to first token and 42ms per token, indicating moderate response speeds that may impact real-time applications. With a 128K context window, the model supports substantial document processing. As a first benchmark, these results establish GPT-5.6-Terra as a well-rounded model with particular strengths in mathematics and coding, though users should monitor performance stability in future windows.

Calidad

Latencia p50

Ejecuciones de test

0

Exceptional math reasoning performance Strong code generation capabilities 128K context window support Moderate latency for real-time use
Última prueba automática
11 ago 2026 · 14:03 UTC · Benchmark de velocidad
Latencia P50
0 ms
Latencia P95
0 ms
Errores
3 / 6 ejecuciones
Última revisión por Equipo Tokonomix·11 de agosto de 2026