Claude Sonnet 5 es el modelo de gama media de Anthropic, lanzado el 30 de junio de 2026 como sucesor de Sonnet 4.6. Anthropic lo presenta como el Sonnet más agéntico que la compañía ha lanzado hasta ahora: un modelo pensado para planificar una tarea, usar herramientas como un navegador o una terminal, y llevar adelante un trabajo de varios pasos con menos supervisión paso a paso de la que necesitaban las generaciones anteriores de Sonnet. El propio posicionamiento de Anthropic es que Sonnet 5 cierra buena parte de la brecha con la línea insignia Opus sin salir del nivel Sonnet.
Dónde destaca
El modelo está construido en torno al uso sostenido de herramientas más que a la conversación de un solo turno. Admite llamadas a funciones, salida JSON estructurada contra un esquema, entrada de PDF y visión, y expone un modo de razonamiento que le permite trabajar un problema antes de responder. Esa combinación encaja bien con flujos de trabajo agénticos: una tarea que requiere leer un documento, llamar a una herramienta, comprobar el resultado y decidir el siguiente paso es exactamente la forma de trabajo para la que Anthropic dice haber diseñado este lanzamiento. Anthropic reporta un 78,5% en OSWorld-Verified, su benchmark de uso de ordenador, y un 46,8% en Humanity's Last Exam cuando se permite al modelo usar herramientas — ambas son cifras publicadas por la propia Anthropic, no resultados reproducidos de forma independiente, así que describen la versión del fabricante sobre el progreso del modelo, no un resultado neutral de terceros.
Bajo el capó
Sonnet 5 tiene una ventana de contexto de 1.000.000 de tokens con una salida síncrona máxima de 128.000 tokens por respuesta. La salida es solo de texto — esta generación de Sonnet no genera imágenes ni audio. La caché de prompts está soportada, lo cual importa para los bucles agénticos que reenvían un contexto grande y mayormente sin cambios (una base de código, un documento largo, un esquema de herramienta) a lo largo de muchos turnos de la misma sesión.
Dónde se queda corto
El propio anuncio de Anthropic para este lanzamiento no indica una fecha de corte de conocimiento, así que cualquiera que dependa del modelo para eventos muy recientes o bibliotecas recién publicadas debería verificar en lugar de asumir. Los puntos fuertes del modelo se concentran en el trabajo de varios pasos con uso de herramientas; para preguntas cortas de un solo turno o clasificación simple, la maquinaria agéntica es más sobrecarga que beneficio, y un modelo más ligero de la misma familia normalmente responderá igual de bien. Las propias afirmaciones de benchmark de Anthropic, al venir del fabricante probando su propio modelo, también conviene tratarlas como orientativas más que definitivas — la magnitud de la mejora respecto a Sonnet 4.6 es la caracterización de Anthropic hasta que se contraste con cargas de trabajo independientes.
Cuándo elegirlo
Sonnet 5 encaja en agentes de programación, agentes de investigación y cualquier flujo de trabajo donde el modelo necesite seguir trabajando a través de varias llamadas a herramientas sin que un humano tenga que volver a indicarle en cada paso — depurar una suite de pruebas que falla, avanzar en una refactorización de varios archivos o ejecutar de principio a fin una tarea de navegar y resumir. También encaja en cargas de trabajo que necesitan una ventana de contexto genuinamente grande junto con uso de herramientas, como revisar una base de código extensa o un conjunto largo de documentos en una sola sesión.
Para trabajos que no necesitan esa autonomía — generación de formato corto, extracción simple, clasificación de una sola llamada — la sobrecarga agéntica no aporta nada útil, y un modelo más pequeño y rápido será normalmente la opción por defecto más sensata.
Alternativas que vale la pena comparar
Dentro de la propia gama de Anthropic, Claude Opus 5 se sitúa por encima de Sonnet 5 como la insignia para el trabajo agéntico y empresarial más complejo, y Claude Fable 5 se sitúa por encima de ese como el modelo más capaz que Anthropic ha lanzado de forma amplia — ambos son opciones si una carga de trabajo resulta necesitar más margen del que ofrece Sonnet 5. El propio posicionamiento de Anthropic presenta a Sonnet 5 como cercano al rendimiento de Opus en muchas tareas, lo que hace que valga la pena empezar por ahí antes de recurrir a un modelo más grande, y solo subir de nivel si la carga de trabajo demuestra específicamente que necesita esa capacidad extra.
Notas de implementación
Como Sonnet 5 está construido en torno a sesiones largas y con uso intensivo de herramientas, las integraciones deben esperar y manejar bucles de llamadas a herramientas de varios turnos en lugar de un único intercambio de solicitud/respuesta — los tiempos de espera, la lógica de reintentos y el formato de los resultados de herramientas deben tener en cuenta una tarea que puede tardar varias rondas en completarse. El techo de 128.000 tokens de salida es generoso pero finito; un flujo de trabajo que espera que una sola llamada devuelva un artefacto generado completo y grande debería confirmar que cabe bajo ese límite antes de depender de ello en producción.