30/06/2026
Hoy Anthropic lanzó Claude Sonnet 5. Y la noticia real no es que salió un modelo nuevo.
La noticia es lo que implica para cualquiera que construye sistemas con agentes: el modelo del "medio" ahora rinde cerca del modelo tope. Y cuesta entre 5 y 7 veces menos.
Eso no es una actualización. Es un cambio en el cálculo de cualquier arquitectura.
Los números que más me llamaron la atención:
→ Terminal-Bench 2.1: 80.4% (vs 67.0% de Sonnet 4.6 — +13.4 puntos)
→ Reasoning con herramientas: 57.4% (Opus 4.8 tiene 57.9%)
→ Knowledge work GDPval-AA: 1618 (Opus 4.8 tiene 1615 — Sonnet lo supera)
→ Computer use OSWorld: 81.2% vs 83.4% de Opus — diferencia de 2.2 puntos
Si usabas Opus para tasks agénticas, esta semana vale la pena repensar esa decisión.
El precio introductorio es $2/M tokens input y $10/M output — hasta el 31 de agosto. Después sube a $3/$15.
Escribí un análisis completo con la tabla de benchmarks oficial y qué deberías revisar en tu stack (link en los comentarios).
¿Ya lo estás probando?