Claude Sonnet 5: rendimiento de Opus a precio de Sonnet — y esto cambia el cálculo
Anthropic acaba de lanzar Claude Sonnet 5, y el argumento central no es que sea el mejor modelo del mundo: es que rinde casi como Opus 4.8 pero a un precio sensiblemente menor. Para quien toma decisiones sobre qué modelos desplegar en producción, ese diferencial importa más que cualquier benchmark de laboratorio.
Qué ha pasado
Anthropic ha publicado Claude Sonnet 5, su nuevo modelo de la gama intermedia, con foco explícito en capacidades agénticas.
[Fuente oficial: anthropic.com](https://www.anthropic.com/news/claude-sonnet-5)
- Rendimiento próximo a Opus 4.8 en tareas agénticas (razonamiento, uso de herramientas, codificación), pero a precios más bajos
- Mejora significativa sobre su predecesor Sonnet 4.6 en seguimiento de tareas complejas, autocorrección sin instrucción explícita y trabajo autónomo multistep
- Disponible desde hoy en todos los planes de Claude (incluido el gratuito, donde es el modelo por defecto) y vía API con precios introductorios hasta agosto de 2026
Por qué importa
El cambio real aquí no es técnico: es económico y operativo. Hasta ahora, si querías capacidades agénticas serias —que el modelo terminara una tarea compleja sin quedarse a medias, que usara herramientas encadenadas, que revisara su propio output— necesitabas Opus, y Opus tiene un coste que justifica conversaciones difíciles con el CFO.
Sonnet 5 reescribe esa ecuación. Los casos de uso que los partners de early access describen —ejecutar workflows de Salesforce end-to-end, resolver bugs con test y fix en un solo pase, gestionar pull requests complejas sin supervisión— son exactamente los workflows que muchos equipos IT tienen en lista de espera porque el coste-beneficio no cerraba con modelos grandes.
Si tu equipo está evaluando qué modelo anclar a sus agentes o pipelines de automatización, este es el momento de reevaluar. El argumento "esperamos a que baje el precio" ya no aplica de la misma manera.
A tener en cuenta
| Aspecto | Detalle |
|---|---|
| Precio introductorio (API) | $2 / M tokens entrada · $10 / M tokens salida (hasta 31 ago 2026) |
| Precio post-introducción | $3 / M entrada · $15 / M salida |
| Referencia de comparación | Rendimiento próximo a Opus 4.8 en evaluaciones agénticas |
| Seguridad agéntica | Mejor que Sonnet 4.6 en rechazo de peticiones maliciosas y resistencia a prompt injection |
| Cybersecurity tasks | Deliberadamente limitado; peor que Opus 4.8 y Mythos 5 en exploits |
| Disponibilidad | API, Claude Code, todos los planes (Free, Pro, Max, Team, Enterprise) |
Mi opinión
El hype diría: "¡Sonnet supera a Opus, la IA barata ya es la mejor!". El criterio dice: no lo supera, se le acerca —y eso, en producción, es suficiente para la mayoría de casos.
Lo que Anthropic está haciendo con esta gama es bajar el umbral de entrada a la IA agéntica real. No piloto, no demo: flujos autónomos multistep que antes requerían el modelo más caro de la gama.
Recomendación concreta: si tienes agentes en producción o en roadmap anclados a GPT-4o o a Opus por defecto, haz una prueba comparativa con Sonnet 5 esta semana. No como experimento de investigación — como decisión de coste operativo. El precio introductorio hace que el coste de la prueba sea irrelevante. El coste de no hacerla, puede que no.
---
*¿Tu organización ya tiene workflows donde un agente termina la tarea solo, o seguís supervisando cada paso manualmente?*