El 22 de septiembre de 2026 Anthropic lanzó Claude Opus 5.5. El titular que circuló fue “40% más barato”, y es un número que conviene leer con cuidado antes de llevarlo a un presupuesto. Lo que sí es firme: el modelo cuesta menos por token que Opus 5, rinde más que Fable 5.1 en programación agéntica y llega a todos los planes pagos. Y para quien lo usa por API, trae cambios que hacen fallar código que hoy funciona.
Claude Opus 5.5 es el modelo que Anthropic lanzó el 22 de septiembre de 2026 en reemplazo de Opus 5. Cuesta USD 4 por millón de tokens de entrada y USD 20 de salida (Opus 5: USD 5 y 25), o sea 20% menos por token. El “40% más barato” es una estimación de Anthropic para cargas típicas con la configuración por defecto, que suma el precio más bajo y el uso de menos tokens por tarea.
Está en Pro, Max, Team y Enterprise (no en Free), en la API como claude-opus-5-5 y en AWS, Google Cloud y Microsoft Foundry. En los benchmarks que publicó Anthropic supera a Fable 5.1 en código y uso de computadora a menos de la mitad de precio. Para una empresa, la consecuencia práctica es doble: el trabajo supervisado de todos los días rinde más por el mismo dinero, y las integraciones propias hay que revisarlas antes de cambiar el modelo.
¿Qué es Claude Opus 5.5 y qué cambia respecto de Opus 5?
Opus 5.5 es la nueva versión del modelo Opus, el que Anthropic posiciona para agentes que programan durante mucho tiempo y para trabajo de conocimiento (Anthropic). Según el anuncio, genera la respuesta más de 30% más rápido que Opus 5 y lee gráficos, diagramas y capturas de pantalla con mucha más precisión. Mantiene la ventana de contexto de 1 millón de tokens de la familia.
El cambio de fondo está en la escalera de modelos. Hasta ahora, la regla era simple: Sonnet para el volumen, Opus para lo difícil, Fable para lo máximo. Con Opus 5.5 esa escalera se aprieta, porque en varias de las pruebas que publica Anthropic el modelo del medio le gana al de arriba.
¿Cuánto cuesta Claude Opus 5.5? El 20%, el 31% y el 40%
Tres números circulan juntos y miden cosas distintas. Conviene separarlos antes de hacer cuentas:
- 20% menos por token es el precio de lista: USD 4 de entrada y USD 20 de salida por millón, contra USD 5 y 25 de Opus 5. La lectura de caché baja a USD 0,20 por millón (60% menos) y el procesamiento por lotes cuesta la mitad: USD 2 y 10 (documentación de Anthropic).
- Unos 31% menos por sesión es el ejemplo que publica Anthropic con exactamente los mismos tokens en los dos modelos: una sesión de programación que sale USD 3,50 en Opus 5 sale USD 2,40 en Opus 5.5. Es el efecto del precio solo, con mucha lectura de caché (Claude).
- 40% menos es la estimación de Anthropic para cargas típicas facturadas por token con la configuración por defecto. Suma el precio y que Opus 5.5 usa menos tokens por tarea en su nivel de esfuerzo por defecto, que ahora es
medium(en Opus 5 erahigh). Si tu integración fija el esfuerzo en alto, el ahorro va a ser menor.
| Modelo | Entrada / salida (USD por millón) | Lectura de caché |
|---|---|---|
| Haiku 4.5 | 1 / 5 | 0,10 |
| Sonnet 5 | 2 / 10 | 0,20 |
| Opus 5 | 5 / 25 | 0,50 |
| Opus 5.5 | 4 / 20 | 0,20 |
| Fable 5.1 | 10 / 50 | 0,25 |
Hay además un modo rápido, en vista previa, a USD 8 y 40 por millón, solo en la API de Claude (no en Bedrock, Google Cloud ni Foundry). Sirve cuando la latencia pesa más que el costo, por ejemplo en un agente que atiende en vivo.
¿Es mejor que Fable 5.1? Lo que dicen los benchmarks
En los benchmarks que publicó Anthropic, sí, en las cinco pruebas que eligió mostrar:
| Prueba | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 (terminal y código) | 66,4% | 55,8% | 52,3% |
| CursorBench 4.0 | 57,8% | 51,8% | 46,6% |
| FrontierCode v1.1 | 54,4% | 50,3% | 48,0% |
| OSWorld 2.0 (uso de computadora) | 81,8% | 80,7% | 74,0% |
| GDPval-AA v2.1 (trabajo de conocimiento, Elo) | 1846 | 1735 | 1708 |
Dos salvedades. Son pruebas que eligió el propio fabricante, y Anthropic no publicó SWE-bench para Opus 5.5: el 96% que circula en ese benchmark es de Opus 5. Y la recomendación oficial no es jubilar a Fable: Anthropic sugiere Opus 5.5 para el trabajo que alguien supervisa (funcionalidades que tocan pocos archivos, depuración, revisión de código) y subir a Fable 5.1 cuando el resultado importa más que el precio del token, en ejecuciones largas sin supervisión o en problemas sin un patrón previo.
¿En qué planes de Claude está Opus 5.5?
En Pro, Max, Team y Enterprise. El plan Free no lo incluye. Con el lanzamiento, Anthropic también subió los límites de uso de la ventana de 5 horas en Pro, Max, Team y Enterprise por asiento, y sumó la opción de reiniciar el límite de la suscripción (Anthropic). Para un equipo en Team, eso significa más trabajo con el modelo fuerte antes de toparse con el límite, sin pagar más por el asiento.
La diferencia con Fable 5.1 es justamente ésa: en Pro y en Team Standard, Fable no entra en el límite del plan y se paga con créditos de uso; Opus 5.5 sí entra. Para la mayoría de los equipos, eso convierte a Opus 5.5 en el modelo fuerte de uso diario. El detalle de qué incluye cada plan está en Claude Pro vs Team vs Enterprise.
¿Qué se rompe si tu empresa usa Claude por API?
Si tu equipo usa Claude desde claude.ai, no hay nada que tocar. Si tenés una integración propia (un agente de soporte, un flujo en n8n, un sistema interno que llama a la API), cambiar claude-opus-5 por claude-opus-5-5 no es suficiente. La documentación lista cuatro cambios incompatibles:
- El razonamiento no se puede apagar. Una llamada con
thinking: disabledo con un presupuesto manual de razonamiento devuelve error 400. El control pasa al parámetro de esfuerzo (effort). - No se puede forzar el uso de una herramienta.
tool_choiceconanyotooldevuelve error 400. Para obtener JSON con un esquema fijo, la alternativa es el uso estricto de herramientas o las salidas estructuradas. - Los bloques de razonamiento quedan atados al modelo y a la conversación. Si cambiás de modelo a mitad de una conversación, puede perderse el razonamiento previo; y en cuentas creadas desde el 31 de agosto de 2026, editar el prompt de sistema o las herramientas a mitad de camino puede dar error.
- La herramienta vieja de uso de computadora ya no se acepta en la API de Claude ni en Google Cloud: hay que pasar al conjunto
computer_toolset_20260801. En Amazon Bedrock sigue funcionando.
Hay un quinto cambio que no da error y por eso es el más traicionero: el texto que el modelo escribe entre llamadas a herramientas ahora llega dentro de bloques de razonamiento que, con la configuración por defecto, vienen vacíos. Una aplicación que le mostraba al usuario “estoy buscando el pedido…” se queda muda sin avisar (novedades de Opus 5.5). Y como el esfuerzo por defecto bajó a medium, una integración que no lo fija explícitamente va a razonar distinto que antes. Conviene medir con los casos reales antes de migrar, no después.
¿Opus 5.5, Sonnet 5 o Fable 5.1? Cuándo conviene cada uno
| Modelo | Cuándo usarlo en una empresa |
|---|---|
| Haiku 4.5 | Tareas de alto volumen y baja dificultad: clasificar, extraer datos, rutear consultas. |
| Sonnet 5 | El grueso de los agentes que corren solos todo el día, donde el costo por conversación define si el caso cierra. |
| Opus 5.5 | El trabajo fuerte que alguien supervisa: análisis, documentos complejos, código, revisión. El modelo de uso diario para quien hoy elige Opus. |
| Fable 5.1 | Ejecuciones largas sin supervisión y problemas nuevos, donde un error cuesta más que el token. |
La lógica de ruteo por modelo que explico en el post de Sonnet 5 sigue igual. Lo que cambia es el escalón de arriba: antes de pagar Fable, hoy vale la pena probar si Opus 5.5 ya resuelve.
Qué hacer esta semana si tu empresa ya usa Claude
- Si usan claude.ai (Pro, Team o Enterprise): contale al equipo que Opus 5.5 está disponible y que rinde más dentro del mismo límite. Si alguien venía gastando créditos en Fable para tareas supervisadas, que pruebe primero con Opus 5.5.
- Si tienen integraciones por API: hacé la lista de dónde se llama a Opus 5, revisá los cuatro cambios incompatibles, fijá el esfuerzo explícitamente y corré tus casos reales con los dos modelos antes de cambiar el de producción.
- Si presupuestan un proyecto: usá el precio de lista (USD 4 / 20) para el cálculo y tomá el 40% como techo optimista, no como piso.
Un modelo más capaz y más barato no cambia por sí solo lo que hace tu equipo con Claude. Lo que mueve el resultado es qué procesos pasan por el modelo y cómo se mide. Eso es lo que trabajo con equipos en Claude para empresas y, cuando hay integraciones de por medio, en una implementación de IA.
Preguntas frecuentes.
Es el modelo que Anthropic lanzó el 22 de septiembre de 2026 en reemplazo de Opus 5, pensado para agentes que programan durante mucho tiempo y para trabajo de conocimiento. Según Anthropic, genera respuestas más de 30% más rápido que Opus 5, lee gráficos y capturas con más precisión y mantiene la ventana de contexto de 1 millón de tokens. En la API se llama claude-opus-5-5.
En la API, USD 4 por millón de tokens de entrada y USD 20 por millón de salida, contra USD 5 y 25 de Opus 5: un 20% menos por token. La lectura de caché cuesta USD 0,20 por millón (60% menos) y el procesamiento por lotes, la mitad: USD 2 y 10. Hay un modo rápido en vista previa a USD 8 y 40, solo en la API de Claude. En los planes por asiento (Pro, Max, Team y Enterprise por asiento) no tiene costo adicional: entra en el límite de uso de cada plan.
Es una estimación de Anthropic para cargas típicas facturadas por token con la configuración por defecto, no el precio de lista. Suma dos efectos: el precio por token 20% más bajo y que Opus 5.5 usa menos tokens por tarea en su esfuerzo por defecto, que ahora es medium (en Opus 5 era high). Con exactamente los mismos tokens, el ejemplo que publica Anthropic muestra una sesión 31% más barata. Si una integración fija el esfuerzo en alto, el ahorro es menor.
En Pro, Max, Team y Enterprise; el plan Free no lo incluye. Con el lanzamiento, Anthropic subió los límites de la ventana de 5 horas en Pro, Max, Team y Enterprise por asiento. También está en la API y en AWS, Google Cloud y Microsoft Foundry.
En los cinco benchmarks que publicó Anthropic, sí: por ejemplo, 66,4% contra 55,8% en Terminal-Bench 4.0 y 81,8% contra 80,7% en OSWorld 2.0, a menos de la mitad del precio por token. Anthropic no publicó SWE-bench para Opus 5.5. Su propia recomendación es usar Opus 5.5 para el trabajo que alguien supervisa y subir a Fable 5.1 cuando el resultado importa más que el precio, en ejecuciones largas sin supervisión o problemas sin un patrón previo.
Además del ID del modelo, la documentación lista cuatro cambios incompatibles: el razonamiento no se puede desactivar (se regula con el parámetro effort), tool_choice con any o tool devuelve error, los bloques de razonamiento quedan atados al modelo y a la conversación, y en la API de Claude y Google Cloud la herramienta de uso de computadora computer_20251124 se reemplaza por computer_toolset_20260801. Además, el texto entre llamadas a herramientas llega dentro de bloques de razonamiento y el esfuerzo por defecto baja a medium. Conviene probar con casos reales antes de cambiar el modelo de producción.
Última actualización: · Versión 1.0 · Fuentes: Anthropic — Introducing Claude Opus 5.5 (22/09/2026), documentación — Novedades de Claude Opus 5.5 y Claude — What a task costs on Opus 5.5. Benchmarks tal como los publicó Anthropic. Precios y disponibilidad sujetos a cambios. Análisis: Diego Ceredi, miembro del Claude Partner Network y consultor certificado por Anthropic.

Claude Enterprise ahora avisa antes de que se dispare la factura
7 min de lectura
Claude Sonnet 5: el modelo pensado para que los agentes de IA salgan más baratos a tu empresa
8 min de lectura