Hay automatizaciones que en una empresa argentina nunca pasaron del Excel de costos: clasificar cada consulta que entra por WhatsApp, leer todas las facturas y remitos del mes, rutear cada correo al área que corresponde. No porque la IA no pudiera, sino porque a decenas de miles de llamadas por mes la cuenta no cerraba. El 7 de octubre de 2026 Anthropic lanzó Claude Haiku 5.5 y esa cuenta cambió de orden de magnitud.
Claude Haiku 5.5 es el modelo chico y rápido de Anthropic, lanzado el 7 de octubre de 2026 para trabajo de alto volumen: clasificar, extraer datos, rutear y hacer de subagente. Cuesta USD 0,10 por millón de tokens de entrada y USD 0,50 de salida en prompts de hasta 100.000 tokens (USD 0,50 y 2,50 por encima). Haiku 4.5 sigue a USD 1 y 5: es diez veces menos por token.
Como el mismo texto cuenta unos 30% más tokens, el ahorro real por tarea ronda las siete u ocho veces. En el cálculo de este artículo, clasificar 30.000 consultas por mes pasa de unos USD 69 a unos USD 9. Pero el código escrito para Haiku 4.5 puede romperse: antes de cambiar el modelo hay que revisar parámetros, prefill y cómo se lee la respuesta.
¿Qué es Claude Haiku 5.5 y qué cambia respecto de Haiku 4.5?
Haiku es el escalón chico de la familia Claude: el más rápido y el más barato. Anthropic lo describe como el modelo para trabajo de alto volumen y sensible a la latencia, como clasificación, ruteo, extracción y tareas de subagente (novedades de Haiku 5.5). Frente a Haiku 4.5, los cambios que importan a una empresa son cuatro:
- Precio: de USD 1 / 5 a USD 0,10 / 0,50 por millón de tokens, mientras el prompt no pase de 100.000 tokens.
- Contexto: la ventana sube de 200.000 a 1 millón de tokens y la salida máxima, de 64.000 a 128.000.
- Pensamiento adaptativo: el modelo decide cuánto razonar y vos lo regulás con el parámetro de esfuerzo (
effort), que por defecto está enmedium. Según Anthropic, es el primer Haiku con control de esfuerzo. - Tokenizador nuevo: el mismo texto cuenta aproximadamente 30% más tokens que en Haiku 4.5. Todo lo que hoy medís en tokens (costos, límites) hay que recalcularlo.
Está en dos lugares. En la app, cualquier usuario de los planes Free, Pro, Max, Team y Enterprise puede elegir Haiku 5.5 en claude.ai, en la web y en iOS y Android, y también está en Claude Code (Anthropic). Y para integraciones se usa por la API de Claude como claude-haiku-5-5, y en Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry (notas de versión de Anthropic). Este análisis se enfoca en las automatizaciones por API, que es donde el precio por token decide si un proceso vive o muere. En la app no cambia lo que paga cada asiento: es una opción más en el selector de modelos.
¿Cuánto cuesta Claude Haiku 5.5 frente a Haiku 4.5 y Sonnet 5.5?
| Modelo | Entrada / salida (USD por millón) | Lectura de caché | Contexto |
|---|---|---|---|
| Haiku 4.5 | 1 / 5 | 0,10 | 200.000 |
| Haiku 5.5 (prompt hasta 100.000 tokens) | 0,10 / 0,50 | 0,01 | 1 millón |
| Haiku 5.5 (prompt de más de 100.000 tokens) | 0,50 / 2,50 | 0,05 | 1 millón |
| Sonnet 5.5 | 2 / 10 | 0,10 | 1 millón |
| Opus 5.5 | 4 / 20 | 0,20 | 1 millón |
Fuente: la página de precios de Anthropic. Dos detalles que cambian la cuenta. Primero, Haiku 5.5 es el único modelo actual de Claude con precio por tamaño de prompt: si una llamada pasa de 100.000 tokens (un contrato largo, un historial entero), toda esa llamada se cobra a la tarifa alta, que igual queda a la mitad de Haiku 4.5. Segundo, el procesamiento por lotes (Batch API) tiene 50% de descuento: lo que no necesita respuesta inmediata, como procesar las facturas del día a la noche, baja a la mitad.
¿Qué tareas conviene pasarle a Haiku 5.5 y cuáles a Sonnet u Opus?
La pregunta no es qué modelo es mejor, sino cuál es el más barato que resuelve bien cada paso. La propia Anthropic lo plantea así: Haiku 5.5 para velocidad y volumen, Sonnet 5.5 para tareas bien acotadas y Opus 5.5 como modelo de uso diario para el trabajo complejo (Anthropic). Llevado a procesos de una empresa:
| Modelo | Qué tareas pasarle |
|---|---|
| Haiku 5.5 | Clasificar tickets y consultas de WhatsApp por tema o urgencia; extraer CUIT, importes y fechas de facturas y remitos; rutear correos; resumir; ser el subagente que busca un dato mientras otro modelo arma el informe. |
| Sonnet 5.5 | Redactar la respuesta al cliente, consultar sistemas, resolver casos acotados de varios pasos. El grueso de un agente que trabaja solo. |
| Opus 5.5 | Análisis de documentos complejos, decisiones con consecuencias, código y el trabajo que alguien supervisa (qué cambia con Opus 5.5). |
La señal para usar Haiku es que la tarea tenga una respuesta corta y verificable: una categoría, un JSON con campos, un área de destino. Si para decidir hay que leer entre líneas o escribir algo que llega al cliente, conviene que ese paso suba a Sonnet. El diseño de un agente que combina modelos está en cómo abaratar agentes con Sonnet; este artículo responde la otra mitad: qué pasa con el paso chico y masivo.
¿Cuánto baja el costo de una automatización? Un cálculo con números
Tomemos una empresa que recibe 30.000 consultas por mes entre WhatsApp, formulario web y correo, y quiere que cada una se clasifique sola (tema, urgencia y área) antes de llegar a una persona. Supuestos, medidos con el tokenizador de Haiku 4.5:
- Instrucciones fijas con las categorías y ejemplos: 1.500 tokens.
- El mensaje del cliente: 300 tokens en promedio.
- La respuesta, un JSON corto: 100 tokens.
- En Haiku 5.5 y Sonnet 5.5 todo eso cuenta 30% más: 2.340 tokens de entrada y 130 de salida por consulta.
| Modelo | Tokens por mes (entrada / salida) | Cálculo | Costo por mes |
|---|---|---|---|
| Haiku 4.5 | 54M / 3M | 54 × 1 + 3 × 5 | ~USD 69 |
| Haiku 5.5 | 70,2M / 3,9M | 70,2 × 0,10 + 3,9 × 0,50 | ~USD 9 |
| Haiku 5.5 con 200 tokens de razonamiento por consulta | 70,2M / 9,9M | 70,2 × 0,10 + 9,9 × 0,50 | ~USD 12 |
| Sonnet 5.5 | 70,2M / 3,9M | 70,2 × 2 + 3,9 × 10 | ~USD 179 |
Tres lecturas. La primera: con Haiku 5.5, clasificar todo lo que entra cuesta del orden de diez dólares por mes, y ahí está el cambio: tareas que no cerraban por costo pasan a cerrar, y se puede clasificar el cien por ciento de lo que entra en lugar de una muestra. La segunda: el razonamiento se cobra como salida, así que en una clasificación simple conviene bajar el esfuerzo y medir si la precisión se sostiene. La tercera: usar Sonnet para todo cuesta unas veinte veces más que Haiku 5.5 sin ganar nada en una tarea que Haiku resuelve bien. Son supuestos ilustrativos; el número de tu empresa sale de medir tus propios mensajes.
¿Qué se rompe al migrar de Haiku 4.5 a Haiku 5.5?
Anthropic lo avisa sin vueltas: el código escrito para Haiku 4.5 puede romperse en Haiku 5.5. Cambiar claude-haiku-4-5 por claude-haiku-5-5 no alcanza. El checklist, según la guía de migración:
- Sacá
temperature,top_pytop_k. Muchos clasificadores fijantemperature: 0para que respondan siempre igual. En Haiku 5.5 cualquier valor distinto del default da error 400. - Reemplazá el prefill. Si tu código termina el mensaje con un turno del asistente (por ejemplo, abriendo una llave para forzar JSON), ahora da error. Para JSON con esquema fijo están las salidas estructuradas o el uso estricto de herramientas.
- Leé los bloques por tipo, no por posición. El pensamiento adaptativo viene activado, así que la respuesta puede empezar con un bloque de razonamiento. El código que toma el primer bloque como respuesta falla en silencio.
- Subí
max_tokenso bajá el esfuerzo. Los tokens de razonamiento cuentan dentro del límite: un clasificador conmax_tokenschico puede cortarse después de pensar y antes de escribir la respuesta. - Cambiá el presupuesto manual de razonamiento.
budget_tokensda error; el control pasa aeffort. - Recontá tokens y costos. Con 30% más tokens por el mismo texto, los límites y presupuestos armados para Haiku 4.5 quedan cortos.
- Manejá el rechazo. Los clasificadores de seguridad pueden declinar un pedido con
stop_reason: "refusal", y el flujo tiene que saber qué hacer con eso.
Si usás el uso de computadora en la API de Claude o en Google Cloud, además hay que pasar al conjunto computer_toolset_20260801. Y una buena noticia para quien migra clasificadores: a diferencia de Sonnet 5.5, Haiku 5.5 sí acepta forzar el uso de una herramienta (tool_choice con any o tool), aunque en ese caso responde sin razonar antes. La recomendación de siempre vale doble: corré tus casos reales con los dos modelos, compará precisión y costo, y recién ahí cambiá el de producción.
El ahorro de un modelo más barato se aprovecha cuando alguien decide qué procesos pasan por cada modelo y cómo se mide el resultado. Ese diseño, con las integraciones migradas y probadas, es lo que hago en una implementación de IA y, del lado de los equipos que usan Claude, en Claude para empresas.
Preguntas frecuentes.
Es el modelo chico y rápido de la familia Claude, lanzado por Anthropic el 7 de octubre de 2026 (claude-haiku-5-5). Está pensado para trabajo de alto volumen y sensible a la latencia: clasificar, rutear, extraer datos y correr como subagente de un modelo más grande. Tiene una ventana de contexto de 1 millón de tokens, hasta 128.000 tokens de salida y pensamiento adaptativo con parámetro de esfuerzo. Se puede elegir en claude.ai (web, iOS y Android) en los planes Free, Pro, Max, Team y Enterprise, está en Claude Code y, para integraciones, en la API de Claude, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry.
USD 0,10 por millón de tokens de entrada y USD 0,50 de salida cuando el prompt tiene hasta 100.000 tokens; por encima de ese tamaño, USD 0,50 y USD 2,50. Haiku 4.5 sigue a USD 1 y USD 5, así que por token es diez veces más barato. Hay que descontar un efecto: Haiku 5.5 usa un tokenizador nuevo y el mismo texto cuenta alrededor de 30% más tokens, por lo que el ahorro real por tarea ronda las siete u ocho veces. La lectura de caché cuesta USD 0,01 por millón y el procesamiento por lotes tiene 50% de descuento.
A Haiku 5.5, las tareas cortas, repetitivas y con respuesta verificable: clasificar tickets o mensajes de WhatsApp, extraer campos de facturas y remitos, rutear correos, resumir y hacer de subagente. A Sonnet 5.5 (USD 2 / USD 10), los pasos que necesitan redactar o razonar sobre un caso acotado. A Opus 5.5 (USD 4 / USD 20), el análisis complejo y el trabajo que alguien supervisa. La regla es mandar cada paso al modelo más barato que lo resuelve bien y medirlo con casos reales.
Con un prompt fijo de unos 1.500 tokens, un mensaje de 300 y una respuesta corta de 100 (medidos con el tokenizador de Haiku 4.5), clasificar 30.000 consultas por mes sale unos USD 69 con Haiku 4.5 y unos USD 9 con Haiku 5.5, ya sumando el 30% de tokens extra del tokenizador nuevo. Con Sonnet 5.5 la misma carga rondaría USD 179. Si el modelo piensa antes de responder, esos tokens se cobran como salida: con unos 200 tokens de razonamiento por consulta, Haiku 5.5 sube a unos USD 12. Son supuestos ilustrativos; el número real sale de medir tus mensajes.
Según la guía de migración de Anthropic: el presupuesto manual de razonamiento (budget_tokens) da error 400; temperature, top_p y top_k con valores distintos del default dan error; el prefill (terminar el mensaje con un turno del asistente) da error; el pensamiento adaptativo viene activado, así que la respuesta puede empezar con un bloque de razonamiento y el código que lee el primer bloque como respuesta falla; los tokens de razonamiento cuentan dentro de max_tokens; y el mismo texto cuenta unos 30% más tokens. Además, el uso de computadora en la API de Claude y Google Cloud pide el nuevo computer_toolset_20260801.
En la app y por API. Según Anthropic, los usuarios de los planes Free, Pro, Max, Team y Enterprise pueden elegir Haiku 5.5 en claude.ai, en la web y en iOS y Android, y también está en Claude Code. Para integraciones se usa por la API de Claude como claude-haiku-5-5, en Amazon Bedrock, en Claude Platform on AWS, en Google Cloud y en Microsoft Foundry. Para automatizaciones de alto volumen, lo que define si el proceso cierra en números es el precio por token de la API.
Última actualización: · Fuentes: Anthropic — notas de versión (7/10/2026), Anthropic — Claude Haiku, precios de Anthropic, novedades de Claude Haiku 5.5 y guía de migración a Haiku 5.5. El cálculo de costos usa supuestos ilustrativos declarados en el texto. Precios y disponibilidad sujetos a cambios. Análisis: Diego Ceredi, miembro del Claude Partner Network y consultor certificado por Anthropic.

Claude Sonnet 5: el modelo pensado para que los agentes de IA salgan más baratos a tu empresa
8 min de lectura
Claude para Startups: qué da el programa de Anthropic y cómo aplicar desde Argentina
9 min de lectura