Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026, orientado a tareas de mucho volumen, como clasificación, extracción y enrutamiento. La novedad para una aplicación existente tiene dos partes: una tarifa que sube cuando el prompt supera 100.000 tokens y cambios de integración que impiden tratarlo como un simple reemplazo de nombre.
El anuncio oficial confirma disponibilidad en la plataforma de Claude, AWS, Google Cloud y Microsoft Azure. En la API de Claude el identificador es claude-haiku-5-5; comprueba el identificador y las condiciones en tu proveedor. Es acceso a un modelo mediante servicios: este anuncio no ofrece pesos descargables para ejecutarlo localmente.
El coste depende del tamaño de cada petición
Según la ficha del modelo y la tarifa oficial, los precios base de la API de Claude son:
- Prompts de hasta 100.000 tokens: 0,10 dólares por millón de tokens de entrada y 0,50 por millón de salida.
- Prompts de más de 100.000 tokens: 0,50 dólares por millón de entrada y 2,50 por millón de salida.
El tramo depende del prompt de cada petición, no del consumo mensual. Rebasarlo cambia la tarifa aplicable a esa petición; no conviene presupuestar toda la actividad con el precio mínimo. La ventana de contexto llega a un millón de tokens y la salida síncrona a 128.000, pero capacidad y coste son decisiones distintas.
Ejemplo hipotético, calculado con esas tarifas: 10.000 peticiones, cada una con 2.000 tokens de entrada y 100 tokens de salida facturable, sumarían 20 millones de entrada y un millón de salida. El coste base sería 2 + 0,50 = 2,50 dólares. No es una factura ni una prueba de Puntoes: excluye herramientas, caché, descuentos, impuestos y precios de otras plataformas. Si hay razonamiento, esos 100 tokens deben representar toda la salida facturable, no solo la respuesta visible.
Migrar desde Haiku 4.5 requiere revisar el cliente
La guía de migración documenta cambios en la API de mensajes. Entre los que conviene revisar:
- El razonamiento manual con
thinking.type: "enabled"ybudget_tokensdevuelve un error 400. Se sustituye por razonamiento adaptativo;output_config.effortpermite ajustar el esfuerzo. - Retira
temperature,top_pytop_k: valores no predeterminados provocan un error. Tampoco se admite terminar la conversación con una respuesta de asistente que el modelo deba completar. - Selecciona los bloques de respuesta por su campo
type. El primero puede ser de razonamiento, en lugar del texto que espera tu aplicación. Unmax_tokensdemasiado pequeño puede agotarse antes de producir texto.
Si utilizas control del ordenador o guardas conversaciones con bloques de razonamiento, consulta también sus apartados específicos: cambian herramientas y condiciones de reutilización. La guía distingue estos clientes de Claude Managed Agents, donde indica que basta cambiar el nombre del modelo.
Las novedades técnicas advierten además de que el mismo texto cuenta aproximadamente un 30% más de tokens que en Haiku 4.5, según el contenido. Recuenta prompts; no reutilices una estimación antigua. El razonamiento adaptativo está activado por defecto, pero se puede desactivar con thinking.type: "disabled" a esfuerzo high o inferior. No es obligatorio para todas las peticiones.
Una decisión concreta antes de sustituirlo
Para un clasificador de incidencias ficticio, mantendríamos una muestra fija con casos ambiguos y etiquetas revisadas por personas. Compararíamos errores de enrutamiento, respuestas vacías, latencia y coste real antes de cambiar todo el tráfico. Es una propuesta, no un ensayo ejecutado.
El proveedor presenta Haiku 5.5 como su modelo pequeño más rápido y capaz; eso no demuestra que mejore tu tarea. Si quieres usarlo como evaluador, el antecedente sobre calibrar un LLM como juez explica por qué el formato correcto no basta. Tampoco traslades automáticamente las reglas de migración de Sonnet 5.5 a Haiku: cada modelo tiene su documentación.
Fuentes
- Anthropic: anuncio de Claude Haiku 5.5, 7 de octubre
- Claude: ficha, disponibilidad, límites y tarifas
- Claude: tarifas, tramos y modalidades de facturación
- Claude: migración desde modelos Haiku anteriores
- Claude: novedades y cambios de comportamiento
- Simon Willison: lectura del lanzamiento. Inspiró la revisión del coste; contrastamos las condiciones con documentación primaria y aportamos un cálculo hipotético propio.