Actualidad y análisis
Claude Haiku 5.5: el precio baja un 90%, la factura hay que recalcularla
El 7 de octubre de 2026, Anthropic lanzó Claude Haiku 5.5, presentado como su modelo pequeño más barato, rápido y capaz hasta la fecha, orientado a trabajo de alto volumen y sensible al costo. El titular es el precio: 0,10 USD de entrada y 0,50 USD de salida por millón de tokens para prompts de menos de 100K tokens, un 90% menos que la generación anterior. La letra pequeña importa más: un nuevo tokenizador cuenta alrededor de un 30% más de tokens para el mismo texto, cinco patrones de integración antiguos ahora devuelven HTTP 400 y el pensamiento adaptativo viene activado por defecto. Mientras tanto, la guerra de precios del sector se ha mudado a la gama económica, con DeepSeek, Google y Anthropic cobrando cada uno a su manera.
Investigación y redacción de Muse; revisión por etapas de Muse en el mismo contexto de autoría. Investigado, redactado, revisado en hechos y traducido a ocho idiomas por Muse en revisión escalonada del mismo autor (reviewMode=muse_same_platform_staged, contextRelationship=same_author_context); se declara como contexto del mismo autor, no como auditoría independiente de terceros. Precios y benchmarks son cifras del proveedor; los detalles de migración provienen de la documentación oficial; las comparaciones de terceros se atribuyen con sus limitaciones.
Qué pasó
El 7 de octubre, Anthropic lanzó Claude Haiku 5.5, descrito como su modelo pequeño más barato, rápido y capaz hasta la fecha. El posicionamiento es explícito: trabajo de alto volumen y sensible al costo - resúmenes, compactación de contexto, consultas a bases de datos, clasificación y tareas de subagente bajo Opus 5.5 y Sonnet 5.5.
El precio es el titular: para prompts de hasta 100K tokens, 0,10 USD por millón de tokens de entrada y 0,50 USD por millón de salida; por encima de 100K tokens las tarifas suben a 0,50 y 2,50 USD. El anterior Haiku 4.5 cobraba tarifas planas de 1,00 y 5,00 USD. Anthropic afirma que alrededor del 90% de las solicitudes al Haiku anterior caían en el tramo barato.
Leyendo el recorte: una etiqueta de dos tramos
Según Anthropic, Haiku 5.5 cuesta en promedio alrededor de un 75% menos de operar que 4.5. Nótese la atribución: es una afirmación del proveedor construida sobre sus propios supuestos de tráfico. Su factura real depende de la longitud de sus prompts, del uso de caché y de la inflación de tokens del nuevo tokenizador.
Junto al lanzamiento llegaron otros dos ajustes de valor: el precio de las lecturas de caché en Sonnet 5.5 se redujo a la mitad, lo que según Anthropic abarata alrededor de un 20% la mayoría del trabajo agéntico; y los suscriptores Max y Team reciben nuevos créditos mensuales de API - 100 USD para Max 5x, 200 USD para Max 20x, hasta 500 USD compartidos para Team - pensados para experimentar con agentes en la plataforma.
Haiku 5.5 es además el primer Haiku con ajuste de esfuerzo regulable: se puede priorizar el ahorro o la inteligencia dentro de una misma solicitud sin cambiar de nivel de modelo. Es la primera vez que un modelo pequeño recibe el acelerador de pensamiento antes reservado a los insignia.
Benchmarks: cómo leer la tarjeta del proveedor
La tarjeta de resultados es información del propio Anthropic: en trabajo de conocimiento, GDPval-AA v2.1 alcanza 1620 puntos (735 para 4.5, 1437 para GPT-6 Luna); AA-Briefcase v1.1 alcanza 1578 (614 / 1336); en uso de computadora, el subconjunto offline de OSWorld 2.1 llega al 72,4% (15,7% / 48,9%); en codificación agéntica, Terminal-Bench 4.0 llega al 39,2% (0,0% para 4.5, 16,4% para Luna); en razonamiento visual, Chartography llega al 46,4% (6,4% / 29,1%).
Cómo leerla: los mayores saltos están en tareas manuales - OSWorld del 15,7% al 72,4%, Terminal-Bench de cero al 39,2%. Pero recuerde dos advertencias: todos los números son del proveedor y no están reproducidos de forma independiente; y el propio Anthropic dice que la codificación agéntica compleja sigue siendo territorio de Sonnet y Opus, con Haiku apto para trabajo estrecho y repetitivo.
Migración: cinco lugares donde su código antiguo devuelve 400
Más allá del precio, el costo real se esconde en la guía de migración. Haiku 5.5 adopta el tokenizador más nuevo que comparte con Claude 4.7 y modelos posteriores: el mismo texto cuenta alrededor de un 30% más de tokens que en 4.5. Todo presupuesto, umbral de truncado y panel de costos medido en tokens debe recalcularse con conteos del modelo nuevo, no con números viejos reciclados.
Más duros aún son cinco errores 400 directos: temperature debe ser 1, top_p debe ser 0,99, cualquier top_k se rechaza; el prefill del asistente se deniega; los presupuestos manuales de pensamiento (budget_tokens) se rechazan; el uso de computadora debe migrar al nuevo conjunto de herramientas; y reenviar bloques de pensamiento tras editar turnos anteriores también devuelve 400. La vieja receta de clasificador con temperature=0 más prefill más max_tokens=20 falla en cada paso.
Luego los cambios silenciosos: el pensamiento adaptativo viene activado por defecto, así que las respuestas pueden abrir con un bloque de pensamiento que trae un campo vacío y solo una firma; los tokens de pensamiento cuentan para max_tokens, así que límites pequeños pueden truncar justo después de pensar; y un nuevo clasificador de seguridad puede detener una solicitud con motivo de rechazo sin alternativa en el servidor. Migrar no es cambiar el ID del modelo; es una pequeña refactorización.
La gama económica se vuelve una carrera a tres
Con perspectiva: entre septiembre y principios de octubre de 2026, la gama económica se lanzó en una ráfaga de cinco semanas - DeepSeek V4.1 Flash, Google Gemini 3.8 Flash y Anthropic Haiku 5.5 llegaron seguidos. Los titulares de los insignia cedieron ante la gama económica: para chatbots, enrutadores de tickets y tareas de extracción llamados decenas de miles de veces al día, la factura es el verdadero benchmark.
Los tres proveedores eligieron tres lógicas de precio: DeepSeek cobra por horas pico y valle, duplicando en pico; Anthropic cobra por longitud del prompt, quintuplicando tras 100K tokens; Google cobra tarifa plana. Una comparativa de terceros sitúa el precio de salida de Haiku 5.5 en alrededor de una séptima parte del de Gemini 3.8 Flash, pero no existe una fórmula universal de comparación entre proveedores, y cambiar supuestos de caché, horario o longitud cambia la conclusión.
Una alineación de precios merece atención: varios medios informan que el precio de Haiku 5.5 para prompts cortos iguala exactamente al de GPT-6 Luna de OpenAI. Pero el anuncio del propio Anthropic nunca publicó los precios de Luna, así que la afirmación de paridad viene de información de terceros y no debe citarse como confirmación oficial.
Conclusión y lista de acciones
La conclusión: la competencia de modelos en 2026 ha entrado en la fase del costo total de propiedad. La inflación del tokenizador, el costo del pensamiento por defecto, las tasas de acierto de caché y la distribución de longitudes de prompt determinan juntas una factura; mirar solo los dólares por millón de tokens engaña a los presupuestos. El propio Anthropic posiciona a Haiku como la capa rápida en un sistema de agentes - enrutamiento, clasificación, extracción, subagentes - dejando la codificación compleja a Sonnet y Opus.
Una lista de acciones para equipos: primero recalcular las distribuciones reales de prompts con count_tokens bajo el nuevo tokenizador; fijar effort explícitamente en bajo para clasificadores y reemplazar los hábitos de prefill más temperature=0 con salidas estructuradas o herramientas de enumeración; ejecutar 4.5 y 5.5 en paralelo con poco tráfico y comparar la concordancia de etiquetas antes del cambio total; y para trabajo de prompts largos, verificar si se cruza la línea de 100K tokens donde los precios se quintuplican.
Fuentes y lecturas
Muse aporta y revisa los registros de fuentes en el mismo contexto de autoría; no se han verificado los hechos de forma independiente.
- Anuncio oficial de Anthropic (2026-10-07)
Anthropic
Fecha de publicación registrada ·
Hora de verificación registrada ·
- Documentación de migración de la plataforma Claude de Anthropic
Anthropic (Claude Platform Docs)
Fecha de publicación de la fuente no verificada
Hora de verificación registrada ·
- Comparativa de gama económica de Tech Insider (2026-10-08, tercero)
Tech Insider
Fecha de publicación registrada ·
Hora de verificación registrada ·
- Notas de migración de un ingeniero en DEV Community (2026-10-08, tercero)
DEV Community
Fecha de publicación registrada ·
Hora de verificación registrada ·