Anthropic vive las semanas más decisivas de su historia: según QZ.com, la empresa planea iniciar su gira de inversores en la semana del 9 de noviembre para cotizar antes de Acción de Gracias, con una valoración entre 1,8 y 2 billones de dólares. Claude Haiku 5.5 llegó en medio de ese panorama, el miércoles 7 de octubre. Para Anthropic , el calendario no es casualidad: frente a OpenAI, la compañía quiere que su modelo más pequeño y rápido capture el trabajo diario de los desarrolladores.
El lanzamiento completa la trilogía 5.5: Opus 5.5 llegó el 22 de septiembre y Sonnet 5.5 el 28 de septiembre. Como lo resumió Decrypt, Haiku 5.5 se presenta como el modelo más barato y rápido jamás publicado por la empresa. El presentador no oculta su sorpresa por ver por fin esta actualización: Haiku 4.5 llevaba casi un año sin cambios y se había quedado atrás.
Precios: recorte fuerte con umbral de 100.000 tokens
Los precios son agresivos: 0,10 dólares por millón de tokens de entrada y 0,50 por millón de salida hasta 100.000 tokens. Según el anuncio de Anthropic, esta tarifa queda un 90 % por debajo de los 1 y 5 dólares de Haiku 4.5; por encima de 100.000 tokens el descuento baja al 50 % (0,50 y 2,50 dólares). La cifra media de la empresa sitúa los costes operativos alrededor de un 75 % más bajos , porque cerca del 90 % de las peticiones del modelo anterior quedaban bajo el umbral. SimonWillison advierte un matiz sutil: el nuevo tokenizer divide el mismo texto en unas 1,25 veces más tokens, así que el descuento real es más suave que la tarifa publicada.
El precio coincide exactamente con GPT-6 Luna, el modelo pequeño de OpenAI publicado el 22 de septiembre a las mismas tarifas de 0,10 y 0,50 dólares. Por debajo de 100.000 tokens ambos cuestan igual; por encima el panorama cambia, porque Luna mantiene sus tarifas hasta 272.000 tokens y solo entonces sube a 0,20 y 0,75 dólares. Las filas de resultados que recoge Decrypt justifican el gasto: Haiku 5.5 supera a Luna en las seis pruebas publicadas. La conclusión de SimonWillison es clara: Haiku gana en contexto corto, Luna en contexto largo.
Mediciones: gran salto de un modelo pequeño
La tabla del anuncio oficial muestra la magnitud del salto: en OSWorld 2.1, que mide el uso real de un ordenador, Haiku 5.5 logra el 72,4 % frente al 15,7 % de Haiku 4.5 y el 48,9 % de Luna. La prueba de programación agéntica Terminal-Bench 4.0 es aún más elocuente: 39,2 % frente a 0,0 % , con Luna en el 16,4 %. El trabajo de conocimiento marca 1.620 frente a 735 en GDPval-AA (Luna en 1.437), 46,4 % frente a 42,4 % en FrontierCode y 46,4 % frente a 6,4 % en la prueba visual Chartography (Luna en 29,1 %). La recopilación completa de Technology Org muestra que el único rival sólido fuera de la comparación, Sonnet 5.5 (70,6 % en Terminal-Bench, por ejemplo), sigue jugando una liga por encima.
Las cifras de los clientes con acceso anticipado respaldan la tabla: según SiliconAngle, Asana vio caer la latencia de su producto agéntico más de un 30 % , con inferencia hasta 2,5 veces más rápida por turno. HubSpot registró un 92,8 en su batería de pruebas de CRM, su mejor nota hasta la fecha. El informe de Box es más detallado: 60 frente a 49 en evaluación de trabajo complejo, alrededor de un 27 % menos de tokens y la mitad de tiempo, con la brecha ampliada a 19 puntos en redacción de informes con derivación numérica.
Esfuerzo ajustable y vías de acceso
Haiku 5.5 es el primer modelo Haiku con esfuerzo ajustable : el desarrollador elige razonamiento bajo, medio, alto o máximo según la tarea; el razonamiento no se desactiva y el valor medio viene por defecto. Las curvas publicadas por Anthropic muestran la precisión subiendo con el coste. El experimento lúdico de SimonWillison concreta el intercambio: un pelícano dibujado con esfuerzo bajo tardó 7 segundos y costó 0,09 centavos, frente a 5 minutos y 9 segundos con 3,38 centavos al máximo.
El acceso es amplio: el modelo está disponible en el asistente Claude, dentro de Claude Code, por API y en las nubes de Amazon, Google y Microsoft, con la nube pública estadounidense incluida. SiliconAngle anota dos descuentos más: el precio de lectura de caché de Sonnet 5.5 se reduce a la mitad, de 0,20 a 0,10 dólares, es decir alrededor de un 20 % menos en la mayor parte del trabajo agéntico. Créditos API mensuales endulzan las suscripciones: 100 dólares para Max 5x, 200 para Max 20x y hasta 500 dólares compartidos para planes de equipo. Decrypt precisa que los créditos igualan la cuota y no se acumulan.
Pruebas en vídeo: de juegos a diseño
Las pruebas del presentador van más allá de las cifras: el clon sencillo de Mac que produjo Haiku 4.5 hace 11 meses convive con el clon de Minecraft generado por Haiku 5.5, con cuevas y física del agua. La prueba más extrema produce un esqueleto de juego de zombis al estilo Call of Duty; una sala isométrica convence por texturas y luz. El ejemplo comunitario destacado viene de un usuario llamado Theo, que construyó una mazmorra con atmósfera cambiante en una sola hora. El diseño animado impresiona más: una animación que exige 40 minutos a los modelos frontera sale de Haiku 5.5 en unos 15 minutos .
El veredicto del presentador gira sobre el eje precio-rendimiento: el modelo cuesta tan poco como Luna pero lo supera con claridad, y termina antes en los duelos frente a Grok. Su conducta cercana a Sonnet en tareas simples lo convierte en subagente natural dentro de Claude Code: el modelo grande traza el plan y el pequeño asume las subtareas repetitivas. La etiqueta de herramienta diaria cobra sentido en esa arquitectura: no un modelo sin límites, sino un compañero barato que trabaja sin pausa.
| Punto | Valor |
|---|---|
| Precio | 0,10 dólares de entrada y 0,50 de salida |
| OSWorld 2.1 | 72,4 %, por delante de Luna |
| Esfuerzo | Primer Haiku ajustable |
Momentos clave
Comentario de la IA
"La carrera de los modelos pequeños ya no se decide solo por precio; la precisión se sentó a la misma mesa. Haiku 5.5 parece el primer modelo barato sin excusas, aunque conviene ver la factura de los contextos largos antes de decidir."
Evaluación de la IA
La objeción más fuerte habita a la sombra de la velocidad: el equipo de Decrypt anota que el modelo respondió a una sencilla pregunta de lógica casi al instante, y mal. La confianza ciega sale cara, sobre todo ante clientes. El entusiasmo del presentador también merece descuento: las pruebas usan tareas elegidas con ajustes elegidos, y no toda carga reproducirá el mismo cuadro.
Los límites están claramente trazados: por encima de 100.000 tokens la ventaja de precio pasa a Luna (SimonWillison), la propia Anthropic orienta la programación agéntica compleja hacia Sonnet y Opus (SiliconAngle), y las pruebas de intrusión con técnicas ofensivas siguen bloqueadas. Haiku 5.5 no es pues el modelo para todo, sino el de tareas acotadas, repetitivas y sensibles a la velocidad.
El móvil de la empresa también merece atención: el objetivo de cotización entre 1,8 y 2 billones de dólares que recoge QZ.com convive con ingresos 2025 de 4.600 millones y una pérdida neta cercana a 42.000 millones (sobre todo contable). Recortar precios de este modo se lee como una maniobra para ampliar la base de desarrolladores antes de la salida a bolsa. Los testimonios que comparte Anthropic son además ejemplos elegidos; sin verificación independiente, es pronto para tomar la tabla al pie de la letra.
El mensaje práctico es claro: los equipos con gran volumen de resúmenes, clasificaciones, consultas a bases y soporte en directo pueden lanzar una pequeña prueba y medir el coste directamente. Para arquitecturas de agentes, la receta está fijada: el modelo grande planifica y Haiku repite. Los créditos API mensuales de los planes Max y de equipo abaratan aún más el billete de prueba.
Fuentes
8 enlaces; ninguna otra noticia publicada los cita. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube.com YouTube — WorldofAI
- @anthropic.com Anthropic — Introducing Claude Haiku 5.5
- @simonwillison.net Simon Willison — Introducing Claude Haiku 5.5
- @decrypt.co Decrypt — Anthropic Launches Haiku 5.5
- @technology.org Technology Org — Claude Haiku 5.5 price and benchmarks
- @qz.com QZ — Anthropic pre-Thanksgiving IPO
- @siliconangle.com SiliconAngle — Haiku 5.5 and Sonnet cache cut
- @blog.box.com Box Blog — Haiku 5.5 accuracy and latency
claude haiku · anthropic · inteligencia artificial · llm · precios api