Volver al inicio

Claude Haiku 5.5: el modelo más barato y rápido de Anthropic

Anthropic lanzó Claude Haiku 5.5 el 7 de octubre: con un precio de 0,10 dólares por millón de tokens de entrada, esfuerzo ajustable y puntuaciones por encima de GPT-6 Luna, la economía de los modelos pequeños está cambiando.

Importado a Nodesdaily: (UTC+03:00)
Ver en YouTube — 6gfACqBAKfw
Opciones de lectura

La voz del dispositivo no está disponible en este navegador.

Lupa de conceptos

Elige un término técnico de esta vista para leer su definición general, un ejemplo didáctico y su uso en el artículo.

No se encontró ningún término de nuestro glosario en esta vista. El glosario aún no cubre todos los términos.

Anthropic vive las semanas más decisivas de su historia: según QZ.com, la empresa planea iniciar su gira de inversores en la semana del 9 de noviembre para cotizar antes de Acción de Gracias, con una valoración entre 1,8 y 2 billones de dólares. Claude Haiku 5.5 llegó en medio de ese panorama, el miércoles 7 de octubre. Para Anthropic , el calendario no es casualidad: frente a OpenAI, la compañía quiere que su modelo más pequeño y rápido capture el trabajo diario de los desarrolladores.

El lanzamiento completa la trilogía 5.5: Opus 5.5 llegó el 22 de septiembre y Sonnet 5.5 el 28 de septiembre. Como lo resumió Decrypt, Haiku 5.5 se presenta como el modelo más barato y rápido jamás publicado por la empresa. El presentador no oculta su sorpresa por ver por fin esta actualización: Haiku 4.5 llevaba casi un año sin cambios y se había quedado atrás.

Precios: recorte fuerte con umbral de 100.000 tokens

Los precios son agresivos: 0,10 dólares por millón de tokens de entrada y 0,50 por millón de salida hasta 100.000 tokens. Según el anuncio de Anthropic, esta tarifa queda un 90 % por debajo de los 1 y 5 dólares de Haiku 4.5; por encima de 100.000 tokens el descuento baja al 50 % (0,50 y 2,50 dólares). La cifra media de la empresa sitúa los costes operativos alrededor de un 75 % más bajos , porque cerca del 90 % de las peticiones del modelo anterior quedaban bajo el umbral. SimonWillison advierte un matiz sutil: el nuevo tokenizer divide el mismo texto en unas 1,25 veces más tokens, así que el descuento real es más suave que la tarifa publicada.

El precio coincide exactamente con GPT-6 Luna, el modelo pequeño de OpenAI publicado el 22 de septiembre a las mismas tarifas de 0,10 y 0,50 dólares. Por debajo de 100.000 tokens ambos cuestan igual; por encima el panorama cambia, porque Luna mantiene sus tarifas hasta 272.000 tokens y solo entonces sube a 0,20 y 0,75 dólares. Las filas de resultados que recoge Decrypt justifican el gasto: Haiku 5.5 supera a Luna en las seis pruebas publicadas. La conclusión de SimonWillison es clara: Haiku gana en contexto corto, Luna en contexto largo.

Mediciones: gran salto de un modelo pequeño

La tabla del anuncio oficial muestra la magnitud del salto: en OSWorld 2.1, que mide el uso real de un ordenador, Haiku 5.5 logra el 72,4 % frente al 15,7 % de Haiku 4.5 y el 48,9 % de Luna. La prueba de programación agéntica Terminal-Bench 4.0 es aún más elocuente: 39,2 % frente a 0,0 % , con Luna en el 16,4 %. El trabajo de conocimiento marca 1.620 frente a 735 en GDPval-AA (Luna en 1.437), 46,4 % frente a 42,4 % en FrontierCode y 46,4 % frente a 6,4 % en la prueba visual Chartography (Luna en 29,1 %). La recopilación completa de Technology Org muestra que el único rival sólido fuera de la comparación, Sonnet 5.5 (70,6 % en Terminal-Bench, por ejemplo), sigue jugando una liga por encima.

Las cifras de los clientes con acceso anticipado respaldan la tabla: según SiliconAngle, Asana vio caer la latencia de su producto agéntico más de un 30 % , con inferencia hasta 2,5 veces más rápida por turno. HubSpot registró un 92,8 en su batería de pruebas de CRM, su mejor nota hasta la fecha. El informe de Box es más detallado: 60 frente a 49 en evaluación de trabajo complejo, alrededor de un 27 % menos de tokens y la mitad de tiempo, con la brecha ampliada a 19 puntos en redacción de informes con derivación numérica.

Esfuerzo ajustable y vías de acceso

Haiku 5.5 es el primer modelo Haiku con esfuerzo ajustable : el desarrollador elige razonamiento bajo, medio, alto o máximo según la tarea; el razonamiento no se desactiva y el valor medio viene por defecto. Las curvas publicadas por Anthropic muestran la precisión subiendo con el coste. El experimento lúdico de SimonWillison concreta el intercambio: un pelícano dibujado con esfuerzo bajo tardó 7 segundos y costó 0,09 centavos, frente a 5 minutos y 9 segundos con 3,38 centavos al máximo.

El acceso es amplio: el modelo está disponible en el asistente Claude, dentro de Claude Code, por API y en las nubes de Amazon, Google y Microsoft, con la nube pública estadounidense incluida. SiliconAngle anota dos descuentos más: el precio de lectura de caché de Sonnet 5.5 se reduce a la mitad, de 0,20 a 0,10 dólares, es decir alrededor de un 20 % menos en la mayor parte del trabajo agéntico. Créditos API mensuales endulzan las suscripciones: 100 dólares para Max 5x, 200 para Max 20x y hasta 500 dólares compartidos para planes de equipo. Decrypt precisa que los créditos igualan la cuota y no se acumulan.

Pruebas en vídeo: de juegos a diseño

Las pruebas del presentador van más allá de las cifras: el clon sencillo de Mac que produjo Haiku 4.5 hace 11 meses convive con el clon de Minecraft generado por Haiku 5.5, con cuevas y física del agua. La prueba más extrema produce un esqueleto de juego de zombis al estilo Call of Duty; una sala isométrica convence por texturas y luz. El ejemplo comunitario destacado viene de un usuario llamado Theo, que construyó una mazmorra con atmósfera cambiante en una sola hora. El diseño animado impresiona más: una animación que exige 40 minutos a los modelos frontera sale de Haiku 5.5 en unos 15 minutos .

El veredicto del presentador gira sobre el eje precio-rendimiento: el modelo cuesta tan poco como Luna pero lo supera con claridad, y termina antes en los duelos frente a Grok. Su conducta cercana a Sonnet en tareas simples lo convierte en subagente natural dentro de Claude Code: el modelo grande traza el plan y el pequeño asume las subtareas repetitivas. La etiqueta de herramienta diaria cobra sentido en esa arquitectura: no un modelo sin límites, sino un compañero barato que trabaja sin pausa.

Visualization: nodesdaily AI
PuntoValor
Precio0,10 dólares de entrada y 0,50 de salida
OSWorld 2.172,4 %, por delante de Luna
EsfuerzoPrimer Haiku ajustable

Momentos clave

  1. Apertura: Anthropic hacia la bolsa
  2. Haiku 4.5 frente a 5.5
  3. Precio y umbral de 100.000
  4. Comparación con Luna
  5. Resultados de medición
  6. Esfuerzo ajustable
  7. El juego de una hora de Theo

Comentario de la IA

"La carrera de los modelos pequeños ya no se decide solo por precio; la precisión se sentó a la misma mesa. Haiku 5.5 parece el primer modelo barato sin excusas, aunque conviene ver la factura de los contextos largos antes de decidir."

Evaluación de la IA

La objeción más fuerte habita a la sombra de la velocidad: el equipo de Decrypt anota que el modelo respondió a una sencilla pregunta de lógica casi al instante, y mal. La confianza ciega sale cara, sobre todo ante clientes. El entusiasmo del presentador también merece descuento: las pruebas usan tareas elegidas con ajustes elegidos, y no toda carga reproducirá el mismo cuadro.

Los límites están claramente trazados: por encima de 100.000 tokens la ventaja de precio pasa a Luna (SimonWillison), la propia Anthropic orienta la programación agéntica compleja hacia Sonnet y Opus (SiliconAngle), y las pruebas de intrusión con técnicas ofensivas siguen bloqueadas. Haiku 5.5 no es pues el modelo para todo, sino el de tareas acotadas, repetitivas y sensibles a la velocidad.

El móvil de la empresa también merece atención: el objetivo de cotización entre 1,8 y 2 billones de dólares que recoge QZ.com convive con ingresos 2025 de 4.600 millones y una pérdida neta cercana a 42.000 millones (sobre todo contable). Recortar precios de este modo se lee como una maniobra para ampliar la base de desarrolladores antes de la salida a bolsa. Los testimonios que comparte Anthropic son además ejemplos elegidos; sin verificación independiente, es pronto para tomar la tabla al pie de la letra.

El mensaje práctico es claro: los equipos con gran volumen de resúmenes, clasificaciones, consultas a bases y soporte en directo pueden lanzar una pequeña prueba y medir el coste directamente. Para arquitecturas de agentes, la receta está fijada: el modelo grande planifica y Haiku repite. Los créditos API mensuales de los planes Max y de equipo abaratan aún más el billete de prueba.

Fuentes

8 enlaces; ninguna otra noticia publicada los cita. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

claude haiku · anthropic · inteligencia artificial · llm · precios api

Seguir el tema

Antes de esta noticia

Un breve orden de lectura de noticias anteriores vinculadas a este evento por un editor.

Evidencia y fuentes

Revisa los pasajes de las fuentes, sus versiones y su origen.

LEE CON LAS FUENTES

Entiende esta noticia.

Comprobando tu cuenta…