Volver al inicio

Cuatro lanzamientos en un día: el regreso de Opus 5.5 y la ruptura de precios de GPT-6 Sol y Luna

OpenAI y Anthropic compartieron un mismo día de lanzamiento: GPT-6 Sol y Luna parten precios a la mitad mientras Claude Opus 5.5 alcanza el nivel Fable con un 40 por ciento menos de coste; crucé cinco análisis con los datos oficiales.

Importado a Nodesdaily: (UTC+03:00)
Ver en YouTube — KYGscdtRS1Y
Opciones de lectura

La voz del dispositivo no está disponible en este navegador.

Lupa de conceptos

Elige un término técnico de esta vista para leer su definición general, un ejemplo didáctico y su uso en el artículo.

No se encontró ningún término de nuestro glosario en esta vista. El glosario aún no cubre todos los términos.

Dos laboratorios importantes anunciaron modelos el mismo martes y elevaron a cuatro la cuenta de grandes lanzamientos de la primera mitad semanal. SpaceX AI adelantó su propio anuncio para evitar la sombra ajena, de modo que hasta el calendario se volvió terreno de competencia. La primera pregunta no fue el valor aislado de cada modelo, sino su encaje en cada flujo de trabajo.

La historia del linaje Opus ilumina este lanzamiento. La versión 4.6 había conquistado usuarios, las 4.7 y 4.8 parecían pasos menores y Opus 5 nunca enamoró. Luego las familias Mythos y Fable ocuparon la escena y dejaron a Opus en la sombra durante un largo periodo.

Opus 5.5: el cuadro oficial

El anuncio oficial lleva fecha del 22 de septiembre de 2026: Opus 5.5 iguala a Fable 5.1 en la mayoría de tareas con un coste 40 por ciento menor que Opus 5 en cargas típicas. La entrada cuesta 4 dólares por millón de tokens, la salida 20; la lectura de caché cayó un 60 por ciento hasta 0,20 dólares. La generación sale más de un 30 por ciento más rápido y los límites de cinco horas suben en los planes Pro y Max.

En seguridad, el modelo inaugura la era posterior al llamado de ritmo y pasó revisión externa en Frontier Design y METR, con la mejor nota de alineación jamás medida por Anthropic. Biología y ciberseguridad llevan salvaguardas estilo Fable, con un programa de verificación abierto a entidades validadas. El equipo de Sam Bowman lo considera más seguro que sus predecesores y sostiene que publicarlo reduce el riesgo de desalineación.

El marcador cifra la afirmación: Terminal-Bench 4.0 da a Opus 5.5 un 66,4 por ciento, por delante de Fable 5.1 con 55,8, Opus 5 con 52,3 y GPT-6 Astra con 57,9. FrontierCode marca 54,4, CursorBench 57,8, GDPval-AA 1846 (Fable 5.1 con 1735, Opus 5 con 1708, Astra con 1542), HLE con herramientas 67,7, OSWorld 81,8, Chartography 89,0 y AutomationBench 40,0. La investigación agéntica científica llega a 58,7 y duplica el 29,0 de Opus 5; Astra lidera con 64,6 pero con un coste por tarea unas cinco veces mayor.

El seguimiento independiente cuenta lo mismo: el índice Artificial Analysis puntúa a Opus 5.5 con 58, frente a 53 de Fable 5.1 y Astra. La síntesis RoboNuggets mide a Opus 5.5 siete puntos sobre Opus 5. El lado Sol se lee distinto, con GPT-6 Sol cerca del 5.6 porque OpenAI apuntó al coste antes que a la capacidad. Los detalles de Opus-sobre-Fable y Astra-arriba descansan cada uno en un único terreno de prueba, dato que conviene recordar.

Sol y Luna: el frente de costes

OpenAI presenta Sol y Luna como los avances de Astra en forma rápida y económica, con 50 por ciento de rebaja frente a las tarifas promo GPT-5.6. Los identificadores gpt-6-sol y gpt-6-luna abren en ChatGPT Work y Codex para todos los niveles de pago, de Plus a Edu. Luna alcanza además a usuarios Free y Go en la app de escritorio como prueba. Sam Altman remarca la meta del mejor modelo por banda de precio y la lógica del precio por tarea.

La bajada de precios cambia la forma de uso: límites más altos y costes más bajos empujan a usar los modelos más veces y más tiempo. En Codex, unas cuotas que duran más que en Claude Code crean una ventaja práctica de OpenAI en lo diario. Cuando los agentes de código asumen tareas largas, el coste de uso continuo decide; Fable y Claude convienen a carreras largas sin supervisión, los modelos GPT a ciclos cortos.

Los veredictos de la comunidad se dividen: Sol gana la analogía del teléfono de generación S, con lo esencial de Astra cerca de un quinto del precio. El equipo Every elige Sol para lectura y escritura diarias, Opus 5.5 para código y visual ambicioso. Varias plumas anuncian el regreso de Claude, Jeffrey Emanuel reporta errores que resistían semanas a Fable y Astra, y Chubby juzga que buscar un único ganador plantea mal la pregunta.

Primeras pruebas de uso

La medición Box bajo Aaron Levy es concreta: 63 por ciento menos de tokens , 42 por ciento menos de verborrea y 30 por ciento más de velocidad frente a Opus 5. Las tareas financieras ganan 39 por ciento de precisión, el análisis de coste cloud 65; los productos de consumo suman 17 por ciento, el diagnóstico clínico 15. Optiver iguala calidad en la mitad de turnos con 40 a 50 por ciento menos de coste, Kiro hace 40 por ciento menos de llamadas con la mitad de tokens. Una auditoría de 200.000 líneas cerró en menos de tres horas donde Opus 5 pasaba de veinte. El port de HAProxy tomó 9,5 horas contra 12 con 51 por ciento menos de coste, y una migración de 680.000 líneas se cerró en el día.

La vitrina creativa llenó los feeds sociales: Alex Albert genera animación de plastilina con una consigna, Chase Lin levanta un arrecife de coral interactivo, una escena del Golden Gate sale solo del código del modelo. Una vista de Market Street se representa con textura de 1906 en Blender, Jake Eaton comparte cuadros hechos de 7.500 líneas de píxeles. Tarek hace redibujar su web personal con su dossier, y el autor del Daily Brief juzga clara y accionable la revisión de su propio sitio por Opus 5.5.

El frente de escritura abre su propia página de victoria: el equipo Every habla del texto más legible jamás visto y la purga de rayas largas se vuelve simbólica. Los datos clave suben al frente, las sesiones largas siguen rastreables y el bucle de retorno se vuelve disfrutable. Makayla Wrigley casa la querida persona 4.6 con gusto de nivel Fable, el equipo Macallan pide disculpas por el modelo viejo y señala el nuevo. En la comparativa de Eric Tech, la salida de Opus 5 parece larga y enredada mientras 5.5 vuelve corta y rastreable.

Duelo en tres minutos y economía del esfuerzo

RoboNuggets sometió la misma maqueta de portada con idénticas referencias de diseño a ambos modelos. Sol devuelve una página limpia y profesional, con un flujo animado ordenado. El campo Opus gana la manga estética con animaciones de puntos, una app interactiva de prueba, tarjetas de información y gráficos más legibles. El veredicto del autor es nítido: Opus para gusto de interfaz, Sol cuando basta la sobriedad profesional.

Eric Tech expone la economía del esfuerzo: Opus 5.5 con esfuerzo medio alcanza a Fable con esfuerzo alto. El liderazgo de código agéntico con poco esfuerzo queda en Opus, los flujos de negocio siguen en Astra. Las puntuaciones de conocimiento del mundo real suben con el valor; el autor ata el duelo Sol a una encuesta de audiencia y sitúa la limpieza comunicativa entre los mayores avances.

Clase de animación y cuaderno de ingeniería

Andy Lo produce animación didáctica dibujada a mano con una consigna: la radiación de Hawking como relato, una catapulta como física interactiva de ajustes variables. El esqueleto del prompt sostiene un bloque de estilo, una paleta, un marco de teatrillo, una narradora, transiciones de papel y un plan de siete escenas con marcas de tiempo. La narración robótica se corrige vía Fish Audio, con Claude Code que entrega un audio separado por escena.

Duncan Rogoff reduce el manual de ingeniería a tres reglas: entregar la tarea entera, definir el terminado y decir cuándo parar para preguntar. Borrar las fórmulas de reflexión prudente ahorra tokens y contexto, y el deslizador de esfuerzo cubre la velocidad. Los seguimientos escritos durante la ejecución cuestan menos que esperar y releer todo el contexto. El archivo CLAUDE.md recibe reglas de seguir y parar, guardas de acciones destructivas, divisiones en subagentes y una lista tasks.md.

Las advertencias genéricas de gusto fallan en diseño; los patrones vetados como fondos crema se listan uno a uno. Elecciones concretas como acentos itálicos en títulos, etiquetas de sección numeradas y botones de píldora frenan la caída a la estética IA por defecto. La regla es simple: escribir lo excluido en preciso, no en vago.

La sección de límites pertenece al acta: las disciplinas de biología y ciber al estilo Fable bloquean en la práctica ciertos casos jurídicos y de ciencias de la vida. Los equipos a la espera de verificación lamentan no poder replegarse a Opus cuando Fable rechaza. El sobrerrechazo toca a pocos, pero donde golpea vuelve inútil el modelo.

Visualization: nodesdaily AI

Puntuaciones Terminal-Bench 4.0

  • Opus 5.566,4%
  • GPT-6 Astra57,9%
  • Fable 5.155,8%
  • Opus 552,3%
Más alto es mejor; cada valor aparece en el cuerpo.
TemaResumen
Opus 5.5Potencia Fable, coste 40 por ciento menor
Sol y LunaMitad de precio, para lo cotidiano
ElecciónSol a diario, Opus para ambición
ModeloTerminal-BenchGDPval-AA
Opus 5.566,4%1846
Fable 5.155,8%1735
Opus 552,3%1708
GPT-6 Astra57,9%1542

Momentos clave

  1. Lanzamiento conjunto y maniobra SpaceX
  2. Precio de Opus 5.5 frente a Fable
  3. Salto en Terminal-Bench e índice
  4. La apuesta de coste de Sol y Luna
  5. Vitrina Blender y escritura corregida
  6. Guía de ingeniería y delegación
  7. Límites y nota de ritmo

Comentario de la IA

"Dos laboratorios punteros publicaron el mismo martes, así que releí cinco análisis distintos a la luz de los anuncios oficiales y las puntuaciones independientes. Mantengo aquí mi voz editorial: sin bombo, con las cifras y los primeros usos realmente observados."

Evaluación de la IA

La versión más sólida del relato de costes es esta: a igual rendimiento, el coste cae cerca de un 47 por ciento trimestral desde 2023, más rápido que la secuenciación de ADN por cuatro, la computación por seis y las baterías por dieciocho. El apunte de Aaron Levy sobre Jevons se sostiene, porque límites más altos y precios más bajos amplían de verdad el trabajo delegable a agentes.

Los límites pesan lo mismo: el entusiasmo descansa a menudo en mediciones aisladas, y las nuevas salvaguardas ya bloquean parte del trabajo profesional, con más rechazos en lo jurídico y quejas de gestión del tiempo. Astra sigue al frente en ciencia agéntica, así que la ventaja de Opus es real pero parcial.

La atribución de fuentes importa para la confianza: precios y puntuaciones vienen de anuncios de Anthropic y OpenAI con síntesis secundarias, el anclaje independiente viene del índice Artificial Analysis, y la ola de entusiasmo viene de los primeros usuarios. El duelo Sol prometido aún no ocurre, así que falta confirmación independiente del lado Sol.

Mi lectura práctica se divide en dos: Sol y Luna ganan la lectura, la escritura y el código ligero por precio, mientras Opus 5.5 toma el código agéntico largo y los proyectos visuales ambiciosos. Los equipos anclados en Codex se quedan cuando las puntuaciones se rozan, así que la elección depende del flujo tanto como de la supremacía bruta.

Fuentes

10 enlaces; 3 de ellos también citados por 11 otras noticias. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

opus 5.5 · gpt-6 sol · gpt-6 luna · modelos ia · agentes de código · precios de modelos

Seguir el tema

Antes de esta noticia

Un breve orden de lectura de noticias anteriores vinculadas a este evento por un editor.

Evidencia y fuentes

Revisa los pasajes permitidos, sus versiones y su origen.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…