Volver al inicio

El asistente «o» de OpenAI, Claude Sonnet 5.5 y MiniMax M3.1: tres apuestas antes de la DevDay

Tres días antes de la DevDay del 29 de septiembre se filtró un asistente siempre activo llamado «o», Anthropic anunció Claude Sonnet 5.5 «en las próximas semanas» y MiniMax presentó M3.1 Flash. Los tres responden de forma distinta a la misma pregunta: velocidad pura, relación rendimiento-precio o trabajo persistente en segundo plano.

Importado a Nodesdaily: (UTC+03:00)
Ver en YouTube — 6DjIjjE3doo
Opciones de lectura

La voz del dispositivo no está disponible en este navegador.

Lupa de conceptos

Elige un término técnico de esta vista para leer su definición general, un ejemplo didáctico y su uso en el artículo.

No se encontró ningún término de nuestro glosario en esta vista. El glosario aún no cubre todos los términos.

La inteligencia artificial no conoce los días tranquilos. A tres días de la conferencia de desarrolladores de OpenAI, ya circulaba una filtración importante: la compañía podría presentar un asistente que funciona de forma permanente. El nombre cabe en una sola letra: «o». Esa filtración era solo una de las tres grandes historias de la semana; Anthropic aportaba su parte con un anuncio de precio y eficiencia, y el laboratorio chino MiniMax aportaba una vista previa.

El producto detrás de una sola letra

Según TestingCatalog, «o» apareció en la pantalla de mejora de la suscripción ChatGPT Pro de 100 dólares como una ventaja incluida: «o, your always-on assistant». El mismo equipo encontró «o» como nombre visible y el sufijo «-o» en la configuración de la aplicación, y lo interpreta como una pista de que el asistente gestionará el correo electrónico. Deducir una capacidad a partir de dos campos de configuración es una inferencia, no una confirmación. La pista más sólida se esconde en la marca. La cuenta @o en X está actualmente suspendida y podría estar reservada para el lanzamiento, aunque un nombre de un solo carácter puede suspenderse por mil razones. wccftech.com señala que OpenAI quiere posicionar el producto frente al agente Muse de Meta, y cnbc.com recuerda que los analistas de JPMorgan dijeron que Muse podría convertirse en la aplicación de consumo más utilizada después de ChatGPT, lo que explica la urgencia de OpenAI.

El nombre en clave interno es la parte más confusa. Una cuenta afirma que «aeon» designa la implementación existente de agentes personalizados para las cuentas de ChatGPT Workspace, con «o» como versión de consumo construida encima. runtimewire.com escribe lo contrario: «o» funcionaría sobre una variante de GPT-6 Astra llamada aeon, ajustada para tareas largas. Tres relatos, ninguno de una fuente primaria, y ninguno zanja la cuestión.

Cuando la velocidad se convierte en característica

Las iniciativas de velocidad de OpenAI están mejor documentadas que la filtración. testingcatalog.com informa de un selector de tres niveles detectado en el área de pruebas de la API: estándar, rápido y ultrarrápido. openai.com confirma el viraje, y developers.openai.com documenta que el procesamiento prioritario pasó a llamarse «Fast mode» el 30 de julio de 2026, con respuestas hasta 2,5 veces más rápidas. La vista previa Ultrafast de openai.com, propulsada por Cerebras, alcanza hasta 750 tokens de salida por segundo. Esa velocidad tiene un precio en la escala de suscripciones. decrypt.co informa que el código del sitio de ChatGPT contiene un nivel «Pro Max» de 500 dólares que parece comprar un procesamiento más rápido en lugar de más uso, mientras que testingcatalog.com describe ese nivel como «Fastest Work and Codex», probablemente sobre Cerebras. cerebras.ai confirma su parte de la historia, señalando que el modo Ultrafast se abrió a una selección de clientes sin renunciar a la calidad. El anuncio de colaboración de openai.com aporta la escala: 750 megavatios de cómputo de baja latencia añadidos a la plataforma.

La velocidad ya no es una característica, es un escalón de precio. El salto de 100 a 500 dólares, tal como lo presenta testingcatalog.com, muestra qué están pagando los usuarios: no volumen de trabajo semanal, sino cuánta sensibilidad a la latencia están dispuestos a absorber. La inferencia del presentador apunta en la misma línea, al estimar que OpenAI ha ampliado visiblemente la inversión en infraestructura y que esta podría ser un eje central de la DevDay.

Anthropic en el frente rendimiento-precio

Las cifras de Anthropic son verificables. En su anuncio de Opus 5.5 del 22 de septiembre, anthropic.com afirma que el modelo alcanza el nivel de Fable 5.1, cuesta un 40 % menos que Opus 5 y genera más de un 30 % más rápido. La tabla de precios de anthropic.com lo concreta: 4 dólares por millón de tokens de entrada, 20 dólares por millón de salida y 0,20 dólares por lectura de caché. techcrunch.com recuerda que el lanzamiento llegó solo dos meses después de que Opus 5 saliera el 24 de julio.

La misma publicación de anthropic.com indica que Claude Sonnet 5.5 y Haiku 5.5 seguirán «en las próximas semanas», sin fecha firme. Las filtraciones recogidas por start-up-fortune afirman que los socios alcanzaron un punto de control más reciente y apuntan a una ventana a finales de septiembre o el 1 de octubre, mientras que start-up-fortune subraya que Anthropic no ha dicho nada más allá del 22 de septiembre. El precio de la filtración es la parte sólida: la publicación sobre Sonnet 5 en anthropic.com fijó en 2 dólares la entrada y 10 dólares la salida por millón de tokens, de forma permanente. La afirmación del presentador de que el modelo supera a GPT-6 en todos los planos se apoya en sus propias pruebas, no en el anuncio de Anthropic.

MiniMax M3.1 y el equilibrio velocidad-eficiencia

La tercera historia lleva el calendario más llamativo del vídeo: el presentador detectó la filtración en una solicitud de fusión de GitHub, empezó a montar el vídeo a su alrededor, y la vista previa de M3.1 Flash se anunció cuando la grabación estaba casi terminando. orcarouter.ai informa de que MiniMax dejó una nota de arquitectura fechada el 22 de septiembre y un punto de control de 250 GB en Hugging Face que solo los socios de inferencia pueden abrir, con observadores de modelos anunciando M3.1 para la semana que viene.

Sobre la calidad de las salidas, el presentador muestra dos pruebas. Una genera pixel art, donde el modelo rápido añade los detalles de ambiente que los modelos más capaces suelen pasar por alto. La otra pide un dibujo lineal a partir de una instrucción corta, donde el modelo más potente devuelve una salida tan deformada que no se puede renderizar, mientras que el modelo rápido construye una escena legible y coherente. El presentador presenta esto menos como un veredicto que como una señal competitiva, sin afirmar que ese modelo sea el mejor. Se menciona además otro modelo rápido: una vista previa gratuita con una ventana de contexto de un millón de tokens, disponible en dos semanas en un cliente de programación. Esa afirmación prepara las demostraciones de agentes de programación que cierran el vídeo, donde los agentes convierten un juego en un clon funcional.

Agentes de larga duración: dónde está la línea

El proyecto de cierre muestra hasta dónde llega la promesa enunciada: 100 000 líneas de código de juego, 26 000 líneas de código de pruebas, 1000 pruebas automatizadas, 775 archivos y unas 25 horas de trabajo ininterrumpido del agente. Encima, el código generó cientos de imágenes y más de un centenar de archivos de audio, además de una guía dentro del propio juego. anthropic.com documenta un salto de escala comparable en programación agéntica, contando que un probador temprano completó una migración de 680 000 líneas en menos de un día. La recopilación de esas cifras en favtutor.com resume la idea: la programación agéntica ya no es una pequeña demostración, sino un modo de producción que comprime semanas de trabajo de ingeniería en pocos días. En contrapeso, goldiebench.com señala que el sector ha empezado a construir su propia medición, lanzando proyectos de una sola pasada y probándolos de verdad en lugar de fiarse de capturas de pantalla. La industria ahora audita sus propias afirmaciones, lo que significa que sobrevivirán menos.

El panorama de la semana es la convergencia entre infraestructura y arquitectura de agentes. OpenAI amplía sus niveles de velocidad, Anthropic promete esa misma velocidad más barata y MiniMax empaqueta la velocidad a un precio todavía más bajo. Los tres apuntan a lo mismo: lo que se promete al usuario ya no es cuán inteligente es el modelo, sino cuánto tarda el trabajo en terminar. La DevDay del 29 de septiembre será la primera ocasión de medir esas promesas.

Visualization: nodesdaily AI

Momentos clave

  1. Tres días para la DevDay y una filtración importante
  2. Una sola letra en la pantalla Pro
  3. Tres niveles de velocidad en la API
  4. Un nuevo nivel de 500 dólares
  5. Opus 5.5: 40 % más barato
  6. De la filtración a la vista previa oficial
  7. La comparación del dibujo lineal
  8. 100 000 líneas de código de juego

Comentario de la IA

"Las filtraciones son pruebas débiles por sí solas, pero el calendario es elocuente: la promesa de un asistente persistente en OpenAI, el empuje en relación rendimiento-precio de Anthropic y la vía rápida de MiniMax caen en los mismos días. La verdadera pregunta no es qué son estos productos, sino cuál puede absorber la demanda de infraestructura que hay detrás. Los tres chocan con el mismo cuello de botella: producir rápido exige apilar capas de hardware más caras y grandes."

Evaluación de la IA

La mejor objeción pertenece a las propias filtraciones. La mejor prueba para «o» sigue siendo una captura de una pantalla de suscripción con «your always-on assistant» y un fragmento de configuración de dos campos; TestingCatalog señala explícitamente que afirmaciones como 63 idiomas o chips concretos no aparecen en ninguna fuente primaria. Extraer una capacidad de correo de dos claves JSON es un razonamiento, no una prueba.

Lo que falta es estructural, no accidental. Evaluar un asistente persistente exige precisamente lo que el fragmento filtrado no contiene: qué aplicaciones toca, qué permisos tiene, dónde se ejecuta y quién responde cuando se equivoca. Los niveles de velocidad sufren la misma laguna: 750 tokens por segundo es una cifra medible, pero nunca se detalla el coste de hardware que implica.

El incentivo del presentador es su propia transparencia. Frases como «mejor que GPT-6» o «pillé un commit filtrado» dejarían huecos si se presentaran como hechos, y el vídeo hace visible en qué pruebas se apoyan y cuán subjetivas son. Separar esas afirmaciones de la información verificada es lo que hace utilizable el resto del análisis.

La conclusión práctica para el lector tiene que ver con esperar. Conectar alguno de estos productos filtrados a un flujo de trabajo de pago antes de la DevDay es una apuesta. Dos opciones de velocidad, en cambio, ya son reales hoy: el modo rápido de Anthropic ofrece hasta 2,5 veces la velocidad de salida en su plataforma, con una prima de precio publicada. Es lo único medible esta semana con el mismo presupuesto.

Fuentes

11 enlaces; 4 de ellos también citados por 11 otras noticias. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

openai · devday 2026 · claude sonnet 5.5 · minimax m3.1 · agentes de ia · cerebras

Seguir el tema

Antes de esta noticia

Un breve orden de lectura de noticias anteriores vinculadas a este evento por un editor.

Evidencia y fuentes

Revisa los pasajes permitidos, sus versiones y su origen.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…

El asistente «o» de OpenAI, Claude Sonnet 5.5 y MiniMax M3.1