Las semanas de noticias de IA rara vez vienen tan cargadas: Anthropic abrió con un modelo pequeño pero decidido, OpenAI sirvió una novedad casi cada día, xAI redefinió su asistente, Google jugó la carta empresarial y Mistral disparó desde Europa su mayor cartucho abierto. El presentador no se limita a enumerar; sigue la veta común. Esa veta son los agentes que se desbordan de la ventana de chat para tomar todo el ordenador. Guerra de precios, respuestas visuales, notas sin conexión y pesos abiertos parecen carriles de la misma carrera.
Haiku 5.5: rápido, barato, sin pretensiones
Claude Haiku 5.5 llega como el benjamín de la familia, diseñado para faenas rápidas de gran volumen. Resúmenes, compactaciones, consultas a bases de datos, clasificación y papel de subagente en tareas de código: ese es su terreno. La lista de precios concreta la propuesta: unos 10 centavos por millón de tokens de entrada hasta 100.000, luego 50; la salida arranca en 50 centavos y sube a 2,50 $. La tabla la confirma la página de anuncio de Anthropic, que señala un coste medio de explotación un tres cuartos por debajo de la generación Haiku anterior. Los suscriptores mensuales seguirán eligiendo los modelos grandes; el verdadero escenario de Haiku está en el lado de la API con contador.
Las mediciones son honestas: Haiku 5.5 queda detrás de Sonnet 5.5 en trabajo de conocimiento, 1620 y 1578 frente a 1840 y 1824, y alcanza 72,4 % en uso del ordenador ante 83,9 %. La codificación agéntica se queda en 39,2 %, el exigente examen de cultura general en 45,9 % sin herramientas. El detalle curioso es el apetito: el modelo quema el segundo mayor volumen de tokens por tarea, así que el ahorro viene del precio unitario, no de la frugalidad. En el minirranking del presentador navega en mitad del pelotón, citado junto a la entrada GPT-6 Luna de OpenAI. Para los desarrolladores que corren tareas sencillas con el ayudante de código, el dúo velocidad-precio basta como justificación.
Tableros, explicadores animados y una queja
La semana de Anthropic no fue solo modelo: tableros en vivo y explicadores animados se sumaron a los anuncios. El lado de tableros se conecta a BigQuery, Databricks, Snowflake y Salesforce para levantar vistas siempre frescas, disponibles en muchos planes de pago. El lado animado solo abrió en beta para planes de equipo y empresa. El presentador suelta aquí una queja sincera: pagando 200 $ al mes por el plan superior con promesa de acceso anticipado, le escuece que la novedad llegue antes a planes de equipo más baratos. Como apunta, el fondo no es nuevo; la animación en JavaScript y los marcos listos ya levantaban tableros. La novedad son menos pasos de instalación, con todo mudado dentro del modelo.
El segmento patrocinado de la semana muestra un equipo de preparación de tres robots construido sobre Hyper Agent: papeles de investigación, diseño de preguntas y producción que convierten un nombre invitado en una escaleta de 30 minutos. Sigue siendo un argumento de producto, pero el patrón que enseña viaja bien: dar a cada agente solo las herramientas que su puesto exige, pedir un plan antes de ejecutar y mantener a todo el equipo en el mismo juego de instrucciones. En una semana anegada de agentes, esa nota de disciplina vale tanto como los anuncios.
GPT-6 y la interfaz visual
El titular de OpenAI es GPT-6 bajando hasta los 1.200 millones de usuarios semanales del chat con Intelligent UI a bordo. La nueva capa responde con esquemas de bici despiezada, guías de armario y recorridos con casillas en vez de prosa plana; el modelo combina por sí mismo texto, visuales y piezas interactivas según la pregunta. La página de anuncio de OpenAI lo hace tangible con un ejemplo de bicicleta: cuadro, ruedas, transmisión, frenos y manillar explicados como cinco sistemas ligados que el lector explora al tacto. En la prueba del presentador, el modelo anterior respondía en texto plano mientras el nuevo servía imágenes y viñetas. Suma la noticia de octubre de variantes Astra y Soul un 50 % más veloces, y la semana de OpenAI se lee como velocidad de la mano con lo visual.
Las gotas diarias no paran ahí: la revisión automática se abre gratis a todo usuario registrado, el flujo de aprobación pasa a un modo que solo molesta ante preocupación seria, y el precio para desarrolladores baja de cinco niveles a tres con límites más holgados arriba. La variante Soul gana un modo ultrarrápido: el estándar cobra 2 $ por millón de tokens de entrada y 10 $ la salida, mientras el modo ocho veces más veloz cuesta unas seis veces más y exige el plan de 500 $. La redirección también se vuelve instantánea: una imagen de perro a medio generar pivota a lobo con un toque. Para un editor con prisa, el modo ultrarrápido que pasea por la pantalla tienta, cartera aparte.
El complemento de reuniones y la interfaz de decisiones son los dos pesos pesados discretos de la semana. El complemento, paralelo claro de Granola, escucha micro y audio del sistema y luego archiva actas, resúmenes y próximos pasos en la memoria del chat; las notas pueden quedar privadas o compartirse. La API Decisions devuelve veredictos en vez de prosa: predicados con probabilidades, elecciones entre opciones fijas y puntuaciones sobre escalas ordenadas, tomando texto e imágenes juntos para enrutado, moderación y calificación. El registro TopFive clava el precio: 10 centavos por millón de tokens de entrada, salida gratuita, respuestas anunciadas diez veces más vivas que la interfaz clásica y disponibilidad general en semanas. Sin sitio en la ventana de chat; es el obrero silencioso de la trastienda del desarrollador.
Grokbot y el caudal de X
El asistente de xAI, Grokbot , vivió el giro más estratégico de la semana: en vez de su modelo por defecto, elegirá el mejor motor trasero por tarea, con Opus 5.5, Midjourney y Suno citados. Queda por saber si los modelos de OpenAI entrarán en la cesta; vista la trifulca de los jefes, la pregunta flota. El registro TechRepublic confirma el movimiento y describe el producto como capa de orquestación más que carcasa de modelo. La segunda novedad es el cableado profundo a X: vigilancia, lectura y caza de tendencias integradas, de alertas de viralidad a ideas de publicación sacadas de tu nicho. En la prueba del presentador, el robot peinó sus últimos 75 mensajes, halló sus mejores y peores entradas de IA y marcó de 10 a 13 hora del Pacífico como su ventana dorada. Frente a rivales de chat único, un techo de robots especialistas en triaje de correo, investigación y orquestación coloca a Grokbot en un lugar distinto.
Pesos abiertos: Le Chonk y Beam
La noticia abierta de la semana llegó de Francia: Mistral Large 4 , apodado Le Chonk, se abre en vista previa como modelo de 1 billón de parámetros con 52.000 millones activos y multimodalidad nativa. El anuncio Mistral indica entrenamiento en 3.800 unidades Grace Blackwell de sus propios centros europeos, cabeza de los modelos abiertos en cargas empresariales como seguridad, finanzas y derecho, y ventaja ante rivales cerrados en localización visual. Los pesos caen a fin de mes; hasta entonces, jefes de ciberseguridad y socios verificados lo prueban en campo. En el banco del presentador, una respuesta de 9.675 tokens tardó dos minutos y medio en aterrizar en mitad del pelotón, en la misma liga que los chinos Kimi K3 y GLM. La segunda historia abierta viene del estadounidense Reflection Beam con 501.000 millones de parámetros, algo por detrás de rivales similares en primeras pruebas y aún no público. Ambas comparten una frase: pesos abiertos gigantes, demasiado grandes para equipos personales, que guiñan a instituciones que quieren sus propios servidores.
Google, Hark, Muse y notas de política
Google cerró su semana en tres frentes: el constructor de juegos Playground se abre a mayores de EE. UU. con títulos listos incluidos; una aplicación de notas sin conexión levanta actas de reunión sin enviar nada a ninguna nube; y un agente Gemini empresarial promete orquestación desde todo sistema vía Workspace, Microsoft 365 y Slack, con una variante Argon susurrada muy cerca. La detección también creció: el registro TheVerge escribe que las verificaciones de marca y C2PA se deslizan hacia las superficies de búsqueda y Chrome, para que Lens y el rodeo circular pregunten a un panel único de dónde viene una imagen.
Hark Pro , salido de la nueva empresa del fundador de Figure Robotics, se lanzó como un robot que maneja el ordenador, con inicio de paneles, sugerencias proactivas y discurso de privacidad, gratis al inicio y apuntando a hardware de 2027 según el registro TechCrunch. Meta llevó su robot Muse a las placas de aficionados: el registro ChipDispatch escribe que kits para ESP32 y Raspberry Pi traen recetas como un recordatorio de tinta electrónica, un bastón para la pantalla grande y una versión táctil de bolsillo. Dos notas pequeñas para cerrar: las reglas de uso de Anthropic ganan un veto a la crueldad sostenida y sin objeto hacia los modelos, acotado a extremos; y el pronóstico de un economista Nobel, solo 5 % del trabajo humano hacia las máquinas en diez años, desentona con el ambiente de la sala.
Una frase resume toda la semana: todos esprintan hacia el mismo ramo de capacidades y la diferencia se desliza del producto mismo al ecosistema de pertenencia. Como dice el presentador, una vez que Muse, Dots, Grokbot y los robots de Google hacen las mismas tareas, elegir se vuelve un negocio de fidelidad; un Muse que no cuesta nada refuerza su juego. La lección práctica en tres partes: las faenas repetitivas en masa pertenecen a modelos rápidos y baratos vía API, el aprendizaje y el descubrimiento merecen grandes modelos de respuestas visuales, y la primera pregunta de agente debería versar sobre el permiso de datos, no sobre la capacidad. En una temporada de precios movedizos y accesos anticipados con candado, mantener esas tres separadas sigue siendo la única estrategia sólida. Las gotas de la semana próxima redibujarán el mapa; al menos las líneas de hoy quedan claras.
| Tema | Esencia |
|---|---|
| Precio Haiku 5.5 | Un cuarto del coste Sonnet, bastante para la API |
| API Decisions | Calificación y enrutado sin texto, salida gratis |
| Peso Le Chonk | 1 billón abierto pronto, mira a instituciones |
Momentos clave
Comentario de la IA
"Ningún modelo aislado es la verdadera historia de la semana; todos los laboratorios giraron a la vez en la misma dirección. Mientras los precios caen y las capacidades convergen, la pregunta del lector cambia: qué modelo es más potente importa menos que a qué empresa confiar tus datos. Este repaso ofrece un mapa inicial sólido para esa pregunta."
Evaluación de la IA
El contraargumento más fuerte apunta a los tableros de puntuación: la mayoría de las cifras salen de los bancos elegidos por cada laboratorio, mientras el minirranking del presentador es el banco de una sola persona con un solo juez. Las promesas de más rápido y más barato reclaman repeticiones independientes; la interfaz de decisiones con salida gratuita y las velocidades ocho veces mayores no deberían entrar en presupuestos sin muestra. Los agentes gratuitos traen su propia pregunta de precio: las actas vertidas en memoria y las vigilias de X agrandan el asunto de dónde duermen los datos. El enrutado hacia modelos rivales también tensa los contratos de privacidad; si los usuarios sabrán de verdad qué servidor empresarial recibió su pedido aún no está resuelto.
La lista de ausencias es larga: nombres de planes y precios se mueven cada semana, y Beam, Argon como la herramienta de movimiento de los planes de equipo esperan ojos independientes. El segmento patrocinado enseña un patrón real pero no es un examen neutro; límites y costes quedan callados. El pronóstico del 5 % del economista Nobel no topa con ningún adversario en el repaso; el campo de la transformación total nunca toma la palabra. La nueva regla de política carece de ejemplos trabajados; qué conducta cae bajo el veto seguirá interpretativo hasta el primer caso real.
El asiento del presentador también se lee: suscrito a 200 $ al mes al plan superior, su queja de acceso anticipado trae un pinchazo personal que tiñe su mirada sobre las marcas. Declarar su simpatía Grokbot suma puntos de honestidad, pero combinado con una semana de enterrar productos rivales, el lector debe aportar el equilibrio. Usar su propio minirranking como árbitro es el doble sombrero: narrador y juez a la vez. Estos intereses no falsifican los hechos; elevan la necesidad de verificar cada afirmación en su fuente primaria.
El consejo al lector es nítido en tres capas: verter el trabajo repetitivo en masa sobre modelos baratos e interfaces de decisión alivia el presupuesto; dedicar los grandes modelos visuales al aprendizaje y al descubrimiento ahorra tiempo; y hacer del permiso de datos la primera pregunta de agente. Toda herramienta que pida acceso a reuniones y al buzón, gratis o no, debería decir dónde guarda lo que oye. Los pesos abiertos prometen independencia institucional, pero la factura de placas y electricidad no es juego de equipo pequeño; calcule el coste total antes de cruzar la puerta.
Fuentes
9 enlaces; 3 de ellos también citados por 8 otras noticias. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @www.youtube.com YouTube — Matt Wolfe
- @www.anthropic.com Anthropic — Claude Haiku 5.5
También citado por: Same Sticker, Different Bill: Haiku 5.5 vs Luna in 12 Runs · The Week in AI Products: Open Agents, Chip Financing, and the Interface Race · Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days · Haiku 5.5: Anthropic finally fixes its small-model problem · Haiku 5.5 Redraws Cost Efficiency for Small Models · Claude Haiku 5.5: Anthropic's Cheapest and Fastest Model Reshapes the Small-Model Race
- @openai.com OpenAI — GPT-6 and Intelligent UI
También citado por: The Week in AI Products: Open Agents, Chip Financing, and the Interface Race · Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days · Markets Under Credit Strain: The Bull Rests as AI Spending Accelerates
- @topfive.ai TopFive — Decisions API
- @www.techrepublic.com TechRepublic — Grok Bot
- @mistral.ai Mistral — Large 4
También citado por: 722 Math Manuscripts From an Unnamed Model: Research Goes Parallel
- @www.theverge.com TheVerge — SynthID
- @techcrunch.com TechCrunch — Hark Pro
- @chipdispatch.com ChipDispatch — Muse SDK
inteligencia artificial · claude · gpt-6 · agentes · pesos abiertos · google