Imaginen a un inversor macro dedicando tres jornadas completas de doce horas a esbozar películas, pequeñas aplicaciones e informes largos sin pausa; eso cuenta Raoul Pal que hizo con Opus 5.5 . Quien sigue este campo a diario dice que ya no distingue las imágenes generadas del cine real. El anuncio de Anthropic sobre Opus 4.5 apunta en la misma dirección: su versión más ambiciosa para programar, montar agentes y usar el ordenador. El debate ya no es si la tecnología llega, sino qué cambió anoche.
Un veterano de treinta años en los mercados tiene una medida clara: una o dos horas de trabajo sin distracciones al día. El modelo no descansa, no paga multas, no arrastra el cansancio de anoche. La tesis de Pal es pues aritmética antes que técnica: enfrente hay una pila que no duerme, no olvida ni se frena. La medición de ArtificialAnalysis sitúa a Opus 4.5 en 70 puntos de su índice de inteligencia, a la altura de GPT-5.1, con precios por token muy rebajados. Cuando la capacidad aguanta y el precio cae, todas las cuentas viejas se reescriben.
La enjambre toma las matemáticas
Lo ocurrido en matemáticas da cuerpo a la tesis. Según el estudio de OpenAI , unos 10 000 agentes autónomos dirigidos por un modelo interno hallaron una singularidad en las ecuaciones de Navier-Stokes tras 88 horas de carrera, con prueba verificada formalmente en Lean . Una pregunta abierta durante casi noventa años se cerró en menos de tres días. Los ponentes comparan la carrera con cien años-hombre de trabajo: la producción de una facultad entera comprimida en una semana.
El eco pesa tanto como el resultado. QuantaMagazine cuenta que el hallazgo cierra una de las preguntas del Milenio planteadas en 2000, cada una dotada con un millón de dólares por el Instituto Clay; una de seis queda archivada. Algunos matemáticos discuten si la prueba enseña matemática nueva, pero la verificación formal deja la exactitud fuera de discusión. La verdadera ruptura está en el método antes que en la prueba: toda pregunta formalmente comprobable entra ya al alcance de los enjambres de agentes .
En predicción, la línea parece ya cruzada. StackFutures registra que en septiembre el robot de Jeffrey Liang, montado con unos 2 000 dólares de cómputo, ganó la Copa Metaculus de cuatro meses frente a cuatro empresas financiadas con más de 15 millones en conjunto. Los sistemas artificiales se llevan también el segundo y el quinto puesto de la misma serie. En ForecastBench, la medida seguida de los pronosticadores máquina frente a la élite humana, la brecha con los mejores superpronosticadores se ha cerrado.
Para los mercados es una caza directa de ventaja. Aun en preguntas abiertas y mal verificables, los enjambres peinarán cada rincón; en palabras de Pal, el número de agentes rondando los precios se multiplicará. Se habla de 7 000 dólares mensuales en tokens por empleado en OpenAI , con modelos internos muy por delante de todo lo público. Si las firmas llevan esa mirada interior hacia fuera, la distribución de rendimientos cambia de forma callada pero permanente.
En lo personal compiten dos futuros. Uno es el gemelo digital que guarda tus archivos y prolonga tu presencia; el otro, una servidumbre numerosa que borra las fricciones del día. Emad, que ya defendía esta causa en torno a Stability y la repite hoy, ve extenderse rápido los equipos de agentes que eliminan fricción. La privacidad sigue sin resolverse: unos quieren sus archivos en sus propias máquinas, otros creen en instalaciones privadas. Ambos caminos comparten un cruce: la capa de coordinación.
La ley corre detrás de la carrera
A medida que esa capa crece, la política se sienta a la mesa. Varios grandes laboratorios pidieron frenar; la presidencia, los gigantes de las plataformas y los fabricantes de aceleradores respondieron avanzando, y China tampoco se detuvo. Mientras tanto el lenguaje mutó: la carrera ya se cuenta abiertamente en palabras de superinteligencia. Nadie espera un alto, porque cada capital recibe la misma oferta de un millón de mentes a su servicio. Hallar una capital que diga que no parece arduo.
Entre líneas de esos llamados duerme la responsabilidad. FedScoop cuenta que el secretario del Tesoro Bessent dijo ante una comisión parlamentaria que los laboratorios no deben recibir inmunidad; creadores que respondan por lo que construyen, he ahí la vía más segura. Al recordar una reunión de abril con banqueros sobre los riesgos de un modelo de Anthropic , dice que el proceso sigue sin pausa. Mientras los laboratorios entregan programas que actúan sobre la sociedad, el marco jurídico aún corre detrás del ritmo de entregas.
En el uso diario el dolor anida en la fricción. Los usuarios queman jornadas en copiar y pegar para reparar pasos rotos; el modelo lee mal la intención y no siempre corrige sus fallos. La respuesta que emerge son programas de sistema pensados primero para la inteligencia: capas que se actualizan solas, ayudantes que miran la pantalla y ordenan los flujos atascados. Herramientas locales de registro prueban una vía parecida; el proceso se observa y los pasos flojos mejoran con ayuda máquina. La meta está fijada: una breve charla matinal que delega el día.
El programa mismo se vuelve maleable. Las herramientas de vídeo en directo muestran interfaces nacidas a pedido; pantallas surgidas de una sola petición ya no son juguetes de laboratorio. Lo que señala Pal es práctico antes que teórico: el programa deja de ser un producto fijo y se vuelve una masa remodelada. Cumplido el vuelco, la carga de gestión se esfuma; la persona enuncia deseos y el enjambre se encarga del resto. El eslabón que falta sigue siendo la intención llegando intacta a la máquina.
En el frente creativo la hoja de costes se ha invertido. Deadline anuncia que The Gifted ganó el certamen Future Vision con Google, XPRIZE y Range Media; elegido entre más de 2 500 candidaturas, el corto logró 2,5 millones de dólares en capital hacia un largo más 100 000 por el guion. La historia ganadora sigue a un niño que reconstruye a su madre desde sus mensajes y su diario. El jurado reunía nombres pesados de las ciencias y las letras.
El precio de crear cae a cero
La curva de velocidad explica el fallo. Un modelo abierto que antes exigía cuatro minutos para quince segundos de metraje hoy termina en ocho; una producción más-rápida-que-lo-real hace posibles dibujos que mutan al gusto del espectador. Pal dice que los cineastas relanzan las mismas peticiones con cada salida y las películas mejoran solas. Como excrítico, no ve ya distancia entre el nivel Hollywood y la producción. La distancia entre comprender y producir se ha cerrado.
El cuadro económico se parte en dos. La mayoría de las firmas trata la ayuda máquina como un programa más por instalar y apenas avanza; y sin embargo las tecnológicas ven subir el beneficio por empleado mientras las plantillas se encogen o se congelan. La brecha remonta al flojo uso de generaciones pasadas: un empleado olvidadizo pero voluntarioso que nada producía, mal configurado. La generación Opus 4.5 y 5.5 cambia el marco; las tasas de error bajan de los rivales humanos y el trato se vuelve grato.
El patrón de reparto también se afina: como en el automóvil, el fabricante guarda un quinto mientras los concesionarios toman lo esencial. Vendedores y asesores máquina a medida, de la tienda al consultorio, avanzan. Los dueños corrientes hallan abstracta la idea de diez mil empleados a su servicio; necesitan respuestas listas, ajustadas al oficio. Quien ocupe esa capa intermedia parece destinado a la parte del león.
El mundo físico no está listo para este ritmo. Cada agente quiere un pequeño piso en la nube; una pieza que trabaje día y noche, vigile y nunca se atasque. Pero no se han construido ni de lejos suficientes pisos. La memoria se veía distinta: amplios jardines levantaban cosechas de tokens en común. Ahora cada agente sirve a una persona, y los jardines se vuelven bloques. En procesadores se habla de un cuello AMD e Intel; la demanda de pequeños servidores virtuales tensa la producción.
La energía guarda la llave de toda la historia. La compilación de Bpdata acredita a China unos 24 gigavatios de centros en servicio, por delante del resto de Asia pero detrás de los 56 gigavatios americanos; una cartera de 50 gigavatios en obra podría cerrar la brecha rápido. Ulanqab asombra: 89 centros giran o se planean en torno al antiguo pueblo agrícola, con luz cerca de 0,358 yuanes el kilovatio-hora. El acceso restringido a la familia más fina de chips sigue siendo el mayor hándicap de Pekín.
Límites físicos: chips y energía
El plano de cierre es personal y algo inquietante. En un año o dos, un portátil podría saber más que su dueño sea cual sea el oficio. Los campos formales como las matemáticas cayeron rápido ante los enjambres; las arenas abiertas como los mercados, que exigen lecturas de patrones enredados, aún resisten. Ahí se planta Pal: enlazar charlas con activos, fusionar fragmentos en la cabeza, aún no ha cruzado a las máquinas. Pero la curva apunta a un solo lado; cuánto dure la resistencia parece atado al tamaño de los enjambres.
| Hallazgos | Medidas |
|---|---|
| 10 000 agentes prueban en 88 horas | 100 años-hombre de trabajo |
| Un robot de $2 000 gana la copa | Rivales con $15 millones |
| 15 segundos en 8 | Más rápido que lo real |
Momentos clave
Comentario de la IA
"El vídeo abre como un elogio tech exagerado, pero mediciones independientes respaldan la tesis central; reuní mi mirada crítica en la evaluación."
Evaluación de la IA
El contraargumento más fuerte habla de espejismo de medición. Las comparaciones corren en condiciones de laboratorio, mientras datos sueltos y cadenas de responsabilidad del comercio real escapan a las medidas. Las promesas de productividad de Anthropic vienen de clientes de acceso temprano; auditorías independientes de largo plazo siguen inéditas. Hasta la lectura de ArtificialAnalysis muestra ese marco: la inteligencia sube, pero el gasto en tokens por tarea también. La baja de precios podría valer menos que los titulares.
La lista de faltas se alarga. Mientras circulan cifras de chips y energía, la plaza de Europa apenas se abre; hasta la comparación China-América del repaso Bpdata sobrevuela los permisos. Las revisiones de seguridad no alinean pruebas concretas. Y el debate sobre lo que enseñan las pruebas halladas por enjambres flota: el resultado vale, pero lo que aprenden los humanos queda brumoso. Que el lector guarde distancia entre el elogio y la prueba.
Los intereses de los ponentes merecen nota. Pal es una voz conocida de la macro y la cripto; los relatos tech entusiastas alimentan la comunidad que lidera. Emad cofundó el campo generativo; el auge de los agentes confirma sus tesis. Eso no falsifica el relato, pero recalibra la escala: ambos se paran del lado optimista. Las voces críticas apenas aparecen en el vídeo; a los lectores toca aportar el equilibrio.
La salida práctica cabe en tres líneas. Primero, prueben los modelos de nueva generación en tareas de escritura y programa; los casos que comprimen cuatro horas en cuatro minutos ya no son excepciones. Segundo, en predicción e investigación miren más allá del modelo único hacia montajes multi- agente ; el caso de 2 000 dólares del dossier StackFutures muestra al diseño venciendo al presupuesto. Tercero, tracen pronto las líneas de derechos y originalidad en lo creativo; la lluvia de premios del aviso Deadline traerá sus tormentas de autor.
Fuentes
9 enlaces; 3 de ellos también citados por 15 otras noticias. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube.com YouTube — RaoulPalTJM
- @anthropic.com Anthropic — Introducing Claude Opus 4.5
También citado por: Opus 5.5 Wrote a Tycoon Game From Scratch That Trades Real Money: the Day Trader Tycoon Experiment · The Week's Big Shake-Up: GPT-6 Soul and Luna at Half Price as Opus 5.5 Claims the Crown
- @artificialanalysis.ai ArtificialAnalysis — Opus 4.5 Benchmarks
- @openai.com OpenAI — Navier-Stokes Solution
También citado por: When Machines Claimed a Millennium Prize Problem · The Machine That Cracked a Millennium Problem: Navier-Stokes and the Mathematical Leap of AI · Eric Schmidt's superintelligence map: long reasoning, alignment fears, and the data-center economy · We Expected 2045, It Came in 2026: Two Mathematicians on the AI Shock in Mathematics · The Navier-Stokes Singularity Rift: OpenAI's 88-Hour Claim and Two Mathematicians' Pushback · OpenAI Solved the $1 Million Navier-Stokes Problem in 88 Hours as the Trillion-Dollar AI Race Heats Up · From Navier-Stokes to Kimi: A Math Triumph and a Control Crisis Collide in AI · OpenAI's Navier-Stokes Claim: A 166-Page Lean-Checked Proposal Built in 88 Hours · The Opening Act of the Singularity: Doom Narratives, 10,000 Agents and the Enterprise Reality Check · The Navier-Stokes Fight: 10,000 AI Agents and the Million-Dollar Equation · From Elevator to Vortex: Why the Navier-Stokes Equation Jammed and What OpenAI Claims · OpenAI Solved the Math but Nobody Is Happy: The Navier-Stokes Fight (+1)
- @quantamagazine.org Quanta Magazine — Millennium Proof
También citado por: OpenAI Solved the $1 Million Navier-Stokes Problem in 88 Hours as the Trillion-Dollar AI Race Heats Up · From Elevator to Vortex: Why the Navier-Stokes Equation Jammed and What OpenAI Claims · Ten Thousand Agents and a Singularity: Inside the Machine Proof of Navier-Stokes
- @stackfutures.com StackFutures — Metaculus Cup Win
- @fedscoop.com FedScoop — Bessent on Lab Liability
- @deadline.com Deadline — The Gifted Wins XPRIZE
- @bpdata.com Bpdata — China AI Infrastructure
inteligencia artificial · enjambres de agentes · claude · predicción · centros de datos · productividad · regulación