Volver al inicio

GPT-6 Astra completó la zona inicial de los Orcos de World of Warcraft sin mostrar un solo fotograma, leyendo solo datos del servidor, y sin morir en 40 minutos. El experimento con el cliente abierto agent-wow prueba que los modelos razonan en el protocolo.

La IA que terminó WoW a ciegas: cero muertes en 40 minutos

Importado a Nodesdaily: (UTC+03:00)
Ver el vídeo — kantan.news
Opciones de lectura

La voz del dispositivo no está disponible en este navegador.

Lupa de conceptos

Elige un término técnico de esta vista para leer su definición general, un ejemplo didáctico y su uso en el artículo.

No se encontró ningún término de nuestro glosario en esta vista. El glosario aún no cubre todos los términos.

Una de las partidas más extrañas en la historia de World of Warcraft la completó un jugador que jamás miró la pantalla. GPT-6 Astra, el modelo insignia de OpenAI, llevó un Orco de nivel 1 por todas las misiones del Valle de las Pruebas en unos 40 minutos sin morir una sola vez, hasta la aldea Sen'jin. Según Tom's Hardware (tomshardware.com), el 3 de octubre, la partida se dirigió con una sola instrucción vía Codex, y el modelo leyó los datos del propio servidor en lugar de píxeles.

El esqueleto de la hazaña es agent-wow, un cliente de juego abierto con una filosofía inusual: no trae reglas de movimiento, combate o interacción, solo un espacio donde el agente construye sus propios módulos. El modelo llenó ese vacío con un módulo único que capturó 28 tipos de mensajes del servidor en memoria. Un script de Python que sondeó esa memoria armó una imagen viva del mundo y convirtió decisiones en actos en la capa de protocolo .

En las misiones, la IA montó una operación de inteligencia abierta. Explotó las tablas SQL de AzerothCore para extraer dadores de misión, puntos de entrega y zonas de aparición, sacados de los archivos del servidor. El desarrollador lo compara con un jugador que pasa horas en Wowhead; con la diferencia de que los datos que el servidor ejecuta siempre son más frescos y exactos que un sitio de fans. El modelo no copió de una guía: fue a la fuente.

Navegación ciega: hasta los fallos del mapa sirvieron

Para orientarse, el modelo escribió una pequeña utilidad en C++ apoyada en la malla de navegación (mmap) de AzerothCore y la librería Detour, calculando las rutas más eficaces entre coordenadas. Lo divertido: hasta los defectos del mapa en zonas sin datos de colisión se volvieron ventaja, y el agente descubrió atajos por su cuenta.

La capa estratégica también pareció sorprendentemente humana. El modelo ordenó las cadenas de misiones del valle según sus requisitos, vendió chatarra, equipó mejoras y entrenó habilidades antes de la cueva final, tomando las dos misiones de la cueva en una sola salida. La partida usó el modelo en razonamiento extra alto, un nivel bajo el máximo, y WoW se eligió porque exige estrategia larga y táctica inmediata a la vez. La meta lejana es ambiciosa: subir un agente al nivel 80 y llenar un servidor de agentes para limpiar la Ciudadela de la Corona de Hielo en modo heroico.

La arena es parte del relato. Según el Warcraft Wiki, el Valle de las Pruebas, al sur de Durotar, es el campo donde los jóvenes Orcos ganan su lugar antes de unirse a la Horda, con demonios de la Espada Ardiente, escorpiones venenosos y el famoso Sarkoth. La Guarida, un pequeño puesto, sirve de punto de encuentro. O sea, el agente se curtió en uno de los campos de entrenamiento más míticos del universo Warcraft.

Las reacciones se dividieron en dos frentes. Un hilo de Hacker News (ycombinator.com) con decenas de comentarios reavivó los debates sobre bots de la era Honorbuddy: algunos jugadores quieren compañeros IA transparentes para completar grupos, otros temen granjeros automáticos indetectables. Softonic sumó la escala del mercado: la IA en juegos superaría 50 mil millones de dólares hacia 2033, el 90 % de desarrolladores usa automatización, pero el 52 % de profesionales cree que las herramientas generativas dañan al sector. GoKawiil puso equilibrio: esto sugiere que un modelo sin entrenar para el juego gestiona tareas abiertas de varios pasos, pero la prueba cubre una zona inicial. Y el montaje solo corre en servidores locales y privados, nunca en los reinos oficiales de Blizzard.

Por qué importa: carrera de acceso, no de vista

La lección real es el acceso reemplazando a la visión. Un modelo conectado a los datos de estado gestionó a la vez navegación, combate, selección de objetivos y recursos, sin analizar un solo píxel. Esa es la nueva vara para futuros agentes: juzgar un modelo no por cómo ve, sino por la constancia de sus decisiones desde el estado crudo. Una partida prueba poco sobre generalizar, pero la idea de un modelo de lenguaje razonando en el protocolo ya salió del laboratorio.

Visualization: nodesdaily AI
HallazgoDetalle
Tiempo y marca40 minutos, cero muertes, todas las misiones
Método visualCero fotogramas; paquetes y SQL
Meta siguienteIcecrown con varios agentes

Comentario de la IA

"Lo que más me impactó de este experimento no fue la velocidad ni el marcador, sino el método: en lugar de darle ojos al modelo, se le dio acceso directo al sistema nervioso del juego. Veo aquí un giro: las pruebas de juego con IA ya no miden reflejos, sino la extracción de sentido desde datos crudos."

Evaluación de la IA

Primero, la reserva: una zona inicial es el contenido más dócil del juego. Monstruos débiles, misiones lineales, muerte ya improbable; y el modelo tuvo información perfecta que ningún jugador posee: coordenadas exactas y datos completos. Cero muertes parece menos un genio ciego y más un planificador totalmente informado.

Segundo, la reproducibilidad. Una sola partida, reportada por el propio desarrollador, sin réplica independiente ni margen de error. La Ciudadela de la Corona de Hielo en heroico es otra liga: coordinación, reacción, equipo y tolerancia al fallo. Como nota GoKawiil, el camino a la banda heroica hoy es intención, no prueba.

Las fuentes también tienen su prisma. Tom's Hardware escribe con reflejo de prensa entusiasta, que premia la novedad; los pronósticos y encuestas vía Softonic llegan sin estudios nombrados y piden lectura medida. La fuente primaria es el desarrollador, parte interesada cuyo relato elige el marco más brillante. Los comentarios de Hacker News dan color, no pruebas.

El balance práctico es doble. A favor, jugar en el protocolo da a los agentes una prueba de razonamiento barata y medible: sin costo visual, estado observable, puntaje nítido. En contra, la misma técnica avivaría el debate sobre bots y trampas en los MMO vivos. La vía sensata en Hacker News parece justa: jugadores IA con identidad transparente, como compañeros que completan grupos, y todos ganan.

Fuentes

6 enlaces; ninguna otra noticia publicada los cita. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

gpt-6 astra · agent-wow · world of warcraft · agente ia · azerothcore · protocolo

Seguir el tema

Antes de esta noticia

Un breve orden de lectura de noticias anteriores vinculadas a este evento por un editor.

Evidencia y fuentes

Revisa los pasajes permitidos, sus versiones y su origen.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…