Gündeme dön

GPT-6 Astra, World of Warcraft'ın Ork başlangıç bölgesini ekrana hiç bakmadan, yalnızca sunucu verilerini okuyarak 40 dakikada ölümsüz tamamladı. Açık kaynaklı agent-wow ile yapılan deney, dil modellerinin protokol katmanında akıl yürütebildiğini kanıtladı.

Ekrana Bakmadan WoW Bitiren Yapay Zekâ: 40 Dakikada Sıfır Ölüm

Nodesdaily’e aktarım: (UTC+03:00)
Videoyu izle — kantan.news
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

World of Warcraft tarihinin en sıra dışı koşularından biri, oynamak için ekrana bakmayan bir oyuncuyla gerçekleşti. OpenAI'ın amiral gemisi modeli GPT-6 Astra, 1. seviye bir Ork karakterle Valley of Trials bölgesindeki bütün görevleri yaklaşık 40 dakikada ve tek bir ölüm yaşamadan bitirip Sen'jin Köyü'ne ulaştı. Tom's Hardware'ın (tomshardware.com) 3 Ekim tarihli haberine göre deney, tek bir komutla Codex üzerinden yürütüldü ve model piksel yerine sunucunun kendi verisini okudu.

Bu koşuyu mümkün kılan iskelet, agent-wow adlı açık kaynaklı özel bir oyun istemcisi. Tasarım felsefesi alışılmışın dışında: istemci yürüme, dövüşme ya da etkileşim gibi hiçbir oyun kuralını hazır vermiyor, yalnızca ajanın kendi modüllerini inşa edebileceği bir çalışma alanı açıyor. Model de bu boşluğu, sunucudan gelen 28 farklı mesaj tipini bellekte yakalayan tek bir modülle doldurdu. Belleği sürekli yoklayan bir Python betiği, bu mesajlardan anlık bir dünya haritası kurdu ve kararları doğrudan protokol katmanında eyleme çevirdi.

Görev tarafında ise yapay zekâ deyim yerindeyse açık kaynak istihbaratı yaptı. AzerothCore'un SQL tablolarını tarayarak görev verenleri, teslim noktalarını ve yaratıkların doğma yerlerini sunucu dosyalarının içinden çekti. Geliştirici bunu bir oyuncunun saatlerce WoWhead'de araştırma yapmasına benzetiyor; fark, sunucunun bizzat çalıştırdığı verinin taraftar sitesindeki bilgiden her zaman daha güncel ve kesin olması. Yani model kopya çekmedi, doğrudan kaynağa indi.

Kör navigasyon: harita hatalarından bile yararlandı

Yön bulma işi için model C++ ile küçük bir yardımcı program yazdı ve AzerothCore'un navigasyon örgüsü (mmap) dosyalarıyla Detour kütüphanesini kullandı. Böylece iki nokta arasında koordinat temelli en verimli güzergâhlar hesaplandı. İşin eğlenceli yanı, çarpışma verisi eksik bölgelerdeki harita kusurlarının bile avantaja çevrilmesi oldu; ajan kestirme sayılabilecek geçitleri bizzat keşfetti.

Strateji katmanında da tablo şaşırtıcı biçimde insansıydı. Model, Valley of Trials'taki görev zincirlerini ön koşul sırasına dizdi, çöpleri tüccara satıp envanteri rahatlattı, ekipman yükseltmelerini kuşandı ve final mağarasına girmeden yeteneklerini eğitti. Son mağaradaki iki görevi aynı seferde üstlenerek operasyonel verimlilik sağladı. Deneyde modelin yüksek muhakeme kipinde (maksimumun bir altı) çalıştırıldığı ve WoW'un uzun vadeli stratejiyle kısa vadeli taktiği bir arada istemesi yüzünden seçildiği belirtiliyor. Uzak hedef ise iddialı: tek ajanı 80. seviyeye çıkarmak ve bir sunucuyu ajanlarla doldurup Icecrown Citadel zindanını zor kipte temizlemek.

Sahanın kendisi de hikâyenin parçası. Warcraft Wiki'nin anlatımına göre Valley of Trials, Durotar'ın güneyinde genç Ork maceracıların Horde'a katılmadan önceki sınav alanı; kuzeydeki mağaralara çöreklenmiş Burning Blade iblisleri, zehirli akrepler ve baş belası Scorpid Sarkoth bölgeye renk katıyor. İşin mutfağında The Den adlı küçük üs, acemilerin rapor verdiği merkez işlevi görüyor. Yani ajan, Warcraft evreninin en köklü eğitim sahasında ter döktü.

Yankılar iki cephede toplandı. Hacker News (ycombinator.com) başlığında onlarca yorum, Honorbuddy günlerinden kalma bot tartışmalarını yeniden alevlendirdi: kimi oyuncu parti eksiğini dolduracak şeffaf yapay zekâ yoldaşları isterken, kimi de kim olduğu belirsiz çiftçi botlardan korkuyor. Softonic ise tabloya pazar ölçeğini ekledi: oyunlarda yapay zekâ pazarının 2033'e dek 50 milyar doları aşacağı öngörülüyor, geliştiricilerin yüzde 90'ı otomasyon kullanıyor ama profesyonellerin yüzde 52'si üretken araçların sektöre zarar verdiğini düşünüyor. GoKawiil'in yorumu ise dengeleyici: bu, oyuna özel eğitim almamış bir modelin çok adımlı açık uçlu işleri yönetebildiğini düşündürüyor, ancak kanıt henüz bir başlangıç bölgesinden ibaret. Üstelik kurulum Blizzard'ın resmi âlemlerinde değil, yalnızca yerel ve özel sunucularda çalışıyor.

Neden önemli: göz değil, erişim yarışı

Asıl ders, görüşün yerini erişimin alması. Piksellerden anlam çıkarmak yerine oyunun durum verisine doğrudan bağlanan bir model, navigasyon, çatışma, hedef seçimi ve kaynak yönetimi gibi katmanları aynı anda yürütebildi. Bu, gelecekteki ajan testleri için yeni bir çıta öneriyor: bir modeli ne kadar iyi gördüğüyle değil, ham durumdan ne kadar tutarlı karar ürettiğiyle ölçmek. Elbette tek koşu genelleme sayılmaz, ama protokol düzeyinde mantık yürüten bir dil modeli fikri artık laboratuvar sohbeti olmaktan çıktı.

Görsel: nodesdaily AI
BulgularDetay
Süre ve skor40 dakika, sıfır ölüm, tüm başlangıç görevleri
Görüş yöntemiSıfır kare; ağ paketleri ve SQL verisi
Sonraki hedefÇok ajanlı Icecrown Citadel denemesi

AI yorumu

"Beni bu deneyde en çok etkileyen şey hız ya da skordan çok yöntem oldu: modele göz vermek yerine oyunun sinir sistemine doğrudan erişim tanınmış. Bir anlatıcı olarak şunu not ediyorum: yapay zekâ oyun oynama testleri artık refleks değil, ham veriden anlam çıkarma yarışı."

AI değerlendirmesi

Önce şerhi düşelim: başlangıç bölgesi, oyunun en uysal içeriği. Yaratıklar zayıf, görevler çizgisel, ölüm riski zaten düşük; üstelik model hiçbir oyuncunun sahip olmadığı kusursuz bilgiye sahipti: kesin doğma koordinatları, eksiksiz görev verisi. Yani sıfır ölüm, görme engelli bir dehanın değil, tam bilgili bir planlamacının eseri.

İkinci sınır, tekrarlanabilirlik. Tek koşu, geliştiricinin kendi raporuna dayanıyor; bağımsız doğrulama, hata payı ya da farklı denemelerin ortalaması yok. Icecrown Citadel ise bambaşka bir lig: eşgüdüm, reaksiyon, ekipman ve hata toleransı gerektirir. GoKawiil'in de işaret ettiği gibi, başlangıç vadisinden zor kip baskına uzanan yol, kanıttan çok niyet beyanı.

Kaynakların da kendi mercekleri var. Tom's Hardware meraklı teknoloji basını refleksiyle yeniliği öne çıkarıyor; Softonic'in aktardığı pazar tahminleri ve anket yüzdeleri kimin araştırması olduğu belirtilmeden geçiyor, o yüzden ölçülü okunmalı. Birincil kaynak geliştiricinin kendisi; ilgili tarafın anlatısı doğal olarak en parlak kareyi seçer. Hacker News yorumları ise renkli ama kanıt değil, kanaat.

Pratik sonuç iki yönlü. Olumlu tarafta, protokol düzeyinde oyun, ajanlar için ucuz ve ölçülebilir bir akıl yürütme testi sunuyor: görüş maliyeti yok, durum tam gözlenebilir, skor net. Risk tarafında ise aynı teknik, canlı MMO ekonomilerinde bot ve hile tartışmasını büyütür. Hacker News'teki sağduyulu seslerin önerdiği yol makul: yapay zekâ oyuncular şeffaf kimlikle, parti dolduran yoldaş olarak oyuna girerse herkes kazanır.

Kaynaklar

6 bağlantı; bunları kullanan başka yayımlanmış haber yok. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

gpt-6 astra · agent-wow · world of warcraft · yapay zeka ajanı · azerothcore · protokol katmanı

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…