Dizüstü bilgisayarını açıp üç gün boyunca ara vermeden film taslakları, küçük yazılımlar ve uzun raporlar üreten bir makro yorumcusu düşünün; Raoul Pal'in Opus 5.5 ile anlattığı yaşantı tam olarak bu. Yıllardır bu alanı günlük izleyen biri olarak artık üretilen görüntülerle gerçek çekim arasındaki farkı ayırt edemediğini söylüyor. Anthropic cephesinden gelen Claude Opus 4.5 duyurusu da aynı yönü işaret ediyor: yazılım üretimi, agent düzenleri ve bilgisayar kullanımı için bugüne kadarki en iddialı sürüm. Tartışma artık teknolojinin gelip gelmeyeceği değil, dün gece nelerin değiştiği.
Otuz yıldır piyasalarla uğraşan birinin ölçüsü nettir: günde bir iki saatlik dağınıklıksız çalışma. Model ise mola vermiyor, otopark cezasıyla uğraşmıyor, dün akşamki yorgunluğu taşımıyor. Pal'in tezi bu yüzden teknik değil, aritmetik: karşısında dinlenmeyen, unutmayan ve hızlanan bir yığın var. ArtificialAnalysis ölçümüne göre Opus 4.5, yapay zekâ endeksinde 70 puanla GPT-5.1'i yakalayarak en üst sıraya yerleşiyor ve birim token fiyatı önceki kuşağa göre ciddi biçimde düşmüş durumda. Yetenek aynı kalırken bedel düşüyorsa önceki kuşak LLM'lerin hesabı kapanıyor ve eski hesapların tamamı yeniden yazılır.
Sürü zekâsı matematiğe el koyuyor
Matematik cephesinde olanlar bu iddiayı ete kemiğe büründürüyor. OpenAI çalışmasına göre dahili bir modelin yönettiği yaklaşık 10 bin özerk agent , 88 saatlik koşunun sonunda Navier-Stokes denklemlerinde bir tekillik buldu ve ispat Lean dilinde biçimsel olarak doğrulandı. Doksan yıla yakındır açık duran soru, üç günden kısa sürede kapandı. Videoda konuşanların aktardığına göre bu koşu yüz insan yıllık emekle kıyaslanıyor; küçük bir ekibin değil, koca bir fakültenin ömürlük çalışması tek bir haftaya sığıyor.
Bulgunun yankısı da en az kendisi kadar öğretici. QuantaMagazine aktarımına göre sonuç, 2000 yılında ortaya konan ve her birine 1 milyon $ ödül bağlanan Milenyum sorularından birini kapatıyor; Clay Enstitüsü listesindeki altı sorudan biri artık dosyalandı. Bazı bilim insanları ispatın yeni matematik öğretip öğretmediğini tartışıyor, fakat biçimsel doğrulama sayesinde sonucun doğruluğu tartışma dışı kalıyor. Burada asıl kırılma, ispatın kendisinden çok yöntemin olması: biçimsel olarak sınanabilen her soru artık agent sürülerinin menziline giriyor.
Tahmin dünyasında eşik çoktan aşılmış görünüyor. StackFutures kaydına göre eylül ayında Jeffrey Liang'in yaklaşık 2 bin $ bütçeyle kurduğu bot, dört ay süren Metaculus Kupası 'nı kazandı; karşısında toplam 15 milyon $'dan fazla kaynak toplamış dört girişim vardı. Aynı yarışma dizisinde yapay sistemler ikinciliği ve beşinciliği de aldı. Tahmin araştırmalarının derli toplu ölçümü olan ForecastBench tarafında da yapay sistemlerle üst düzey insan tahmincileri arasındaki fark kapanmış durumda.
Piyasalar için bu gelişme doğrudan getiri arayışı anlamına geliyor. Açık uçlu, doğrulanması güç sorularda bile sürüler her köşede değer arayacak; Pal'in ifadesiyle pazarda gezinen agent sayısı katlanarak büyüyecek. OpenAI bünyesinde çalışan başına ayda 7 bin $'lık token tüketimi konuşuluyor; kurum içi modellerin dışarıdan görünenden çok ileride olduğu söyleniyor. Kurumlar bu iç görünümü dışarı taşıyabilirse getiri dağılımı sessizce ama kalıcı biçimde değişir.
İşin kişisel cephesinde iki farklı gelecek tarifi yarışıyor. Biri, kayıtlarını tutan ve senin adına varlığını sürdüren dijital ikiz ; ötekinde ise günlük pürüzleri ortadan kaldıran kalabalık bir destek kadrosu var. Emad'in evvelce Stability çevresinde savunup şimdi yinelediği görüş, sürtünmeyi kaldıran agent kadrolarının kısa vadede yaygınlaşacağı yönünde. Gizlilik tarafı ise henüz çözümsüz: kimi kayıtları kendi makinesinde tutmak istiyor, kimi özel kurulumların bunu sağlayacağını düşünüyor. Her iki yolda da ortak nokta aynı: koordinasyon katmanı.
Yarış hızlanırken hukuk geriden geliyor
Koordinasyon katmanı büyüdükçe siyaset de masaya oturuyor. Büyük laboratuvarların bir kısmı yavaşlama çağrısı yaptı; karşılık olarak başkanlık koltuğu, platform devleri ve hızlandırıcı üreticileri yola devam dedi, Çin tarafı da durmadı. Tartışmanın dili bu arada dönüştü: yarış artık açıkça süper zekâ sözcükleriyle anlatılıyor. Kimse duramayacağını düşünüyor, çünkü her başkent emrinde bir milyon üst düzey zihin istemekle yüz yüze. Böyle bir teklife hayır diyecek başkent bulmak güç.
Çağrıların satır arasında ise sorumluluk maddesi duruyor. FedScoop haberine göre Hazine Sekreteri Bessent, Temsilciler Meclisi komitesinde laboratuvarlara sorumluluk bağışıklığı verilmemesi gerektiğini söyledi; üretenin ürettiğinden sorumlu olması, güvenliğin en sağlam yolu olarak sunuldu. Anthropic modelinin güvenlik riskleri üzerine nisanda banka yöneticileriyle yapılan toplantıyı anımsatan sekreter, sürecin ara vermeden sürdüğünü belirtti. Laboratuvarlar eyleyen yazılım dağıtırken hukuk çerçevesi henüz dağıtım hızına yetişemiyor.
Günlük kullanımda asıl darboğaz sürtünme katmanında yaşanıyor. Kullanıcılar günün büyük bölümünü kopyala yapıştırla, bozulan adımları onarmakla geçiriyor; model niyeti tam okuyamıyor, kendi hatasını her zaman düzeltemiyor. Çözüm olarak yapay zekâ öncelikli sistem yazılımları öne çıkıyor: kendisini güncelleyen işletim katmanları, ekranı izleyip aksayan akışı düzenleyen yardımcılar. Yerelde çalışan kayıt araçları da benzer bir yolu deniyor; süreç gözleniyor, aksayan adımlar yapay destekle iyileştiriliyor. Hedef belli: sabah kısa bir konuşmayla günün tamamını devreden yardımcı.
Yazılımın kendisi de esnekleşiyor. Canlı görüntü üreten araçlar, arayüzü ihtiyaca göre doğuran örnekler gösteriyor; bir istekle beliren ekranlar artık laboratuvar oyuncağı değil. Pal'in işaret ettiği nokta kuramsal değil, pratik: yazılım sabit bir ürün olmaktan çıkıp şekil değiştiren bir hamura dönüşüyor. Bu dönüşüm tamamlandığında yönetim yükü ortadan kalkacak; kullanıcı ne istediğini söyleyecek, sürü geri kalanını üstlenecek. Eksik kalan tek halka, niyetin makineye eksiksiz geçmesi.
Yaratıcılık cephesinde maliyet çizelgesi altüst olmuş durumda. Deadline duyurusuna göre Google, XPRIZE ve Range Media ortaklığındaki Future Vision mücadelesini The Gifted adlı kısa film kazandı; 2 bin 500'den fazla başvuru arasından seçilen yapım, uzun metraj için 2,5 milyon $'lık sermaye desteği ve öykü geliştirme için 100 bin $ ödül aldı. Kazanan filmin, bir çocuğun annesini mesajlarından ve günlüğünden yeniden kurma hikâyesini anlattığı belirtiliyor. Jüri koltuğunda bilim ile edebiyat dünyasından ağır isimler oturuyordu.
Yaratıcılığın bedeli sıfıra iniyor
Hız eğrisi bu sonucu açıklıyor. Bir dönem 15 saniyelik görüntü için 4 dakika bekleten açık model , bugün aynı işi 8 saniyede bitiriyor; gerçek zamanlı üretim sayesinde izleyici girdisiyle değişen çizgi filmler mümkün hale geliyor. Pal'in aktardığına göre filmciler her yeni sürümde aynı istemleri yeniden koşuyor ve filmler kendiliğinden güzelleşiyor. Eski bir film eleştirmeni olarak Hollywood düzeyiyle üretim arasında fark kalmadığını söylüyor. Anlayış ile üretim arasındaki mesafe kapanmış durumda.
İktisadi tablo ise ikiye bölünmüş görünüyor. Şirketlerin büyük çoğunluğu yapay desteği yeni bir yazılım kurar gibi görüyor ve kayda değer adım atmıyor; oysa teknoloji şirketlerinde çalışan başına düşen kazanç hızla yükselirken kadrolar küçülüyor ya da sabit kalıyor. Farkın kaynağı eski kuşak modellerin yetersiz kullanımında aranıyor: unutkan ama istekli bir çalışan gibi görünen sistem, doğru kurulmayınca sonuç üretemiyordu. Opus 4.5 ile 5.5 kuşağı bu tabloyu değiştiriyor; hata payı insan rakiplerinin gerisine düşüyor, etkileşim keyifli hale geliyor.
Dağıtım biçimi de netleşiyor: otomobil pazarındaki gibi, üreticinin payı beşte birde kalırken bayiler değerin büyük kısmını toplayacak. Küçük dükkândan kliniğe, her ölçeğe özel kurulmuş yapay satıcı ve danışman kadroları öne çıkacak. Çünkü sıradan işletmeci, emrinde on binlerce çalışan olduğu fikrini soyut buluyor; ona hazır kurulmuş, kendi işine uyarlanmış çözüm gerek. Bu boşluğu dolduran ara katman, değerin aslan payını alacak gibi duruyor.
Fiziksel dünya ise bu hıza henüz hazır değil. Her agent bulut içinde kendisine ayrılmış küçük bir daire istiyor; günün her saati çalışacak, gözetim yapacak, işlerini aksatmayacak bir alan. Oysa bu dairelerden yeterince inşa edilmiş değil. Hafıza tarafında tablo farklıydı: geniş bahçeler kurulmuş, token üretimi topluca yapılıyordu. Şimdi her agent tek kişilik hizmet veriyor, bahçe düzeni apartman düzenine dönüyor. İşlemci tarafında AMD ve Intel kaynaklı dar boğaz konuşuluyor; küçük sanal sunuculara olan istek üretimi zorluyor.
Enerji başlığı tüm bu hikâyenin kilidini tutuyor. Bpdata derlemesine göre Çin yaklaşık 24 gigavatlık işletmedeki veri merkezi kapasitesiyle Asya'nın geri kalanını geride bırakıyor, fakat 56 gigavatlık ABD kapasitesinin henüz gerisinde kalıyor; inşa halindeki 50 gigavatlık ek kapasite farkı hızla kapatabilir. Ulanqab örneği çarpıcı: bir zamanlar tarım kenti olan bölgede 89 veri merkezi işliyor ya da planlanıyor, elektrik fiyatı kilovatsaat başına 0,358 yuan seyrediyor. En ileri yonga ailesine erişim kısıtı ise Pekin'in en büyük handikabı olmaya devam ediyor.
Fiziksel sınırlar: işlemci ve enerji
Kapanış karesi kişisel ve biraz da rahatsız edici. Bir iki yıl içinde dizüstü bilgisayar, bilgi alanı ne olursa olsun sahibinden daha bilgili hale gelebilir. Matematik gibi biçimsel alanlar sürülere çabuk düştü; piyasalar gibi açık uçlu, karmaşık örüntü okuma gerektiren alanlar henüz direniyor. Pal'in durduğu nokta burası: bağlantı kurma, sohbetten varlığa geçiş, kafada birleşen parçalar henüz makineye geçmedi. Fakat eğri aynı yönde ilerliyor; direncin süresi, sürülerin büyüklüğüne bağlı görünüyor.
| Bulgular | Ölçütler |
|---|---|
| 10 bin agent, 88 saatte ispat | 100 insan yıllık emek |
| 2 bin $'lık bot kupayı aldı | Rakipler 15 milyon topladı |
| 15 sn görüntü 8 sn'de üretildi | Gerçek zamandan hızlı |
Videodaki anahtar anlar
AI yorumu
"Video, abartılı bir teknoloji övgüsü gibi açılıyor fakat bağımsız ölçümler çekirdek iddiayı destekliyor; eleştirel bakışımı değerlendirme bölümünde topladım."
AI değerlendirmesi
Karşı görüşün en güçlü hali şu: görülen tablo bir ölçüm yanılsaması olabilir. Kıyaslamalar laboratuvar koşullarında yapılıyor, gerçek iş dünyasındaki dağınık veri ve sorumluluk zinciri ise ölçülmüyor. Anthropic duyurusundaki verimlilik iddiaları erken erişim müşterilerinden geliyor; bağımsız ve uzun soluklu verimlilik denetimleri henüz yayımlanmış değil. ArtificialAnalysis ölçümü bile aynı tabloyu gösteriyor: zekâ artıyor, fakat iş başına düşen token tüketimi de artıyor. Maliyet düşüşü manşetteki kadar büyük olmayabilir.
Eksik kalanlar listesi kabarık. Enerji ve yonga tarafındaki sayılar konuşulurken Avrupa'nın durumu neredeyse hiç açılmıyor; Bpdata derlemesindeki Çin-ABD kıyasında bile izin süreçleri yüzeysel geçiliyor. Güvenlik değerlendirmeleri somut testlerle anlatılmıyor. Ayrıca sürülerin bulduğu ispatların öğretici değeri tartışması havada kalıyor: sonuç doğru, fakat insanın öğrendiği şey belirsiz. Okur, övgü ile kanıt arasındaki mesafeyi korumalı.
Konuşanların duruşlarını da not etmek gerek. Pal, makro piyasalar ve kripto çevresinin tanınan ismi; heyecanlı teknoloji anlatısı yönettiği topluluğun doğal besini. Emad ise üretken yapay alanının kurucularından; agent patlaması onun tezlerini doğruluyor. Bu durum anlatılanları yanlış kılmaz, ancak ölçüyü değiştirir: iki isim de iyimser tarafta duruyor. Eleştirel sesler videoda neredeyse hiç yer bulamıyor; dengeyi okur kendi kurmalı.
Okur için pratik çıktı üç başlıkta toplanıyor. Birincisi, yazım ve yazılım ağırlıklı işlerde yeni kuşak modelleri küçük bir pilotla dene; dört saatlik işi dört dakikaya indiren örnekler artık istisna değil. İkincisi, tahmin ve araştırma işlerinde tek modele değil, çoklu agent düzenine bak; StackFutures kaydındaki 2 bin $'lık örnek, sermayeden çok kurgunun belirleyici olduğunu gösteriyor. Üçüncüsü, yaratıcı işlerde hak ve özgünlük çerçevesini baştan çiz; Deadline duyurusundaki ödül yağmuru, telif tartışmalarını da beraberinde getirecek.
Kaynaklar
9 bağlantı; 3 tanesi 15 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @youtube.com YouTube — RaoulPalTJM
- @anthropic.com Anthropic — Introducing Claude Opus 4.5
Aynı kaynağı kullanan: Opus 5.5 Sıfırdan Gerçek Parayla İşlem Yapan Tycoon Oyunu Yazdı: Day Trader Tycoon Deneyi · Haftanın Büyük Sarsıntısı: GPT-6 Soul ve Luna Yarı Fiyata, Opus 5.5 Zirveye Oynuyor
- @artificialanalysis.ai ArtificialAnalysis — Opus 4.5 Benchmarks
- @openai.com OpenAI — Navier-Stokes Solution
Aynı kaynağı kullanan: Milyonluk Denklemin Peşinde: On Bin Etmen ve Bir Gece Yarısı Bildirisi · Milenyum Problemini Çözen Makine: Navier-Stokes ve Yapay Zekânın Matematik Devrimi · Eric Schmidt'ten süperzeka haritası: uzun akıl yürütme, hizalanma korkusu ve veri merkezi ekonomisi · 2045'i Beklerken 2026 Geldi: İki Matematikçi Yapay Zekanın Şokunu Anlatıyor · Navier-Stokes'ta Tekillik Krizi: OpenAI'nin 88 Saatlik İddiası ve İki Matematikçinin İtirazı · OpenAI 88 Saatte Milyon Dolarlık Navier-Stokes Sorununu Çözdü: Trilyon Dolarlık Yarış Kızışıyor · Navier-Stokes’tan Kimi’ye: Yapay Zekâda Matematik Zaferi ve Kontrol Krizi Bir Arada · OpenAI Navier-Stokes İddiası: 88 Saatte 166 Sayfalık Lean Doğrulamalı Çözüm Önerisi · Tekilliğin Açılış Perdesi: Kıyamet Anlatısı, 10 Bin Ajan ve Şirketlerdeki Gerçek Tablo · Navier-Stokes Kavgası: 10 Bin Yapay Zeka Ajanı ve Milyon Dolarlık Denklem · Asansörden Girdaba: Navier-Stokes Denklemi Neden Düğümlendi ve OpenAI Ne Öne Sürdü · OpenAI Matematiği Çözdü Ama Kimse Mutlu Değil: Navier-Stokes Kavgası (+1)
- @quantamagazine.org Quanta Magazine — Millennium Proof
Aynı kaynağı kullanan: OpenAI 88 Saatte Milyon Dolarlık Navier-Stokes Sorununu Çözdü: Trilyon Dolarlık Yarış Kızışıyor · Asansörden Girdaba: Navier-Stokes Denklemi Neden Düğümlendi ve OpenAI Ne Öne Sürdü · On Bin Yapay Zekâ Ajanı ve Bir Tekillik: Navier-Stokes Kanıtının Perde Arkası
- @stackfutures.com StackFutures — Metaculus Cup Win
- @fedscoop.com FedScoop — Bessent on Lab Liability
- @deadline.com Deadline — The Gifted Wins XPRIZE
- @bpdata.com Bpdata — China AI Infrastructure
yapay zekâ · agent sürüleri · claude · tahmin · veri merkezi · üretkenlik · düzenleme