Gündeme dön

Üç Günde Üç Model: Astra'nın AGI İddiasını Masaya Yatırmak

Fireship, Eylül 2026'nın ilk haftasında peş peşe gelen Anthropic Fable ve Mythos 5.1, Meta Muse Spark 1.3 ve OpenAI GPT-6 Astra sürümlerini inceliyor. Dağınık lansman, aynı güne denk gelen kesinti ve erken erişim övgüleri eşliğinde asıl soruyu soruyor: Astra gerçekten genel zekâ mı, yoksa iyi paketlenmiş bir sınır modeli mi?

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — FluKUJyeYD8
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Video, yapay zekâ gündeminin akıl almaz bir haftasıyla açılıyor: salı günü Anthropic Fable ve Mythos 5.1, çarşamba Meta Muse Spark 1.3, perşembe OpenAI GPT-6 Astra duyurulmuş. Üçü de kodlama ve bilgi işi iddiasında; sunucu haftayı, zengin yatırımcıların çölde olduğu sakin eylül beklentisinin tam tersi bir fırtına olarak resmediyor.

Anthropic cephesinde iki model aynı çekirdekten geliyor: Fable kullanılabilen, Mythos ise hassas konularda konuyu değiştiren sürüm olarak anlatılıyor. Tanıtım puanları bir yana, vaka çalışmaları daha ilginç bulunuyor. Beş yıldır milyonda bir çöken bir hedge fonu kodu, Fable 5.1'e verilmiş; model çökme anı görüntüsünden yola çıkıp kaynağı kapalı bir satıcı kütüphanesini derleme diline kadar çözerek hatayı satıcının kodunda bulmuş.

Mythos tarafında ilaç tasarımı öne çıkıyor: modern ilaçların ilk adımı olan hedefe yapışan protein tasarımında yapay zekâ isabetinin tipik olarak yüzde 10 bandında olduğu, yeni sürümün bu alanda iddialı olduğu aktarılıyor. Kodlama dışı bir başarı olarak protein işi, modelin bilgi işi etiketini dolduran kanıt sayılıyor.

Çarşamba sahnesi Meta'nın: Muse Spark 1.3, sınıra yakın güçte ama ölçülmesi neredeyse bedavaya yakın bir model olarak tanıtılıyor. Standart uç nokta fiyatları milyon jeton başına girişte 1,25, çıkışta 4,25 dolar; verilerinin eğitime kullanılmasını kabul edenlere ise girişte 10, çıkışta 20 sentlik katılımcı katmanı sunuluyor. Geliştiricilerin çift haneli bir yüzdesinin bu katmanı seçtiği bilgisi, alaycı bir ucuz et benzetmesiyle veriliyor.

Perşembe sabahı Astra çıkmadan hemen önce ChatGPT, Claude, Grok ve Cursor aynı anda çökmüş. Akla yatkın açıklama Azure tarafındaki kesinti; eğlenceli kuram ise Astra'nın ilk iş olarak rakiplerini saf dışı bırakması. Sunucu iki açıklamayı yan yana koyup espriyi kuramın önüne geçirmiyor, teknik olasılığı koruyor.

Lansmanın kendisi de dağınık: OpenAI duyuru sayfasını açıyor, ambargolu haberler Reuters, CNBC ve The Verge'de yayımlanıyor, sonra sayfa bilinmeyen bir nedenle geri çekiliyor. Yaklaşık 90 dakika sonra sayfa dönüyor; modelin henüz kimseye açık olmadığı, Plus ve Pro kullanıcılarına günler içinde geleceği anlaşılıyor. Üst yönetici özür paylaşıyor, bekleyen bir aboneye erken yatmasını söylüyor ve modelin yayımlanmadan önce yönetimle resmi bir incelemeden geçtiğini açıklıyor.

Erken erişim izlenimleri, beklendiği gibi olumlu; ayrıcalıklı azınlığın olumsuz konuşmaması şaşırtmıyor. Yine de uzamsal farkındalık gerektiren demolar dikkat çekici: San Francisco'daki bir sanat sarayının Blender içinde neredeyse birebir modellenmesi, demo evin önce modellenip sonra Unreal 5'te yürünebilir sahneye çevrilmesi örnek veriliyor. OpenAI çalışanının paylaştığı ev turu ile bir düzine aracının kendi aralarında konuştuğu Unreal dünyası, en çok konuşulanlar arasında.

Bağımsız ölçümde tablo serinletici: Artificial Analysis endeksinde Astra 61 puanla GPT 5.6 Soul ile aynı, Fable 5.1'in 5 puan gerisinde görünüyor. Büyük lansman gürültüsü ile puan cetveli arasındaki uyumsuzluk, videonun merkezine yerleşiyor. Rakamlar, hikâyenin heyecanını dengeleyen çıpa işlevi görüyor.

Videonun destekçisi CodeRabbit Security, sürekli kod güvenliği vaadiyle anılıyor: kalıp eşleştirme yerine akıl yürüten güvenlik aracıları, erişilebilirlik ve patlama alanına göre risk önceliklendiriyor, sorunu sade dille anlatıp değişiklik önerisi sunuyor. Birleştirme öncesi her isteği tarayan yapı, haftalık güvenlik telaşına bağlanıyor.

Kapanışta sunucu, haftanın üç sürümünü tek cümlede topluyor: Anthropic derin vaka gücü, Meta fiyat baskısı, OpenAI vitrin ve iddia gücüyle öne çıkıyor. AGI sorusu yanıtsız bırakılıyor ama terazinin bir kefesine demolar, diğerine bağımsız puanlar konmuş oluyor.

Genel çıkarım, erken erişim parıltısıyla bağımsız ölçümün ayrıştırılması gerektiği yönünde. Lansman haftasının kazananı, en yüksek sesle AGI diyen değil, bağımsız cetvelde çizgisini koruyan olacak gibi görünüyor.

AI yorumu

"Lansman karmaşası ile teknik içerik arasındaki dengeyi çok isabetli buldum; büyük iddiaları alkış yerine ölçülebilir kanıtla tartma tavrını ben de benimsiyorum."

AI değerlendirmesi

Karşıt görüşü cömertçe kurarsak, bağımsız puanlar her şeyi anlatmaz: çökme ayıklama ve protein tasarımı gibi gerçek işler, genel zekâ tartışmasından bağımsız değer taşır. Bir model cetvelde gerideyken sahada işe yarayabilir; video da zaten demoların gücünü teslim ediyor. Bu açıdan puan farkını hüküm saymak acele olur.

Yöntem sınırları açık: sunucunun elinde erken erişim yok, değerlendirmeler ikinci el; kesinti nedeni doğrulanmamış bir olasılık olarak kalıyor. Tek video, üç modelin tamamını derinlemesine test etmiyor; daha çok lansman okuması yapıyor. İzleyici bunu test raporu değil, gündem çözümü olarak okumalı.

Doğrulanabilirlik tarafında fiyatlar, puanlar ve vaka iddiaları bağımsız sayfalardan teyit ister. Özellikle yönetim incelemesi ve ambargo haberleri gibi iddialar, şirket açıklaması ile gazetecilik kaynağı arasında gidip geliyor. Karar verecek biri, CNBC ve Artificial Analysis gibi birincil kaynaklara kendisi bakmalı.

Benim pratik çıkarımım şu: model seçiminde lansman haftası heyecanını bir kenara bırakır, kendi iş yükümle küçük bir kör test yapardım. Fiyatı Meta ile, derin ayıklamayı Anthropic ile, vitrin hızını OpenAI ile ölçer; AGI etiketini ise satın alma ölçütü yapmazdım.

Kaynaklar

6 bağlantı; 3 tanesi 3 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

programlama · günde · model · astra · ddiasını · masaya · nodesdaily

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…