Gündeme dön

OpenAI'nin "o" Asistanı, Claude Sonnet 5.5 ve MiniMax M3.1: DevDay Öncesi Üç Model Savaşı

OpenAI'nin 29 Eylül DevDay konferansından üç gün önce sızan "o" adlı sürekli çalışan asistan, Anthropic'in "önümüzdeki haftalarda" dediği Claude Sonnet 5.5 ve Çinli MiniMax'in M3.1 Flash önizlemesi aynı haftaya denk geliyor. Üçü de aynı soruya farklı cevap veriyor: hız mı, fiyat/performans mı, yoksa sürekli görev mi?

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — 6DjIjjE3doo
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Yapay zekâ alanında sakin bir gün yok. OpenAI'nin geliştiriciler konferansına üç gün kala büyük bir sızıntı dolaşmaya başladı: şirketin birinci büyük duyurusu olabilecek, sürekli açık olan bir asistan. İsim tek harf: "o" . Bu sızıntı, videoda öne çıkan ve DevDay'da herkesin konuşacağı üç hikâyeden yalnızca biriydi; aynı hafta Anthropic'ten bir fiyat/performans haberi ve Çinli MiniMax'ten bir önizleme geldi.

Tek harfin arkasındaki ürün: "o"

TestingCatalog'ın haberine göre "o", ChatGPT'nin $100'luk Pro aboneliğinin yükseltme ekranında bir fayda satırı olarak belirdi: "o, your always-on assistant" . Aynı ekip yapılandırma dosyasında "o" adını bir görünen isim, "-o" ekini ise bir e-posta son eki olarak buldu. testingcatalog.com'a göre bu ikinci alan, asistanın e-posta işlerini yürüteceği işaretine yorumlanıyor; ancak yalnızca iki alan adına bakarak bir yetenek atfetmek doğrulama değil, çıkarımdır. Daha güçlü iz, ismin kaynağında gizli: @o hesabı X üzerinde askıya alınmış durumda ve bu kaynak için önümüzdeki lansman için ayrılmış olabilir. Bu da o kadar kesin değil; tek karakterlik bir isim, binlerce nedenle askıya alınmış olabilir. wccftech.com'a göre OpenAI, ürünü Meta'nın Muse ajanı karşısında konumlandırmak istiyor. cnbc.com'a göre JPMorgan analistleri Muse'un ChatGPT'den sonra en çok kullanılacak tüketici uygulaması olabileceğini söyledi; bu değerlendirme, OpenAI'nin acele etme sebebini açıklıyor.

İç isim tartışması en çok yanlış anlaşılan kısım. Bir kaynak, "aeon" adının ChatGPT Workspace hesaplarındaki mevcut özel ajan uygulamasını gösterdiğini ve tüketiciye dönük "o"nun bunun üzerine kurulacağını söylüyor. runtimewire.com ise tersini yazıyor: "o", uzun süreli görevler için özel bir GPT-6 Astra varyantı olan aeon üzerinde çalışacak. Üç farklı anlatıcı, hiçbiri birincil kaynak olmadan, hangisinin doğru olduğunu söyleyemiyor.

Hız bir ürün özelliğine dönüşüyor

OpenAI'nin hız tarafındaki hamleleri, sızıntılardan daha iyi belgelenmiş. testingcatalog.com'un aktardığına göre API oyun alanında üç hızlı seviye görüldü: standart, hızlı ve ultra hızlı. openai.com ise bunu resmen doğruluyor: geliştiriciler.openai.com'a göre öncelikli işleme 30 Temmuz 2026'da "hızlı mod" adıyla yeniden adlandırıldı ve 2,5 kat hız sunuyor. openai.com'un kendi paylaşımına göre Cerebras altyapısında çalışan yeni Ultrafast modu ise saniyede 750 çıktı jetonuna kadar çıkabiliyor. Bu hızın bedeli bir abonelik kademesinde beliriyor. decrypt.co, ChatGPT'nin web sitesi kodunda "Pro Max" adlı 500 dolarlık bir kademe bulunduğunu ve bunun daha fazla kullanım değil, daha hızlı işleme satın aldığını aktarıyor. testingcatalog.com'a göre kademe "Fastest Work and Codex" vaadiyle tanımlanıyor ve altyapının Cerebras'tan gelmesi muhtemel. cerebras.ai bunu kendi tarafından doğruluyor: şirketin duyurusuna göre Ultrafast modu başlangıçta yalnızca seçilmiş müşterilere açık ve 750 jetonluk hız kalite kaybı olmadan geliyor. openai.com'un ortaklık duyurusu ise ölçeği tamamlıyor: platforma 750 megawatt düşük gecikmeli bilgi işlem gücü ekleniyor.

Hız sadece bir özellik değil, yeni bir fiyat mertebesi. testingcatalog.com'un $500 kademeyi 5 katına çıkarması, kullanıcının haftalık ya da aylık iş yükünü değil, gecikme hassasiyetini ne kadar ödediğini gösteriyor. Konuşmacının çıkarsaması da bu yönde: OpenAI'nin altyapı yatırımı son bir yılda gözle görülür biçimde arttı ve DevDay'da büyük bir eksen olabilir.

Anthropic: fiyat/performans cephesi

Anthropic tarafındaki rakamlar doğrulanabilir durumda. anthropic.com'un 22 Eylül tarihli Opus 5.5 duyurusuna göre model, Opus 5'in üzerinde Fable 5.1 seviyesinde çalışıyor, %40 daha ucuz çalışıyor ve %30'dan fazla hızlı üretim yapıyor. anthropic.com'un fiyat tablosu bunu netleştiriyor: bir milyon token için giriş 4 dolar, çıktı 20 dolar, önbellek okuma 0,20 dolar. techcrunch.com ise sürümün 24 Temmuz'daki Opus 5'ten yalnızca iki ay sonra geldiğini vurguluyor.

anthropic.com aynı duyuruda Claude Sonnet 5.5 ve Haiku 5.5'in "önümüzdeki haftalarda" geleceğini yazıyor; kesin tarih yok. start-up-fortune tarafından aktarılan sızıntılar ise partner erişimine yeni bir kontrol noktası açıldığını ve 30 Eylül ya da 1 Ekim'e yakın bir lansman penceresi işaret ettiğini iddia ediyor. start-up-fortune, Anthropic'in 22 Eylül'ün ötesinde resmî bir tarih vermediğini de vurguluyor. Sızıntıdaki fiyat ise şüphesiz: anthropic.com'un Sonnet 5 duyurusuna göre 2 dolar giriş ve 10 dolar çıktı, 1 milyon token için kalıcı olarak belirlenmiş. Konuşmacının "GPT-6'dan her yönden daha iyi" iddiası ise kendi testine dayanıyor, Anthropic'in açıklamasına değil.

MiniMax M3.1 ve hız/verim dengesi

Üçüncü hikâye, videonun en ilginç zamanlamasını taşıyor: konuşmacı sızıntıyı bir GitHub çekme talebi yakaladıktan sonra videoyu kurgulamaya başlamış, M3.1 Flash önizlemesi ise neredeyse çekim bittiğinde resmen duyurulmuş. orcarouter.ai'in aktardığına göre MiniMax, 22 Eylül tarihli bir mimari notu ve Hugging Face üzerinde erişimi kısıtlı 250 GB'lık bir kontrol noktası bırakmış; M3.1'in "önümüzdeki hafta" çıkacağı yönündeki haber model izleyicilerine düştü.

Çıktı kalitesi tarafında konuşmacı iki deneme gösteriyor. Birinde piksel sanatı üretiliyor ve hızlı model, ileri modellerin sıklıkla atladığı atmosfer ayrıntılarını ekliyor. Diğerinde birkaç satırlık bir istek çizgi resim üretmeye yönelik; güçlü model bunu geçersiz kılan bir bozuk çıktı verirken, hızlı model okunur ve tutarlı bir sahne kuruyor. Konuşmacı bunu tek testten ziyade bir rekabet göstergesi olarak sunuyor ve modelin en iyi olduğu iddiasından uzak duruyor. Ek bir hızlı model daha bahis edilir: bir milyon token'lık bağlam penceresiyle ücretsiz bir önizleme, iki hafta içinde bir kodlama istemcisinde açılacak. Bu iddia, sızan kodlama ajanı denemelerinin arka planını oluşturuyor; bu ajanlar bir oyunu tam bir kopyaya dönüştürebildiğinde, işin ölçeği küçük demoları aşıyor.

Uzun süreli ajanlar: sınır nerede

Videonun kapanışındaki proje, söylenen sözün nereye kadar gittiğini gösteriyor: yüz bin satırlık oyun kodu, yirmi altı bin satırlık test kodu, bin otomatik test, yedi yüz yetmiş beş dosya ve yaklaşık yirmi beş saatlik kesintisiz ajan çalışması. Üstüne koda gömülü olarak üretilmiş yüzlerce görsel ve yüzden fazla ses dosyası ile oyun içi bir kullanım kılavuzu da var. anthropic.com, ajan kodlama ölçeğine dair benzer bir sıçrayışı doğruluyor: bir erken test kullanıcısı 680 bin satırlık bir kod geçişini bir günden kısa sürede tamamladığını yazıyor. favtutor.com'un derlediği bu sayılar, kavramı özetliyor: ajan kodlama artık küçük bir demo değil, haftalar sürecek bir mühendislik işini günlere sığdıran bir üretim biçimi. Buna karşılık goldiebench.com, bu tür yapay oluşturulmuş projelerin bağımsız bir değerlendirme sitesi kurduğunu ve tek seferlik denemeleri gerçekten oynanabilir biçimde test ettiğini belirtiyor. Sektör, kendi ölçüm aracını üretmeye başladı; bu da iddiaların daha fazla denetim altına gireceği anlamına geliyor.

Haftanın büyük resmi, altyapı ile ajan mimarisinin birbirine kilitlenmesi. OpenAI hız kademelerini genişletiyor, Anthropic aynı hızı daha ucuza sunmayı vaat ediyor, MiniMax ise hızı daha ucuz bir fiyatla paketliyor. Üçü de aynı yere bakıyor: kullanıcıya vaat edilen şey artık modelin ne kadar akıllı olduğu değil, işin ne kadar sürede tamamlandığı. DevDay 29 Eylül'de, o zaman bu vaatlerin hangisinin gerçek olduğu ilk kez ölçülebilir olacak.

Görsel: nodesdaily AI

Videodaki anahtar anlar

  1. DevDay'a uc gun ve buyuk sizinti
  2. Pro abonelik ekraninda tek harf
  3. API'de uc hiz seviyesi
  4. 500 dolarlik yeni kademe
  5. Opus 5.5: yuzde 40 ucuz
  6. Sizintidan resmi lansmana
  7. Cizgi resim kiyaslamasi
  8. Yuz bin satirlik oyun kodu

AI yorumu

"Sızıntılar tek başına zayıf kanıt, ama bu hafta yığılmaları anlamlı: OpenAI'nin kalıcı asistan iddiası, Anthropic'in fiyat/performans hücumu ve MiniMax'in sesten resme hızlı çıkarışı aynı günlere düşüyor. Asıl soru ürünlerin ne olduğu değil, hangisinin altyapı talebini gerçekten taşıyacağı. Çünkü hepsinin arkasında aynı darboğaz var: hızlı çıktı üretmek için daha pahalı ve büyük donanım katmanları."

AI değerlendirmesi

En güçlü karşı görüş, sızıntıların kendisine ait. "o" için en sağlam kanıt, "your always-on assistant" yazan bir abonelik ekranı görüntüsü ve iki alandan oluşan bir yapılandırma parçası; TestingCatalog bunu yayınlarken, 63 dil veya belirli çipler gibi iddiaların hiçbir birincil kaynakta geçmediğini açıkça belirtiyor. İki JSON alanından bir ürün yeteneği çıkarmak, doğrulama değil çıkarımdır.

Eksik kalan kısımlar tesadüfi değil yapısaldır. Kalıcı bir ajanı değerlendirmek için gereken şey tam da sızan parçada yok: hangi uygulamalara dokunduğu, hangi izinlere sahip olduğu, nerede çalıştığı ve hata yaptığında kimin sorumlu olduğu. Hız kademelerinde de benzer bir boşluk var: saniyede 750 jeton ölçülebilir bir rakam, ama bunun hangi donanım maliyetine denk geldiği açıklanmıyor.

Konuşmacının çıkarı, kendi ifadesiyle spekülasyonu doğrudan denetlenebilir kılıyor. "GPT-6'dan daha iyi" ve "sızan bir commit yakaladım" türü cümleler, kanıtsız bırakılsa yazıda delik gibi dururdu; video, bu iddiaların hangi teste dayandığını ve ne kadar öznel olduğunu görünür kılıyor. Bu yüzden iddiaları doğrulanmış bilgiden ayırmak, konuyu değerlendirmek için gerekli.

Okur için pratik çıkarım, bekleme eğiliminde. Sızan ürünler DevDay'da resmen açıklanmadan önce hiçbirini ücretli bir iş akışına bağlamak riskli. Buna karşılık iki hız kademesi hâlihazırda gerçek: Anthropic'in platformunda 2,5 kat çıktı hızı sunan hızlı mod, açık bir fiyat karşılığıyla satın alınabiliyor. Aynı gün, aynı bütçeyle ölçülebilecek tek şey o.

Kaynaklar

11 bağlantı; 4 tanesi 11 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

openai · devday 2026 · claude sonnet 5.5 · minimax m3.1 · yapay zeka ajanlari · cerebras

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…