Haftanın yapay zekâ gündemi tek cümleyle özetlenebilir: en iyi yardımcı, artık en iyi modellerle çalışmak istiyor. Elon Musk, X paylaşımında Grokbot'un bundan böyle her görevde en yüksek başarı ihtimali sunan arka uç modelini kullanacağını yazdı; adı geçenler arasında Anthropic'in Claude Opus 5.5 sürümü ile Midjourney ve Suno da bulunuyor. Thenextweb'in 7 Ekim tarihli haberine göre Musk hangi işin hangi modele gideceğini açıklamadı, fakat çok modelli yönlendirme ilkesi net: görsel istenirse Midjourney, şarkı istenirse Suno, zor bir metin işi varsa Claude devreye girebilecek.
Bu hamle, yardımcılarla modeller arasındaki eski ödünleşimi ortadan kaldırmayı hedefliyor. Pink'in anlatısına göre bir yanda kullanımı keyifli fakat görece zayıf modellerle çalışan Grokbot ve Muse duruyor, öte yanda güçlü bir modelle çalışan ancak henüz ham olan Dots yer alıyor. Kullanıcı şimdiye dek ya en iyi uygulamayı ya en iyi modeli seçmek zorundaydı; Musk şimdi ikisini birden vadediyor. Zamanlama da dikkat çekici, çünkü Thenextweb aynı yazıda bir gün önce Grok kullanıcılarının mobil ve web erişiminde sorun yaşadığını, City AM'in bunu aktardığını yazıyor.
En rahat yardımcı, en güçlü modellerle buluşuyor
Grokbot cephesinde başka yenilikler de var. Hesaplardaki yıldız simgeli birincil bot, kullanıcı sormadan iş arayıp öneren önleyici yardımcı anlayışını taşıyor; Pink, e-postasındaki süresi dolmak üzere olan bir teklifin kendisine otomatik hatırlatıldığını anlatıyor. Ne var ki Pink bu tür otomatik önerilerin ancak dörtte birinin gerçekten işe yaradığını, kalanının yalnızca yeni bir bildirim kalabalığı ürettiğini söylüyor. Dots ve Muse da aynı yolda ilerliyor, fakat hiçbiri bu işi henüz tam kıvamına getirebilmiş değil.
Grokbot ayrıca X üzerindeki içerikleri okuyup tarayabilen ve gündemi izleyebilen yerleşik izleme yeteneği kazandı; daha önce bunun için ayrıca ödeme gerektiren bir geliştirici arayüzü gerekirken artık kurulum gerekmiyor. Bu tür platform içi izleme, yardımcının dış dünyaya açılan ilk ciddi penceresi sayılır. Elbette yönlendirmenin bedeli ve kullanıcıya seçim hakkı tanınıp tanınmayacağı belirsizliğini koruyor: yazı işleri için Grok yeterli görülüp Opus sevenler düş kırıklığı yaşayabilir, ayrıca pahalı modellerin kullanım hakkını ne hızla tüketeceği bilinmiyor. Bu bilgi Thenextweb kaynağından elde edilmiştir.
OpenAI cephesinde haftanın en somut yeniliği GPT-6'nın ChatGPT kullanan herkese açılması oldu. Şirketin 7 Ekim tarihli duyurusuna göre 1,2 milyardan fazla haftalık kullanıcı bu yeni kuşak zekâdan yararlanacak; ücretli planlarda GPT-6 Sol, ücretsiz ve Go planlarında ise GPT-6 Luna çalışıyor. Bununla gelen etkileşimli arayüz düzeni, uzun metin duvarı yerine konuya özel görsel düzenler üretiyor. Bu bilgi OpenAI kaynağından elde edilmiştir.
Sohbet penceresi uygulamaya dönüşüyor
Pink'in denemeleri, yeni düzenin ders anlatımından günlük işlere dek uzandığını gösteriyor. Tabata antrenmanı sorusuna tablo ve açıklamayla yanıt veren sistem, ardından geri sayımlı bir antrenman zamanlayıcısı kuruyor; amuda kalkmayı öğrenmek isteyene dört aşamalı bir yol haritası çizip her aşamaya webden bulunmuş görseller eşliyor. IKEA ürün bağlantısında montajı önce yanlış anlayıp sonra istenince açık bir şema çiziyor, meditasyon anlatımını boya programı estetiğinde sunup günlük takip çizelgesi ekliyor. Dallanan korkulu öyküde ise okur kapıyı kilitlemeyi seçtikçe anlatı yeni seçeneklerle sürüyor. Bu bilgi OpenAI kaynağından elde edilmiştir.
Dots cephesi ise henüz olgunlaşma aşamasında. Sesli aramalarda bağlantının hızlanıp güvenilir hale getirilmesi, görüşmelerin yazılı döküm ve özetlerinin sunulması ve yardımcının sürekli tekrarladığı kontrol sözlerine çeşitlilik katılması planlanıyor. Buna ek olarak Codex mühendisliğinin başındaki isim, 28 gün boyunca her gün ya ChatGPT için somut bir iyileştirme yayınlanacağı ya da herkese tam kullanım hakkı sıfırlaması verileceği sözünü verdi. Nerdschalk'in derlemesine göre bu söz 4 Ekim günü paylaşıldı ve GPT-6 Astra ile 6.1 Sol sürümlerinin hızı şimdiden yaklaşık yarı yarıya artırıldı; yine de sıfırlamanın her hesaba uygulanacağı onaylanmış değil.
Anthropic haftaya küçük ama hızlı modeliyle damga vurdu: Claude Haiku 5.5, şirketin kendi tanımıyla bugüne dek çıkardığı en ucuz, en hızlı ve en yetenekli küçük model oldu. Anthropic'in 7 Ekim tarihli duyurusuna göre bir önceki Haiku kuşağına kıyasla çalıştırma maliyeti ortalama yüzde 75 daha düşük. Ölçüm sonuçları da iddialı: bilgi işleri değerlendirmesinde 1620 puanla GPT-6 Luna'nın 1437 puanını geride bırakıyor, bilgisayar kullanımı ölçümünde yüzde 72,4 ile selefinin yüzde 15,7'sini katlıyor, uçbirim yazılım ölçümünde yüzde 39,2 ile rakiplerini açık ara geçiyor. Bu bilgi Anthropic kaynağından elde edilmiştir.
Fiyat cephesinde Anthropic cömert davrandı: Sonnet 5.5 sürümünün cache okuma bedeli yarıya indi, böylece ajan işlerinin çoğunda yaklaşık yüzde 20 tasarruf sağlandı; Max ve Team abonelerine ajan geliştirmeleri için aylık API kredisi tanımlandı. Pink, $100'lük planda Opus 5.5 sürümünü sınırlara takılmadan kullandığını, $20'lik planda ise Sonnet 5.5 ile bir haftanın rahat çıkarıldığını anlatıyor. Ailenin en büyük üyesi Fable 5.5 ise henüz duyurulmadı; Pink'e göre çıktığında dengeleri sarsabilir, fakat bu beklenti doğrulanmış değildir. Bu bilgi Anthropic kaynağından elde edilmiştir.
Bulut zorunluluğu ve ofis içi yapay zekâ
Haftanın en tartışmalı kararı Anthropic'ten geldi: 6 Ekim itibarıyla Pro ve Max planlarında yeni Cowork görevleri için bulut zorunluluğu başladı ve görevler yalnızca bulutta çalışıyor, yalnızca bu bilgisayarda seçeneği kaldırıldı ve geri dönüş yolu bırakılmadı. Tepkinin iki nedeni var: duyuru e-posta ve uygulama bildirimiyle yapılsa da Pink dahil birçok kullanıcı hiçbir şey almadığını söylüyor; ayrıca Cowork'un en güçlü satış söylemi olan her şey cihazda kalır ilkesi zedelenmiş oldu. Hackingdemand'in 5 Ekim tarihli incelemesine göre var olan yerel oturumlar silinmiyor ve bitene dek kullanılabiliyor, fakat dosyalara ulaşmak için masaüstü uygulamasının açık olması gerekiyor. Bu bilgi Hackingdemand kaynağından elde edilmiştir.
Pink, bulut taşınmasının mobil tarafta işleri belirgin iyileştirdiğini kabul ediyor: artık her görev telefondan izlenip yönetilebiliyor. Yine de mantık sorusu ortada duruyor; dosyalar cihazdaki uygulamayla yüklenip güncelleniyorsa bilgisayar zaten açık olmalı, o halde işlem neden yerelde koşmuyor? Bulutta ısrar edenler için önerilen seçenek, Claude'un geliştirici odaklı komut aracı. Öte yandan Claude artık Google'ın ofis uygulamalarının içine giriyor: Docs, Sheets ve Slides için hazırlanan resmi eklenti herkese açık deneme olarak tüm ücretli planlara sunuldu. Bu bilgi Claude kaynağından elde edilmiştir. Aynı tablonun ikinci yarısı ofis tarafında: eklenti, dosyanın yanında açılan bir kenar çubuğunda çalışıyor; açık belgeyi, seçili hücreleri ve slaytları görüp doğrudan değişiklik yapabiliyor. Docs tarafında cümle düzeltip başlığı yerinde yeniden biçimlendiriyor, büyük yeniden yazımları onay kartları halinde öneriyor. Sheets tarafında formül yazıp özet tablo ve grafik kuruyor, veri birleştirme için Python'a başvurup sonucu sayfaya geri yazıyor. Slides tarafında mevcut tema ve düzenlerle yeni slaytlar üretip taşan öğeleri işaretliyor. Varsayılan sor-ondan-sonra-değiştir kipi, her adımı onay kartına bağlıyor. Bu bilgi Claude kaynağından elde edilmiştir.
Google, Drive tarafında sessiz ama önemli bir kapı açtı: Markdown dosyaları artık Drive ve Docs içinde doğrudan önizlenip düzenlenebiliyor ve ortak çalışmaya uygun hale geliyor. Eskiden bu dosyalar ya yalnızca görüntüleniyor ya da Docs biçimine dönüştürülüyordu. Pink'in vurguladığı gibi neredeyse her yapay zekâ aracı Markdown üretiyor; bu biçimin Drive'ın ana dili haline gelmesi, ajanların doğrudan Drive'a yönlendirilip dosya üzerinden çalıştırıldığı yeni iş akışlarının önünü açıyor. Bu bilgi Thenextweb kaynağından elde edilmiştir.
Ücretsiz Gemini daralıyor, oyun ve erişilebilirlik genişliyor
Google cephesinin tatsız haberi ücretlendirmede: 9 Ekim'den itibaren plansız Gemini kullanıcıları yalnızca Flash-Lite modeline erişebilecek, Flash ve Pro seçenekleri kapanıyor. 9to5google'un 3 Ekim tarihli haberine göre ayda $4,99 ödeyen Plus aboneleri Lite ve Flash ile yetinecek, Pro seçeneğini kaybedecek; Pro ve Ultra planlarında ise kısıtlama yok, üstelik Pro plana en yüksek paralel akıl yürütme seçeneği ekleniyor. Ekim ayında her model için düşük, orta ve yüksek emek düzeyi seçimi geliyor; yüksek emek daha kapsamlı yanıt verse de kullanım hakkından daha çok yiyor. Bu bilgi 9to5google kaynağından elde edilmiştir.
Tatlı haberler ise oyun ve görsel taraftan geldi. Playground adlı deneme platformu, yazılım bilgisi gerektirmeden yazılı tarifle oyun üretmeyi vadediyor: iki ve üç boyutlu seçenekler, hazır kalıplar ve tek başına oynama düzeni hazır, çok oyunculu seçenek yakında geliyor. Pink'in lunapark işletme oyunu denemesi, ilk sonucun kaba çıktığını fakat uğraşınca düzgün bir oyunun mümkün göründüğünü ortaya koyuyor. Görsel tarafta Nano Banana Pro beklentisi sürüyor; Pink'e göre yaşı ilerlemiş bu model hâlâ çoğu zaman GPT Images 2.5 sürümünü geride bırakıyor. Bu bilgiler Google blogu kaynağından elde edilmiştir.
Doğrulama ve erişilebilirlik tarafında iki sevindirici adım var. SynthID Detector 7 Ekim'de herkese açıldı: görsel, ses, video veya metin yükleyip görünmez filigranı tarayan portal, Google üretimi içeriklerin yanı sıra OpenAI ve Kakao araçlarıyla üretilmiş içerikleri de tanıyor, Apple desteği yakında geliyor. Gigazine'in 8 Ekim tarihli denemesine göre 2023'ten bu yana 180 milyardan fazla görsel ve videoya filigran işlendi. Öte yandan Gemini Live içine eklenen rehberli görüş özelliği, görme engelli ve az gören kullanıcılara telefon kamerası üzerinden eşzamanlı sesli betimleme ve doğal yönlendirmeler sunuyor; Google blogu, Aira işbirliğiyle on binlerce saatlik görsel yorumlama verisiyle eğitildiğini ve binden fazla gönüllüyle sınandığını yazıyor. Bu bilgiler Gigazine ve Google blogu kaynaklarından elde edilmiştir.
| Gelişme | Anlamı |
|---|---|
| Grokbot rakip modellere açılıyor | Yardımcı konforu model gücüyle birleşiyor |
| GPT-6 herkese, Cowork buluta | Sohbet uygulamaya, ofis buluta taşınıyor |
| Gemini ücretsizde kısılıyor | Lite sürüm yetmezse plan yükseltmek gerekiyor |
Videodaki anahtar anlar
AI yorumu
"Pink'in haftalık turu, ajan savaşlarının yeni cephesini net gösteriyor: kazanan en iyi model değil, en iyi modelle çalışan en rahat yardımcı olacak. Grokbot'un rakip modellere açılması bu tezin en cesur denemesi; Cowork'un buluta taşınması ve Gemini'nin ücretsiz planda kısılması ise aynı haftada kullanıcı güveniyle ücretlendirme gerçeğinin çarpıştığını kanıtlıyor."
AI değerlendirmesi
En güçlü karşı görüş, Grokbot hamlesinin bir güç gösterisinden çok bir itiraf olduğu yönünde: xAI kendi modelleriyle en iyi yardımcıyı besleyemediğini kabul edip rakip modellere kira ödemeyi seçti. Bu bağımlılık, fiyatlamayı ve veri gizliliğini Anthropic ile diğer sağlayıcıların insafına bırakıyor; ayrıca kullanıcıya model seçme hakkı verilmemesi, şeffaflık söylemiyle çelişiyor.
Eksik kalanlar listesi de kabarık. Cowork'un buluta taşınması, dosyaların cihazda kalmasını önemseyen kullanıcıları yanıtsız bırakıyor; Gemini'nin ücretsiz planda Lite sürüme indirilmesi, giriş seviyesi kullanıcıları rakip uygulamalara itebilir. SynthID yalnızca filigran taşıyan içerikleri yakalıyor, filigransız üretimler dedektörden kaçıyor; Playground'un ilk oyunları ise tanıtımdaki kadar kolay görünmüyor.
Pink'in konumu da not edilmeli: haftalık özet formatı gereği her gelişmeyi sınayan ve abone çağrısıyla kapatan bir anlatıcı; videonun ortasındaki Okou tanıtımı, sponsorlu bölümün açıkça ayrıldığı dürüst bir çerçevede sunuluyor. Yine de seçimleri kişisel kullanım alışkanlıklarını yansıtıyor; 100 dolarlık plan önerisi herkesin bütçesine uymaz.
Okur için pratik çıkarım net: ajan seçerken yardımcı konforuyla model gücünü birlikte değerlendirin; Grokbot'un yönlendirmesi oturana dek yazı işlerinde Opus'u elden bırakmayın. Cowork kullanıyorsanız 6 Ekim sonrası için dosya erişim düzeninizi gözden geçirin, Gemini'de ücretsiz kaldıysanız Flash-Lite sınırlarını bilin. Oyun denemek için Playground'a, erişilebilirlik için Gemini Live içindeki rehberli görüşe bir bakın.
Kaynaklar
12 bağlantı; 4 tanesi 11 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @youtube.com YouTube — Paul J Lipsky
- @thenextweb.com Thenextweb — Grok Bot multi-model routing
Aynı kaynağı kullanan: Haftanın Yapay Zekâ Ürünleri: Açık Agentler, Yonga Finansmanı ve Arayüz Yarışı
- @openai.com OpenAI — GPT-6 and Intelligent UI for everyone
Aynı kaynağı kullanan: Haftanın Yapay Zekâ Ürünleri: Açık Agentler, Yonga Finansmanı ve Arayüz Yarışı · Kredi Daralması Gölgesinde Piyasalar: Boğa Dinleniyor, Yapay Zekâ Harcamaları Büyüyor
- @openai.com OpenAI — GPT-6 Sol and Luna models
Aynı kaynağı kullanan: Space Bunny Alpha: Ücretsiz Gizli Yapay Zeka Deneyinin Perde Arkası · Yapay Zekânın En Yoğun Haftası: Dünya Modelleri, Açık Ağırlıklar ve Uzayda Yapay Zekâ · Yapay Zeka Fiyat Savaşı: Opus 5.5, GPT-6 Sol ve Agent Dünyasının Sessiz Darboğazı · Aynı Gün Dört Lansman: Opus 5.5 Dönüşü ile GPT-6 Sol ve Luna Fiyat Devrimi · Piyasa Gözden Kaçırıyor: Yapay Zekâda Dev Talep Dalgası ve Neo Bulutların Sessiz Rallisi
- @anthropic.com Anthropic — Claude Haiku 5.5
Aynı kaynağı kullanan: Aynı Etiket Farklı Fatura: Haiku 5.5 ile Luna Düellosu · Haftanın Yapay Zekâ Ürünleri: Açık Agentler, Yonga Finansmanı ve Arayüz Yarışı · Haiku 5.5: Anthropic sonunda küçük model sorununu çözdü · Haiku 5.5 Maliyet Verimliliğini Yeniden Çiziyor · Claude Haiku 5.5: Anthropic'in En Ucuz ve En Hızlı Modeli Dengeleri Değiştiriyor
- @claude.com Claude — Google Workspace add-on
- @9to5google.com 9to5google — Gemini model access limits
- @blog.google Google blog — Playground game creation
- @blog.google Google blog — Guided Vision in Gemini Live
- @nerdschalk.com Nerdschalk — Codex 28-day pledge
- @gigazine.net Gigazine — SynthID Detector public launch
- @hackingdemand.com Hackingdemand — Cowork cloud migration
yapay zekâ · grokbot · chatgpt · claude · gemini · yapay zekâ ajanları