Gündeme dön

Haftanın Yapay Zekâ Tablosu: Ucuz Modeller, Görsel Yanıtlar, Ajan Yağmuru

Anthropic hızlı ve ucuz Haiku 5.5 modelini çıkardı, OpenAI yanıtları görselleşen GPT-6 arayüzünü herkese açtı, xAI Grokbot'u rakip modellere yönlendiren bir çatıya dönüştürüyor ve Mistral 1 trilyon parametreli açık ağırlığını duyurdu. Haftanın bütün parçaları aynı yöne bakıyor: ajanlar her yerde, fiyatlar düşüyor, tercih ölçütü ham güçten çok güvene kayıyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — NUizyuGj-kE
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Yapay zekâ gündemi nadiren bu kadar kalabalık olur: Anthropic haftaya küçük ama iddialı bir modelle girdi, OpenAI neredeyse her gün yeni bir damla paylaştı, xAI ajanını baştan tanımladı, Google kurumsal karta oynadı, Mistral ise Avrupa'dan şimdiye kadarki en büyük açık hamlesini yaptı. Sunucu turu tek tek duyuruları sıralamakla kalmıyor, aralarındaki ortak damarı da gösteriyor. O damar, sohbet penceresinden taşan ve bilgisayarın bütün işlerine el atan ajanlar. Fiyat rekabeti, görsel yanıtlar, çevrimdışı notlar ve açık ağırlıklar hep aynı yarışın farklı kulvarları gibi duruyor.

Haiku 5.5: hızlı, ucuz, iddiasız

Claude Haiku 5.5 , ailenin en küçük üyesi olarak hızlı ve yüksek hacimli işler için tasarlanmış. Özet çıkarma, sıkıştırma, veri tabanı sorguları ve sınıflandırma gibi tekrarlayan yükler ile yazılım işlerinde yardımcı etmen rolü öne çıkıyor. Fiyat listesi iddiayı netleştiriyor: giriş tarafı ilk 100 bin jetona kadar milyon başına yaklaşık 10 cent, sonrası 50 cent; çıkış tarafı 50 centten başlayıp 2,50'ye çıkıyor. Bu tabloyu Anthropic duyuru sayfası doğruluyor ve şirket bir önceki Haiku kuşağına göre ortalama maliyetin kabaca dörtte üç oranında gerilediğini belirtiyor. Sohbet için aylık ödeme yapan okur zaten büyük modelleri seçecek; Haiku'nun asıl sahnesi dakika başına fatura kesilen API tarafı.

Ölçüm tarafında tablo dürüst: Haiku 5.5 bilgi işlerinde 1620 ve 1578 puanla Sonnet 5.5'in 1840 ve 1824 değerlerinin gerisinde kalıyor, bilgisayar kullanımında yüzde 72,4 ile Sonnet'in yüzde 83,9'unu yakalayamıyor. Agentic yazılımda yüzde 39,2, zorlu genel kültür ölçümünde araçsız yüzde 45,9 görülüyor. İginç ayrıntı, modelin görev başına en çok jeton harcayan ikinci model olması; yani ucuzluk birim fiyattan geliyor, cimrilikten değil. Sunucunun kendi mini ölçümünde de orta sıralarda geziniyor ve OpenAI'in GPT-6 Luna girişiyle aynı ligde anılıyor. Yine de yazılım yardımcısında basit işleri ucuza koşturmak isteyen geliştirici için hız ve fiyat ikilisi yeterli bir gerekçe oluşturuyor.

Panolar, hareketli açıklayıcılar ve sitem

Anthropic haftayı modelle sınırlı tutmadı: canlı panolar ve hareketli açıklayıcı üretimi de duyurular arasındaydı. Pano tarafı BigQuery, Databricks, Snowflake ve Salesforce gibi veri kaynaklarına bağlanıp güncel kalan gösterimler kuruyor ve birçok ücretli planda kullanılabiliyor. Hareketli açıklayıcı tarafı ise yalnızca ekip ve kurumsal planlarda denemeye açıldı. Sunucu burada samimi bir sitem de paylaşıyor: ayda 200 $ ödediği üst planda erken erişim sözü varken, yeni yeteneğin daha ucuz ekip planlarına verilmesi canını sıkmış. Not ettiği gibi işin kendisi yeni değil; JavaScript ile canlandırma ve hazır çerçevelerle pano kurmak zaten mümkündü. Yenilik, kurulum adımlarının azalması ve her şeyin modelin içine taşınması.

Haftanın destekli bölümünde sunucu, Hyper Agent üzerinde kurduğu üçlü bir hazırlık ekibini gösteriyor: araştırma, soru hazırlama ve yapım işlerinde üç etmen, konuk adını alıp ham malzemeden 30 dakikalık yayın akışı çıkarıyor. Bölüm bir ürün tanıtımı olarak kalsa da öğrettiği desen genel geçerli: her etmene yalnız işine gereken araçları vermek, önce taslak isteyip sonra çalıştırmak ve bütün ekibi aynı talimat setinde buluşturmak. Ajan kalabalığının arttığı bu haftada bu disiplin notu, duyuruların kendileri kadar değerli.

GPT-6 ve görsel arayüz

OpenAI cephesinin manşeti, haftada 1,2 milyar kişiye ulaşan sohbet ürününe inen GPT-6 ve onunla gelen Intelligent UI oldu. Yeni arayüz, yanıtları düz metin yerine patlatılmış bisiklet şeması, gardırop kılavuzu ve işaret listeli rehberler gibi görsel ve etkileşimli parçalarla örüyor; model soruya göre metin, görsel ve etkileşimli öğeyi kendisi harmanlıyor. OpenAI duyuru sayfasındaki bisiklet örneği fikri somutlaştırıyor: kadro, tekerlek, aktarma, fren ve gidon beş bağlı sistem olarak anlatılıyor ve okur parçaya dokunarak ilerliyor. Sunucunun denemesinde aynı soruya eski model düz metinle, yeni model görselli ve maddeli yanıt veriyor. Ekim başında Astra ve Soul varyantlarının yüzde 50 hızlandığı bilgisi de bu tabloya eklenince, haftanın OpenAI öyküsü hız ile görselliğin el ele yürümesi oluyor.

Günlük damlalar bununla bitmiyor: otomatik inceleme bütün girişli kullanıcılara ücretsiz açıldı, onay akışı elden geçirildi ve yalnızca ciddi endişede soran bir kip varsayılan rahatsızlığı azalttı. Geliştirici tarafında API katmanı beşten üçe indi, üst katmanlarda hız sınırı gevşetildi ve Soul varyantına ultra hızlı kip eklendi; standart milyon giriş jetonu 2 $ ve çıkış 10 $ iken, sekiz kat hızlı kip yaklaşık altı kat fiyat istiyor ve 500 $ planını gerektiriyor. Yönlendirme tarafında ise yarım kalan üretim tersine çevrilebiliyor: köpek görseli kurt görseline tek dokunuşla çevriliyor. Hız tutkunu bir kurgucu için ekranı gezen ultra hızlı kip denemeye değer görünüyor, cüzdan tarafı hariç.

Toplantı eklentisi ve karar API'si haftanın iki sessiz ama ağır parçası. Eklenti, Granola'yı andıran bir yaklaşımla mikrofon ve sistem sesini dinleyip döküm, özet ve sonraki adımları sohbetin hafızasına yazıyor; notlar özel kalabiliyor ya da ekiple paylaşılabiliyor. Decisions API ise uzun metin yerine karar döndürüyor: önerme olasılığı, seçenek tercihi ve düzey puanı olmak üzere üç tip çıktı veriyor, metin ve görseli birlikte alabiliyor ve saniyede karar gerektiren yönlendirme, moderasyon ve puanlama işlerine talip oluyor. Bu fiyat ve hız iddiasını TopFive kaydı somutluyor: giriş jetonu milyonda 10 cent, çıkış ücretsiz, yanıtın klasik uçtan on kat hızlı olduğu öne sürülüyor ve genel kullanıma haftalar kaldığı yazıyor. Sohbet penceresinde yeri yok; bu uç, geliştiricinin arka plandaki sessiz işçisi.

Grokbot ve X verisi

xAI'in asistanı Grokbot haftanın en stratejik dönüşünü yaşıyor: artık her işe kendi modeli yerine o işe en uygun arka uç modeli seçecek; adı geçenler arasında Opus 5.5, Midjourney ve Suno var. OpenAI modellerinin de bu havuza girip girmeyeceği belirsiz; iki patron arasındaki gerilim düşünülünce soru havada kalıyor. Bu yönlendirme hamlesini TechRepublic kaydı doğruluyor ve ürünün model katmanından çok orkestrasyon katmanına oynadığını yazıyor. İkinci yenilik, X ile derin bütünleşme: okuma, izleme ve eğilim yakalama doğrudan içeride; viral olanı haber verme, niş eğilimden gönderi fikri önerme gibi işler sayılıyor. Sunucunun denemesinde bot son 75 gönderiyi tarayıp en iyi ve en zayıf yapay zekâ paylaşımlarını bulmuş, Pasifik saatiyle 10.00-13.00 aralığını verimli saat olarak işaretlemiş. Tek sohbetli rakiplerin aksine e-posta ayıklayan, araştırma yapan ve orkestrasyon kuran uzman botların tek çatıda toplanması, Grokbot'u kalabalıkta farklı bir yere koyuyor.

Açık ağırlıklar: Le Chonk ve Beam

Haftanın açık ağırlık haberi Fransa'dan geldi: Mistral Large 4 , takma adıyla Le Chonk, 1 trilyon parametreli ve 52 milyarı aktif çok kipli bir model olarak önizlemeye açıldı. Mistral duyurusu, modelin kendi Avrupa veri merkezlerindeki 3.800 Grace Blackwell yongasında eğitildiğini, siber güvenlik, finans ve hukuk gibi kurumsal yüklerde açık modeller arasında en üstte oynadığını ve bazı görsel konumlandırma işlerinde kapalı rakipleri bile geçtiğini yazıyor. Ağırlıkların ay sonunda düşmesi bekleniyor; o zamana kadar siber liderler ve denetimli ortaklarla sahada sınanıyor. Sunucunun ölçümünde 9.675 jetonla iki buçuk dakikada üretilen yanıt orta sıralarda kalmış; Çinli açık modeller Kimi K3 ve GLM ile aynı ligde anılıyor. İkinci açık haber ABD'li Reflection'dan: 501 milyar parametreli Beam erken sınamada benzer rakiplerin biraz gerisinde görünüyor ve henüz herkese açık değil. İkisinin ortak cümlesi aynı: kişisel sistemlere sığmayan ama kendi sunucusunda tutmak isteyen kurumlara göz kırpan devasa açık ağırlıklar.

Google, Hark, Muse ve politika notları

Google haftayı üç koldan kapattı: Playground adlı oyun kurucu ABD'de 18 yaş üstüne açıldı ve hazır oyunlarla birlikte geliyor; çevrimdışı çalışan not uygulaması toplantıları sisteme göndermeden döküyor; kurumsal Gemini etmeni Workspace, Microsoft 365 ve Slack üzerinden her sistemden erişilir bir orkestrasyon vadediyor ve yeni Argon varyantının yaklaştığı konuşuluyor. Yapay üretim dedektörü tarafı da genişliyor: TheVerge kaydı, filigran ve C2PA doğrulamasının arama ve Chrome yüzeylerine taşındığını, Lens ve daire içine alma ile görselin kökeninin tek panelden sorulabildiğini yazıyor.

Hark Pro , Figure Robotics'in kurucusunun yeni şirketinden bilgisayar kullanan bir etmen olarak çıktı; panolu ana ekranı, proaktif önerileri ve gizlilik vurgusuyla ücretsiz başlıyor, TechCrunch kaydına göre 2027 sistemini hedefliyor. Meta ise Muse etmenini hobi kartlarına taşıdı: ChipDispatch kaydı, ESP32 ve Raspberry Pi için açılan kitlerle renkli mürekkep ekranlı hatırlatıcı, çubuk sistemli büyük ekran ve dokunmatik mini sürüm gibi tarifler sunulduğunu yazıyor. Kapanışta iki küçük not: Anthropic kullanım ilkesine modellerle sürekli ve nedensiz kaba davranışı yasaklayan bir madde ekledi, uç durumlarla sınırlı olduğu açıklandı; Nobel ödüllü iktisatçının on yılda insanların yaptığı işlerin yalnızca yüzde 5'inin makinelere geçeceği öngörüsü ise salonun genel havasıyla çelişiyor.

Bütün haftayı tek cümlede toplamak gerekirse: herkes aynı yetenek kümesine koşuyor ve fark ürünün kendisinden çok hangi ekosisteme ait olduğuna kayıyor. Sunucunun da dediği gibi Muse ve Dots ile Grokbot ve Google etmenleri aynı işleri yapar hale gelince sadakat yarışına dönüşecek; ücretsiz kullanılabilen Muse bu yarışta elini güçlendiriyor. Okur için pratik ders üç parçalı: tekrarlayan ve hacimli işlerde ucuz ve hızlı modeller API üzerinden koşturulmalı, öğrenme ve keşif işlerinde görsel yanıtlı büyük modeller tercih edilmeli, ajan tercihlerinde ise veri iznini kime verdiği insan baştan bilmeli. Fiyatların haftalık değiştiği, erken erişimlerin herkese açık olmadığı bir dönemde tek sağlam strateji bu üçlüyü ayrı tutmak. Haftaya yeni damlalarla tablo yine değişecek; bu tur en azından bugünün haritasını net çiziyor.

Görsel: nodesdaily AI
KonuÖzet
Haiku 5.5 fiyatıSonnet'in dörtte biri maliyet, API işleri için yeterli güç
Karar API'siSınıflandırma ve yönlendirme artık metinsiz, çıkış ücretsiz
Le Chonk ağırlığı1 trilyon parametre açık geliyor, kurum hedefine kilitli

Videodaki anahtar anlar

  1. Haiku fiyatları
  2. Pano ve hareket
  3. Üçlü hazırlık ekibi
  4. Görsel yanıtlar
  5. Karar API'si
  6. Grokbot yönlendirme
  7. Açık ağırlıklar
  8. Hark ve Muse

AI yorumu

"Bu haftanın asıl haberi tek bir model değil, bütün laboratuvarların aynı anda aynı viraja girmesi. Fiyatlar düşerken yetenekler birbirine yaklaşıyor ve okurun sorusu değişiyor: en güçlü model hangisi değil, hangi şirkete ne kadar veri emanet edeceğim. Bu tur, o soruya sağlam bir başlangıç haritası sunuyor."

AI değerlendirmesi

En güçlü karşı görüş ölçütlerin tarafsızlığına dair: listedeki puanların çoğu laboratuvarların kendi seçtiği tezgâhlardan geliyor, sunucunun mini ölçümü ise tek kişinin tezgânı ve tek yargıcı. En hızlı ve en ucuz iddiaları bağımsız tekrara muhtaç; özellikle çıkışın ücretsiz olduğu karar ucu ile sekiz kat hız vaatleri sahada sınanmadan bütçe planına girmemeli. Ücretsiz ajanların bedeli de soru işareti: toplantı dökümlerinin hafızaya yazılması ve X izleme özellikleri, verinin nerede saklandığı sorusunu büyütüyor. Rakip modele yönlendirme fikri ise gizlilik sözleşmelerini zorluyor; istemin hangi şirketin sunucusuna gittiğini kullanıcı gerçekten bilecek mi, bu henüz net değil.

Eksik kalanlar listesi de uzun: fiyat ve plan adları haftalık değişiyor, erken sınamadaki Beam ve Argon ile ekip planındaki hareketli açıklayıcı bağımsız gözle test edilemedi. Sponsorlu bölüm, desen dersi verse de tarafsız bir inceleme değil; ürünün sınırları ve maliyeti konuşulmuyor. Nobel ödüllü iktisatçının yüzde 5 öngörüsünün karşıtları, yani topyekûn dönüşüm bekleyenler, turda hiç söz almıyor. Politika maddesinin uygulanma örnekleri de yok; hangi davranışın yasak kapsamına gireceği ilk gerçek vakaya kadar yoruma açık kalacak.

Sunucunun konumu da okunmalı: ayda 200 $ ödeyen bir üst plan abonesi olarak erken erişim serzenişi kişisel bir hayal kırıklığı taşıyor ve markalara bakışı renklendiriyor. Grokbot sempatisini açıkça beyan etmesi dürüstlük puanı getiriyor ama aynı hafta rakip ürünleri gömen bir tonla birleşince dengeyi okur kurmalı. Kendi mini ölçümünü hakem gibi kullanması da çift şapka: hem anlatan hem ölçen konumunda. Bu çıkarlar bilgiyi yanlış yapmıyor, yalnızca her iddiaya birincil kaynaktan bakma ihtiyacını artırıyor.

Okur için çıkarım net ve üç katmanlı: hacimli ve tekrarlayan işleri ucuz modellere ve karar uçlarına yıkmak bütçeyi rahatlatır; öğrenme ve keşif işlerinde görsel yanıtlı büyük modeller zaman kazandırır; ajan tercihlerinde ise ilk soru yetenek değil veri izni olmalı. Toplantı ve e-posta erişimi isteyen her araca, ücretsiz bile olsa, hangi veriyi nerede tuttuğu sorulmalı. Açık ağırlıklar kurumsal bağımsızlık vadediyor ama kart ve elektrik faturası küçük ekiplerin değil; o kapıdan girmek isteyen önce toplam sahip olma maliyetini hesaplamalı.

Kaynaklar

9 bağlantı; 3 tanesi 8 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

yapay zekâ · claude · gpt-6 · ajanlar · açık ağırlık · google

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

Kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…