Gündeme dön

Yapay Zeka Fiyat Savaşı: Opus 5.5, GPT-6 Sol ve Agent Dünyasının Sessiz Darboğazı

Eylülün 22'sinde Anthropic ve OpenAI yaklaşık bir saat arayla yeni modellerini duyurdu. Opus 5.5 görev başına yüzde 40 ucuz, GPT-6 Sol ve Luna ise bir önceki sürümlere göre yarı fiyata geldi. Aynı hafta Gemini Notebook canlı sohbete açıldı, xAI Grok 4.7'yi çıkardı ve Meta Muse'u gözlüğe taşıma planını duyurdu. Fiyatlar düşerken gerçek darboğaz, agent iş yüklerinde oluşan güven ve denetim maliyeti.

Nodesdaily’e aktarım: (UTC+03:00)
Görsel: nodesdaily AI
YouTube'da izle — Q6uuvZmb0t8
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Eylülün 22'sinde yapay zeka dünyasında iki büyük laboratuvar aynı gün masaya çıktı. Anthropic, Claude Opus 5.5'i duyururken OpenAI yalnızca yaklaşık bir saat sonra GPT-6 Sol ve GPT-6 Luna'yı yayımladı. Zamanlama tesadüf değil: iki şirket de aynı müşteri havuzuna, günde kodlama ve araştırma yapan profesyonellere hitap ediyordu. Bir hafta içinde dört modelin fiyat düzeyinin aşağı çekildiğini görmek, sektörün artık yarışı zekadan çok birim maliyete kaydığının en net göstergesi.

Önce sayılar. Anthropic'in kendi verilerine göre Opus 5.5, Opus 5'e göre görev başına yaklaşık yüzde 40 daha ucuz. Bunun iki bileşeni var: giriş ve çıkış jetonları birim başına 5 dolar ve 25 dolardan sırasıyla 4 dolar ve 20 dolara indi; ayrıca önbellek okuma ücreti milyon jeton başına 0,50 dolardan 0,20 dolara geriledi. Önbellek okuma fiyatı, uzun süreli ajan ve kodlama işlerinde maliyetin büyük kısmını oluşturduğu için bu satır sessizce en önemli olanı.

OpenAI'nin hamlesi daha doğrudan bir fiyat indirimiydi. GPT-6 Sol, kendisinden önceki GPT-5.6 Sol ile karşılaştırıldığında girişte 4 dolardan 2 dolara, çıkışta 20 dolardan 10 dolara indi. GPT-6 Luna için rakamlar 0,20 dolardan 0,10 dolara ve 1,20 dolardan 0,50 dolara geriliyor. Her iki modelde de düşüş yüzde 50. Şirket ayrıca GPT-6 Astra'nın hâlâ en güçlü modeli olduğunu, Sol ve Luna'nın ise fiyat duyarlı iş yükleri için konumlandığını belirtiyor.

Bağlam açısından şu tablo daha önemli: Anthropic de kendi Opus sınıfının fiyatını düşürürken, rakibin aynı gün yarıya indirdiğini duyurdu. Bağımsız bir yorumcu olan Simon Willison'a göre bu, eylül ayında klasik bir fiyat savaşı anına benziyor. Grok 4.7'nin 2 dolar ve 6 dolarlık fiyatıyla bu hattın dışında kalmaması da savaşın sektör geneline yayıldığını gösteriyor. Arz tarafında rekabet varsa, alıcı tarafında da kısa sürede pazarlık gücü oluşur.

Şimdi fiyatın ötesindeki tablo. Bu modellerin asıl vaadi, daha akıllı olmaları değil; aynı işi daha az hesapla yapmaları. Anthropic bunu sunucu başına daha az işlem gücü gerektiği şeklinde açıklıyor ve çıktı üretiminde Opus 5'e göre yüzde 30'dan fazla hız artışı bildiriyor. OpenAI'nin aynı gün duyurduğu GPT-6 için önbellek iyileştirmeleri, kalıcı ajanların daha az tekrar eden çağrı yapmasını hedefliyor. Kısacası verimlilik artık pazarlama sloganı değil, altyapı kararı.

Ancak bu optimizmanın bedeli var. Daha küçük ve daha hızlı bir model, daha az bağlam taşıyor demek. Kaynağın kendi testinde Opus 5.5'in web'de çok hızlı gezindiği, fakat bazı kaynaklarda zayıf kaldığı not edilmiş. Aynı kaynakta Opus 5.5'in yazım tonunu yakalamada en başarılı model olduğu, buna karşılık tasarım işlerinde kendisinden önce kullandığı modelin biraz gerisinde kaldığı belirtiliyor. Kısacası tek bir kazanan yok; hangi işi yaptığınız belirliyor.

Kaynağın kendi uygulama testleri de aynı tabloyu gösteriyor. Ham görüntüden sessizlikleri ve tekrarları temizleyen bir kurgu işinde iki model de yaklaşık haftalık kullanımın yüzde birini harcadı, ancak süreler ciddi biçimde ayrıştı: Opus 5.5 yaklaşık yedi buçuk dakikada, rakip model on beş buçuk dakikada tamamladı. Özetle, iş kalitesi ve hız arasındaki denge modelden modele belirgin biçimde değişiyor ve tek bir kıyaslama tablosu bu farkı yansıtmıyor.

Haftanın ikinci büyük hattı Gemini Notebook'ta. Google, mobil uygulamada defterlerle gerçek zamanlı konuşma özelliğini kullanıma açtığını ve raporlar altında etkileşimli özetler sunduğunu duyurdu. Bu özetler yalnızca metin değil; bilgi grafiği, test, flaş kart, zihin haritası ve sunum gibi üretilen varlıkları tek bir akışta birleştiriyor. Ayrıca 2 Eylül'den itibaren kullanım limitleri hesaplama tabanlı bir sisteme geçti; kota dolduğunda üretim ileride çalıştırılabiliyor.

Kaynakta, defterlerin Google Dokümanlar içinde kaynak olarak kullanılabildiği de anlatılıyor. Bu özellik, bu yazının hazırlandığı sırada Google'ın resmî duyurularında yer almıyordu; bu yüzden doğrulanmış bir güncelleme olarak değil, kaynağın kendi gözlemi olarak okunmalı. Aynı biçimde bazı okuma aracı özellikleri de farklı planlara ve dönemlere dağılmış durumda. Yani araçlar hızla değişiyor, özellik listeleri ise aynı hızda eskiyor.

Üçüncü hat xAI'den geliyor. Grok 4.7, 4.6 ile aynı fiyat ve hızda, daha büyük bir temel model ve daha uzun pekiştirmeli öğrenme koşusuyla yayımlandı. Şirket modeli kendi ajan iskeletini doğal biçimde anlayacak şekilde eğittiğini ve 500 bin jetonluk bir bağlam penceresi sunduğunu belirtiyor. Aynı hafta ajanlara sesli not ve sesli görüşme özellikleri geldi. Daha önce şirketin, bu tür ajanların kendi bulut bilgisayarlarında çalıştığını ve kurumsal kullanıma açıldığını duyurmuştu.

Dördüncü hat donanıma taşıyor. Meta'nın bağlantı etkinliğinde şirket, Muse ajanını gözlüklere taşıma planını açıkladı; cihazı adını anarak konuşturup baktığınız nesneye soru sorabilmeniz hedefleniyor. Gözlüğün kamerasız, yalnızca sesli sürümü de duyuruldu. Küçük bir cebe sığan ayrı bir ajan cihazı tanıtıldı ve yıl sonuna kadar yüzden fazla stil hedeflendi. Dikkat çeken ayrıntı, bu cihazın henüz seri üretimde olmaması ve malzemelerinin değişmeye açık bulunması.

Bütün bu hikayenin arka planında tek bir ekonomik gerçek var: ajanlar para harcıyor. Bir model daha akıllı olduğunda değil, daha çok adım attığında fatura büyür. Uzun süreli görevlerde tekrar eden çağrılar, bellek taşıma ve araç kullanımı maliyeti dikey değil yatay biçimde büyütür. Fiyat indirimlerinin bu nedenle bir indirim kampanyasından çok, marj yapısı değişikliği olduğu söylenebilir; ucuz jeton, uzun süreli ajan kullanımını ekonomik hale getiren asıl unsur.

Öte yandan tam tersi yönde de ciddi bir kaygı var. Daha küçük ve daha hızlı modeller, yanlış kararın maliyetini de düşürür. Bir ajanın yanlış e-postayı göndermesi, yanlış dosyayı silmesi veya uygunsuz bir işlemi onaylaması ucuz bir çağrıyla gerçekleştiğinde, toplam zarar küçülmez. Bu yüzden üreticiler için ölçüm birimi artık yalnızca jeton değil; karar başına doğrulama maliyeti. Kaynakta da benzer bir kaygı dile getiriliyor: araçlar daha güçlü hale geldikçe insan onayının nerede devreye gireceğinin belirsizleşmesi en büyük açık soru.

Pratikte ne yapılmalı? Önceliği tek bir model seçmekte değil, işin türüne göre katman kurmakta görüyorum. Kısa ve yüksek hacimli sınıflandırma, yönlendirme ve puanlama işleri için ucuz ve hızlı sınıf modelleri yeterli. Uzun ve riskli görevlerde ise güçlü model, denetim kaydı ve geri alma yeteneği birlikte düşünülmeli. Aynı haftanın bir diğer dersi de bu: fiyat ve hız karşılaştırmaları, kalite ölçümü olmadan yanıltıcı sonuç veriyor. Aynı görevi üç modelle yapıp çıktıyı kör karşılaştırmak, en azından şeffaf bir tablo bırakıyor.

Sonuç olarak bu hafta tek bir kazanan çıkarmıyor; üç şirketin aynı günlerde aynı yöne doğru fiyat kestiği bir pazar çıkıyor. Opus 5.5 görev başına maliyeti düşürürken uzun bağlamlı işlerde öne geçiyor, GPT-6 Sol ve Luna fiyat duyarlı hacimler için konumlanıyor, Grok 4.7 kendi ajan iskeletiyle bütünleşiyor. Düşen jeton fiyatı, ajan ekonomisinin ön koşuludur; ön koşulun kendisi ise denetimsiz bir otomasyonu meşrulaştırmaz.

Milyon jeton başına çıkış fiyatı

  • Grok 4.7$6
  • GPT-6 Sol$10
  • GPT-5.6 Sol$20
  • Opus 5.5$20
  • Opus 5$25
Çıkış jetonları birim fiyatı; aynı iş yükünde maliyet çıktı miktarıyla orantılıdır.
ÖlçütOpus 5.5GPT-6 SolGrok 4.7
Giriş ($/M jeton)422
Çıkış ($/M jeton)20106
Bağlam penceresiUzun bağlam odaklı1.05M jeton500 bin jeton
KonumlandırmaUzun görevlerGenel amaçlıKendi ajan iskeleti
Aynı modelin önceki sürümüne göreYuzde 40 daha ucuzYuzde 50 daha ucuzAyni fiyat ve hiz

Videodaki anahtar anlar

  1. Ayni gune iki model duyurusu
  2. Uc modelle kurgu karsilastirmasi
  3. Kurgu duzenleme sureleri karsilastirmasi
  4. Kucuk ajan cihazi tanitimi

AI yorumu

"Bu haftanın asıl haberi model sayısı değil, birim maliyetin yarıya inmesi. Aynı yetenek seviyesini daha az tokenla almak, altyapı bütçesini doğrudan etkileyen bir değişim. Ancak fiyat düşüşü tek başına yeterli değil: agent iş akışlarında asıl mesele, yanlış kararın maliyetini kimin ödediği."

AI değerlendirmesi

En güçlü iddia fiyat savaşıydı ve bu iddia kaynaklarla örtüşüyor: Anthropic'in kendi fiyat tablosu, OpenAI'nin yarıya indirimi ve bağımsız bir yorumcunun değerlendirmesi aynı yönü gösteriyor. Ancak buradaki 'yüzde 40 daha ucuz' rakamı şirketin kendi varsayılan ayar ölçümü. Uzun bağlamlı araştırma, çok dosyalı kod ve sık araç kullanımı gibi işlerde oran farklı çıkabilir; bu yüzden rakamı genelleme olarak değil, üreticinin kendi senaryosu olarak okumak gerekir.

Eksik kalan yer, modellerin aynı işi gerçekten aynı kalitede yaptığının bağımsız biçimde gösterilmemesi. Kaynaktaki karşılaştırmalar tek kişinin, kendi iş akışına ait ölçümler; farklı bağlam uzunluğu, farklı diller ve uzun süreli projeler sonucu değiştirebilir. Kısa görevlerde öne çıkan model, uzun görevlerde geriye düşebilir. Bu yüzden model seçimi, tek bir genel sıralamaya değil, kendi iş yükünüzde ölçüme dayanmalı.

Karşı görüşü de koymak gerek: fiyat indirimi rekabetten geliyor olabilir, ama bu rekabetin ne kadar sürdüğü belirsiz. Şirketler kayıp birim maliyeti finanse etmek için hızlandırılmış amortisman ya da geçici fiyatlama kullanıyor olabilir. Sözleşmeleri ve fiyat sayfalarını karar anında yeniden kontrol etmek, bu makaledeki rakamlardan daha önemli bir adım. Uzun vadeli taahhüt veren ekipte fiyat yerine kota ve hız garantisi daha güvenli bir ölçüttür.

Pratik çıkarımım net: önce işi sınıflandırın. Yönlendirme, sınıflandırma, puanlama gibi kısa ve tekrarlayan kararları ucuz ve hızlı modellere verin. Uzun ve geri alınabilirliği zor işleri güçlü modellerle çalıştırın, her adımı kaydedin ve insan onayı koyun. Fiyat düşüşünü bir lütuf değil, denetim bütçesi olarak görün. Çünkü ucuz bir çağrı, pahalı bir hatayı ucuzlatmaz; sadece daha çok hata yapma imkanı verir.

Kaynaklar

9 bağlantı; 6 tanesi 20 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

yapay zeka · model fiyatlari · agent · token maliyeti · claude opus · gpt-6 · nodedaily

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…