Gündeme dön

Fiyat Savaşı Başladı: GPT-6 Sol ve Luna ile Maliyetler Yarıya İndi

OpenAI, Astra'nın yanına Sol ve Luna'yı ekleyerek GPT-6 ailesini genişletti; Sol'un fiyatı yarıya indi, Luna %80 üzerine %50 ek indirimle geldi ve AutomationBench'te benzer skorlar beşe kat daha ucuza sunuluyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — HPkK58V1Piw
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Bugün takvim aynı güne sıkışan iki lansmanla hızlandı. OpenAI, en akıllı model olarak sunduğu Astra'nın yanına Sol ve Luna'yı ekleyerek üçlü bir aile kurduğunu açıkladı; listede Terra yok. Duyuru sayfası yenilendiğinde aileye özel bir animasyon beliriyor ve Astra'nın zirvedeki yerini koruduğu vurgulanıyor. Astra'yı daha önce deneyimlediğimde çapraz araç kullanımı çok akıcıydı, şimdi merak ettiğim Sol ve Luna'nın aynı doğal iş arkadaşı hissini verip vermediği. Anthropic ise aynı gün Opus 5.5'i getirdi; sektörde herkes aynı tarihe kilitlenmiş gibi, fiyat rekabetinin fitili ateşlendi.

Fiyat tarafı bu hikâyenin kalbi. GPT-6 Sol, önceki kuşak Sol'a göre giriş fiyatını dört dolardan iki dolara, çıkış fiyatını yirmi dolardan on dolara indirdi — tam yarı yarıya. Giriş jetonu (input) sizin gönderdiğiniz metin, çıkış jetonu (output) modelin ürettiği metin demek; tıpkı lokantada sipariş ve gelen tabak gibi. GPT-6 Luna tarafında tablo daha çarpıcı: zaten %80 indirimliydi, üzerine bir %50 daha eklendi ve önbellek (cache) okumalarında %90'a varan indirim açıklandı. Önbellek okuma, aynı bağlamı tekrar tekrar işlememek demek — ajan aynı dosyayı yüz kez okuyorsa doksan dokuzunu neredeyse bedavaya getiriyor. Günlük işler için Luna'nın bu kadar ucuz ve aynı zamanda daha akıllı hale gelmesi, API faturasını doğrudan küçültüyor.

Aile içindeki konumlandırma net. Astra en üstte, kapsamlı akıl ve muhakeme için referans; Sol orta seviye karmaşık kod ve ajan işleri için, Luna ise yüksek hacimli odaklı görevler için en verimli seçenek olarak anlatılıyor. Üçünü bir mutfak gibi düşünün: Astra şef, Sol sous-chef, Luna hızlı ve titiz yardımcı — her soruda bütün mutfağı ayağa kaldırmaya gerek yok, doğru uzman devreye giriyor. OpenAI dokümantasyonunda Sol'un karmaşık kod ve ajan akışlarında, Luna'nın hızlı toplu işlerde öne çıktığı yazıyor; bilgi kesim tarihleri Astra için Nisan 2026, Luna için Mayıs 2026 olarak veriliyor. Önceki kuşakta Fable'a göre iletişimde daha hızlı ve etkili olduğu söylenen Astra deneyimini baza alırsam, Sol ve Luna'nın aynı çizgiye gelmesi kullanım rahatlığını belirleyecek.

Bu iddiaların ölçüldüğü yerlerden biri AutomationBench. Zapier'in gerçekçi iş akışları için geliştirdiği bu test, ajanların birden fazla uygulamayı koordine etmesini, otonom biçimde doğru API'yi bulmasını ve şirket politikalarına uymasını ölçüyor. Tek bir testin hükmü sınırlı — OpenAI'nin kendi grafiği en etkili gördüğünü en üste koymakta haklı, ama saha doğrulaması şart. Benim için önemli soru şu: laboratuvarda 33 puan alan bir model, gerçek müşteri verisiyle aynı hızda mı koşuyor? Bu yüzden AutomationBench skoru tek başına karar vermez; bilgisayar kullanımı ve yazılım mühendisliği gibi yan testlerle birlikte okunmalı.

En küçük üye Luna'dan başlayalım. Önceki Luna'ya göre skorda 9,1'den 14'e yaklaşan bir sıçrama var — neredeyse iki kat — diğer bir skalada 20'ye karşı 17 gibi daha mütevazı bir fark görülüyor. Maliyet tarafı ise net: 0,070 dolara karşı 0,037 dolar bandı ve 0,021 civarında %50-55'e varan avantaj. Küçük bir örnek: günde on binlerce kısa görevi (örneğin ticket etiketleme veya rapor özetleme) Luna'ya verirseniz, aynı işi yarı fiyata ve daha yüksek doğrulukla kapatıyorsunuz. Luna'nın bir ajan gibi arkaplanda toplayıp getiren davranışa evrilmesi de bu tabloya uyuyor; çok iş, az fatura.

Asıl fark Sol'da ortaya çıkıyor. OpenAI grafiğinde 5.6 Sol'un ekstra yüksek modunda 33,2 puan için 0,27 dolar görünürken, aynı işin 5.6 Sol ile en yüksek (max) ayarında ancak %28 için 0,67 dolara, ekstra yüksekte %26 için 0,54 dolara geldiği anlatılıyor. Yani yeni Sol hem daha akıllı hem yaklaşık iki kat daha ucuz. Bu farkı somutlaştırmak için üç adımda düşünün: 1) aynı otomasyon işini tanımla, 2) aynı zorluk ayarında koş, 3) hem puanı hem faturayı yan yana koy. Sonuç: Sol, önceki nesle göre aynı cüzdanda daha yüksek puan veriyor. Teknik etikette giriş-çıkış fiyatı yarıya indiği için ajan döngülerinde tasarruf katlanarak büyüyor.

Astra ile kıyas işi daha da ilginçleştiriyor. Astra Medium, 34,1 puan için 1,27 dolara koşarken GPT-6 Sol benzer bir bandı — kabaca 33 puan — 0,27 dolara sunuyor; yani beşte bir maliyete çok yakın skor. Grafikte Sol'un Astra Light ile Medium arasında konumlandığı görülüyor, bu önemli çünkü çoğu ekip için Medium yeterli sayılıyor. Rakip tarafta Fable 5.1'in 31,4 puan için 2,45 dolar harcadığı noktada Sol'un 33 puan için 0,27 doları, dokuz kat daha pahalı ama geride kalan bir tabloyu işaret ediyor. Anthropic'in Fable 5.1'i en yetkin model olarak öne çıkarması ve Opus 5.5'i Fable seviyesinde işler için %40 daha ucuz bir alternatif diye tanımlaması da bu denkleme dahil; sahada hangisinin sürdürülebilir olduğu, sadece tek bir grafiğe değil tekrarlanan testlere bakarak anlaşılacak.

Diğer cephelerde tablo karışık ama öğretici. Frontier kod testinde sıralama hızla değişiyor; maliyet gökyüzüne çıkarken puanlar birbirine yakın seyrediyor. Bilgisayar kullanımı (computer use) tarafında ise 5.6 Sol'un belirli bir noktada Astra Light'ı geçtiği görülüyor — yani fare ve klavye ile ekranı kullanma becerisi, ajanların dış dünya ile konuşma yolu, Luna'da da belirgin fark yaratmış. Bunu şöyle açayım: bilgisayar kullanımı, modelin tarayıcı veya masaüstü arayüzünü kendi başına işletmesi demek; form doldurma, dosya taşıma veya uygulama içinde tıklama gibi adımlar. OpenAI'nin bu beceride Sol ve Luna için sunduğu yerli iş arkadaşı tonu — gereksiz uzun gevezelik yerine kısa, bağlama oturan yanıtlar — günlük ajan akışında zaman kazandırıyor. Uzun ufuklu OSWorld 2.0 gibi 108 görevlik masaüstü serilerinde bu farkın ne kadar kalıcı olduğunu görmek için bağımsız sonuçlar bekleniyor.

Hata oranı ve önbellek ekonomisi, fiyattan daha sessiz ama daha kritik bir hikâye anlatıyor. Luna'nın hata skalasında çok düşük bir banda indiği, Astra'nın ise en düşük hata bandında kaldığı vurgulanıyor; hatadan kastım modelin yanıltması veya yanlış yönlendirmesi. Bir şirket yönetirken her çalışanının işini adım adım bilemezsiniz, sonuç ve güven önemlidir — ajan size bilmediğiniz bir konuda hızla çıktı ürettiğinde küçük bir yanıltma bile pahalıya patlar. Bu yüzden hata düşüşü doğrudan güven artışı demek. Önbellek tarafında %90'a varan indirim, aynı bağlamın yüzlerce kez okunduğu ajan işlerinde faturanın çoğunu oluşturan kalemi törpülüyor; aynı araştırma dosyasını on ajan adımında tekrar okumak, artık tek okuma kadar maliyetli değil.

Erişim tarafında duyuru net: GPT-6 ve Luna, ChatGPT içinde Work, Codex, Plus, Pro, Enterprise ve Education planlarında ve Go ile açık kullanıcılar için masaüstü uygulamasında yer alıyor; sohbetin her yüzeyinde değil, API tarafında ise doğrudan model kimlikleriyle çağrılıyor. OpenAI yardım sayfasına göre GPT-6 Astra, sohbette GPT-6 Pro adıyla Pro 100 ve Pro 200 ile Business ve Enterprise planlarına kademeli açılıyor; Plus içinde sohbet erişimi yok. Geliştirici tarafında model kimlikleri net: luna ve sol ayrı uç noktalar, bilgi kesimleri Mayıs ve Nisan 2026. Fiyatlandırma tarafında uzun bağlam ve önbellek yazma kalemleri de ayrı satırlarda; toplama bakarken sadece giriş-çıkış değil, önbellek okuma ve yazma toplamını da hesaba katmak gerekiyor.

Peki bu ne anlama geliyor? Gündelik iş, araştırma ve ara görevler için Luna artık bariz bir aday; benzer zekâyı çok daha ucuza verdiği için deneme maliyeti düşüyor ve daha fazla kişiye hizmet götürme fikri gerçekçi hale geliyor. Sol ise kod ve ajan döngülerinde Astra'ya yakın skorla beşte bir faturaya indiği için ekiplerin varsayılan tercihi olmaya aday. Anthropic tarafında Opus hâlâ pahalı ve birçok görev için fazla lüks kalıyor; iki şirketin farklı yere nişan aldığı açık. Bugünün kazananı kullanıcı — ucuz, pahalı ve akıllı seçenekler aynı anda masada. Ben önümüzdeki günlerde Sol ve Luna'yı Opus 5.5 karşısında işinize yarayan senaryolarda koşup sonuçları paylaşacağım; nerede ucuza, nerede sağlam akılla koşmak gerektiğini birlikte netleştireceğiz.

Görsel: nodesdaily AI

Benzer skor için toplam koşu maliyeti

  • GPT-6 Sol (~33 puan)$0.27
  • Astra Medium (34.1)$1.27
  • Fable 5.1 (31.4)$2.45
AutomationBench'te yakın skor bandında harcanan toplam tutar; puanlar OpenAI grafiğinden, tutarlar koşu maliyetinden.
ModelGiriş /1MÇıkış /1MBench puan
GPT-6 Sol$2$1033,2
GPT-6 Luna$0,10$0,5014,0
Astra Medium$10$5034,1
Fable 5.1$10$5031,4
Opus 5.5$4$2066,4*

AI yorumu

"Benim gözümde bu duyuru akıl yarışından çok fiyat yarışını başlattı; aynı işi beşe kat ucuza yapabilmek, pahalı amiral gemilerini sorgulatıyor."

AI değerlendirmesi

Karşıt görüşü en güçlü haliyle kurarsam, indirimlerin büyüklüğü tek başına kalite ispatı değil. Sol'un yarı fiyatı, önceki kuşak Sol'un promosyon fiyatına göre hesaplanıyor; liste fiyatına göre oran %60-67 bandına çıkabiliyor ve sahada hız ile doğruluk aynı oranda düşmemiş olabilir. Luna'daki birikimli indirim de benzer şekilde, toplam fatura üzerindeki etki kullanım desenine bağlı — tek seferlik kısa görevlerde önbellek kazancı sınırlı kalır. Bu yüzden ucuzluk, ancak aynı skorun aynı koşullarda tekrarlanmasıyla anlam kazanır.

Metodoloji sınırları da not edilmeli. AutomationBench tek bir tedarikçi grafiği ve tek bir otomasyon paketi; OpenAI'nin kendi iç değerlendirmesi, bağımsız OSWorld 2.0 veya Terminal-Bench 4.0 ile aynı anda okunmalı. Grafikteki max ile extra-high ayrımı, çıkarım derinliği (effort) ayarına bağlı ve medium varsayılan üzerinden verilen maliyetler, en yüksek ayarda farklı görünüyor. Ayrıca Fable ve Opus 5.5 skorları aynı zemin ve aynı hız çarpanında karşılaştırılmadı; hızlı mod ve standart mod arasındaki fiyat farkı da tabloya dahil edilmeli.

Doğrulanabilirlik tarafında iddiaların kaynağı net: fiyatlar OpenAI geliştirici dokümanlarından, benchmark skorları OpenAI grafiğinden ve Anthropic'in kendi lansman notlarından geliyor. Fable 5.1'in en yetkin model olduğu ve Opus 5.5'in Fable seviyesinde işi %40 ucuza yaptığı ifadesi Anthropic'in çerçevesi; GPT-6 Sol'un Astra Medium'a yakın olduğu ifadesi ise OpenAI'nin seçili ayar ve seçili testteki okuması. Bağımsız kanıt için Artificial Analysis Intelligence Index ve Terminal-Bench gibi üçüncü taraf sonuçları ile fiyat/doğruluk eğrisinin saha raporları beklenmeli; aksi halde tek kaynaktan genelleme riski var.

Pratik çıkarım: toplu ve tekrarlı işler için Luna, kod ve ajan orkestrasyonu için Sol mantıklı bir varsayılan; en zorlu muhakeme, uzun bağlam ve yüksek güven gerektiren regüle işlerde Astra hâlâ referans. Anthropic tarafında Pro planın 17 dolar yıllık ve Max'in 100 dolardan başlaması, Opus 5.5'e erişimi plan matrisine bağlı kılıyor ve herkes için açık değil. Ekipler için önerim, aynı gerçek iş akışını üç modelde aynı effort ayarında koşup hem faturayı hem hata oranını yan yana koymak; ucuz olanın değil, güvenilir ve ucuz olanın kazanacağını bu tablo gösterecek.

Kaynaklar

7 bağlantı; 4 tanesi 19 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

gpt-6 · sol · luna · astra · automationbench · openai · anthropic

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…