Bugün takvim aynı güne sıkışan iki lansmanla hızlandı. OpenAI, en akıllı model olarak sunduğu Astra'nın yanına Sol ve Luna'yı ekleyerek üçlü bir aile kurduğunu açıkladı; listede Terra yok. Duyuru sayfası yenilendiğinde aileye özel bir animasyon beliriyor ve Astra'nın zirvedeki yerini koruduğu vurgulanıyor. Astra'yı daha önce deneyimlediğimde çapraz araç kullanımı çok akıcıydı, şimdi merak ettiğim Sol ve Luna'nın aynı doğal iş arkadaşı hissini verip vermediği. Anthropic ise aynı gün Opus 5.5'i getirdi; sektörde herkes aynı tarihe kilitlenmiş gibi, fiyat rekabetinin fitili ateşlendi.
Fiyat tarafı bu hikâyenin kalbi. GPT-6 Sol, önceki kuşak Sol'a göre giriş fiyatını dört dolardan iki dolara, çıkış fiyatını yirmi dolardan on dolara indirdi — tam yarı yarıya. Giriş jetonu (input) sizin gönderdiğiniz metin, çıkış jetonu (output) modelin ürettiği metin demek; tıpkı lokantada sipariş ve gelen tabak gibi. GPT-6 Luna tarafında tablo daha çarpıcı: zaten %80 indirimliydi, üzerine bir %50 daha eklendi ve önbellek (cache) okumalarında %90'a varan indirim açıklandı. Önbellek okuma, aynı bağlamı tekrar tekrar işlememek demek — ajan aynı dosyayı yüz kez okuyorsa doksan dokuzunu neredeyse bedavaya getiriyor. Günlük işler için Luna'nın bu kadar ucuz ve aynı zamanda daha akıllı hale gelmesi, API faturasını doğrudan küçültüyor.
Aile içindeki konumlandırma net. Astra en üstte, kapsamlı akıl ve muhakeme için referans; Sol orta seviye karmaşık kod ve ajan işleri için, Luna ise yüksek hacimli odaklı görevler için en verimli seçenek olarak anlatılıyor. Üçünü bir mutfak gibi düşünün: Astra şef, Sol sous-chef, Luna hızlı ve titiz yardımcı — her soruda bütün mutfağı ayağa kaldırmaya gerek yok, doğru uzman devreye giriyor. OpenAI dokümantasyonunda Sol'un karmaşık kod ve ajan akışlarında, Luna'nın hızlı toplu işlerde öne çıktığı yazıyor; bilgi kesim tarihleri Astra için Nisan 2026, Luna için Mayıs 2026 olarak veriliyor. Önceki kuşakta Fable'a göre iletişimde daha hızlı ve etkili olduğu söylenen Astra deneyimini baza alırsam, Sol ve Luna'nın aynı çizgiye gelmesi kullanım rahatlığını belirleyecek.
Bu iddiaların ölçüldüğü yerlerden biri AutomationBench. Zapier'in gerçekçi iş akışları için geliştirdiği bu test, ajanların birden fazla uygulamayı koordine etmesini, otonom biçimde doğru API'yi bulmasını ve şirket politikalarına uymasını ölçüyor. Tek bir testin hükmü sınırlı — OpenAI'nin kendi grafiği en etkili gördüğünü en üste koymakta haklı, ama saha doğrulaması şart. Benim için önemli soru şu: laboratuvarda 33 puan alan bir model, gerçek müşteri verisiyle aynı hızda mı koşuyor? Bu yüzden AutomationBench skoru tek başına karar vermez; bilgisayar kullanımı ve yazılım mühendisliği gibi yan testlerle birlikte okunmalı.
En küçük üye Luna'dan başlayalım. Önceki Luna'ya göre skorda 9,1'den 14'e yaklaşan bir sıçrama var — neredeyse iki kat — diğer bir skalada 20'ye karşı 17 gibi daha mütevazı bir fark görülüyor. Maliyet tarafı ise net: 0,070 dolara karşı 0,037 dolar bandı ve 0,021 civarında %50-55'e varan avantaj. Küçük bir örnek: günde on binlerce kısa görevi (örneğin ticket etiketleme veya rapor özetleme) Luna'ya verirseniz, aynı işi yarı fiyata ve daha yüksek doğrulukla kapatıyorsunuz. Luna'nın bir ajan gibi arkaplanda toplayıp getiren davranışa evrilmesi de bu tabloya uyuyor; çok iş, az fatura.
Asıl fark Sol'da ortaya çıkıyor. OpenAI grafiğinde 5.6 Sol'un ekstra yüksek modunda 33,2 puan için 0,27 dolar görünürken, aynı işin 5.6 Sol ile en yüksek (max) ayarında ancak %28 için 0,67 dolara, ekstra yüksekte %26 için 0,54 dolara geldiği anlatılıyor. Yani yeni Sol hem daha akıllı hem yaklaşık iki kat daha ucuz. Bu farkı somutlaştırmak için üç adımda düşünün: 1) aynı otomasyon işini tanımla, 2) aynı zorluk ayarında koş, 3) hem puanı hem faturayı yan yana koy. Sonuç: Sol, önceki nesle göre aynı cüzdanda daha yüksek puan veriyor. Teknik etikette giriş-çıkış fiyatı yarıya indiği için ajan döngülerinde tasarruf katlanarak büyüyor.
Astra ile kıyas işi daha da ilginçleştiriyor. Astra Medium, 34,1 puan için 1,27 dolara koşarken GPT-6 Sol benzer bir bandı — kabaca 33 puan — 0,27 dolara sunuyor; yani beşte bir maliyete çok yakın skor. Grafikte Sol'un Astra Light ile Medium arasında konumlandığı görülüyor, bu önemli çünkü çoğu ekip için Medium yeterli sayılıyor. Rakip tarafta Fable 5.1'in 31,4 puan için 2,45 dolar harcadığı noktada Sol'un 33 puan için 0,27 doları, dokuz kat daha pahalı ama geride kalan bir tabloyu işaret ediyor. Anthropic'in Fable 5.1'i en yetkin model olarak öne çıkarması ve Opus 5.5'i Fable seviyesinde işler için %40 daha ucuz bir alternatif diye tanımlaması da bu denkleme dahil; sahada hangisinin sürdürülebilir olduğu, sadece tek bir grafiğe değil tekrarlanan testlere bakarak anlaşılacak.
Diğer cephelerde tablo karışık ama öğretici. Frontier kod testinde sıralama hızla değişiyor; maliyet gökyüzüne çıkarken puanlar birbirine yakın seyrediyor. Bilgisayar kullanımı (computer use) tarafında ise 5.6 Sol'un belirli bir noktada Astra Light'ı geçtiği görülüyor — yani fare ve klavye ile ekranı kullanma becerisi, ajanların dış dünya ile konuşma yolu, Luna'da da belirgin fark yaratmış. Bunu şöyle açayım: bilgisayar kullanımı, modelin tarayıcı veya masaüstü arayüzünü kendi başına işletmesi demek; form doldurma, dosya taşıma veya uygulama içinde tıklama gibi adımlar. OpenAI'nin bu beceride Sol ve Luna için sunduğu yerli iş arkadaşı tonu — gereksiz uzun gevezelik yerine kısa, bağlama oturan yanıtlar — günlük ajan akışında zaman kazandırıyor. Uzun ufuklu OSWorld 2.0 gibi 108 görevlik masaüstü serilerinde bu farkın ne kadar kalıcı olduğunu görmek için bağımsız sonuçlar bekleniyor.
Hata oranı ve önbellek ekonomisi, fiyattan daha sessiz ama daha kritik bir hikâye anlatıyor. Luna'nın hata skalasında çok düşük bir banda indiği, Astra'nın ise en düşük hata bandında kaldığı vurgulanıyor; hatadan kastım modelin yanıltması veya yanlış yönlendirmesi. Bir şirket yönetirken her çalışanının işini adım adım bilemezsiniz, sonuç ve güven önemlidir — ajan size bilmediğiniz bir konuda hızla çıktı ürettiğinde küçük bir yanıltma bile pahalıya patlar. Bu yüzden hata düşüşü doğrudan güven artışı demek. Önbellek tarafında %90'a varan indirim, aynı bağlamın yüzlerce kez okunduğu ajan işlerinde faturanın çoğunu oluşturan kalemi törpülüyor; aynı araştırma dosyasını on ajan adımında tekrar okumak, artık tek okuma kadar maliyetli değil.
Erişim tarafında duyuru net: GPT-6 ve Luna, ChatGPT içinde Work, Codex, Plus, Pro, Enterprise ve Education planlarında ve Go ile açık kullanıcılar için masaüstü uygulamasında yer alıyor; sohbetin her yüzeyinde değil, API tarafında ise doğrudan model kimlikleriyle çağrılıyor. OpenAI yardım sayfasına göre GPT-6 Astra, sohbette GPT-6 Pro adıyla Pro 100 ve Pro 200 ile Business ve Enterprise planlarına kademeli açılıyor; Plus içinde sohbet erişimi yok. Geliştirici tarafında model kimlikleri net: luna ve sol ayrı uç noktalar, bilgi kesimleri Mayıs ve Nisan 2026. Fiyatlandırma tarafında uzun bağlam ve önbellek yazma kalemleri de ayrı satırlarda; toplama bakarken sadece giriş-çıkış değil, önbellek okuma ve yazma toplamını da hesaba katmak gerekiyor.
Peki bu ne anlama geliyor? Gündelik iş, araştırma ve ara görevler için Luna artık bariz bir aday; benzer zekâyı çok daha ucuza verdiği için deneme maliyeti düşüyor ve daha fazla kişiye hizmet götürme fikri gerçekçi hale geliyor. Sol ise kod ve ajan döngülerinde Astra'ya yakın skorla beşte bir faturaya indiği için ekiplerin varsayılan tercihi olmaya aday. Anthropic tarafında Opus hâlâ pahalı ve birçok görev için fazla lüks kalıyor; iki şirketin farklı yere nişan aldığı açık. Bugünün kazananı kullanıcı — ucuz, pahalı ve akıllı seçenekler aynı anda masada. Ben önümüzdeki günlerde Sol ve Luna'yı Opus 5.5 karşısında işinize yarayan senaryolarda koşup sonuçları paylaşacağım; nerede ucuza, nerede sağlam akılla koşmak gerektiğini birlikte netleştireceğiz.
Benzer skor için toplam koşu maliyeti
- GPT-6 Sol (~33 puan)$0.27
- Astra Medium (34.1)$1.27
- Fable 5.1 (31.4)$2.45
| Model | Giriş /1M | Çıkış /1M | Bench puan |
|---|---|---|---|
| GPT-6 Sol | $2 | $10 | 33,2 |
| GPT-6 Luna | $0,10 | $0,50 | 14,0 |
| Astra Medium | $10 | $50 | 34,1 |
| Fable 5.1 | $10 | $50 | 31,4 |
| Opus 5.5 | $4 | $20 | 66,4* |
AI yorumu
"Benim gözümde bu duyuru akıl yarışından çok fiyat yarışını başlattı; aynı işi beşe kat ucuza yapabilmek, pahalı amiral gemilerini sorgulatıyor."
AI değerlendirmesi
Karşıt görüşü en güçlü haliyle kurarsam, indirimlerin büyüklüğü tek başına kalite ispatı değil. Sol'un yarı fiyatı, önceki kuşak Sol'un promosyon fiyatına göre hesaplanıyor; liste fiyatına göre oran %60-67 bandına çıkabiliyor ve sahada hız ile doğruluk aynı oranda düşmemiş olabilir. Luna'daki birikimli indirim de benzer şekilde, toplam fatura üzerindeki etki kullanım desenine bağlı — tek seferlik kısa görevlerde önbellek kazancı sınırlı kalır. Bu yüzden ucuzluk, ancak aynı skorun aynı koşullarda tekrarlanmasıyla anlam kazanır.
Metodoloji sınırları da not edilmeli. AutomationBench tek bir tedarikçi grafiği ve tek bir otomasyon paketi; OpenAI'nin kendi iç değerlendirmesi, bağımsız OSWorld 2.0 veya Terminal-Bench 4.0 ile aynı anda okunmalı. Grafikteki max ile extra-high ayrımı, çıkarım derinliği (effort) ayarına bağlı ve medium varsayılan üzerinden verilen maliyetler, en yüksek ayarda farklı görünüyor. Ayrıca Fable ve Opus 5.5 skorları aynı zemin ve aynı hız çarpanında karşılaştırılmadı; hızlı mod ve standart mod arasındaki fiyat farkı da tabloya dahil edilmeli.
Doğrulanabilirlik tarafında iddiaların kaynağı net: fiyatlar OpenAI geliştirici dokümanlarından, benchmark skorları OpenAI grafiğinden ve Anthropic'in kendi lansman notlarından geliyor. Fable 5.1'in en yetkin model olduğu ve Opus 5.5'in Fable seviyesinde işi %40 ucuza yaptığı ifadesi Anthropic'in çerçevesi; GPT-6 Sol'un Astra Medium'a yakın olduğu ifadesi ise OpenAI'nin seçili ayar ve seçili testteki okuması. Bağımsız kanıt için Artificial Analysis Intelligence Index ve Terminal-Bench gibi üçüncü taraf sonuçları ile fiyat/doğruluk eğrisinin saha raporları beklenmeli; aksi halde tek kaynaktan genelleme riski var.
Pratik çıkarım: toplu ve tekrarlı işler için Luna, kod ve ajan orkestrasyonu için Sol mantıklı bir varsayılan; en zorlu muhakeme, uzun bağlam ve yüksek güven gerektiren regüle işlerde Astra hâlâ referans. Anthropic tarafında Pro planın 17 dolar yıllık ve Max'in 100 dolardan başlaması, Opus 5.5'e erişimi plan matrisine bağlı kılıyor ve herkes için açık değil. Ekipler için önerim, aynı gerçek iş akışını üç modelde aynı effort ayarında koşup hem faturayı hem hata oranını yan yana koymak; ucuz olanın değil, güvenilir ve ucuz olanın kazanacağını bu tablo gösterecek.
Kaynaklar
7 bağlantı; 4 tanesi 19 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @youtube.com YouTube — Mert Durmazer | Digital Academy: GPT-6 Sol ve Luna
- @developers.openai.com https://developers.openai.com/api/docs/models/gpt-6-sol
Aynı kaynağı kullanan: Yapay Zeka Fiyat Savaşı: Opus 5.5, GPT-6 Sol ve Agent Dünyasının Sessiz Darboğazı
- @developers.openai.com https://developers.openai.com/api/docs/models/gpt-6-luna
Aynı kaynağı kullanan: Haftanın Büyük Sarsıntısı: GPT-6 Soul ve Luna Yarı Fiyata, Opus 5.5 Zirveye Oynuyor
- @developers.openai.com https://developers.openai.com/api/docs/pricing
Aynı kaynağı kullanan: Haftanın Büyük Sarsıntısı: GPT-6 Soul ve Luna Yarı Fiyata, Opus 5.5 Zirveye Oynuyor
- @openai.com https://openai.com/index/gpt-6-astra/
Aynı kaynağı kullanan: Beyin ve Gövde: GPT-6 Astra ile Hermes Üzerinde Tek Ekranlık Ajan Düzeni · Space Bunny Alpha: Ücretsiz Gizli Yapay Zeka Deneyinin Perde Arkası · Robot Kullanım Ajanları: Genel Amaçlı Modeller Robot Kontrolünü Neden Kazanıyor · Base44 ve GPT-6 Astra ile Dakikalar İçinde Üretken Bir Kart Koleksiyon Uygulaması Oluşturmak · Gemini 4 Sızıntısı mı? GPT-6 Astra ve Fable 5.1 Karşısında 10 Etkileşimli 3D Testi · Gemini 4 Pro Sızdı, GPT-6 Soul Testte: Arena'dan Google Buluta Haftanın AI Sarsıntısı · 10 Bin Ajan, 88 Saat, 1 Milyon Dolar: AI Mastermind #39'un Kod, Para ve Otonomi Turu · Tek Promptla Kanal Klonlamak: GPT-6 Astra ve Higgsfield ile $33 Bin Vaatli Video Fabrikası · GPT-6 Astra Kullanım Rehberi: Yatay Güç ile İşi Bitiren Model · Eskizden Gerçekçi Villaya: GPT-6 Astra ve Higgsfield MCP ile Sunum Videosu · GPT-6 Astra ile Günde 500 Dolar İddiası: Üç İş Modelini Uçtan Uca Kurmak · Ajanlar İşi Devralınca: GPT-6 Astra Sonrası Yığına Yatırım (+5)
- @felloai.com https://felloai.com/claude-opus-5-5/
- @platform.claude.com https://platform.claude.com/docs/en/models/overview
gpt-6 · sol · luna · astra · automationbench · openai · anthropic