Gündeme dön

Aynı Gün Dört Lansman: Opus 5.5 Dönüşü ile GPT-6 Sol ve Luna Fiyat Devrimi

OpenAI ve Anthropic aynı gün sahneye çıktı: GPT-6 Sol ve Luna fiyatı yarıya indirirken Claude Opus 5.5 Fable düzeyini %40 ucuza yakaladı; beş ayrı incelemeyi resmi verilerle çapraz okudum.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — KYGscdtRS1Y
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Aynı salı günü iki büyük laboratuvar peş peşe model duyurdu; haftanın ilk yarısında sayılan büyük sürüm sayısı dörde ulaştı. SpaceX AI tarafı gölgede kalmamak için duyurusunu öne çekti, yani takvim bile rekabetin parçası haline geldi. Ortaya çıkan ilk soru modellerin tek tek değeri değil, hangisinin kimin iş akışına oturduğu oldu.

Opus soyunun hikâyesi bu lansmanı anlamak için şart. 4.6 sürümü kullanıcıların gönlünde taht kurmuş, 4.7 ve 4.8 küçük adımlar olarak görülmüş, Opus 5 ise sevilmemişti. Üstüne Mythos ve Fable ailesi sahneyi alınca Opus uzun süre vitrinin arkasında kaldı.

Opus 5.5: resmi tablo

Resmi duyuru 22 Eylül 2026 tarihini taşıyor: Opus 5.5 çoğu işte Fable 5.1 düzeyinde sonuç veriyor ve tipik yükte Opus 5'ten %40 daha ucuza çalışıyor. Giriş tokeni 4 dolar, çıkış tokeni 20 dolar; önbellek okuma 0,20 dolarla %60 gerilemiş durumda. Çıktı üretimi %30 hızlanmış, Pro ve Max paketlerinde beş saatlik limitler yükseltilmiş.

Güvenlik cephesinde model, hız yarışı çağrısı sonrasındaki ilk sürüm olarak dış denetimden geçti; Frontier Design ve METR testleri, davranış denetiminde bugüne kadarki en güçlü hizalama skorunu verdi. Biyoloji ve siber güvenlikte Fable 5.1 benzeri tedbirler devrede, doğrulanmış kuruluşlar için yaşam bilimleri programı başvuruya açık. Sam Bowman ekibi modelin öncekilerden güvenli olduğunu ve sürümün hizalama riskini azalttığını savunuyor.

Skor tablosu iddiayı sayıya döküyor: Terminal-Bench 4.0 skorunda Opus 5.5 %66,4 ile Fable 5.1 (%55,8) ve Opus 5 (%52,3) önde, GPT-6 Astra %57,9 ile geride kalıyor. FrontierCode %54,4, CursorBench %57,8, GDPval-AA 1846 (Fable 5.1 1735, Opus 5 1708, Astra 1542), HLE araçlı test %67,7, OSWorld %81,8, Chartography %89, AutomationBench %40 seviyesinde. Bilimsel ajan araştırmasında %58,7 ile Opus 5'in %29 skorunu ikiye katlıyor; Astra %64,6 ile lider ama görev başına maliyetin yaklaşık beşte biri konuşuluyor.

Bağımsız cephede Artificial Analysis endeksi Opus 5.5 skorunu 58 olarak yazdı; Fable 5.1 ve Astra 53 puanda kalmıştı. RoboNuggets derlemesinde Opus 5.5, Opus 5'in 7 puan üstüne çıktı. Sol tarafında tablo farklı: GPT-6 Sol kabaca 5.6 düzeyinde, çünkü OpenAI odağı performanstan çok maliyete koymuş. Opus tarafında Fable skorunun aşılması ve Astra tarafında zirvenin korunması, tek test zemininde okunması gereken bir ayrıntı olarak kayda geçti.

Sol ve Luna: maliyet cephesi

OpenAI tarafı Sol ve Luna modellerini Astra kazanımlarının hızlı ve ekonomik hali olarak tanıttı; 5.6 tanıtım fiyatına göre %50 indirim uygulandı. API kimlikleri gpt-6-sol ve gpt-6-luna olarak açıldı, ChatGPT Work ve Codex cephesinde Plus ile Edu dahil tüm ücretli katmanlara yayıldı. Luna masaüstü uygulamada ücretsiz ve Go kullanıcılarına da deneme için sunuldu. Sam Altman her fiyat katmanında en iyi model hedefini ve görev başına fiyat mantığını öne çıkardı.

Maliyet düşüşü burada kullanım biçimini değiştiriyor: limitler yükselip fiyat inince ekipler modeli daha sık ve daha uzun görevlerde çalıştırıyor. Codex tarafında limitlerin Claude Code cephesine göre daha uzun dayanması, günlük işlerde OpenAI lehine pratik bir fark yaratıyor. Kodlama ajanları üstlendikçe sürekli kullanım maliyeti belirleyici oluyor; uzun ve gözetimsiz işlerde Fable ve Claude, kısa döngülerde GPT tarafı tercih ediliyor.

Topluluk hükmü ikiye bölündü: Sol, Astra gücünün beşte fiyatına gelen S kuşağı telefon benzetmesiyle anıldı. Every ekibi günlük okuma yazmada Sol tarafını, iddialı kod ve görsel projelerde Opus 5.5 tarafını seçti. Yuclimb ve Chenjin kalemleri Claude geri döndü diye yazdı, Jeffrey Emanuel en sert görevlerde Fable ve Astra haftalarca çözemediği hataların yakalandığını aktardı. Chubby ise tek kazanan aramanın yanlış soru olduğunu savundu.

Erken kullanıcı kanıtları

Box ekibinin Aaron Levy önderliğindeki ölçümü somut: Opus 5'e göre %63 az token , %42 az gevezelik, %30 hız artışı. Finans görevlerinde %39, bulut maliyeti analizinde %65 doğruluk artışı; tüketici ürünlerinde %17, klinik tanıda %15 iyileşme yazıldı. Optiver yarı turda aynı kaliteyle %40 ile %50 maliyet düşüşü, Kiro %40 az çağrıyla yarı token bildirdi. 200 bin satırlık kod denetimi üç saatin altında bitti; Opus 5 aynı işte 20 saati geçmişti. HAProxy çevirisinde 9,5 saate 12 saat ve %51 düşük maliyet, 680 bin satırlık taşımada ise günden kısa süre konuşuldu.

Görsel vitrin sosyal akışı süsledi: Alex Albert tek komutla kil hamuru animasyonu üretti, Chase Lin interaktif mercan resifi kurdu, Golden Gate sahnesi yalnızca model koduyla yazıldı. Market Street sahnesi 1906 dokusuyla Blender içinde canlandı, Jake Eaton 7500 satırlık piksellerle tablo serisi paylaştı. Tarek kişisel sitesini yeniden çizdirip sunumunu hazırlattı; AI Daily Brief yazarı kendi sitesinde Opus 5.5 incelemesini net ve uygulanabilir buldu.

Yazı cephesi ayrı bir zafer sayfası açtı: Every ekibi gördükleri en okunabilir metin diye yazdı, uzun çizgilerin ayıklanması sembolleşti. Bilgi öne yükleniyor, uzun oturumlar izlenebilir kalıyor, geri bildirim döngüsü keyifli hale geliyor. Makayla Wrigley 4.6 kişiliği ile Fable zekâsının birleştiğini yazdı, Macallan ekibi önceki sürüm için özür dileyip yenisini önerdi. Eric Tech kıyasında Opus 5 çıktısı uzun ve dağınık, 5.5 çıktısı kısa ve izlenebilir göründü.

Üç dakikalık düello ve çaba ekonomisi

RoboNuggets aynı açılış sayfası komutunu ve aynı tasarım referanslarını iki modele verdi. Sol temiz ve profesyonel bir sayfa, özellik animasyonlarıyla derli toplu bir akış çıkardı. Opus tarafı nokta animasyonları, deneme yapılabilen interaktif uygulama, bilgi kartları ve daha okunabilir grafiklerle estetik raundu aldı. Yazarın hükmü netti: arayüz zevki aranıyorsa Opus, sade profesyonellik yetiyorsa Sol.

Eric Tech çaba seviyesi ekonomisini masaya koydu: orta çabada Opus 5.5, yüksek çabadaki Fable skorunu yakalıyor. Ajan kodlamada düşük çaba bandında liderlik Opus tarafında, iş akışlarında ise Astra önde gidiyor. Gerçek dünya bilgisinde skor yükseldikçe değer artıyor; yazar Sol düellosunu izleyici anketine bağladı ve iletişimdeki sadeleşmeyi en büyük güncellemelerden saydı.

Animasyon sınıfı ve mühendis defteri

Andy Lo tek komutla el çizimi eğitim animasyonu üretti: Hawking ışıması hikâye formatında, mancınık ise ayarlarıyla oynanabilen interaktif fizik sahnesi olarak. Komutun iskeleti stil bloğu, renk paleti, kukla tiyatrosu çerçevesi, küçük kız anlatıcı, kâğıt geçişleri ve yedi sahnelik zaman damgalı plandan oluşuyor. Robotik seslendirme Fish Audio ile çözüldü, Claude Code sahne başına ayrı ses dosyası üretti.

Duncan Rogoff mühendis rehberini üç ilkeye indirdi: görevi bütün ver, bitiş tanımını yaz, ne zaman durup soracağını söyle. Dikkatlice düşün kalıplarını silmek token ve bağlam kazandırıyor, hız gerekiyorsa çaba kaydırıcısı yetiyor. Çalışırken ara girdi girmek, bitmesini bekleyip tüm bağlamı yeniden okutmaktan ucuz. CLAUDE.md dosyasına durma ve devam kuralları, yıkıcı işlem koruması, alt ajan bölmesi ve tasks.md listesi ekleniyor.

Tasarım tarafında genel uyarılar işe yaramıyor; krem zemin ve soluk beyaz gibi yasaklı desenleri tek tek saymak gerekiyor. Başlıklarda italik vurgu, numaralı bölüm etiketleri ve hap butonlar gibi somut tercihler, modelin varsayılan yapay zekâ estetiğine kaymasını engelliyor. Kural basit: ne istemediğini genel değil, özel yaz.

Sınırlar cephesi de kayda geçti: biyoloji ve siber güvenlikte Fable benzeri tedbirler bazı hukuk ve yaşam bilimi işlerini fiilen kilitliyor. Doğrulama programı başvurusu bekleyen ekipler, reddedilen görevlerde Opus tarafına sığınamamaktan şikâyet ediyor. Aşırı tedbir herkesi vurmuyor ama vurduğu yerde modeli kullanılmaz hale getiriyor.

Görsel: nodesdaily AI

Terminal-Bench 4.0 skorları

  • Opus 5.5%66,4
  • GPT-6 Astra%57,9
  • Fable 5.1%55,8
  • Opus 5%52,3
Yüksek skor daha iyi; tüm değerler gövde metninde geçiyor.
KonuÖzet
Opus 5.5Fable seviyesi güç, %40 düşük maliyet
Sol ve Luna%50 ucuz, günlük işlere odaklı
SeçimGünlük işte Sol, iddialı projede Opus
ModelTerminal-BenchGDPval-AA
Opus 5.5%66,41846
Fable 5.1%55,81735
Opus 5%52,31708
GPT-6 Astra%57,91542

Videodaki anahtar anlar

  1. Aynı gün lansman ve SpaceX hamlesi
  2. Opus 5.5 fiyatı ve Fable kıyası
  3. Terminal-Bench sıçraması ve endeks skoru
  4. Sol ve Luna maliyet hamlesi
  5. Blender vitrini ve yazı düzeltmesi
  6. Mühendis rehberi ve görev devri
  7. Sınırlar ve hız yarışı notu

AI yorumu

"Yapay zekâda nadir görülen bir salı yaşandı ve ben günün sonunda hangi modelin neyi değiştirdiğini net görmek istedim; o yüzden beş ayrı incelemeyi resmi duyurular ve bağımsız kıyaslarla çapraz okudum. Ortaya çıkan tabloyu birinci tekil sesimle, abartısız ama kararlı biçimde yazdım."

AI değerlendirmesi

Maliyet eğrisini savunanların en güçlü hali şu: Epic AI verisine göre belirli bir performans düzeyinde maliyet 2023'ten beri her çeyrekte yaklaşık %47 geriliyor; DNA dizilemeye karşı 4 kat, işlem gücüne karşı 6 kat, pile karşı 18 kat hızlı ucuzluyor. Aaron Levy'nin Jevons göndermesi de bu yüzden boş bir slogan değil, sınırlar uzadıkça ajanların kapsadığı iş havzası gerçekten büyüyor.

Sınırlar tarafı ise tek teste yaslanıyor: RoboNuggets kıyası da AI Daily Brief derlemesi de büyük ölçüde tek ölçüm zemininde konuşuyor; hukuk işindeki ret artışı ve zaman yönetimi şikâyeti gibi ters örnekler, hizalama tedbirlerinin bazı profesyonel kullanımları fiilen kilitlediğini gösteriyor. Terminal-Bench-Science cephesinde Astra liderliği sürüyor, yani Opus üstünlüğü evrensel değil.

Çıkar çatışması haritası net okunmalı: fiyat ve skor iddialarının kaynağı Anthropic ile OpenAI duyuruları ve Labellerr gibi ikincil derlemeler; bağımsız zemin Artificial Analysis endeksi; coşku dalgası ise erken erişimdeki uygulayıcılardan geliyor. Eric Tech'in söz verdiği Sol düellosu henüz yok, o yüzden Sol tarafı için bağımsız doğrulama hanesi boş duruyor.

Pratik çıkarımım iki kümeye ayrılıyor: günlük okuma yazma ve hafif kod işlerinde Sol ve Luna fiyatıyla öne çıkıyor, uzun soluklu ajan kodlama ve görsel ağırlıklı iddialı projelerde Opus 5.5 masaya geliyor. Codex ekosistemine gömülü ekipler yakın skorları yeterli bulup kalıyor, bu yüzden seçim teknik üstünlükten çok iş akışı sadakatine dayanıyor.

Kaynaklar

10 bağlantı; 3 tanesi 11 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

opus 5.5 · gpt-6 sol · gpt-6 luna · yapay zeka modelleri · kodlama ajanları · model fiyatları

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…