Gündeme dön

Haftanın Büyük Sarsıntısı: GPT-6 Soul ve Luna Yarı Fiyata, Opus 5.5 Zirveye Oynuyor

OpenAI GPT-6 Soul ve Luna'yı yüzde 50 indirimle günlük işe sokarken Anthropic Opus 5.5 ile çıtayı yeniden koydu; Alibaba Qwen 4 ailesini, Tencent HY Image 3.5'i ve Trump'ın 'yapay zekâ artık süper zekâ' çıkışını aynı videoda buluşturan çılgın bir 48 saat.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — GJIkBVSoxUw
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Son iki günde yapay zekâ gündemi aynı anda patlayan bir havai fişek gösterisine döndü ve WorldofAI kanalının bu derleme videosu hepsini tek potada topluyor; sunucunun kendisi 'üçüncü videom bugün' diyerek tempoyu özetliyor. Eylül başında tanıtılan GPT-6 Astra amiral gemisinden sonra sahneye şimdi aynı neslin iki hafif sıkleti çıkıyor, Anthropic cephesinde Opus 5.5 ailesi genişliyor, Çin'den Alibaba ve Tencent peş peşe duyurular yapıyor ve araya Amerika siyaseti girip teknoloji adını bile tartışmaya açıyor. Bu kadar farklı kulvardan haberin aynı 48 saate sıkışması, videoyu haftanın panoraması haline getiriyor.

GPT-6 Soul ve Luna — Aynı Nesil, Yarı Fiyat

OpenAI'ın yeni ikilisi GPT-6 Soul ve GPT-6 Luna, Astra'nın sunduğu GPT-6 zekâsını günlük iş yüklerine indirmek için tasarlanmış. Kodlama, bilgi doğruluğu, bilgisayar kullanımı ve profesyonel görevlerde iyileşme vaat ederken en çok konuşulan nokta fiyat oluyor. Soul milyon token başına 2 dolar giriş ve 10 dolar çıkışla listeleniyor, Luna ise 0,10 dolar giriş ve 0,50 dolar çıkışla geliyor. Her ikisi de bir önceki GPT-5.6 promosyon fiyatlarına göre yaklaşık yüzde 50 daha ucuz; sunucunun ifadesiyle 'aynı nesil zekâ, çok daha düşük fatura' düşüncesi burada somutlaşıyor ve yüksek hacimli kullanım için bariyer düşürülüyor.

Fiyat tek başına heyecan yaratmaz; videonun profesyonel iş odaklı Automation Bench vurgusu tabloyu tamamlıyor. Bu test gerçek şirket akışlarını birden fazla uygulama arasında koşuyor ve burada Soul, Anthropic'in önceki amiral gemisi Opus 5'i en yüksek çabayla çalışırken geride bırakırken görev başına maliyeti yalnızca yüzde 9 seviyesine çekiyor. Luna cephesinde de tablo benzer: bir nesil öncesine göre 5,4 puanlık artış elde ederken görev başına maliyet yüzde 58 aşağı geliyor. Sunucunun altını çizdiği mesaj net: OpenAI ucuzlatırken aynı anda dolar başına daha fazla iş yaptırıyor ve bu denklemi satın alma kararının merkezine koyuyor.

Merak edilen bir diğer soru gerçek dünyada neye mal olduğu ve Artificial Analysis gibi bağımsız platformların ne ölçtüğü. Videoda AIML API üzerinden tek atışta dört ayrı üç boyutlu sahne ürettiriliyor; hareketli balık sürüsü ve tsunami benzeri sahneler dahil. Opus 5.5 dört sahne için toplam 4,37 dolar harcarken Soul aynı dörtlüyü 0,34 dolara üretiyor ve görsel detay farkına rağmen maliyet farkı 13 kata yaklaşıyor. Yapay zekâ genel sıralamasında Soul üçüncü sırada konumlanırken Artificial Analysis tarafında GPT-5.6 Soul ile yeni Soul arasında yalnızca bir puanlık fark görülmesi, sunucunun 'fiyat çok iyi ama sıçrama beklediğimden küçük' yorumunu getiriyor. Aynı bölümde halüsinasyon oranlarının kabaca Soul'da yüzde 92'den 60'a, Luna'da yüzde 93'ten 77'ye indiği aktarılıyor; bu düşüş özellikle Luna ölçeğinde dikkat çekici.

Opus 5.5 — Tahtın Yeni Sahibi mi

Anthropic tarafı videonun en iddialı başlığını oluşturuyor. Claude Opus 5.5, Claude 5.5 ailesinin ilk üyesi olarak tanıtılıyor ve sunucunun anlatımıyla neredeyse tüm görevlerde Fable 5.1 seviyesinde veya üzerinde performans gösterirken Opus 5'e göre işletme maliyetini yüzde 40 aşağı çekiyor. Şu an bağımsız sıralamada zirvede gösterilen model, aynı zamanda kullanım limitlerinde 22 Ekim'e kadar geçerli ek sıfırlama hakkı tanıyor. Bir karşılaştırmada New York silüeti Three.js ile istendiğinde Soul tek karelik statik bir çerçeve verip render döngüsünü kuramazken Opus 5.5 dokular, gölgeler, ışık ve etkileşimli kamera gezinmesiyle tam sahneyi inşa ediyor; işte sunucunun 'fark iki alanda değil, alanlar genelinde' dediği makas burada görünür oluyor. Buna karşılık Soul aynı mesaj için takvim, kilit ekranı ve SVG ikonlarıyla tarayıcı içi işletim sistemi benzeri bir arayüzü oldukça yetkin kurduğunda, prompt detayının fark yarattığı da not düşülüyor.

Opus 5.5'in saf güç gösterisi gece treni simülasyonuyla devam ediyor. Kuzey hattı, hatta Alaska benzeri bir coğrafyada raylar üzerinde giden bir tren, Three.js içinde peşinden giden kamera açıları ve ışık atmosferiyle birlikte baştan sona kodlanıyor ve sunucu bunu GPT Astra'ya göre bariz kalite farkı olarak yorumluyor. Detay sadece estetikte değil; sahnenin tamamı ışık ve çevre simülasyonuyla çalışır hale getiriliyor ve modelin uzun bağlamda planı bozmadan ilerlediği vurgulanıyor.

Minecraft'tan Elden Ring'e — Tek İstekle Oyun Fabrikası

Demo maratonu uzadıkça ölçek büyüyor. Minecraft tarzı bir sandbox dünya, gölgelendiricilerle birlikte yeniden kuruluyor ve Opus 5.5 en yüksek çabayla 1 saat 37 dakika çalışarak ışık, doku ve görünümde orijinalinden kimi açılarda daha zengin bir deneyim sunuyor. Ardından Spider-Man Miles Morales esintili tam oynanabilir bir şehir, orta seviyede çabayla üretiliyor; binalar arası salınım fiziği, animasyonlar ve dokuların hepsi tek istemle geliyor. Videonun nirengi noktası ise Elden Ring tarzı bir aksiyon oyunu: en yüksek çıkarım çabasıyla üretilen bu klon, orijinalin dokularını ve atmosferini taklit etmekle kalmıyor, patron dövüşüne kadar etkileşimli bir döngü kuruyor. Sunucu burada tezini netleştiriyor; artık model yalnızca açılış sayfası değil, baştan sona oynanabilir oyun üretiyor ve fark temel kavrayış derinliğinde ortaya çıkıyor.

Opus 5.5 yalnızca gücün değil, ailenin de habercisi. Anthropic aynı gün blogunda doğruladığı üzere Claude Haiku'nun geri döndüğünü ve Sonnet 5.5 ile Haiku 5.5'in haftalar içinde geleceğini duyuruyor; beklenti, Opus 5.5'teki verimlilik ve güvenlik kazanımlarının daha hafif modellere taşınması. Paralel bir ara demoda tarayıcı içinde macOS benzeri bir sistem isteği de dikkat çekiyor: takvim, kilit ekranı, SVG ile çizilmiş uygulama ikonları, tamamen çalışan köprüler ve müzik çalar bile kuruluyor, ancak klasörleri sürükleyip bırakma henüz çalışmıyor ve sunucu bunun için ek prompt iyileştirmesi gerektiğini ekliyor.

Çin'den Çift Salvo — Qwen 4 ve HY Image 3.5

Alibaba cephesi Apsara konferansı üzerinden Qwen 4 yol haritasını netleştiriyor. Listede en tepede Qwen 4 Max, yanında Qwen 4 Plus ve Qwen 4 Flash bulunuyor; en çok merak uyandıran ise yerel çalıştırılabilir Qwen 4 27B, sunucunun ifadesiyle önde gelen kapalı modellere yakın bir yerel seçenek vaadi taşıyor. Yol haritası bununla bitmiyor; Qwen 4.5 ve Qwen 5 için 5 ila 10 trilyon parametre bandı telaffuz ediliyor ve bu gerçekleşirse ölçek tarafında ciddi bir sıçrama anlamına geliyor. Tencent ise görsel üretim kulvarında HY Image 3.5 Preview ile yanıt veriyor: HY Image 3.0'a göre insan değerlendirmelerinde yüzde 30 üstünlük, tutarlılık iyileştirmeleri, metinden görsele ve görselden görsele destek ile 2K çözünürlüğe kadar üretim. En çarpıcı veri fiyat: Tencent Cloud üzerinden görsel başına 2 sent ve referans görseller için ek ücret olmaması, kalite ile maliyeti aynı anda iten yeni normali işaret ediyor.

Trump'ın Yeniden Adlandırma Hamlesi — Yapaydan Süper'e

Videonun en politik bölümü Beyaz Saray koridoruna uzanıyor. Eski Başkan Donald Trump, 'artificial' kelimesinin teknolojiyi sahte gösterdiğini söyleyerek isim değişikliği istiyor. Önce üç seçenek arasında oylama yaptırıyor: Superior Intelligence, Extreme Intelligence ve Supreme Intelligence; son oylamada X platformunda 184 bin oyla yüzde 52 ile Superior Intelligence öne çıkıyor. 22 Eylül'de Birleşmiş Milletler Genel Kurulu konuşmasında ise Trump, Amerika Birleşik Devletleri belgelerinde 'super intelligence' yani SI teriminin kullanılacağını, bunun daha doğru bir tanım olduğunu savunuyor ve 'ulusal belgeler ve umarım dünya' ifadesiyle niyeti genelleştiriyor. BBC'ye konuşan uzmanlar SI teriminin bugün için erken ve yanıltıcı olduğu, sektörün bunu daha ileri bir seviye için saklamak istediği görüşünde birleşiyor; Washington'da bazı isimler şimdiden SI demeye başlasa da sektör genelinde yerleşmesi şüpheli görünüyor ve sunucu esprili biçimde 'kanal adımı World of Super Intelligence yapmam gerekecek' diyor.

Toparlandığında video, tek bir modelin zafer ilanından çok ekosistemin yön değiştirdiğini fısıldıyor. Fiyat listeleri artık teknik tablonun ilk satırı, verimlilik neredeyse performans kadar pazarlanıyor ve 27B yerel modeller ile görsel başına 2 sent gibi eşiklerle erişim tabana yayılıyor; öbür yanda Opus 5.5'in oyun fabrikası demoları tepe modelin hâlâ açık ara ayrıştığını kanıtlıyor. Üretim maliyeti neredeyse 13 kat düşerken görsel kalitenin 'çok geride değil' kalması, birçok ekip için 'en iyiyi değil, en mantıklı pahalı/ucuz dengesini' seçme dönemini başlatıyor; sunucunun 'kendi komut kütüphanemde Soul, Opus 5.5 tadında iş çıkardı' gözlemi de bu yüzden ağırlık kazanıyor. Kalan soru, indirimlerin kalıcı mı kampanya mı olduğu ve bağımsız testlerin aynı tabloyu doğrulayıp doğrulamayacağı; cevap gelene dek karar verirken etiket fiyatını değil görev başına maliyeti konuşmak en sağduyulu yol gibi duruyor.

Görsel: nodesdaily AI

Görev Başına Maliyette Düşüş

  • Soul vs Opus 5%9
  • Luna vs öncül%42
  • Opus 5.5 vs Opus 5%60
  • Soul 4 sahne vs Opus1/13
Yüzde değer küçüldükçe maliyet düşüyor; 4 sahne testi yaklaşık 13 kat farkla en düşük.
ModelGiriş / 1MÇıkış / 1MGörev Başına Maliyet
GPT-6 Soul$2,00$10,00Opus 5'e göre %9
GPT-6 Luna$0,10$0,50Öncüle göre %42 ( %58 düşüş)
Opus 5.5——Opus 5'e göre %60 ( %40 düşüş)
4 Sahne Testi$0,34 (Soul)$4,37 (Opus)13x fark

Videodaki anahtar anlar

  1. Açılış — 48 saatte 6 duyuru, üçüncü video
  2. GPT-6 Soul $2/$10, Luna $0,10/$0,50 — yüzde 50 indirim
  3. Automation Bench — Soul, Opus 5'i yüzde 9 maliyetle geçiyor
  4. 4 sahnelik karşılaştırma — $4,37'ye karşı $0,34 ve 13 kat fark
  5. New York Three.js — statik kareye karşı tam şehir
  6. Gece treni — Alaska hattında takip kamerası
  7. Minecraft + shaders 1s37dk ve Spider-Man salınımı
  8. Elden Ring klonu — patron dövüşüne kadar
  9. Qwen 4 27B yerel ve 5-10T yol haritası
  10. HY Image 3.5 — yüzde 30 üstünlük, görsel 2 sent
  11. Trump — Superior Intelligence %52 ve BM'de SI

AI yorumu

"Bana kalırsa bu videonun anlattığı şey yeni bir zekâ sıçramasından çok yeni bir fiyat/fayda denklemi: en pahalı model değil, dolar başına en akıllı model konuşulacak."

AI değerlendirmesi

Bu derlemenin güçlü yanı, fiyat ve demosunu aynı terazide tartması: Soul ve Luna'da yüzde 50 indirim ve görev başına yüzde 9 ve yüzde 58'lik maliyet düşüşleri somut, Automation Bench ve AIML API'deki 4 sahnelik 13 kat fark gibi ölçümler aynı videoda yan yana duruyor ve $2/$10 ile $0,10/$0,50 gibi liste fiyatları açıkça veriliyor; Opus 5.5 tarafında yüzde 40 işletme avantajı ve 1 saat 37 dakikalık en yüksek çaba ile gelen dokulu oyunlar da iddiayı ete kemiğe büründürüyor.

Sınır ise doğrulama katmanında. Halüsinasyon oranları ve Automation Bench skorları büyük ölçüde sunucunun aktardığı şirket ve video içi ölçümlere dayanıyor; Artificial Analysis'te yalnızca bir puanlık ilerleme bile 'beklediğim sıçrama olmadı' şerhini doğuruyor ve OpenAI'ın fiyat indirimlerinin promosyon mu kalıcı mı olduğu net değil. Qwen 4.5/5'in 5-10 trilyon parametre hedefi ile HY Image 3.5'in yüzde 30 üstünlük iddiası da üretici açıklaması ve şirket bulutu fiyatlaması düzeyinde kalıyor; bağımsız tekrar testleri ve karşı benchmark'lar gelmeden genelleme yapmak erken olur.

Benim çıkarımım, bu haftayı tek bir kazananla değil makasla okumak: aynı işi 13 kat ucuza yapmak varken her görevde en tepe modele gitmek maliyetli bir alışkanlık; harcaması yüksek ekipler için Soul/Luna günlük motor, kalite tavanını zorlayan işlerde Opus 5.5 haklı tercih olabilir. Fiyat listesi ayda bir değiştiği için karar anında güncel tarifeyi ve kendi verinizdeki görev başına maliyeti ölçmek, videodaki rakamlara doğrudan bel bağlamaktan daha sağlıklı.

Kaynaklar

8 bağlantı; 2 tanesi 1 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

gpt-6 · opus 5.5 · yapay zeka · qwen 4 · tencent · fiyat · nodesdaily

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…