Gündeme dön

Opus 5.5'in %40 daha ucuz iddiası ve GPT-6 ile kumaş simülasyonu: 20 dakikada gerçekçi fizik neden öne geçti

Video, Anthropic'in **Opus 5.5** için öne sürdüğü %40 daha düşük faturalandırma, %60 daha indirimli oturum önbelleği okuma ve ~%20 girdi-çıktı indirimi iddialarını ve hemen ardından **GPT-6 Sol ile Luna** olarak sunulan OpenAI duyurusunu özetleyip, iki modelin aynı interaktif kumaş simülasyonunu kodlamasını, rüzgar ve yırtılma fiziğini ve yaratıcının **GPT-6'yı 20 dakikada daha akıcı bulurken Opus varyantını 60 dakikada daha zayıf bulmasını** tartışıyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — sqr20uQLtgg
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Rekabetin temposu bir anda hızlanıyor. Video, Opus 5 olarak anılan serinin hemen ardından Opus 5.5 diye sunulan paketin anlatılmasıyla açılıyor; ardından GPT-6'nın Sol ve Luna adlarıyla birlikte duyurulduğu aktarılıyor. Anlatıcı, bu yarışı yalnızca sayı tablolarında değil, doğrudan kodun ürettiği bir sahnede ölçmek istiyor ve izleyiciye küçük bir oyun kuruyor: aynı kumaş simülasyonunun iki ayrı model tarafından yazılmış iki sürümü yan yana gelecek, hangisinin hangisi olduğunu seyirci sezecek.

Token ve önbellek tarafında neyin değiştiği anlatılıyor

Öne çıkan iddia, aynı işin daha az jeton ile bitirilebilmesi. Videoda, yeni Opus varyantının bir önceki Opus ailesine göre %40 daha az fatura ürettiği, abonelikteki kullanım yüzdelerinin bu sayede daha yavaş eriyeceği ve fiilen daha fazla kontenjan kalacağı söyleniyor. Buna ek olarak, aynı oturum içinde tekrar kullanılan bağlama verilen önbellek okuma indiriminin %60 daha derinleştiği , normalde zaten indirimli olan bu kalemin üzerine ekstra bir kesinti bindiği aktarılıyor. Ortalama %20 girdi-çıktı indirimi de eklendiğinde, uzun süren sohbetlerde ya da bir süre ara verip dönülen oturumlarda toplam maliyetin gözle görülür biçimde düştüğü vurgulanıyor; elbette bu oranlar videodaki aktarımdır ve tek başına resmi fiyat kartının yerini tutmaz.

Buradaki önbellek kavramı, bir oturumun kendi hafızası olarak düşünülmeli. Model isteği işlemeden önce girdiyi iç durumuna çevirir; aynı ön eke dayalı ikinci istekte bu durum yeniden hesaplanmak yerine okunur ve okuma, yazmaya göre çok daha ucuz fiyatlanır. Resmi belgelerde bu mekanizma 5 dakikalık ve 1 saatlik yaşam süreleri ile anılır: 5 dakikalık yazım taban girdinin 1,25 katı, 1 saatlik yazım 2 katı maliyettir; okuma ise tabanın yaklaşık %10'u (bazı ailelerde daha da düşük) olarak faturalandırılır. Opus 5'in resmi kartı 24 Temmuz 2026'da $5 giriş / $25 çıkış ve 1 milyon jeton bağlam ile yayımlanmışken, videodaki 5.5 etiketi resmi GA listesinde yer almıyor — tek kaynaklı bir sızıntı olarak okunmalı, fiyat ve pencere bilgileri için referans yine Opus 5 kartı olarak kalıyor.

Başarı ölçüsü cephesinde video temkinli bir tablo çiziyor. Anlatı, yeni Opus varyantının birkaç kulvarda en iyi model iddiasını taşıdığını ve bazı iş akışlarında Fable 5.1 ötesinde sonuçlar verdiğini aktarırken, aynı anda GPT-6'nın özellikle iş akışı odaklı görevlerde daha güçlü göründüğünü belirtiyor. Bu yüzden kumaş simülasyonu bir yan deneme değil, iddianın sahaya indiği yer olarak kurgulanıyor: tasarımı planlama, uzun süreli ajan görevlerini sürdürme ve hata ayıklama gibi ölçütlerin yanında, gözle görülür bir fizik sahnesi üzerinden modelin ürettiği kodun kalitesi sınanıyor.

Karşılaştırmanın sahnesi: interaktif kumaş

Sahne, tamamen kodla üretilmiş interaktif bir kumaş simülasyonu . Önemli olan yüzeyin parlaması değil, fiziksel detayların doğru kurulması. İki üretim de maksimum efor ayarıyla çalıştırılıyor; videoda bir modelin eforu maksimumda, diğerinin varsayılan maksimumda koştuğu ifade ediliyor. Ekranda rüzgâr ekleniyor, simülasyon çalıştırılıyor ve kumaş çekilerek yırtılması izleniyor. Bir sürümde kumaş çekildikçe kendi kendine yavaşça süzülüp uzayan bir yırtılma çizgisi verirken, diğer sürümde yırtık daha keskin bir yüzey kalitesi sunsa da akışta kesintiler hissedilecek şekilde davranıyor; işte bu süreklilik farkı, değerlendirmede belirleyici oluyor.

Yaratıcının gözüyle ayrım netleşiyor: bir kumaşta süreklilik ve rüzgarda dağılma daha gerçekçi , çekme bittiğinde bile liflerin taşıdığı atalet hissi korunuyor ve görsel olarak göze daha hoş gelen bir akış ortaya çıkıyor. Diğer kumaşta ise yırtığın kenarındaki yüzey bir tık daha pürüzsüz görünse de, kumaşı oynatma hissi daha az doğal kalıyor ve fizik kuralları daha kesik kesik işliyor. Anlatıcı, görsel kalite ile fizik kalitesini ayrı tartıyor: yüzeyin keskinliği tek başına sahneyi kurtarmıyor; rüzgarla birlikte dalgalanmanın ve yırtılma anındaki gerilimin bütünlüğü, simülasyonu inandırıcı kılan unsur olarak öne çıkıyor.

Hız, tercih ve temkinli sonuç

Sonuç kısmı hem zaman hem beklenti açısından keskin. Daha çok beğenilen sürümün yaklaşık 20 dakikada üretildiği, diğerinin yaklaşık bir saatte tamamlandığı söyleniyor; yani sevilen fizik aynı zamanda daha hızlı gelmiş. Yaratıcı, uzun süredir gönlünde ayrı bir yeri olan Opus ailesinin bu kıyasta geride kalmasını bir hayal kırıklığı olarak dile getiriyor, fakat tek bir simülasyonun hüküm için yeterli olmadığını da ekliyor: modelin yapabildiği çok sayıda başka iş var ve ajantik kodlama ile iş akışı gücü gibi alanlarda daha geniş testler gerekiyor. Geride kalan not şu: Opus 5.5 etiketi doğrulanmamış bir sızıntı olarak kalırken, GPT-6 Sol/Luna anlatısı da resmi bir model kartı ile teyit edilmemiş bir aktarım; bu yüzden videodaki fiyat ve performans iddiaları, resmi fiyat kartı ve bağımsız ölçümlerle birlikte okunmalı ve tek sahnelik fizik sınavı genelleştirilmemeli.

Görsel: nodesdaily AI
BaşlıkNot
40% fatura iddiasıAynı iş daha az jeton; abonelikte kontenjan yavaş erir, uzun oturumda belirgin.
Kumaşta süreklilikRüzgar ve yırtılma birlikte akıyor; yüzey keskinliği tek başına yetmiyor.
20 dk vs 60 dkSevilen fizik hızlı geldi; tek sahne genelleşmez, resmi kartla doğrula.
BoyutOpus 5.5 iddiasıGPT-6 videoda
Faturalandırma~%40 daha düşük—
Önbellek okuma%60 daha indirimli—
Girdi-çıktı~%20 indirim—
Simülasyon süresi~60 dakika~20 dakika
Fizik sürekliliğiyüzey keskin, akış kesikdaha akıcı, sürekli

Videodaki anahtar anlar

  1. Giriş: Opus 5 ve ardından 5.5 anlatısı
  2. %40 daha az fatura iddiası
  3. Önbellek okumada %60 ek indirim
  4. Benchmark çerçevesi: Fable 5.1 ve iş akışları
  5. Sahne: interaktif kumaş, rüzgar ve yırtılma
  6. Tercih: hangi fizik daha akıcı bulundu
  7. Süreler: 20 dakika ile 60 dakika ve temkin

AI yorumu

"Bana kalırsa bu videonun değeri fiyat tablosunu ezberletmesi değil, aynı işi daha az jetonla bitirme vaadi ile ekrandaki akışkanlığın aynı cümlede sınanması; %40 ucuzluk ve %60 önbellek indirimi kulağa hoş gelirken, kumaşın yırtılırken nasıl süzüldüğü ve rüzgarda nasıl dağıldığı, verimliliğin gerçekten işe dönüşüp dönüşmediğini ele veriyor."

AI değerlendirmesi

En güçlü karşı tez, tek sahnelik fizik sınavını genelleştirmenin riskini hatırlatır: rüzgar ve yırtılma sürekliliği göze hoş gelse de, iş akışı otomasyonu, uzun bağlamda planlama ve hata ayıklama gibi daha geniş ölçütler bu videoda kıyaslanmıyor. Eğer resmi ölçümler Opus 5 çizgisinde planlama ve uzun süreli ajan görevlerinde istikrar gösteriyorsa, kumaş sahnesindeki bir anlık geride kalış modelin tamamını yeniden fiyatlamaz; tersine, %40 fatura ve %60 önbellek anlatısı abonelik ekonomisinde daha belirleyici hale gelebilir.

Sınırlar açık: örneklem dar — her modelden tek üretim, maksimum efor ayarı tek bir noktada, rüzgar ve yırtılma dışında kuvvet parametresi yok ve hız ölçümü yaklaşık 20 dakikaya karşı yaklaşık bir saat gibi yuvarlanmış sürelerle aktarılıyor. Ayrıca 5.5 ve Sol/Luna etiketleri resmi model kartıyla doğrulanmamış , bu yüzden fiyat kartı karşılaştırması Opus 5'in $5/$25 ve 1M pencere resmiyle, performans karşılaştırması ise bağımsız iş akışı ve ajan ölçümleriyle üçgenlenmeden eksik kalır.

Pratik çıkarım, fiyattan çok üretim hattına bakmak. Uzun oturumlarda önbellek isabetini artırmak, eforu göreve göre kalibre etmek ve 1 saatlik yazımı yalnızca gerçekten uzun beklemelerde kullanmak , videodaki indirimleri gerçeğe yaklaştırır. Model seçiminde ise tekil fizik demosuna göre değil, kendi iş yükünüzde yeniden üretilebilir bir görevde iki modelin süre, jeton ve çıktı kalitesini yan yana koşarak karar verin; aksi halde ucuz görünen önbellek, gerçek kullanımda pahalı yazıma dönüşebilir.

Kaynaklar

7 bağlantı; 2 tanesi 4 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

opus 5.5 · gpt-6 · yapay zeka · fiyat · önbellek · kumaş simülasyonu · fizik

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…