Gündeme dön

Aynı Etiket Farklı Fatura: Haiku 5.5 ile Luna Düellosu

Uğur Keşkekçi aynı üç görevi Haiku 5.5 ile GPT-6 Luna modeline veriyor; liste ücreti aynı çıkıyor ama 12 koşunun faturası ile süresi iki modelin maliyet mantığını baştan yazıyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — GOzxwIEBVGc
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Liste ücreti aynı, fatura aynı değil. Anthropic 7 Ekim 2026 günü Haiku 5.5 modelini tanıttı ve 100 bin jeton eşiğinin altındaki işlerde birim ücretleri 10 kat aşağı çekti: milyon başına $0.10 giriş ve $0.50 çıkış . Eşik aşılınca tarife 5 katına çıkıyor ($0.50 ve $2.50) ve Anthropic ortalamada %75 maliyet avantajı vadediyor. Bu bilgi Anthropic kaynağından elde edilmiştir ve tanıtım günü yayımlanan resmi duyuru yazısıyla doğrulanmıştır.

OpenAI tarafında GPT-6 Luna kısa bağlamda milyon başına $0.10 ve $0.50 yazıyor; yani liste ücreti Haiku ile kuruşu kuruşuna aynı, uzun bağlamda ise $0.20 ve $0.75 ile çok daha sakin artıyor. Bu bilgi OpenAI kaynağından elde edilmiştir ve güncel ücret tablosundaki kısa ile uzun bağlam sütunlarıyla doğrulanmıştır. Ama ArtificialAnalysis ekibinin ölçümü kritik bir ayrıntı ekliyor: Haiku görev başına yaklaşık 162 bin çıkış jetonu tüketirken Luna 50 binde kalıyor, yani Haiku benzer zeka skoruna yaklaşık 3 kat jeton ile ulaşıyor. Bu bilgi ArtificialAnalysis kaynağından elde edilmiştir ve zeka endeksi görevlerindeki jeton sayımlarıyla desteklenmiştir.

Oda testinde iki model de sade kalıyor

İlk görevde yapımcı odasının dört ayrı açıdan çekilmiş fotoğraflarını iki modele de verip Three.js ile gezilebilir bir oda yazmalarını istiyor. Haiku 32 dakikada 355 bin jeton tüketip işi $1.48 maliyetle bitiriyor, Luna aynı işi $0.18 düzeyinde tamamlıyor. İki çıkış da sade kalıyor; Luna tarafında koltuk ile masa yönleri karışıyor, Haiku ise biraz daha esnek bir yerleşim kuruyor. Tek komutluk 3B dünya üretimlerini puanlamanın neden zor olduğu arXiv üzerinde yayımlanan WorldBench çalışmasında da anlatılıyor. Bu bilgi arXiv kaynağından elde edilmiştir ve çalışmadaki yürüt-kağıdı karma değerlendirmesiyle doğrulanmıştır.

Üreticinin kendi skor tablosu Haiku modelini her satırda Luna modelinin önüne koyuyor: bilgi-iş ölçümünde 1620'ye 1437, bilgisayar kullanımında %72.4'e %48.9, terminal yazılımında %39.2'ye %16.4, görsel yorumlamada %46.4'e %29.1. Bağımsız tarafta ArtificialAnalysis zeka endeksinde Haiku modeline 43 puan , Luna modeline 38 veriyor ve Haiku modelini küçük sınıfın zirvesine yerleştiriyor. DataCamp incelemesi ise perde arkasını veriyor: beklenen Haiku 5 hiç gelmedi, bir yıl aradan sonra doğrudan 5.5 geldi ve aile Opus 5.5 modelinden iki hafta, Sonnet 5.5 modelinden dokuz gün sonra tamamlandı. Bu bilgi DataCamp kaynağından elde edilmiştir ve sürüm takvimi anlatısıyla doğrulanmıştır.

Medeniyet kurgusunda eski yapılar yıkılmıyor

İkinci görev taş devrinden geleceğe uzanan bir medeniyet kurgusunu tek komutla canlandırmak. Haiku modeli 35 dakikada $2.68 karşılığında piramitlerden ortaçağa akan hoş bir ön yüz çıkarıyor ama yeni yapı yükselirken eski yapıları yıkmayı akıl edemiyor; Luna tarafı da aynı noktada takılıyor, eski yapılar içerde kalıp yeniler dış çembere diziliyor. Büyük modellerin kendi çıktısını test edip düzelttiği yerde küçük modellerin bu öz-denetimi yapamadığı görülüyor. Yapımcının bu görev sınıfı için hükmü net: günlük e-posta, özet, rapor ve tablo okuma gibi hacimli işler bu modellerin evi, 3B kurgu üretimi değil.

Arenada iki modelin yazdığı robot yazılımları karşı karşıya geliyor; yüzü aşkın karşılaşmanın sonunda Haiku modeli açık ara önde bitiriyor ve yapımcının aktardığı skor 156'ya 45 yazıyor. Muhakeme ile strateji tarafında Haiku modelinin üstünlüğü net. Ama Opus 5.5 modeli en düşük efor ayarıyla bile ikisini de geride bırakıyor; Sonnet modelinin düşük eforda başa baş bir düello çıkarıp çıkaramayacağı ise test dışı kalıyor. Bu tablo Firecrawl karşılaştırmasındaki saptamayla da örtüşüyor: Anthropic yazılım yardımcısı uçbirim döngüsünde derinleşirken OpenAI ürünü daha geniş bir yüzeye yayılıyor ve tercih göreve göre yapılıyor. Bu bilgi Firecrawl kaynağından elde edilmiştir ve yüzey ile korumalı alan karşılaştırmasıyla doğrulanmıştır.

Üçüncü görev hayali bir akıllı kupa için satış sayfası hazırlamak. Haiku modeli sıcak tonlarda, kendi marka renklerini taşıyan, fiyat ile sık sorulan sorular ve ön sipariş paneli içeren düzgün bir sayfa çıkarıyor ama bölüm ölçüleri rastgele büyüyor, upuzun bir telefon görseli ile uyumsuz aralıklar puanı kırıyor. Luna modeli marka yazı tipleriyle daha derli toplu, her çözünürlükte dengeli bir sayfa kuruyor; ürün adı tercihi de ilginç: Haiku tarafı Cor, Luna tarafı Cora diyor. Süre 13 dakikaya 4 dakika , maliyet $0.88 düzeyine $0.04 düzeyinde Luna lehine yazılıyor. Bonus koşuda Sonnet 5.5 modeli aynı komutu 30 dakikada $4.76 ile bitirip daha canlı, hareketli bir sayfa çıkarıyor; tek komutta gelen bu seviye küçük modellerde 10-15 komutla bile zor yakalanır.

12 koşunun faturası teoriyi bitiriyor

Günün faturası teoriyle pratiğin farkını kapatıyor: 12 koşunun toplamında Haiku modeli $12.5 düzeyinde, Luna modeli $0.81 düzeyinde kalıyor; süre 287 dakikaya 93 dakika yazılıyor. Farkın iki motoru var: Haiku modeli 100 bin jeton eşiğini aştığı için 5 katlı tarifeye giriyor, ayrıca görev başına Luna modelinin yaklaşık 3 katı jeton tüketiyor. Bu bilgi Claude kaynağından elde edilmiştir ve ücret tablosundaki eşik üstü satırlarla doğrulanmıştır.

Kim hangisini alsın? Ayda $20 düzeyinde paket kullanan biri için günlük işlerde iki model de fazlasıyla yetiyor; e-posta yazımı, özet, raporlama ile dosya düzenleme gibi hacimli işlerde küçük model tercihi bütçeyi koruyor. Kapsamlı projelerde ise Sonnet ile Sol sınıfı daha tutarlı sonuç veriyor; yapımcının ilkesi net: paranın yettiği en iyi modeli al, ucuz model peşinde koşarak 10-15 komutluk dolambaçlı yollara sapma.

Son söz liste ücreti ile gerçek maliyetin aynı şey olmadığı. Haiku 5.5 modeli düşük-orta efor ayarıyla hacimli işlerde sessiz bir güç; 1M jetonluk bağlam penceresi ile uyarlanabilir düşünme desteği onu Haiku 4.5 modelinden ayrı bir lige taşıyor. Luna modeli ise jeton cimrisi yapısıyla uzun koşularda bütçe dostu kalıyor. İki model de 100 bin jeton altındaki işlerde cep yakmıyor; eşik üstünde Luna modelinin sakin tarifesi öne geçiyor.

Görsel: nodesdaily AI
KonuSonuç
Liste ücretiİkisi de $0.10 ve $0.50, eşik altı
12 koşu faturasıHaiku $12.5, Luna $0.81 düzeyinde
Süre287 dakikaya 93 dakika, Luna önde

Videodaki anahtar anlar

  1. Aynı ücret iddiasıyla açılış
  2. Fotoğraflardan oda görevi
  3. Medeniyet kurgusu koşuyor
  4. Robot yazılımları arenada
  5. Akıllı kupa sayfası görevi
  6. Sonnet bonus koşusu
  7. Gerçek fatura açıklanıyor

AI yorumu

"Beni en çok şaşırtan liste ücreti ile gerçek maliyetin bu kadar açılabilmesi oldu. Aynı etikete bakıp karar veren biri 15 kat farkla karşılaşıyor; bu yazıda faturanın neden şiştiğini sayı sayı izah ediyorum."

AI değerlendirmesi

En güçlü itiraz ölçümlerin kaynağında. Skor tablolarının çoğu Anthropic duyurusundan geliyor ve üretici tablosunda yeni modelin eskisini ezmesi şaşırtıcı değil. Bağımsız tarafta ArtificialAnalysis Haiku modelini zirveye koyarken jeton oburluğunu aynı cümlede söylüyor; otomasyon görevlerindeki düşük skorun ise aşırı reddetme sorunundan kaynaklandığı ve düzeltme sonrası yeniden ölçüleceği notu düşülüyor.

Videoda istatistiksel ciddiyet yok: her görev üçer kez koşulup en iyi sonuç gösteriliyor, varyans ile ortalama raporlanmıyor. Arena kuralları ile puanlama ölçütü kapalı kutu; oda ile sayfa görevlerinde görsel yargı tek kişinin gözüne kalıyor. Yazılım kalitesi için test kapsamı, erişilebilirlik ya da hız ölçümü gibi nesnel ölçütler kullanılmıyor.

Yapımcının çıkarı abone tutan düello formatında: aynı komut, yan yana sonuç, sonda fatura. Bu format gerilimi seviyor ama büyük modeller lehine biten her test küçük modelleri haksız yere çöp gibi gösterebiliyor. Yine de 12 koşunun faturasını açık paylaşması ve lafı süslemeden sayıya dayandırması bu tür içerikte az görülen bir şeffaflık taşıyor.

Benim çıkarımım eşiğe göre: 100 bin jeton altındaki toplu işlerde Haiku 5.5 modeli hızı ile fiyatı birleştiriyor; eşik üstü uzun koşularda Luna modelinin tarifesi ile cimri jeton yapısı kazanıyor. Satış sayfası gibi tek komutluk ön yüz işlerinde Luna, muhakeme ağırlıklı robot kurgularında Haiku önde. Bütçe varsa Sonnet sınıfı tek komutta bitiriyor; yoksa küçük model ile kısa komutlar, dar kapsam ve sık kontrol en akıllı yol.

Kaynaklar

8 bağlantı; 3 tanesi 6 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

yapay zeka · claude · gpt · jeton maliyeti · yazılım araçları

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

Kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…