On iki bin dolarlık bir kutu ocak ayına kadar gelmeyecekse, soru fiyatı değil sırayı değiştirir: önce satın alıp sonra öğrenmek yerine, saatliği iki dolara kiralayıp öğrenip sonra karar vermek. Konuşmacı da tam bunu yapıyor; yeni Mac Studio M5 Ultra için hevesli olduğunu saklamıyor ama cüzdanı açmadan önce kiralanmış 96 GB'lık bir ekran kartı üzerinde 27-32 milyar parametre sınıfı açık ağırlıklı bir modeli üç gerçek işte sınıyor. Sonuç ezber bozan türden: yerel model yavaş ama iş görüyor, asıl mesele hangi işi hangi modele vereceğini bilmek. Bu yazı o testin sırasını izliyor; rakamları da Apple, Nvidia ve güncel mağaza listeleriyle doğruluyor.
Kiralık 96 GB ile sorulan 12 bin dolarlık soru
Deneyin sahnesi Vast.ai: konuşmacı RTX Pro 6000 donanımlı bir örneği saatliği yaklaşık 1,5-2 dolara kiralıyor, kullanmadığında duraklatıp silebiliyor; tıpkı DigitalOcean'daki bir sunucu gibi. GPUTable'a göre aynı kartın spot fiyatı 0,29-0,67 dolar, isteğe bağlı fiyatı 0,94-1,49 dolar aralığında; Vast.ai'nin kendi listesinde de benzer bantlar görülüyor, RunPod'un güvenli bulutunda fiyat 2,09 dolara kadar çıkıyor. Yani videodaki 2 dolar, güvenli tarafta makul bir üst bant. Kurulumu da kendisi yapmıyor; Codex'in bilgisayar kullanımı marifetiyle Vast hesabına bağlanıp Open Code içinde özel model olarak tanımlatıyor. Bu detay önemli çünkü yerel model testinin önündeki teknik duvarı yıkıyor: kiralama, kurulum ve koşma üçü de birkaç adıma iniyor.
Neden 96 GB? Çünkü bu ağırlık sınıfının giriş bileti bu. Videoda adı Quinn diye duyulan model aslında Alibaba'nın Qwen ailesinden; ResearchAudio'ya göre Qwen3 32B, 32K bağlamda INT4 nicemleme ile yaklaşık 28 GB, BF16 ile 83 GB istiyor; Ollama'da Q4_K_M kalıbı yaklaşık 20 GB ile iniyor. Yani nicemlemeyle 96 GB bu model için bol oda demek; tam hassasiyette bile sınırda sığıyor. Apple'a göre M5 Ultra'da 96 GB seçeneği yaklaşık 7.300 dolardan başlıyor, 256 GB yapılandırması 12 bin dolar bandına tırmanıyor. Konuşmacının 96 GB'lık RTX Pro 6000'i seçmesi tesadüf değil: iki adayın bellek miktarı aynı, böylece düello denk koşullarda yapılıyor.
Üç gerçek iş testi
İlk iş, müşteri destek e-postası: dağınık bir yardım masası çıktısı, katı kurallar, konu satırı zorunluluğu. Konuşmacı aynı girdiyi yerel modele ve o günün en yeni sınır modeline veriyor; Anthropic'e göre Opus 5.5, 22 Eylül 2026'da çıkmış, kodlama ve aracı işlerde güçlenmiş, tipik iş yükünde bir öncekine göre yaklaşık yüzde 40 daha ucuza koşan bir model. Sonuç berabere: yerel model 3 dakika 12 saniyede aynı hükme varıyor; bir aylık iade ya da veriye erişim rehberliği. Hız farkı büyük, hüküm farkı yok. Destek kuyruğu gibi beklemeye dayanıklı işlerde bu tablo, kiralık yerel modelin yeterince iyi olduğunu gösteriyor.
İkinci iş, pazartesiden cumaya 20 saatlik üretim planı: bütçe artığı, sponsor dengesi, cumaya patlayan acil iş, çekim ve altı LinkedIn gönderisi. Yerel model burada da aynı iskeleti kuruyor; 22 saatlik çizelge demiyorum, 22 saatlik takvim, yasak listesi, yükleniciye mesaj, bilinmeyenler listesi. Dikkat çekici olan, modelin bilmediğini uydurmak yerine açık soru sorması. Konuşmacının altını çizdiği asenkron aracı fikri burada doğuyor: sen başında beklemeyeceksen yavaşlık kusur olmaktan çıkıyor; gece 2'de gider sınıflandıran, kanal denetimi yapan, ay sonu kapatan bir aracı için 3 dakika ile 30 saniye arasındaki fark anlamsızlaşıyor.
Buradan bir zihin modeli çıkıyor: etkileşimli şekillendirme işleri (ürünü yoğurma, kampanya yazma, gerçek zamanlı kodlama) hızlı sınır modellerinde; rutin, yinelenen, zamana duyarsız işler yerel modelde. Konuşmacı Hermes ve OpenClaw gibi aracı düzeneklerini sayıyor; Open Code'u ise bilerek en kötü vitrin olarak kullanıyor: oturulup beklenecek bir sohbet kutusu, yavaş modelin en zayıf göründüğü yer. Buna rağmen sonuçlar denk çıkınca tez güçleniyor: vitrin değişirse, yani model arka planda çalışan bir aracıya bağlanırsa, yerel modelin değeri katlanıyor. Üçlü gerekçe de net: maliyet, gizlilik, sahiplik.
M5 Ultra'yı özel yapan şey kapasite değil bant
Apple'a göre M5 Ultra, iki M5 Max'in tek pakette birleşimi; bellek bant genişliği 1,2 TB/sn ile M5 Max'in 614 GB/sn değerinin neredeyse iki katı. Birleşik bellek 96, 256 ve 512 GB seçenekleriyle geliyor; 512 GB seçeneği ekim sonunu buluyor. Konuşmacının heyecanı da burada: daha fazla gigabayt değil, saniyede belleğe girip çıkan veri miktarı. Yerel model çıkarımında belirleyici olan bu sayı; kapasite sığar mı sorusunu, bant genişliği ne hızda akar sorusunu yanıtlıyor. Bu ağırlık sınıfı için 96 GB yetiyor; hızı belirleyen, o belleğe hangi hortumla bağlandığın.
Donanım cephesinde üç yol var ve üçü de aynı 96 GB'a farklı faturayla varıyor. Nvidia'ya göre RTX Pro 6000, 96 GB ECC GDDR7 bellek, 1.792 GB/sn bant, 600 W güç ve 4.000 TOPS yapay zekâ işlem gücüyle masaüstü sınıfının tepesi. B&H Photo (bhphotovideo) listesinde kart 10.499 dolar görünüyor; videoda geçen 15.670 dolarlık fiyat, stok ve satıcıya göre değişen anlık bir değer olarak okunmalı, güncel liste daha düşük. İkinci yol, 32'şer GB'lık üç RTX 5090'ı birleştirmek: Newegg'e göre tek kart 5.300-9.800 dolar aralığında, üçlü toplam 18 bin doları aşıyor; üstüne kasa, ağ bağlantısı ve kartlar arası aktarım hızı kaygısı ekleniyor. Üçüncü yol, Mac Studio'nun birleşik belleği: her şey tek havuzda, taşıma derdi yok. Tek kart sadeliği ile ölçeklenebilir üçlü arasındaki seçim aslında bir tercih: arıza yüzeyi mi, taşıma hızı mı.
Tuzak soru ve üçüncü hakem
Üçüncü test bir tuzak: tek seçenekli pazarlama tavsiyesi isteniyor, uydurma oran yasak, eksik sayıya bilinmiyor yazılacak. Burada sınır modeli açık ara kazanıyor. Konuşmacı iki çıktıyı üçüncü bir modele hakem diye veriyor; dört ölçüt: kısıta bağlılık, matematik doğruluk, akıl yürütme gücü, kanıta dayalı tavsiye. Hakemin hükmü: Opus, bilinmeyen bilinmeyendir kuralına uyuyor, deneysel mantığı sağlam, Meta ile YouTube tekrarını ayıklıyor; yerel model ise birkaç desteksiz varsayımda bulunuyor. Skor iki beraberlik, bir yenilgi. Ama konuşmacının sorusu isabetli: bu kalite farkı hangi işlerde parayı hak ediyor?
Maliyet hesabı deneyi kapatıyor: konuşmacı on dolarlık kredinin yaklaşık 2,82 dolarını harcıyor; 12 bin dolarlık kutu ise hafta sonları ve geceleri atıl bekleyecek. Günde birkaç saatlik gerçek kullanımda kiralama, satın almanın küçük bir kesrine bile ulaşmıyor. Üstelik kiralık kart, satın alma kararından önce bir prova işlevi görüyor: model sınıfı büyürse tek kartta sıkışmak ile birleşik bellekte genişlemek arasındaki farkı görmeden 12 bin dolar bağlanmıyor. Gizlilik ve sahiplik de cabası: veri dışarı çıkmıyor, jeton ücreti yok, deneme neredeyse bedava.
Hüküm: hangi kutu, kime
Konuşmacı 12 bin dolarlık M5 Ultra'yı almıyor; gözü yaklaşık 7 bin dolarlık 128 GB'lık M4 Mac Studio'da: yarı fiyat, daha çok bellek, daha yavaş ama asenkron işte yavaşlığın hükmü yok, üstüne 4 TB disk. Tavsiyesi de bir kural: bir saatliğine Vast.ai'den kirala, 2 dolara Open Code ya da Hermes düzenekli yerel modeli gerçek işine bağla, neyi boşaltabildiğini gör, sonra karar ver. Görsel üretim, ses dökümü, video kurgu ve bilgisayar kullanımı gibi işler de yerel modellere taşınabilir; gelecek bölümlerin konusu bu. Kısacası tez şu: önce kirala, ölç, sonra al; alacaksan da gösterişe değil, bant genişliği ile bellek matematiğine bak.
| Seçenek | Fiyat | Bellek | Bant |
|---|---|---|---|
| M5 Ultra 256 GB | ~12.000 $ | 256 GB birleşik | 1,2 TB/sn |
| RTX Pro 6000 | 10.499 $ + kasa | 96 GB GDDR7 | 1,79 TB/sn |
| 3x RTX 5090 32 GB | ~18.000 $+ | 96 GB toplam | PCIe darboğazı |
| Vast.ai kiralık | ~2 $/saat | 96 GB | istek üzerine |
Videodaki anahtar anlar
- 12 bin dolarlık soru: M5 Ultra ocaktan önce yok
- Vast.ai kurulumu: RTX Pro 6000 saatliği 2 dolar
- Codex kurulumu yapıyor, Open Code bağlanıyor
- Test 1: destek e-postası 3 dakikada berabere
- Test 2: 20 saatlik hafta planı denk çıkıyor
- Bant genişliği: 1,2 TB/sn iki katı hız
- Üç donanım yolu aynı 96 GB'a çıkıyor
- Tuzak soru: Opus kazanıyor, hakem Codex
- Hüküm: M4 128 GB ve 2 dolarlık prova kuralı
AI yorumu
"Kutuyu almadan önce kiralamak, bu yılın en akıllı donanım fikri olabilir. Konuşmacının 2 dolarlık deneyi, 12 bin dolarlık hevesi ölçülebilir bir karara indiriyor ve bence yerel model tartışmasını gösterişten matematiğe çekiyor."
AI değerlendirmesi
En güçlü itiraz, kiralanmış tek kart ile sahip olunan Mac'in aynı şey olmaması. Kiralık örnekte bulunabilirlik garantisi yok; spot örnekler geri alınabiliyor, yoğun saatte fiyat zıplıyor, veri merkezine giden veri gizlilik kazancını törpülüyor. Ayrıca 96 GB düellosu, 256 GB Mac'in alanını daraltıyor; daha büyük ağırlıklar gündeme geldiğinde bugünün beraberliği yarının darboğazı olabilir. Konuşmacı bunu açıkça tartışmıyor; test, tam da 96 GB'a sığan model sınıfında yapılıyor.
Ölçüm cephesi eksik: saniyede jeton, ilk jetona kadar süre, güç tüketimi, fan gürültüsü, toplam sahip olma maliyeti yok. Tek model sınıfı ve üç metin işi var; görsel üretim, ses dökümü, video kurgu ve bilgisayar kullanımı yalnızca mümkün diye geçiştiriliyor. Hakemlik de tek kör: üçüncü model aynı ailenin kuzeni olunca bağımsızlık iddiası zayıflıyor; Grok gibi dışarıdan bir hakem adı geçiyor ama puanı yok.
Konuşmacının çıkarı şeffaf: kutuyu gerçekten istiyor, sponsorluk şakasını da yapıyor. M4 övgüsü bu ışıkta okunmalı; uygun fiyat anlatısı izleyiciyi ucuz alternatife ısındıran bir çerçeve. Yine de deneyin parası cebinden çıkmış, yöntemi tekrarlanabilir, üçüncü testi bilerek kaybettirmiş; bu özdenetim anlatıyı tanıtımdan ayırıyor.
Okur için çıkarım bir kural: yerel modele taşınacak iş listesi yap, bir saatlik 2 dolarlık provayı gerçek işinle yap, hızı değil hüküm kalitesini ölç. Satın alma eşiği de net: haftada 20 saatten fazla kesintisiz yerel işin ve gizlilik zorunluluğun varsa kutu, yoksa kiralama. Benim hükmüm şu: bu deney, 12 bin dolarlık hevesi 2 dolarlık ölçüme indirgediği için değerli; donanım kararını gösterişten matematiğe çekiyor.
Kaynaklar
10 bağlantı; 1 tanesi 10 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @youtube.com YouTube — Craig Hewitt
- @apple.com Apple — Mac Studio Specifications
- @nvidia.com Nvidia — RTX Pro 6000 Blackwell
- @bhphotovideo.com B&H Photo — RTX Pro 6000 Listing
- @gputable.dev GPUTable — RTX Pro 6000 Rental Prices
- @vast.ai Vast.ai — RTX Pro 6000 Pricing
- @researchaudio.io ResearchAudio — Qwen3 GPU Requirements
- @ollama.com Ollama — Qwen3 32B Library
- @anthropic.com Anthropic — Claude Opus 5.5
Aynı kaynağı kullanan: Süperzeka yarışı: Musk ve Huang enerjiyi, yörüngeyi ve güvenli ajanları anlattı · Claude Opus 5.5: Fikirden Bitmiş İşe Tek Oturuşta Giden Yapay Zeka · Yapay Zekânın En Yoğun Haftası: Dünya Modelleri, Açık Ağırlıklar ve Uzayda Yapay Zekâ · OpenAI'nin "o" Asistanı, Claude Sonnet 5.5 ve MiniMax M3.1: DevDay Öncesi Üç Model Savaşı · Yapay Zeka Fiyat Savaşı: Opus 5.5, GPT-6 Sol ve Agent Dünyasının Sessiz Darboğazı · Aynı Gün Dört Lansman: Opus 5.5 Dönüşü ile GPT-6 Sol ve Luna Fiyat Devrimi · Karar Önce, Zekâ Sonra: Jev Artı Opus 5.5 Düzeni · Piyasa Gözden Kaçırıyor: Yapay Zekâda Dev Talep Dalgası ve Neo Bulutların Sessiz Rallisi · Opus 5.5'i 24 Kod Görevinde Test Ettim: Fable Seviyesinde, Yari Zamanda, Yari Maliyette · Claude Opus 5.5 Sahnede: Bir Saatte Ödüllü Site, 3D Uzay Yolculuğu ve Tek Panelde Tüm Hesaplar
- @newegg.com Newegg — RTX 5090 Listings
mac studio · rtx pro 6000 · yerel model · qwen · vast.ai · bellek bant genişliği