Gündeme dön

228. Gün: 12 Dakikada Minecraft, 3 Sentlik Model ve 233 Bin Dolarlık ARR

BridgeMind yayıncısı, 1 milyon dolar hedefli vibe-coding maratonunun 228. gününde sabah çıkan DeepSeek-V4.1-Flash modelini süreli teste soktu: 3 sentlik ilk deneme, 12 dakikada biten bir Minecraft klonu, yayında 232 binden 233 bin dolara çıkan ARR sayacı ve sesli asistan planları. Ben bu yayını, ucuz çıkarım ile pahalı orkestrasyon arasındaki gerilimin canlı bir kaydı olarak okudum.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — ufmw2YoqBM8
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

228. güne girerken tabloda iki sayı yazıyordu: 1 milyon dolarlık hedef ve 231 bin 260 dolarlık ARR. Yayıncı bunu saklamıyor, tam tersine her yayının başlığına koyuyor. Bence bu maraton formatının bütün çekiciliği burada: ilerleme herkesin gözü önünde ölçülüyor.

Günün ilk haberi sabah gelmişti: DeepSeek-V4.1-Flash çıkmıştı. Reuters da 10 Eylül tarihli haberiyle çıkışı doğruluyor ve modelin yeni mimari ailesinin en küçük üyesi olduğunu yazıyor. Yayıncı süreölçeri kurup modele bir saatlik canlı test ilan etti.

Yayın benchmax tablosuyla açıldı: DeepSeek-V4.1-Flash 74,2 puanla Opus 5 ve GPT-5.6 Sol modellerinin önünde görünüyordu. Sohbette espri patladı: benchmax yapmak başlı başına bir ölçüt olmalı. Ben bu espriyi ciddiye alıyorum, çünkü tabloyu gösteren de modeli satan tarafla aynı ekosistem.

Asıl test Bridgebench tarafında koştu. İlk deneme 3 dakika 28 saniyede bitti ve 3 sente mal oldu; aynı iş GPT-6 Astra ile 3 dakika 54 saniye sürüp yaklaşık 20 katına patladı. Yayıncı özellikle yansımalar ve tasarım kalitesine dikkat çekti, sohbet de aynı fikirdeydi.

Fiyat tarafını web kaynaklarıyla yan yana koydum. Yayında milyon token başına 15 ve 60 sent rakamları telaffuz edildi; teknoloji basını ise modelin rakiplerine göre yaklaşık 86 kat daha ucuza yarıştığını ve bellek ihtiyacını ciddi oranda düşürdüğünü yazıyor. Flash etiketi boşuna değil: bu segment hız ile fiyatın kesişimi.

Test düzeneği topluluktan geldi. Isaac adlı izleyicinin Minecraft istemi seçildi, modelden bir alt klasör açıp klonu oraya kurması istendi. Komutlar canlı verildi, bekleme süreleri kesilmedi. Bence bu formatın dürüstlüğü burada: hata da başarı da kayıtta.

Sonuç şaşırtıcıydı: Minecraft klonu yaklaşık 12 dakikada bitti ve toplam harcama 50 sentte kaldı. Yayıncı bunu bir flash modelden gördüğü en iyi sonuç diye niteledi. Muse Spark 1.3 ve Gemini 3.8 Flash denemelerinin zayıf kaldığını, buna karşılık Opus 5 ve GPT-5.6 Sol seviyesine çıkılamadığını da ekledi.

Karşılaştırma bununla bitmedi. Daha önce Muse 3 ile üretilmiş bir Minecraft sürümü Chrome tarayıcıda çalıştırılıp yan yana bakıldı. Eski sürümün hâlâ ayakta olması, tek atışlık başarıların arkasındaki tutarlılık sorusunu gündeme getirdi.

Yayının en sert cümleleri modele değil, çalışma ortamınaydı. Yayıncı DeepSeek tarafındaki hazır test ortamını sevmediğini açıkça söyledi. Devamında modelin tutarsızlığından ve yavaşlığından yakındı, hatta gerçek kod tabanına bu modeli yaklaştırmayacağını söyledi. Bence günün en dürüst anı buydu.

Bridgebench tarafında ayrı bir hikaye var: platformun üçüncü sürümü neredeyse hazırmış. Yayın iki saate yakın sürede 44 bin izlenmeye ulaşınca yayıncı, yeni sürümle birlikte bu ilginin gelire döneceğini söyledi. Test aracı ile içerik birbirini besliyor.

Araya başka denemeler de girdi: Sonnet modeline roket temalı bir istem verildi, dünkü test tekrar koşuldu. Sohbette kod kalitesi tartışması açıldı; yaygın görüş, bu tür görsel testlerin kalite hakkında fikir verdiği yönündeydi. Ben temkinliyim: güzel görünen ekran, temiz mimari demek değil.

Günün muhasebe bölümü epey açıktı. Yayıncı ayda yaklaşık 1.300 dolarlık yapay zeka aboneliği ödediğini söyledi. 15 bin dolarlık API kotasının hızla eridiğini, AWS faturasının ayda 1.000 doları bulduğunu, günlük token tüketiminin 1-2 milyar aralığında gezdiğini ekledi. Maratonun görünmez maliyeti bu.

Ürün cephesinde iOS derlemesi vardı. BridgeMind tarafının iPhone uygulaması için Apple hesabına girildi, AWS Amplify tarafındaki dağıtım hatasının nedeni incelendi. Canlı yayında hesaplara girilip hata ayıklanması, vibe-coding kültürünün alametifarikası artık.

En çok konuşulan an sayaçtı: ARR yayın sırasında 232 bin doları aşıp 233 bine dayandı. İkinci çeyrekte 70 bin dolar gelir ve 37 bin dolar net kâr açıklandı, kâr marjı yüzde 50'nin üzerinde. YouTube gelirlerinin bu sayaca dahil olmadığı özellikle vurgulandı.

Hedef de netleşti: eylül sonuna kadar 300 bin dolar. Yayıncı X tarafındaki destekçi kitlesinin tek gönderiyle 250 bin izlenme getirebildiğini söyledi. Topluluk burada pazarlama kanalı gibi çalışıyor.

Sesli asistan bölümü ürünün yönünü gösterdi. iOS tarafına uyandırma sözcüğü, masaüstündeki mevcut asistana dokunmadan komut verme fikri konuşuldu. Mevcut ses altyapısının pahalı olduğu, kullanıcı kredilerinin hızla tükendiği itiraf edildi.

Umut GPT Live ve gerçek zamanlı ses modellerine bağlanmış durumda. Yayıncı mevcut gerçek zamanlı modelleri zayıf bulduğunu saklamadı ama yeni sürümün asistanı baştan yazdırabileceğini söyledi. Bağımsız bir araştırmaya göre 4 bin oturumluk ölçümlerde dakika maliyetleri sanılandan çok farklı çıkıyor; fiyat konusu hâlâ sisli.

Yayın ritüelleri de formatın parçası: YouTube ve Twitch sohbetlerini birleştiren uygulama, arka plandaki çalışma müziği, izleyicilere hediye edilen ChatGPT Pro abonelikleri ve araya giren sponsor okuması. Bunlar dolgudan çok, topluluğu ayakta tutan mekanikler.

Model kimliklerini web ile teyit ettim. GPT-5.6 ailesi Luna, Terra ve Sol üyelerinden oluşuyor; Opus 5, rakibinin yarı fiyatına kodlamada eşleşme iddiasıyla çıkmış; GPT-6 Astra ise OpenAI amiral gemisi olarak Copilot tarafına da girmiş durumda. Yayındaki isimler hayal ürünü değil.

Test rakipleri de gerçek: Muse Spark 1.3 Meta tarafının, Gemini 3.8 Flash ise Google tarafının güncel duyuruları. Yani düello, o haftanın gerçek gündemiyle yapılmış. Bu, yayının tarihsel değerini artırıyor.

Daha iyi iddialarının haritasını şöyle çıkardım: benchmax tablosunda DeepSeek önde, Bridgebench görsel testlerinde fiyat-performans açık ara önde, ağır siklet genel yeteneklerde ise Opus 5 ve Sol çizgisi korunuyor. Üç farklı ölçüt, üç farklı kazanan; tek tabloyla anlatılamaz.

Kapanış GPT Live ve 5.6 Luna ile yapıldı. Yayıncı günün ilerlemesini büyük diye niteleyip çalışmayı ertesi güne bıraktı. Vedalaşma hızlıydı, sayaç 233 binde kaldı.

Benim genel çıkarımım şu: 228 gündür süren bu maraton, yapay zeka ekonomisinin iki yakasını aynı karede gösteriyor. Çıkarım ucuzluyor, orkestrasyon pahalılaşıyor; model bedavaya geliyor, onu ürüne çeviren emek ve altyapı ağıra patlıyor.

Görsel: nodesdaily AI

Aynı işin maliyeti

  • V4.1 Flash3 sent
  • GPT-6 Astra60 sent
Yayıncının testindeki harcama; tek deneme.
ModelSüreMaliyet
DeepSeek V4.1 Flash3 dk 28 sn3 sent
GPT-6 Astra3 dk 54 sn60 sent

AI yorumu

"Benim gözümde bu yayın bir model incelemesinden çok, tek kişilik bir yazılım işinin açık defteri gibiydi. Rakamlar havada uçuşuyor, testler canlı yapılıyor, sayaç herkesin önünde artıyor. Bu şeffaflık etkileyici; ama her canlı test gibi, alkış ile kanıt arasındaki çizgiyi de bulanıklaştırıyor."

AI değerlendirmesi

En güçlü itirazı ciddiye alıyorum: VentureBeat tarafının aktardığı Composio denemesinde, liderlik tablolarının zirvesindeki bir DeepSeek modeli, sekiz farklı çalışma ortamında koşulan 30 çetin ajan görevinin ancak yüzde 53,8'ini bitirebildi. 240 koşunun 129'u geçti, 30 iş akışının yalnızca altısı her ortamda tamamlandı. Yani 3 sentlik tek istemlik bir demo ile gerçek ajan işi arasında uçurum var; sonucu belirleyen ham modelden çok orkestrasyon. Bu yayın o uçurumun eğlenceli tarafını gösteriyor.

Metodolojide üç eksik görüyorum. Birincisi, canlı testler tek denemelik ve süre baskılı; sohbetin coşkusu sonucu etkiliyor. İkincisi, güvenlik boyutu hiç test edilmedi; oysa The Verge tarafının aktardığı vakada vibe-coding ile kurulan bir sitede aylar sonra SQL enjeksiyonu açığı yakalanmıştı. Üçüncüsü, eski bir DeepSeek sürümüne dair güvenlik testlerindeki yüksek başarısızlık oranları, temkinli olmak için ek gerekçe; eski sürüm bugünkü model değil ama ürün ailesinin sicili sayılır.

Doğrulanabilirlik tarafında dört soru işareti not ettim. Benchmax rakamları yayıncının kendi tablosundan geliyor, bağımsız tekrar koşu yok. Fiyat tarafında ise VentureBeat, DeepSeek tarafının V4 fiyatlarına zam yapacağını yazdı; bugünkü 3 sent yarının tarifesi olmayabilir. ARR ve kâr rakamları tamamen beyana dayanıyor. Milyar parametreli mimariye dair telaffuz edilen teknik detayları ise bağımsız kaynakta bulamadım, o yüzden bu yazıda tekrarlamıyorum.

Benim pratik hükmüm şöyle: deneme, prototip ve Bridgebench gibi görsel testler için bu sınıf modelleri ben de denerim; ucuzlar, hızlılar, eğlenceliler. Ama para kazandıran kod tabanını, müşteri verisini ve üretim dağıtımını emanet etmem; yayıncının kendi cümlesi burada rehberim. 228 gündür süren bu maratonun bana öğrettiği, modelin değil sistemin para ettiği.

Kaynaklar

12 bağlantı; 3 tanesi 21 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

deepseek · vibe-coding · bridgemind · minecraft-klonu · gpt-6-astra · sesli-asistan · arr

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…