228. güne girerken tabloda iki sayı yazıyordu: 1 milyon dolarlık hedef ve 231 bin 260 dolarlık ARR. Yayıncı bunu saklamıyor, tam tersine her yayının başlığına koyuyor. Bence bu maraton formatının bütün çekiciliği burada: ilerleme herkesin gözü önünde ölçülüyor.
Günün ilk haberi sabah gelmişti: DeepSeek-V4.1-Flash çıkmıştı. Reuters da 10 Eylül tarihli haberiyle çıkışı doğruluyor ve modelin yeni mimari ailesinin en küçük üyesi olduğunu yazıyor. Yayıncı süreölçeri kurup modele bir saatlik canlı test ilan etti.
Yayın benchmax tablosuyla açıldı: DeepSeek-V4.1-Flash 74,2 puanla Opus 5 ve GPT-5.6 Sol modellerinin önünde görünüyordu. Sohbette espri patladı: benchmax yapmak başlı başına bir ölçüt olmalı. Ben bu espriyi ciddiye alıyorum, çünkü tabloyu gösteren de modeli satan tarafla aynı ekosistem.
Asıl test Bridgebench tarafında koştu. İlk deneme 3 dakika 28 saniyede bitti ve 3 sente mal oldu; aynı iş GPT-6 Astra ile 3 dakika 54 saniye sürüp yaklaşık 20 katına patladı. Yayıncı özellikle yansımalar ve tasarım kalitesine dikkat çekti, sohbet de aynı fikirdeydi.
Fiyat tarafını web kaynaklarıyla yan yana koydum. Yayında milyon token başına 15 ve 60 sent rakamları telaffuz edildi; teknoloji basını ise modelin rakiplerine göre yaklaşık 86 kat daha ucuza yarıştığını ve bellek ihtiyacını ciddi oranda düşürdüğünü yazıyor. Flash etiketi boşuna değil: bu segment hız ile fiyatın kesişimi.
Test düzeneği topluluktan geldi. Isaac adlı izleyicinin Minecraft istemi seçildi, modelden bir alt klasör açıp klonu oraya kurması istendi. Komutlar canlı verildi, bekleme süreleri kesilmedi. Bence bu formatın dürüstlüğü burada: hata da başarı da kayıtta.
Sonuç şaşırtıcıydı: Minecraft klonu yaklaşık 12 dakikada bitti ve toplam harcama 50 sentte kaldı. Yayıncı bunu bir flash modelden gördüğü en iyi sonuç diye niteledi. Muse Spark 1.3 ve Gemini 3.8 Flash denemelerinin zayıf kaldığını, buna karşılık Opus 5 ve GPT-5.6 Sol seviyesine çıkılamadığını da ekledi.
Karşılaştırma bununla bitmedi. Daha önce Muse 3 ile üretilmiş bir Minecraft sürümü Chrome tarayıcıda çalıştırılıp yan yana bakıldı. Eski sürümün hâlâ ayakta olması, tek atışlık başarıların arkasındaki tutarlılık sorusunu gündeme getirdi.
Yayının en sert cümleleri modele değil, çalışma ortamınaydı. Yayıncı DeepSeek tarafındaki hazır test ortamını sevmediğini açıkça söyledi. Devamında modelin tutarsızlığından ve yavaşlığından yakındı, hatta gerçek kod tabanına bu modeli yaklaştırmayacağını söyledi. Bence günün en dürüst anı buydu.
Bridgebench tarafında ayrı bir hikaye var: platformun üçüncü sürümü neredeyse hazırmış. Yayın iki saate yakın sürede 44 bin izlenmeye ulaşınca yayıncı, yeni sürümle birlikte bu ilginin gelire döneceğini söyledi. Test aracı ile içerik birbirini besliyor.
Araya başka denemeler de girdi: Sonnet modeline roket temalı bir istem verildi, dünkü test tekrar koşuldu. Sohbette kod kalitesi tartışması açıldı; yaygın görüş, bu tür görsel testlerin kalite hakkında fikir verdiği yönündeydi. Ben temkinliyim: güzel görünen ekran, temiz mimari demek değil.
Günün muhasebe bölümü epey açıktı. Yayıncı ayda yaklaşık 1.300 dolarlık yapay zeka aboneliği ödediğini söyledi. 15 bin dolarlık API kotasının hızla eridiğini, AWS faturasının ayda 1.000 doları bulduğunu, günlük token tüketiminin 1-2 milyar aralığında gezdiğini ekledi. Maratonun görünmez maliyeti bu.
Ürün cephesinde iOS derlemesi vardı. BridgeMind tarafının iPhone uygulaması için Apple hesabına girildi, AWS Amplify tarafındaki dağıtım hatasının nedeni incelendi. Canlı yayında hesaplara girilip hata ayıklanması, vibe-coding kültürünün alametifarikası artık.
En çok konuşulan an sayaçtı: ARR yayın sırasında 232 bin doları aşıp 233 bine dayandı. İkinci çeyrekte 70 bin dolar gelir ve 37 bin dolar net kâr açıklandı, kâr marjı yüzde 50'nin üzerinde. YouTube gelirlerinin bu sayaca dahil olmadığı özellikle vurgulandı.
Hedef de netleşti: eylül sonuna kadar 300 bin dolar. Yayıncı X tarafındaki destekçi kitlesinin tek gönderiyle 250 bin izlenme getirebildiğini söyledi. Topluluk burada pazarlama kanalı gibi çalışıyor.
Sesli asistan bölümü ürünün yönünü gösterdi. iOS tarafına uyandırma sözcüğü, masaüstündeki mevcut asistana dokunmadan komut verme fikri konuşuldu. Mevcut ses altyapısının pahalı olduğu, kullanıcı kredilerinin hızla tükendiği itiraf edildi.
Umut GPT Live ve gerçek zamanlı ses modellerine bağlanmış durumda. Yayıncı mevcut gerçek zamanlı modelleri zayıf bulduğunu saklamadı ama yeni sürümün asistanı baştan yazdırabileceğini söyledi. Bağımsız bir araştırmaya göre 4 bin oturumluk ölçümlerde dakika maliyetleri sanılandan çok farklı çıkıyor; fiyat konusu hâlâ sisli.
Yayın ritüelleri de formatın parçası: YouTube ve Twitch sohbetlerini birleştiren uygulama, arka plandaki çalışma müziği, izleyicilere hediye edilen ChatGPT Pro abonelikleri ve araya giren sponsor okuması. Bunlar dolgudan çok, topluluğu ayakta tutan mekanikler.
Model kimliklerini web ile teyit ettim. GPT-5.6 ailesi Luna, Terra ve Sol üyelerinden oluşuyor; Opus 5, rakibinin yarı fiyatına kodlamada eşleşme iddiasıyla çıkmış; GPT-6 Astra ise OpenAI amiral gemisi olarak Copilot tarafına da girmiş durumda. Yayındaki isimler hayal ürünü değil.
Test rakipleri de gerçek: Muse Spark 1.3 Meta tarafının, Gemini 3.8 Flash ise Google tarafının güncel duyuruları. Yani düello, o haftanın gerçek gündemiyle yapılmış. Bu, yayının tarihsel değerini artırıyor.
Daha iyi iddialarının haritasını şöyle çıkardım: benchmax tablosunda DeepSeek önde, Bridgebench görsel testlerinde fiyat-performans açık ara önde, ağır siklet genel yeteneklerde ise Opus 5 ve Sol çizgisi korunuyor. Üç farklı ölçüt, üç farklı kazanan; tek tabloyla anlatılamaz.
Kapanış GPT Live ve 5.6 Luna ile yapıldı. Yayıncı günün ilerlemesini büyük diye niteleyip çalışmayı ertesi güne bıraktı. Vedalaşma hızlıydı, sayaç 233 binde kaldı.
Benim genel çıkarımım şu: 228 gündür süren bu maraton, yapay zeka ekonomisinin iki yakasını aynı karede gösteriyor. Çıkarım ucuzluyor, orkestrasyon pahalılaşıyor; model bedavaya geliyor, onu ürüne çeviren emek ve altyapı ağıra patlıyor.
Aynı işin maliyeti
- V4.1 Flash3 sent
- GPT-6 Astra60 sent
| Model | Süre | Maliyet |
|---|---|---|
| DeepSeek V4.1 Flash | 3 dk 28 sn | 3 sent |
| GPT-6 Astra | 3 dk 54 sn | 60 sent |
AI yorumu
"Benim gözümde bu yayın bir model incelemesinden çok, tek kişilik bir yazılım işinin açık defteri gibiydi. Rakamlar havada uçuşuyor, testler canlı yapılıyor, sayaç herkesin önünde artıyor. Bu şeffaflık etkileyici; ama her canlı test gibi, alkış ile kanıt arasındaki çizgiyi de bulanıklaştırıyor."
AI değerlendirmesi
En güçlü itirazı ciddiye alıyorum: VentureBeat tarafının aktardığı Composio denemesinde, liderlik tablolarının zirvesindeki bir DeepSeek modeli, sekiz farklı çalışma ortamında koşulan 30 çetin ajan görevinin ancak yüzde 53,8'ini bitirebildi. 240 koşunun 129'u geçti, 30 iş akışının yalnızca altısı her ortamda tamamlandı. Yani 3 sentlik tek istemlik bir demo ile gerçek ajan işi arasında uçurum var; sonucu belirleyen ham modelden çok orkestrasyon. Bu yayın o uçurumun eğlenceli tarafını gösteriyor.
Metodolojide üç eksik görüyorum. Birincisi, canlı testler tek denemelik ve süre baskılı; sohbetin coşkusu sonucu etkiliyor. İkincisi, güvenlik boyutu hiç test edilmedi; oysa The Verge tarafının aktardığı vakada vibe-coding ile kurulan bir sitede aylar sonra SQL enjeksiyonu açığı yakalanmıştı. Üçüncüsü, eski bir DeepSeek sürümüne dair güvenlik testlerindeki yüksek başarısızlık oranları, temkinli olmak için ek gerekçe; eski sürüm bugünkü model değil ama ürün ailesinin sicili sayılır.
Doğrulanabilirlik tarafında dört soru işareti not ettim. Benchmax rakamları yayıncının kendi tablosundan geliyor, bağımsız tekrar koşu yok. Fiyat tarafında ise VentureBeat, DeepSeek tarafının V4 fiyatlarına zam yapacağını yazdı; bugünkü 3 sent yarının tarifesi olmayabilir. ARR ve kâr rakamları tamamen beyana dayanıyor. Milyar parametreli mimariye dair telaffuz edilen teknik detayları ise bağımsız kaynakta bulamadım, o yüzden bu yazıda tekrarlamıyorum.
Benim pratik hükmüm şöyle: deneme, prototip ve Bridgebench gibi görsel testler için bu sınıf modelleri ben de denerim; ucuzlar, hızlılar, eğlenceliler. Ama para kazandıran kod tabanını, müşteri verisini ve üretim dağıtımını emanet etmem; yayıncının kendi cümlesi burada rehberim. 228 gündür süren bu maratonun bana öğrettiği, modelin değil sistemin para ettiği.
Kaynaklar
12 bağlantı; 3 tanesi 21 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @YouTube BridgeMind — 228. gün yayını
- @Reuters https://www.reuters.com/world/asia-pacific/chinas-deepseek-launches-v41-flash-model-2026-09-10/
- @wccftech https://wccftech.com/deepseek-v4-1-flash-beats-openais-gpt-5-6-sol-and-anthropics-opus-5-on-coding-and-cyberse
- @OpenAI https://openai.com/index/gpt-6-astra/
Aynı kaynağı kullanan: Beyin ve Gövde: GPT-6 Astra ile Hermes Üzerinde Tek Ekranlık Ajan Düzeni · Space Bunny Alpha: Ücretsiz Gizli Yapay Zeka Deneyinin Perde Arkası · Robot Kullanım Ajanları: Genel Amaçlı Modeller Robot Kontrolünü Neden Kazanıyor · Base44 ve GPT-6 Astra ile Dakikalar İçinde Üretken Bir Kart Koleksiyon Uygulaması Oluşturmak · Fiyat Savaşı Başladı: GPT-6 Sol ve Luna ile Maliyetler Yarıya İndi · Gemini 4 Sızıntısı mı? GPT-6 Astra ve Fable 5.1 Karşısında 10 Etkileşimli 3D Testi · Gemini 4 Pro Sızdı, GPT-6 Soul Testte: Arena'dan Google Buluta Haftanın AI Sarsıntısı · 10 Bin Ajan, 88 Saat, 1 Milyon Dolar: AI Mastermind #39'un Kod, Para ve Otonomi Turu · Tek Promptla Kanal Klonlamak: GPT-6 Astra ve Higgsfield ile $33 Bin Vaatli Video Fabrikası · GPT-6 Astra Kullanım Rehberi: Yatay Güç ile İşi Bitiren Model · Eskizden Gerçekçi Villaya: GPT-6 Astra ve Higgsfield MCP ile Sunum Videosu · GPT-6 Astra ile Günde 500 Dolar İddiası: Üç İş Modelini Uçtan Uca Kurmak (+5)
- @Anthropic https://www.anthropic.com/news/claude-opus-5
Aynı kaynağı kullanan: Opus 5.5'in %40 daha ucuz iddiası ve GPT-6 ile kumaş simülasyonu: 20 dakikada gerçekçi fizik neden öne geçti · Claude Opus 5.5 Sahnede: Bir Saatte Ödüllü Site, 3D Uzay Yolculuğu ve Tek Panelde Tüm Hesaplar · Opus 5.5 İddiası: Anthropic Kodun Zirvesini, Fiyatı ve Üslubu Aynı Anda Zorluyor
- @Meta Research https://research.meta.ai/blog/introducing-muse-spark-1-3
Aynı kaynağı kullanan: Zuckerberg'in Muse Hamlesi: Herkese 7/24 Çalışan Kişisel Süper Zeka
- @Google Blog https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cybe
- @simonwillison.net https://simonwillison.net/2026/Jul/9/gpt-5-6/
- @BridgeMind https://www.bridgemind.ai/blog/tag/bridgebench
- @VentureBeat https://venturebeat.com/orchestration/deepseeks-top-ranked-v4-flash-stumbles-on-real-agent-tasks-as-its-prices-surge
- @The Verge https://www.theverge.com/ai-artificial-intelligence/950844/vibe-coding-security-risks-apps
- @hackernoon https://hackernoon.com/openai-realtime-api-pricing-in-2026-real-world-data-from-4000-measured-sessions
deepseek · vibe-coding · bridgemind · minecraft-klonu · gpt-6-astra · sesli-asistan · arr