DeepSeek bu sürümle yazısız bir kuralı bozdu: Flash diye anılan model, bir süreliğine amiral Pro tarafına giden işi üstleniyor. 14 Eylül 2026 saat 04.00 UTC itibarıyla Pro istekleri yeni Pro gelene kadar Flash tarifesiyle V4.1 Flash tarafına yönleniyor. Bu ucuz trafiğin yan seçeneği değil; bir süre ana hattın Flash rozeti takması demek.
Eski hiyerarşi basitti. V4 Pro jeton başına 49 milyar aktif parametreyle 1,6 trilyon parametrelik ağır sıkletti, azami güç istenince seçilen modeldi. V4.1 Flash 552 milyar parametrelik gövdeyle geliyor, daha küçük ama hâlâ devasa. O yüzden manşet parametre sayısı değil işin her aşamasında modelin ne kadarının uyandığı.
İşin özü asimetrik Nedensel Kodlayıcı-Kod Çözücü ayrımı. Kabaca okuma ve yazma farklı ekiplerde: okurken istemi, kod tabanını ve araç çıktılarını yaklaşık 8 milyar aktif parametre düzenliyor, yanıt yazılırken ve sıradaki araç çağrısı seçilirken yaklaşık 16 milyar parametre devralıyor. Zihinsel resim şu: bir ekip devasa dosyayı ayıklıyor, damıtılmış parçaları planı yazan daha güçlü ekibe veriyor.
Tasarım kirasını bellekten ödüyor. Uzun ajan işleri işlenmiş bağlamın büyüyen kaydını biriktiriyor ve pencere milyon jetona uzadıkça bu kaydı taşımak pahalılaşıyor. DeepSeek jeton başına yaklaşık 890 baytlık genel önbellekten söz ediyor, önceki nesle göre aktif bellekte yaklaşık dörtte bir, kalıcı depolamada sekizde bir. Küçük önbellek demek canlı koşu başına daha az yüksek bantlı bellek, oturum başına daha az SSD alanı ve ajan eski malzemeye dönerken daha az tekrar iş demek.
Sonra tablolar geliyor. Videonun aktardığına göre Terminal-Bench 2.1 tarafında Flash 90,6 alırken Claude Opus 5 tarafı 89,1 ve GPT-5.6 Sol tarafı 88,8 alıyor; DeepSWE tarafında 74,2 sayısı 74,0 ve 73,0 sayılarının önünde; AutomationBench tarafında makas 54,8 sayısına karşı 50,3 ve 45,8 ile açılıyor. Erken bağımsız sinyaller dokuyu tamamlıyor: bir zekâ endeksi Flash tarafını 40 puanla kendi Prosunun 36 puanının üstüne ama yerli rakiplerin altına koyuyor, bir tasarım arenası ise bitmiş iş başına çok düşük maliyetle pahalı kapalı modelin bir buçuk puan yakınına yerleştiriyor.
Model yalnız çalışmıyor, Harness güncellemesi bu yüzden önemli. DeepSeek Harness tarafını beynin çevresindeki her şey diye çerçeveliyor: araçlar, dosyalar, kabuk erişimi, planlama, alt ajanlar, oturumlar, depolama, zamanlama. Yeni sürüm iş ortasında sistem talimatı değişince pahalı bağlamı yaşatıyor, önbellek isabeti ve jeton istatistiklerini daha görünür kılıyor, isteğe bağlı alt ajan çalışma ortamlarını tazeliyor. 0.1.5 sürümü dosya yükleme ve yan panel önizlemeleriyle Harness tarafını koşucudan günlük tezgâha taşıyor.
Açık ağırlıklar ve MIT lisansı tabloyu tamamlıyor ama videonun açıkça söylediği bir şartla. Geliştirici denetim, desteklenen çıkarım yığınları ve tek kapalı API tarafına kilitlenmeme kazanıyor ama gövdenin tamamı standart bir dizüstünün çok ötesinde bir yerde yaşamak zorunda. Karar üçe ayrılıyor: API tarafında kuran uzun ajanlar için daha ucuz bir okuyucu alıyor, altyapı ekibi ciddi donanım bedeliyle kontrol alıyor, her işe tek şampiyon arayan ise taç kanıtı değil cephe sohbetine üyelik kanıtı alıyor. Bu sürümün tezi asimetri: okumanın izin verdiği yerde ucuz, kararın gerektirdiği yerde güçlü ol.
| Test | V4.1 Flash | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|
| Terminal-Bench 2.1 | 90,6 | 89,1 | 88,8 |
| DeepSWE | 74,2 | 74,0 | 73,0 |
| AutomationBench | 54,8 | 50,3 | 45,8 |
AI yorumu
"Benim okumam şu: asıl hamle yüksek skor değil, ucuz okuma. Uzun ajan işlerinin çoğu bağlam taşımaksa okumayı ucuza, kararı pahalıya yapmak doğru asimetri; ama üretim trafiğini bağımsız tekrarlar satıcı tablosunu doğrulamadan yönlendirmem."
AI değerlendirmesi
En güçlü itirazı kurmak zor değil: bunlar bir amirali emekliye ayırmayı haklı çıkarmak için yayımlanmış satıcı tabloları ve aynı sürümün DeepSWE bandının çevresindeki koşuma göre yüzde 65,5 ile 74,2 arasında gezdiği aktarılıyor. Bağımsız sinyaller şimdilik karışık: bir endeks Flash tarafını 40 puanla kendi Prosunun 36 puanının önüne ama iki yerli rakibin gerisine koyuyor, bazı incelemeler program ağırlıklı ve fen ağırlıklı kümelerde zayıf noktalara işaret ediyor. Bu tablo sürümü boş yapmaz ama manşet skorları kesin hüküm değil geçici not yapar.
Videonun test etmediği kısım da önemli: dağınık gerçek repolarda uzun ufuklu kararlılık, saatler süren işlerde değişen ara talimatlara dayanıklılık, sürekli ajanlarda normal ve indirimli dönem faturası, güvenlik incelemesi verisi. Harness güncellemesi bunun bir kısmını önbelleği koruyan talimat değişimi ve daha görünür önbellek istatistikleriyle kapatıyor ama istatistiğin görünmesi bir aylık üretim arızasının ölçülmesi demek değil. Bellek ve depolama oranlarını da lansman metnindeki dörtte bir ve sekizde bir oranlarıyla değil tarafsız bir kurulumun sayacıyla görmek isterim.
Kaynağın konumu her rakamı nasıl okuduğumu belirliyor. DeepSeek skorları, Pro isteklerinin yeni Pro gelene kadar Flash tarifesine taşınacağı duyurusuyla birlikte yayımladı ve iş ortakları şimdiden yeni modelin arkasına dizildi. O yüzden taşıma öncesi tekrar listem kısa: Terminal-Bench tekrarını sabit bir koşum sürümünde koş, tek satıcı tablosu yerine bağımsız endekse bak, normal ve indirimli dönem canlı fiyatlarını sağlayıcıdan doğrula, lansman metni yerine Harness sürüm notlarını oku. Bu elekten geçen rakam trafiği hak eder, geçemeyen slaytta kalır.
Benim pratik hükmüm üç parçalı. Kod ajanı kuruyorsan Flash kontrollü denemeyi hak ediyor çünkü okuma artı önbellek maliyet yapısı uzun koşuların birim ekonomisini değiştiriyor. Kendi donanımında çalıştırmak istiyorsan MIT lisansı kontrol veriyor ama 552 milyar parametrelik gövde ciddi hızlandırıcı donanımı istiyor, yani kontrol gerçek ama ucuz değil. Her işe tek en güçlü model arayana ise bu sürüm bir şey kapatmıyor; Flash tarafını cephe ajanlar masasına oturtuyor, fazlası değil eksiği değil.
Kaynaklar
9 bağlantı; 3 tanesi 4 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @youtube DeepSeek V4.1 Flash — bölüm videosu
- @deepseek.com https://www.deepseek.com/en/news/deepseek-v4-1-flash/
Aynı kaynağı kullanan: DeepSeek V4.1 Flash'in Çılgın Mimarisi: Paylaşımlı Hafızayla 437 Kat Küçülen KV · DeepSeek V4.1 Flash’ta Ayrılan Beyin: 890 Baytlık Notlarla Sınır Modellerine Meydan · Yapay Zeka Tier Listesi Sıfırlandı: GPT-6 Astra Zirvede, Abonelik Matematiği Dengeleri Değiştirdi · DeepSeek V4.1 Flash: Ucuz, Hızlı, Açık — Ama Test Masasında Pürüzlü
- @huggingface.co https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
Aynı kaynağı kullanan: DeepSeek V4.1 Flash'in Çılgın Mimarisi: Paylaşımlı Hafızayla 437 Kat Küçülen KV
- @techtimes.com https://www.techtimes.com/articles/327163/20260910/deepseek-v41-flash-cuts-agent-memory-costs-fourfold-new-architecture.htm
- @orcarouter.ai https://www.orcarouter.ai/blog/deepseek-v4-1-new-base-model
Aynı kaynağı kullanan: DeepSeek V4.1 Flash: Ucuz, Hızlı, Açık — Ama Test Masasında Pürüzlü
- @technode.com https://technode.com/2026/09/10/deepseek-releases-harness-0-1-5-with-v4-1-flash-support-file-uploads-and-sidebar-previews/
- @kingy.ai https://kingy.ai/blog/deepseek-v4-1-flash-local-hardware-requirements/
- @decrypt.co https://decrypt.co/377917/deepseek-openai-gpt-6-astra-design-benchmark
- @gate.com https://www.gate.com/news/detail/deepseek-v41-flash-achieves-40-point-intelligence-score-costs-7x-less-than-24185950
deepseek · v4.1 flash · kod ajanları · skorlar · açık ağırlık · harness