Gündeme dön

DeepSeek V4.1 Flash ve Gemini 3.8 Flash Karşı Karşıya: Beş Promptluk Kodlama Düellosu

Ömer Göçmen'in karşılaştırma videosu, Eylül başında peş peşe çıkan iki flash modeli aynı ringe çıkarıyor: DeepSeek V4.1 Flash ve Gemini 3.8 Flash. Resmi skor kartları ve fiyatlar masaya konduktan sonra iki model beş uygulamalı promptla (lunapark, deprem uygulaması, tarayıcıda işletim sistemi, 2B planın 3B eve çevrilmesi, çiftlik oyunu) test ediliyor. Beklentisi DeepSeek'ten yana olan yazarın tercihi, testlerin sonunda Gemini'den yana dönüyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — kUOhikNvG9o
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

Eylül ayının ilk yarısı flash segmentine iki lansman sığdırdı: Google 2 Eylül'de Gemini 3.8 Flash'ı güvenlik odaklı Cyber varyantıyla duyurdu, DeepSeek ise 10 Eylül'de V4.1 Flash'ı yayıma alıp önceki flash sürümlerini emekliye ayırdı. Ömer Göçmen'in videosu tam bu kesişimde duruyor ve denk görünen iki modelden hangisinin günlük iş için daha isabetli seçim olduğunu beş uygulamalı testle yanıtlamaya çalışıyor.

Önce resmi skor kartı: DeepSeek'in API belgelerine göre V4.1 Flash, Terminal Bench 2.1'de 82.7, DeepSWE'de 54.4, Cybergym'de 76.7 ve Toolathlon'da 70.3 alıyor; model sınırlı süreli multimodal beta ile geldi ve API'de deepseek-flash adıyla çağrılıyor. Videodaki grafik okuması da bu tabloyla uyumlu: model açık ağırlıklı rakiplerinin önünde görünürken amiral gemisi seviyesinin biraz gerisinde kalıyor.

Mimari tarafında anlatı tanıdık: 552 milyar parametreli karışık-uzman yapısında her prompt için ağın tamamı değil token başına yaklaşık 8 milyar aktif parametre çalışıyor, hız da buradan geliyor. Fiyat tarafı üç kademeli: DeepSeek milyon token başına 0.15 dolar girdi ve 0.60 dolar çıktı isterken Gemini 3.8 Flash'ta bu rakamlar 0.75 ve 3.75 dolar; videodaki tabloda en pahalı koltukta 1.40 ve 4.40 dolarla GLM oturuyor. Gemini'nin tarifesi yıl sonuna kadar geçerli tanıtım oranı, yani bugünkü makas kalıcı olmayabilir.

Test düzeneği beş uygulamadan oluşuyor: 3B lunapark, deprem verisi uygulaması, tarayıcıda çalışan işletim sistemi, 2B planın 3B eve çevrilmesi ve çiftlik oyunu. DeepSeek OpenCode Go üzerinden yüksek ayarda, Gemini ise kendi sunucusu üzerinden koşturuluyor ve her test 10 üzerinden puanlanıyor. Puanlayıcının bizzat videonun yazarı olduğunu not düşeyim; yöntemin sınırlarına değerlendirme bölümünde döneceğim.

Lunapark testinde iki model de gündüz, gezi ve festival modlarını kuruyor; zorunlu dönme dolap ile hız treni ikisinde de var. Fark detayda açılıyor: Gemini trene binilebilir bir sürüş kamerası ekliyor, festival modunda havai fişekleri kendiliğinden katıyor ve fizik geçişlerini daha akıcı kuruyor. DeepSeek ise talimata harfiyen uyuyor ama talimatın bir harf dışına çıkmıyor; puanlar 8.5'e 7.8.

Deprem uygulamasında istatistik kartları iki tarafta da doğru; makası harita açıyor. Gemini Türkiye haritasını ve fay hatlarını istenir istenmez çiziyor, şehir ve büyüklük filtrelerini düzgün bağlıyor. DeepSeek tarafında harita ülkeyi andırmaktan uzak kalıyor; sonuç 8.3'e 7.9.

Tarayıcı içi işletim sistemi testinde Gemini renkli bir masaüstü, çalışan dosya yöneticisi ve gerçekten kaydeden bir not defteri çıkarıyor. DeepSeek kurulumu ise soluk renkler, açılmayan dosyalar ve kaydetmeyen notlarla geride kalıyor; yazarın kendisi de sorunun modelden çok OpenCode uyumundan kaynaklanabileceğini söylüyor. Bu turda Gemini 8.2 alıyor.

2B planı 3B eve çevirme işinde iki model de duvar, oda etiketi ve kamera kontrollerini kuruyor. DeepSeek mobilyaları yanlış yönlere ve yanlış odalara yerleştirirken Gemini daha az hata yapıp oda oda gezinme gibi ekstralar katıyor. Puanlar 7.7'ye 7.3 ile yine Gemini lehine.

Finaldeki çiftlik oyunu zaman, altın, tohum, işçi ve market ekonomisini tek promptta istiyor ve makas burada en çok açılıyor. Gemini 3'e 3 arazi, derli toplu yerleşim ve alım-satım geri bildirimleriyle oyunu hissettirirken DeepSeek 2'ye 2 arazide ve üst üste binen panellerle kalıyor. Skor 8.3'e 7.3.

Videonun genel hükmü net: beklentisi DeepSeek'ten yana olan yazar, beş testin sonunda Gemini 3.8 Flash'ı öneriyor ve Antigravity ile birlikte denenmesini salık veriyor. Fiyat parantezini açık tutarak bitireyim: DeepSeek yaklaşık beş kat ucuz ve açık ağırlıklı; bu tabloyu yalnızca videodaki puanlarla değil kendi iş yükünüzde iki kısa denemeyle doğrulamak en sağlıklısı.

Görsel: nodesdaily AI

AI yorumu

"Flash segmentindeki tempo beni şaşırtıyor: altı haftada üç Flash sürümü çıkaran Google bir yanda, eski modellerini emekli edip tek isimde birleşen DeepSeek öbür yanda. Bu videoyu seçmemin sebebi skor tablolarından çok, modellerin tek promptla gerçek uygulama kurarken izlenmesi; rakamlar vitrin, asıl hikaye ekran kaydında. Yine de tek videoyla hüküm vermem, değerlendirme bölümünde nedenini anlatıyorum."

AI değerlendirmesi

Önce DeepSeek'in avukatlığını yapayım: resmi skorları bağımsız ölçümlerde de üst segmentte geziyor, fiyatı rakibinin beşte biri ve MIT lisanslı açık ağırlıkları sayesinde modeli kendi donanımınızda koşturabiliyorsunuz. Üstelik videodaki test, yazarın kendi itirafıyla DeepSeek'in sevmediği bir ajan iskeleti üzerinde yapıldı; aynı promptlar farklı bir koşumda farklı sonuç verebilir.

Yönteme gelince tablo zayıf: tek deneme, kör puanlama yok, örneklem beş prompt ve puanlayıcı videonun sahibi. Satıcıların kendi testlerinde hep kazanmasını eleştiren bağımsız yazılar boşuna değil; daha çarpıcısı, DeepSeek'in dahili Terminal Bench skoru ile bağımsız koşu arasında 9 puanlık fark ölçülmüş olması. Resmi grafikler vitrin, karar bağımsız koşularla verilir.

Doğrulanabilirlik tarafında iki tarih notu: Gemini'nin 0.75 ve 3.75 dolarlık tarifesi yıl sonuna kadar geçerli bir tanıtım oranı, DeepSeek ise sınırlı süreli betadan yeni çıkmış durumda. GLM fiyatları da plana ve döneme göre değişiyor; videodaki rakamları bugünkü tarifelerle karşılaştırmadan cebe koymayın. Ve unutmayın: izlediğiniz bir laboratuvar raporu değil, bir içerik üreticisinin uygulamalı izlenimi.

Benim çıkarımım şu: bütçe ve veri özerkliği önceliğinizse DeepSeek ile başlayın, tek promptla görsel ve işlevsel prototip peşindeyseniz Gemini'yi deneyin. İkisini de tek videoya göre kilitlemeyin; aynı işi iki modele de verip çıktıyı kendi gözünüzle karşılaştırmak on dakika sürer ve her testten ucuzdur.

Kaynaklar

10 bağlantı; 1 tanesi 2 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

deepseek · gemini · kodlama · benchmark · fiyat performans · yapay zeka

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…