Gündeme dön

Jev 300 Kararda Test Edildi: Yapay Zekâ Alım-Satım Laboratuvarı Gerçeği Açığa Çıkardı

The Fintech Builder, TypeSafe'in yapısal karar modeli Jev'i beş piyasada 300 noktada canlı bir laboratuvarda test etti: 90 mum, 15 tipli soru ve kendi stop-hedefin yönettiği işlemler. Sonuç %50 isabet ve kritik bir tutarlılık açığı.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — FPhDl_MwT8U
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

TypeSafe'in Jev'i sohbet etmiyor, yazı üretmiyor; geliştiricinin önceden tanımladığı şemaya göre tipli ve olasılıklı kararlar döndürüyor. The Fintech Builder'ın laboratuvarı tam da bu fikri alıp piyasaya taşıyor: her karar noktasında modele 90 günlük mum, işlem kuralları ve 15 tipli soru gönderiliyor, hepsi tek çağrıda paralel yanıtlanıyor. Şirketin kendi iddiasına göre 70–500 milisaniyede dönen bu 'System One' mimarisi, token başına 4.2 sent giriş ve sıfır çıkış fiyatıyla yüz kat daha hızlı ve ucuz olmayı hedefliyor — fakat video, hızın doğruluğa otomatik olarak çevrilmediğini gösteriyor.

Laboratuvar nasıl kuruldu: 5 piyasa, 300 nokta, 90 mum

Deney iki yıla yayılmış 300 kesit üzerinde kurulu: NVIDIA, JP Morgan, Exxon, Bitcoin ve altın ETF'si GLD'de her biri 60 nokta. Her kesitte Jev yalnızca kapanışa kadar olan 90 günlük mumu görüyor, sonrası tamamen gizli. Ölçüm bilerek sade tutulmuş: işlem ertesi gün açılıştan giriyor, stop, hedef ve taşıma süresi modelin kendi cevaplarından geliyor ve en fazla sekiz bara kadar taşınıyor. Maliyet her yönde beş baz puan, büyüklük 10 bin dolar. Kritik kural ise şu: model stop için 'uygulanmaz' derse işlem stopsuz koşuyor, kimse cevabı elle düzeltmiyor. Her kesit aynı ufukta salt al-tut olarak da skorlanıyor, böylece aktif kararın getirisi çıplak beta ile karşılaştırılabiliyor.

Jev'in döndürdüğü şey tek bir kelime değil, bir paket. Bir seçim sorusu her seçenek için olasılık veriyor — örneğin uzun %62, işlemsiz %31, kısa %7, seçime güven %44 gibi. Bir evet-hayır sorusu 'kurulum var mı, %59' diye olasılığa dönüşüyor, bir skor sorusu ise 6 üzerinden 3.65 gibi bir ölçeğe oturuyor. Son beş soru tam bir planı oluşturuyor: yön, giriş biçimi, stop, hedef ve taşıma süresi. Her cevap tipli olduğu için geriye dönüp piyasayla bire bir doğrulanabiliyor. Video bu paketin iç tutarlılığını kodla denetliyor; hiçbir API katmanı cevapları birbirine zorla uyumlu hale getirmiyor.

En iyi kare, 30 Eylül 2025 kapanışına ait. Jev %62 olasılıkla uzun diyor, güven %44, diğer okumalar da aynı yöne bakıyor: güçlü boğa eğilimi, güçlü momentum, sağlam kurulum algısı ve eksiksiz plan — %2 stop, %3 hedef, üç bara kadar taşı. Ertesi açılış 185.24'ten alınıyor, iki bar sonra hedef geliyor: maliyet sonrası %2.9, yaklaşık 290 dolar. Aynı sekiz barlık pencerede al-tut %1.2 kaybettiriyor. Karar, okuma ve plan aynı hikâyeyi anlattığında Jev'in ne kadar temiz çalışabildiğini bu örnek özetliyor — fakat videonun büyük kısmı bu uyumun istisna olduğunu anlatıyor.

Genel skor: çok pas, az işlem, kafa kafaya isabet

Toplamda Jev 300 kararın 254'ünde pas geçiyor, yani zamanın yaklaşık %85'inde piyasada değil. Geriye 46 işlem kalıyor, tam ortadan bölünmüş: 23 kazanan, 23 kaybeden. Net sonuç %3.82, 382 dolar, kâr faktörü 1.06, işlem başına %0.08. Dürüst karşılaştırma için aynı kesitlerde her kapanışta alıp sekiz bar tutmak 17 bin doların üzerinde bir toplam üretiyor — elbette sermaye her kesitte yeniden işe koşulduğu için toplam adil değil. İşlem başına bakıldığında bile al-tut %0.59 ile Jev'in %0.08'ini geride bırakıyor. Eğri Kasım 2025'teki tek bir Bitcoin kısa pozisyonunda zirve yapıp sonra 2 bin dolardan fazla geri veriyor. Bu dalgalanma, az sayıda işlemle gelen varyansın ne kadar yüksek olduğunu hatırlatıyor.

Piyasa bazında tablo daha da parçalı. NVIDIA yedi işlemde dördünü kazanmasına rağmen iki kısa pozisyon yüzünden 1.100 dolar kaybettiriyor. JP Morgan ve Exxon ilk 108 kararda toplamı eksi 1.400'e çekiyor. Bitcoin tek başına hikâyeyi taşıyor: 300 kesitte al-tutun zarar yazdığı tek pazar burası ve Jev burada 963 dolar üretiyor. Altın ETF'si GLD ise on işlemde yedi galibiyetle kapanışı kurtarıyor. Bitiş çizgisinde 12 işlem hedefe ulaşıyor, 15'i stopa çarpıyor, 19'u süre dolduğu için kapanıyor. Uzunlar 900 dolar kazandırırken kısalar 518 dolar götürüyor. Detaylar, yön seçiminin getiri dağılımını nasıl çarpıttığını gösteriyor.

Güven skoru neden ters çalıştı?

Güvene göre kademelendirme ters köşe yapıyor. %35'in altındaki güvenle alınan işlemler ortalama %1 kazanırken, %50'nin üzerindekiler ortalama %3.1 kaybediyor ve Jev hiçbir işlemi %55'in üzerinde güvenle almamış. Kazananla kaybeden arasında güven 32'ye karşı 34, 'kurulum var' olasılığı her ikisinde de 47 — yani modelin kendi özgüven ve kurulum sinyalleri iyi ile kötüyü ayırmıyor. Video, laboratuvarda indirgenmiş pilotun da aynı uyarıyı verdiğini hatırlatıyor: sadece mumlarla ve 10 indikatör eklenmiş halde Apple'da 12 kesitte denenen iki koşum, 12 kararın yalnızca dördünde hemfikir kalıyor ve hepsi de 'işlem yok' diyor. İndikatör eklenince dört uzun birden kısa'ya dönüyor ve dördü de stopa çarpıyor, zarar 118 dolardan 840 dolara sıçrıyor.

Videonun en keskin bulgusu iç çelişki. Aynı çağrı içindeki 15 cevabı çapraz kontrol eden yedi kuraldan altısı vaka yakalıyor. 46 işlemin 32'si model 'kurulum muhtemelen yok' derken alınmış, 21'i 'belirsizlik nedeniyle pas geç' sinyali varken açılmış, dokuzunda stop hiç yok. En çarpıcı olanı ise 16 işlemde hedef yok — ve bunlar tam olarak 16 kısa pozisyonun kendisi. Her kısada giriş biçimi, hedef ve taşıma süresi 'uygulanmaz' dönüyor; plan adeta 'işlem yapma' diyor. Yön cevabı her zaman açılan tarafa eşlik ediyor ama planın geri kalanı yönle kavga ediyor. Laboratuvar hiçbirini yamamıyor, bu yüzden sonuçlar ham halde kalıyor.

İki işlem bu desenin hem en kötüsünü hem en iyisini aynı kalıpta gösteriyor. 30 Mart 2026'da NVIDIA'da %40 güvenle açılan kısa, güçlü ayı okumasına rağmen stopsuz, hedefsiz ve sekiz bar taşıma ile gidiyor; piyasa yükselince kayıp %13.07 ile serinin en kötüsü oluyor. Aynı 'stopsuz, hedefsiz, pas geç sinyali yüksek' profili 13 Kasım 2025'te Bitcoin'de %70 'pas geç' sinyaline rağmen kısa olarak açılıyor ve Bitcoin sekiz günde %15'e yakın düşünce %14.55 getiriyle serinin en iyisi oluyor. En güvenli kısa denemesi 13 Mart 2025'te JP Morgan'da %55 güven ve %96 ayı sinyaliyle geliyor ama hisse %10 yükselince %10.19 kayıp yazıyor. Çelişkisiz 12 işlem %6.36 kazanırken, en az bir çelişki taşıyan 34 işlem toplamda %2.54 kaybettiriyor — fark, uyumun getiri üzerindeki ağırlığını netleştiriyor.

Madde yalnızca işlemde değil, pas kararında da aynı. Jev 45 kez 'işlem yok' derken aynı anda bir yön ve eksiksiz plan seçiyor — 10 Şubat 2025'te NVIDIA'da %52 'işlem yok' kararına eşlik eden %62 uzun plan, %2 stop %3 hedef ve iki-üç bar taşıma bunun tipik örneği. Pasın isabeti de zayıf kalıyor: işlemden sonra fiyat sekiz bar içinde ortalama %4.15 hareket ederken, pas sonrası da %3.84 hareket ediyor; yani model kenarda kaldığında piyasa neredeyse aynı ölçüde oynuyor. Bu pencerede %5 ve üzeri 65 büyük hareket kaçıyor — 39 yukarı, 26 aşağı. 18 Ağustos 2026'da %76 güvenle pas geçilen Bitcoin, sonraki sekiz günde %22 yükseliyor. Video bu yüzden 'dikkatli ama isabetli değil' teşhisini koyuyor ve bir sonraki adım olarak hem indikatörlü tam koşumu hem de sembol-tarihi gizleyen kör testi planlıyor: amaç Jev'in grafiği mi okuduğunu yoksa tarihi mi hatırladığını ayırmak.

Görsel: nodesdaily AI

Videodaki anahtar anlar

  1. Jev'in verdiği tipli paket: olasılık, güven ve tam planHer soru tipli döner; olasılıklar ve plan birlikte test edilebilir.
  2. Örnek işlem: 30 Eylül 2025'te uzun ve hedefte kapanışKarar, okuma ve plan aynı yöne baktığında en temiz sonuç geliyor.
  3. Genel tablo: 254 pas, 46 işlem, %50 isabet
  4. Çelişki deseni: her kısada hedef yok, plan 'işlem yapma' diyor16 kısa pozisyonun 16'sında da hedef ve giriş biçimi uygulanmaz.

AI yorumu

"Benim gözümde bu video, 'model konuştu, biz uyguladık' döneminin bittiğini ilan ediyor. Jev hızlı ve ucuz, fakat aynı çağrı içindeki cevapları birbirini denetlemediğinde tek bir starsız short, dört iyi işlemi silebiliyor."

AI değerlendirmesi

En güçlü haliyle video, 'tek cevap yeter' varsayımını çürütüyor. Jev'in tipli mimarisi her soruyu ölçülebilir kılıyor ve bu ölçüm, en iyi işlemde görülen uyumun — yön, güven, kurulum ve planın aynı yöne bakması — neden nadir olduğunu açıklıyor. Hız ve maliyet iddiası da bu bağlamda anlam kazanıyor: saniyenin onda biri içinde dönen bir karar, kod içinde çapraz doğrulamaya tabi tutulabiliyorsa değerli; aksi halde aynı hızla hatalı bir plana da kilitleniyor. Steelman budur: Jev'i bir sohbet modeli gibi değil, bir 'akıllı if' katmanı gibi kullanmak.

Sınırlar da net. Geriye dönük test, 90 mumun ötesinde haber akışı, seans içi likidite ve kayma modellemesi olmadan tek bir varlıkta al-tut ile yarışıyor; 46 işlemlik örneklem, güven aralıklarını geniş tutmayı gerektiriyor. Video, 15 soruluk şemayı TypeSafe ekibine geri bildirim olarak götüreceğini söylüyor ama şema tasarımının kendisi de bir hiperparametre — stopu 'uygulanmaz' döndüren bir modelin stopsuz koşması, tasarım seçimidir, kader değil. Ayrıca pilotun gösterdiği indikatör duyarlılığı, durum temsilinin sonuç üzerindeki etkisini hatırlatıyor; aynı model, aynı kesitte farklı temsille taban tabana zıt karar verebiliyor.

Pratik çıkarım, tek bir olasılığı doğrudan işleme çevirmemek. 12 uyumlu işlemin %6.36'sı ile 34 uyumsuzun –%2.54'ü arasındaki makas, basit bir uzlaştırma katmanının bile getiriyi değiştirebileceğini düşündürüyor. Yön ile plan çeliştiğinde pas geçmek, stop 'uygulanmaz' ise pozisyonu küçültmek veya reddetmek, güveni tek başına sıralayıcı olarak kullanmamak gibi kurallar, laboratuvarda kodla uygulanabilir ve geriye dönük olarak test edilebilir. Video, 'güven yüksekse daha çok risk' refleksini özellikle uyarıyor; burada yüksek güven ortalaması kaybettirmiş.

Son söz, beklentiyi hizalamakla ilgili. Jev halüsinasyon üretmiyor iddiası, şema dışına taşmama garantisine indirgeniyor; doğru karar garantisi değil. 300 kararlık bu koşum, modelin grafiği mi yoksa takvimi mi okuduğunu henüz ayırmıyor — kör test bu boşluğu kapatmak için gerekli. Bu haliyle Jev, yazı yazan bir asistanın yerini almıyor; yazının hiç gerekmediği, yalnızca sınıflandırma, yönlendirme ve eşikleme gereken dar koridorlarda, iyi yazılmış bir orkestrasyonla anlam kazanıyor.

Kaynaklar

6 bağlantı; bunları kullanan başka yayımlanmış haber yok. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

jev · typesafe · borsa · al-sat · backtest · yapay zeka trading

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…