Gündeme dön

Grok 4.7 Geldi: Aynı Fiyat, Daha Uzun Ufuk — 20 Üretimde Saha Testi

xAI'ın 21 Eylül 2026'da yayınladığı Grok 4.7, Grok 4.6 ile aynı 2 dolar giriş ve 6 dolar çıkış fiyatında kalırken uzun ufuklu kodlama ve ajan testlerinde belirgin kazanım sunuyor; 20 farklı üretimle yapılan saha denemesi, ucuz ve hızlı ama detayda hâlâ temkinli bir tablo çiziyor.

Nodesdaily’e aktarım: (UTC+03:00)
YouTube'da izle — 6Rfk1P98q74
Okuma seçenekleri

Bu tarayıcıda cihazdan sesli okuma kullanılamıyor.

Kavram merceği

Bu görünümde geçen teknik kavramlardan birini seç. Genel tanımı, öğretici örneği ve haberdeki kullanımını birlikte oku.

Bu görünümde sözlüğümüzdeki kavramlardan biri bulunmadı. Sözlük henüz tüm terimleri kapsamıyor.

21 Eylül 2026'da xAI, Grok 4.7 'yi sessiz ama iddialı bir güncelleme olarak yayınladı; videoda SpaceX AI diye anılan yapı aslında xAI , modelin adı da videonun yazdığı gibi Grock değil Grok. Sunucu Julian Goldie, son haftalarda Grok ailesiyle 20'den fazla üretim yaptığını söyleyip yeni sürümü kendi Agent OS tezgahı ve Goldiebench sahasında sınıyor. İlk izlenimim şu: bu sürüm devrimden çok, aynı ticari paketin daha dirençli bir eğitimi — fiyat aynı, ufuk daha uzun. Tıpkı aynı iskeleyle bir kat daha çıkmak gibi, fatura değişmeden dayanıklılık artıyor.

Aynı Fiyatla Daha İyi Skorlar

Lansman notlarının harmanlandığı LLM Stats derlemesine göre Grok 4.7 aynı fiyat ve aynı 500 bin token bağlam sınıfında kalıyor: 200 bin altı isteklerde 2 dolar giriş / 0.50 dolar önbellekli giriş / 6 dolar çıkış (milyon token başına), 200 bin üstünde tüm istek 4 / 1 / 12 dolara geçiyor. Skorlarda ise uzun ufuklu testler öne çıkıyor: CursorBench 4.0 'ta 40.4'ten 46.3% 'e, DeepSWE 'de 65.2'den 71.0% 'e, Terminal-Bench 4.0 'ta 20.3'ten 38.0% 'e, EEBench 'te 60'tan 66.0% 'e yükseliş var; tablo tamamen xAI kaynaklı ve henüz bağımsız doğrulama bekliyor. Tıpkı inşaat iskelesi gibi, model aynı iskeleyi kullanıp daha uzak kata tırmanıyor; örneğin 10 sayfalık bir kod deposunu tek seferde yorumlatmak istersen, aynı fatura kaleminde daha az kayma yaşıyorsun. Bu sırada metin ve görsel alıp metin üreten yapı korunuyor; bilgi kesimi Haziran 2026 , ek veriler Ağustos 2026 'ya uzanıyor.

Bu kazanımın arkasında daha sert bir eğitim diyeti var — duyuru, Grok 4.7'nin aynı fiyat etiketinde daha inatçı bir öğrenme gördüğünü söylüyor. Modelin en pratik yeniliği muhakeme eforu (reasoning effort) ayarı: dört seviye var — low, medium, high, xhigh — varsayılan high . Tıpkı bir marangozun zımpara kademesi gibi, düşükte hızlı ve ucuz, yüksekte yavaş ama derin çalışıyorsun; başlık skorlarının çoğu xhigh 'te raporlanmış, bu da token-per-task hesabını yeniden ölçmeyi gerektiriyor. Örneğin basit bir özet düşükte ucuza biterken, çok adımlı ajan döngüsü xhigh'te daha fazla token yakıyor; varsayılan bütçe her görevde aynı kalmıyor.

Bağlam penceresi 500 bin ile sınıf değiştirmiyor; Grok 4.6 ile aynı ligde. Lansman metni ayrıca fast varyantı anıyor: iki kat fiyat, iki kat çıkış hızı — ama dokümanlar yayın anında yalnızca grok-4.7 kimliğini listeliyor, ayrı bir hızlı kimlik henüz görünmüyor. Pratikte şu demek: 200 bin token eşiği bir uçurum; kısa promptta standart tarife, uzun promptta tüm istek pahalı dilime geçiyor. Geliştirici için akılcı yol, high 'te başla, darboğaz uzunsa xhigh 'e çık ve token sayacını her seviyede ayrı ölç — varsayılan bütçeyle pazarlık bitmiyor. 500 bin 'lik pencere büyük görünür ama 200 bin üstünde fiyat da pencerede olduğu gibi iki katına çıkıyor; uzun sohbeti planlarken her iki boyutu birlikte hesaplamak gerekiyor.

Goldiebench'te Saha Testi: Twilight Veil'den Neon City'ye

Goldie'nin tezgahında testler Goldiebench adını taşıyor; arayüzde Grok 4.7, 4.6 ve 4.5 arasında tek tıkla geçiş var ve tüm çıktılar workspace 'te önizlemeye hazır. Öne çıkan örnek Twilight Veil adlı 3B dünya oyunu: oynanış akıcı, kurulum kolay, görsel atmosfer fena değil; ama sunucunun dediği gibi Astra 6 seviyesinde değil. İkinci örnek Neon City ve bir uçuş simülatörü de benzer çizgide — çalışıyor, hızlı, fakat aynı bütçede metin içi kıyaslarda anılan rakip amiral modellerin verdiği doku ve hava eksik kalıyor. Tıpkı hızlı eskiz gibi: oran doğru, gölge ve malzeme henüz ham. Videoda beğeni topluluk tepkisi de bu yüzden ikiye bölünmüş; ucuz ve hızlı olan sevilirken, son kat vernik arayanlar beklemede.

Videoda tekrar eden gözlem net: detay eksikliği hissi. Kod testlerinin çoğunda model işi bitiriyor, testleri geçiriyor, ama son kat vernik yok; rakip modellerin 'havası' burada daha sönük. Telafisi hız ve fiyat: aynı komutlar saniyeler içinde dönüyor, giriş ve çıkış tokenleri de rakip amiral modellere göre belirgin ucuz — video, metin içi kıyaslarda 46.3'e karşı 41.7 gibi başa baş skorları da bu yüzden vurguluyor (birebir isimler ASR kaynaklı karışık, doğrulanmış tablo Grok 4.7'ye karşı 4.6'yı gösteriyor). Geliştirici tarafında X aboneliği üzerinden CLI ve doğrudan Agent OS entegrasyonu var; komut satırını ekleyip tüm üretimi workspace'te saklıyorsun. Örneğin, tek dosyada bir saat widget'ı isteyip sonra üzerine filtre eklettiğinde yapı bozulmuyor — iskelet sağlam, süs eksik. Bu, harness'ın inadının modelin zekasından önce geldiğini gösteriyor; tıklayan ve hatırlayan tezgah, tek başına modelden daha belirleyici.

Fiyat, Erişim ve Yol Haritası

Fiyat tarafında tablo sade: aynı etiket, daha uzun dayanıklılık. 2 / 0.50 / 6 dolar giriş seviyesi, hobi denemesi için cömert; uzun bağlamda 4 / 1 / 12 'ye geçişi planlarken prompt'u kısaltmak tasarruf demek. Erişimde Grok Build , Cursor , Grok API ve yönlendirici bulutlar ilk günden açık; X üzerinden CLI erişimi de bu yüzden cazip. Hız tutkunu için fast varyantı söylemde var, pratikte tek kimlik; bu yüzden gecikme katmanını dokümandan değil hesabınızdaki gerçek liste üzerinden planlayın — pazarlama satırı ile API gerçeği ayrışabiliyor. Tıpkı uçak bileti gibi, ilan edilen hız ve biniş kapısındaki hız her zaman örtüşmüyor; ölçümünüzü kendi hesabınızda yapın.

Yol haritası hızlı akıyor: Goldie, Grok 4.8 'in yakın olduğunu, sürümlerin artık haftalar içinde tazelendiğini söylüyor; Gate haberine göre xAI, 2.5 trilyon parametreli Grok 4.8'in ön eğitimini hafta sonuna kadar kapatmayı hedefliyor. Promosyon notunu tek cümlede toparlayayım: sunucunun işlettiği AI Profit Boardroom / Agent OS çatısı 3 bin 400 üyeli bir topluluk, 30 günlük yol haritası , haftada 4 koçluk görüşmesi ve görev panosu ile modelden çok tezgahı satıyor. Benim vardığım yer şu: Grok 4.7 günlük deneme ve orta ölçekli ajan döngüleri için eğlenceli ve ekonomik bir alternatif , özellikle Claude aboneliği ödemek istemeyenler için; ama tek başına 'mükemmel' değil, ince detay ve kritik kararlarda insan gözü şart. 20 üretimlik saha, ucuz ve hızlı denerken gerçek işi kime emanet edeceğini hatırlatıyor.

Görsel: nodesdaily AI

Grok 4.7 Başlık Skorları

  • CursorBench 4.046.3%
  • DeepSWE71.0%
  • Terminal-Bench38.0%
  • EEBench66.0%
Yüksek daha iyi; tüm değerler satıcı raporu.
BoyutÖzet
Fiyat2 / 0.50 / 6 (<200k) → 4 / 1 / 12 (≥200k) aynı etiket
SkorCursor 46.3%, DeepSWE 71%, Terminal 38%, EE 66% (xAI)
Saha20 üretim: Twilight Veil akıcı, detay ince işçilik ister
BenchmarkGrok 4.7Grok 4.6Fark
CursorBench 4.046.3%40.4%+5.9
DeepSWE71.0%65.2%+5.8
Terminal-Bench 4.038.0%20.3%+17.7
EEBench66.0%60.0%+6.0

Videodaki anahtar anlar

  1. Giriş — Grok 4.7 sahada
  2. Benchmarklar — diğer amirallere karşı
  3. Tezgah — 4.7 / 4.6 / 4.5 arası geçiş
  4. Demo — Twilight Veil 3B dünya
  5. Gözlem — hız var, detay hafif
  6. Erişim — X üzerinden CLI ve Agent OS
  7. Yol haritası — Grok 4.8 yakında

AI yorumu

"Bana kalırsa Grok 4.7'nin hikayesi 'daha ucuz' değil, 'aynı faturada daha ısrarcı' olması; videodaki 20 üretim de bunu kanıtlıyor — hızlı, ekonomik ve denemesi eğlenceli, ama ince işçiliği henüz başkalarına bırakıyorum."

AI değerlendirmesi

Bana kalırsa videonun en güçlü iddiası da en dikkatli okunması gerekeni: Grok 4.7'nin aynı faturada daha ısrarcı olması. Steelman yapayım: eğer darboğazın gerçekten uzun ufuklu kodlama ve ajan döngüleri ise, aynı 500 bin pencerede daha yüksek skorlar somut değerdir. 200 bin altı fiyatın sabit kalması, denemeyi ucuzlatıyor; Goldiebench gibi bir tezgahla 20 üretimde akıcılığın hızla görülmesi de bu tezi destekliyor. Tıklayan ve hatırlayan bir harness ile aynı model daha fazla iş bitiriyor — özellikle eski araçları olan küçük ekipler için genelleştirilebilir bir avantaj.

Eksik kalanlar ise metodoloji ve risk. Tablodaki tüm sayılar xAI kaynaklı ; LLM Stats yazısının uyardığı gibi Terminal-Bench ve EEBench gibi testler Grok Build harness'ı ile koşulmuş, bu da skor ile tezgahı birbirine bağlıyor. EEBench 'te model kartı 66.0 derken haber tablosu 64.0 yazıyor; CursorBench 4.0 ise önceki sürümle karşılaştırılamaz. Fast varyantı söylemde var ama dokümanda ayrı kimlik yok. Videoda anılan rakip model adları ASR kaynaklı karışık (videoda SpaceX AI ve Grock gibi yazım hataları var), bu yüzden birebir model kıyasını videonun cümlesinden değil doğrulanmış tablodan okumak gerekiyor. Üstelik metin içi 'ucuz token' vurgusu, high/xhigh 'te artan token-per-task'i gizleyebilir.

Çıkar ve doğrulanabilirlik katmanını da kontrol ettim. xAI, Grok 4.7'yi SuperGrok ve Cursor kanallarında paketlerken, dış kaynaklar aynı dönemde Grok'un halüsinasyon ve taraflı çıktılarla gündeme geldiğini yazıyor; RAND yorumunda düzenleyici tartışmaların kızıştığı hatırlatılıyor. Fiyat ve plan bilgileri ayda bir değişiyor; docs.x.ai ve x.ai/pricing sayfaları karar anında canlı kontrol ister. Grok 4.8 için 2.5 trilyon parametre ve hafta sonu ön eğitim kapanışı da tek kaynaklı bir iddia; bağımsız teyit bekler. Token-per-task ve fast varyantı gibi kalemler de tek kaynaktan alınmamalı.

Benim pratik çıkarımım şu: günlük deneme, hızlı prototip ve orta ölçekli ajan döngüleri için Grok 4.7 bugün en sürtünmesiz yollardan biri — hızlı, ekonomik, denemesi eğlenceli , özellikle Claude aboneliği ödemek istemeyenler için iyi bir alternatif. Ama üretim verisini ve yüksek riskli talimatı doğrudan buluta emanet edecekler için insan onayı , kendi değerlendirmelerinizde yeniden ölçüm ve 200 bin eşiğine göre prompt kısaltma olmadan geçmeyin. Builder'lar için evet, her şeye koşturan genel asistan arayanlar için henüz değil; pazarlama satırını değil hesabınızdaki gerçek modeli temel alın.

Kaynaklar

7 bağlantı; 2 tanesi 2 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.

grok 4.7 · xai · cursor · agent os · goldiebench · fiyat

Konuyu takip et

Bu haberden önce

Aynı olayla editör tarafından ilişkilendirilmiş önceki haberlerden kısa bir okuma sırası.

Kanıt ve kaynaklar

İzinli kaynak metnini, sürümünü ve köken bilgisini incele.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…