SpaceXAI (x.ai), kodlama ve bilgi işi için en yetenekli modeli olarak sunduğu Grok 4.7’yi duyurdu. Resmi yazıya göre model, zor görevlerde daha uzun çalışıyor, kendi çıktısını daha dikkatli doğruluyor ve bugüne kadarki en iyi ayarlanmış güvenlik katmanlarıyla geliyor. Fiyat ve hız bandı Grok 4.6 ile aynı tutuluyor.
Resmi benchmark özeti
x.ai tablosunda Grok 4.7 xHigh için girdi/çıktı fiyatı milyon token başına $2 / $6. CursorBench 4.0’ta %46,3; DeepSWE v1.1’de (yüksek efor) %71,0; EEBench’te %64,0; AA Briefcase v1.1’de 1.657 Elo; Terminal-Bench 4.0’ta %37,6 skorları listeleniyor. Karşılaştırmalar Grok 4.6 High, GPT-5.6 Sol Max ve Fable 5.1 Max ile yan yana veriliyor. Model, Grok Bot harness’ini yerel olarak daha iyi anlamak üzere eğitilmiş.
Güvenlik ve siber
Şirket, Grok 4.7’nin tamamen yeni bir güvenlik yığınıyla geldiğini; reddetme ve jailbreak direncinde kendi testlerinde en güçlü sonuçları aldığını; LatchBio biyolojik güvenlik kıyasında %62,4 ile zirvede olduğunu; HackerBench v0.3’te riskli/kötü amaçlı siber istemlerin yalnızca %3,3’ünün geçtiğini iddia ediyor. Seçili siber güvenlik ortaklarına davetli red-team erişimi başlatıldığı belirtiliyor. Bunlar üreticinin kendi değerlendirmeleridir.
Artificial Analysis bağımsız bağlamı
Artificial Analysis, 21 Eylül 2026 tarihli yazısında Grok 4.7’nin Intelligence Index’te 46 puan aldığını (+2 vs 4.6) ve SpaceXAI’yi en iyi dört laboratuvar arasına taşıdığını raporladı. AA-Briefcase’te 1657 Elo (+111); GDPval-AA’de 1695 Elo; Coding Agent Index’te Grok Build ile 56 (+9) yazıyor. Kazanımların daha yüksek token kullanımıyla geldiği (xhigh’ta görev başına ~81k çıktı tokenı) ve 500k bağlam penceresinin 4.6 ile aynı kaldığı belirtiliyor. Bu bağımsız ölçümler resmi x.ai iddialarını tamamlayıcı bağlamdır; ayrı bir ürün haberi değildir.
Erişim
Grok 4.7 Cursor ve Grok Build’de, Grok API’de, üçüncü taraf kodlama harness’lerinde ve model yönlendiricilerinde kullanılabiliyor. İki kat çıktı hızı sunan hızlı varyant da iki kat fiyatla servis ediliyor.
Kaynak: x.ai — Introducing Grok 4.7 · Artificial Analysis — Benchmarking Grok 4.7
Henüz yorum yok. İlk yorumu siz yapın!