
SpaceXAI, yeni nesil yapay zeka modeli Grok 4.6‘yi resmi olarak kullanima sundu. Model, Artificial Analysis siralamalarinda GPT-5.6 Sol ile esit puan alarak ucuncu siraya yerlesti ve Kimi K3‘u geride birakti. Grok 4.6, sahip oldugu yuksek performansa karsin rakip modellerin cok altinda bir fiyat noktasinda sunuluyor.
Grok 4.6 Benchmark Sonuclari: Ust Duzey Performans
Grok 4.6, Artificial Analysis platformundaki agentik gorevler testinde 61 puan aldi. Bu sonuc, Claude Fable 5 Max‘in 62 puanina sadece %1,6 farkla yaklasti. Modelin en guclu oldugu alanlar ise profesyonel agent calismalari oldu. GDPVal-AA v2 testinde 1753, AA-Briefcase testinde ise 1577 puan alarak hem GPT-5.6 Sol Max hem de Fable 5 Max‘i geride birakti.
Kodlama performansi acisindan da Grok 4.6 etkileyici sonuclar ortaya koydu. CursorBench v3.2‘de %69,9 basari oraniyla GPT Sol’un %67,2‘lik skorunu asti. DeepSWE ve Terminal-Bench testlerinde ise Grok 4.6, hem Sol hem de Fable 5 modellerini geride birakti.
Grok 4.6 Fiyatlandirma: Rekabeteci Maliyet Avantaji
SpaceXAI’in Grok 4.6 icin belirledigi fiyatlandirma, modelin en buyuk avantajlarindan biri. Grok 4.6, milyon token basina 2 dolar giris ve 6 dolar cikis ucreti alyor. Karsilastirma yapildiginda, Fable 5 ayni islem icin milyon token basina 10 dolar giris ve 50 dolar cikis talep ediyor. Yani Grok 4.6, giris tokenlarinda 5 kat, cikis tokenlarinda ise 8 kat daha ucuz.
SpaceXAI, bu durumu “en guclu zeka-dolar dengesi” olarak tanimliyor.
Grok 4.6’nin Teknik Altyapisindaki Iyilestirmeler
SpaceXAI, Grok 4.6’da bir dizi teknik yenilik kullandi. Daha uzun bir egitim suresi, yeniden uretilen SFT trajectory’leri, model tabanli iz filtreleme ve agentik RL uygulamalari modelin sicramasinin arkasindaki temel faktorler olarak aciklandi. Ayrica model, uzun trajectory’lerde daha fazla kendi kendini test ediyor; calismalarini kontrol ederek hata birikimini dogrudan hedef aliyor.
Grok Bot: Kalici Hafizali Yapay Zeka Asistani
SpaceXAI ayni lansman kapsaminda Grok Bot‘u da tansitti. Grok Bot’un en buyuk yeniligi kalicilik. Kullanici ayrildiktan sonra da calismaya devam eden bulut bilgisayarlar kullaniyor. API veya MCP bulunmayan durumlarda bile web sitelerinde ve uygulamalarda oturum acabiliyor. Birden fazla Bot birbirine mesaj gonderebiliyor, baglam paylasabiliyor ve uzman Bot’lara is aktarabiliyor.
Beta surumu su an icin SuperGrok Heavy, Cursor Ultra ve Cursor Teams Premium kullanicilariyla sinirli. Kurumsal erisim icin bekleme listesi acik.
Sonuc: Grok 4.6 Yapay Zeka Pazarini Yeniden Sekillendiriyor
Grok 4.6, yuksek performansi ve dusuk maliyeti bir arada sunarak yapay zeka model pazarinda ciddi bir bosluk dolduruyor. Ozellikle agent tabanli gorevler, cok adimli arastirma ve yazilim gelistirme alanlarinda guclu sonuclar vermesi, bu modeli hem gelistiriciler hem de isletmeler icin cazip kiliyor. SpaceXAI’in agresif fiyatlandirma stratejisi, onumuzdeki donemde diger buyuk oyunculari da benzer adimlar atmaya zorlayabilir.
Kaynak: Rohan Paul (@rohanpaul_ai), Artificial Analysis
Henüz yorum yok. İlk yorumu siz yapın!