CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
2 Oct 2026 · 22:31 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
MODEL HABERLERI SAYI #2.752 2 Eki 2026 · Cuma

Ataraxos: Stratego’da süper insan AI Nature’da; eğitim maliyeti 8.000 dolardan az

Nature’da yayımlanan makalede Carnegie Mellon, NYU, Stanford ve MIT araştırmacıları Ataraxos adlı Stratego yapay zekâsını tanıttı.

AiHaber Editör
Editör
2DK 8OKUMA

★ Hızlı Özet

  • Nature’da yayımlanan makalede Carnegie Mellon, NYU, Stanford ve MIT araştırmacıları Ataraxos adlı Stratego yapay zekâsını tanıttı.
  • Maliyet ve DeepNash karşılaştırması Makaleye göre Ataraxos bir hafta 16 Nvidia H100 artı inanç ağı için dört gün dört GPU ile eğitildi; 2025…
  • Yöntem Sistem insan verisi olmadan öz-oyunla öğreniyor. Güçlü düzenlileştirme erken dönemde çeşitliliği zorluyor; sonra gevşetilip adım boyu…
  • Kaynak: Nature — Scalable decision-making for games of imperfect information

Nature’da yayımlanan makalede Carnegie Mellon, NYU, Stanford ve MIT araştırmacıları Ataraxos adlı Stratego yapay zekâsını tanıttı. Yazarlara göre sistem, oyunun tarihinde bilinen ilk süper insan sonucunu verdi: 20 maçlık resmi seride dört kez dünya şampiyonu Pim Niemeijer’e karşı 15 galibiyet, 1 mağlubiyet, 4 beraberlik (beraberlik yarı galibiyet sayıldığında yaklaşık yüzde 85 etkili kazanma oranı).

Maliyet ve DeepNash karşılaştırması

Makaleye göre Ataraxos bir hafta 16 Nvidia H100 artı inanç ağı için dört gün dört GPU ile eğitildi; 2025 fiyatlarıyla 8.000 dolardan az. DeepMind’in DeepNash’inin 1.024 TPU’da iki–üç aylık eğitiminin güncel fiyatla 3–4,5 milyon dolar bandında olduğu tahmin ediliyor. Doğrudan kafa kafaya karşılaştırma yok; DeepNash kodunun artık çalışmadığı belirtiliyor.

Yöntem

Sistem insan verisi olmadan öz-oyunla öğreniyor. Güçlü düzenlileştirme erken dönemde çeşitliliği zorluyor; sonra gevşetilip adım boyutu küçültülüyor. Gizli taşları tahmin eden bir inanç ağı her hamleden önce olası durumlar örnekliyor ve aday hamleler üzerinde arama yapıyor. Aynı teknikler Barrage Stratego, Hanabi ve dou dizhu’da da kullanıldı. Kod kamuya açıldı.

Kaynak: Nature — Scalable decision-making for games of imperfect information

— Paylaş

Beğendiysen yay.

Yapay Zeka Sohbetlerinde
Sosyal Medyada

Tartışma

Bu habere emoji ile tepki ver

Hizli:

Henüz yorum yok. İlk yorumu siz yapın!

Yapıcı ve saygılı yorumlar bekliyoruz. Topluluk kuralları