CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
8 Oct 2026 · 22:24 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
MODEL HABERLERI SAYI #2.812 8 Eki 2026 · Perşembe

NVIDIA, Nemotron’u ince ayarla IOI ve IMO 2026’da altın madalya seviyesine taşıdı

NVIDIA, Nemotron model ailesinin ince ayarla uzman modellere dönüştürülerek iki ayrı olimpiyatta altın madalya seviyesine ulaştığını açıkladı.

AiHaber Editör
Editör
4DK 2OKUMA

★ Hızlı Özet

  • NVIDIA, Nemotron model ailesinin ince ayarla uzman modellere dönüştürülerek iki ayrı olimpiyatta altın madalya seviyesine ulaştığını açıkladı.
  • Sonuçlar IOI 2026: SFT ve GenCorrect ile eğitilen Nemotron-3-Ultra-CC, 600 üzerinden 535,4 puan aldı. Altın eşiği 361,12, en yüksek insan p…
  • Yeniden kullanılabilir tarif NVIDIA, iki projede de aynı dört adımlı yaklaşımı kullandığını söylüyor: güçlü bir Nemotron temel modeliyle baş…
  • Yarışmacı programlamada Ekip 22 bin problem derledi ve iki uzman model eğitti. 30 milyar toplam, 3 milyar aktif parametreli Nemotron-3-Nano-…

NVIDIA, Nemotron model ailesinin ince ayarla uzman modellere dönüştürülerek iki ayrı olimpiyatta altın madalya seviyesine ulaştığını açıkladı. Şirketin Hugging Face blogunda yayımlanan yazıya göre Nemotron 3 tabanlı sistemler hem Uluslararası Bilgisayar Olimpiyatı’nda (IOI 2026) hem de Uluslararası Matematik Olimpiyatı’nda (IMO 2026) altın eşiğini geçti. İki yarışma farklı beceriler ölçüyor. IOI, gizli testleri sıkı süre ve gönderim sınırları içinde geçen algoritma ve kod istiyor. IMO ise doğal dilde titiz ispatlar bekliyor.

Sonuçlar

  • IOI 2026: SFT ve GenCorrect ile eğitilen Nemotron-3-Ultra-CC, 600 üzerinden 535,4 puan aldı. Altın eşiği 361,12, en yüksek insan puanı ise 498,27’ydi.
  • IMO 2026: Nemotron 3 Ultra’nın genel, SFT ve RL kontrol noktalarını birlikte kullanan bir üret-doğrula-düzelt sistemi 42 üzerinden 30 puan aldı. Resmî altın eşiği 29’du.

Bu sonuçları okurken bir ayrıntıya dikkat etmek gerekiyor. NVIDIA’ya göre IOI sonucu, insan yarışmacılarla aynı süre, internet erişimi ve gönderim kısıtlarıyla canlı olarak yapılan bir denemeden geldi. Ancak bu deneme gayriresmî ve denetimsizdi, resmî IOI sıralamasına da dahil edilmedi. IMO sisteminin ispatları ise resmî IMO jürisi tarafından puanlandı.

Yeniden kullanılabilir tarif

NVIDIA, iki projede de aynı dört adımlı yaklaşımı kullandığını söylüyor: güçlü bir Nemotron temel modeliyle başlamak, alana özgü problemleri ve kaliteli akıl yürütme izlerini derlemek, SFT ve gerektiğinde RL gibi standart son eğitim yöntemlerini uygulamak, uzman modeli de aday yanıtları üretip değerlendiren ve iyileştiren bir çıkarım döngüsüyle eşleştirmek. Şirkete göre her yarışma için yeni bir temel model geliştirmek gerekmedi.

Yarışmacı programlamada

Ekip 22 bin problem derledi ve iki uzman model eğitti. 30 milyar toplam, 3 milyar aktif parametreli Nemotron-3-Nano-CC hem SFT hem RL aldı. 550 milyar toplam, 55 milyar aktif parametreli Nemotron-3-Ultra-CC ise yalnızca SFT aldı. IOI 2025 üzerinde Nano’nun puanı son eğitimden önce 130’du. SFT sonrası 280’e, RL sonrası 291’e çıktı. Yinelemeli üret-değerlendir-düzelt stratejisi GenCorrect ile 468 puana ulaşıp 438,3’lük altın eşiğini geçti. Ultra-CC aynı stratejiyle 502 puan aldı. Ultra için tek bir SFT turu bile, tamamen eğitilmiş Nano’yu IOI, ICPC ve LiveCodeBench Pro’da geride bırakmaya yetti.

Olimpiyat matematiğinde

IMO projesinde SFT verisi, 15.818 farklı ispat probleminden 414.890 filtrelenmiş örnek içeriyordu. Veri yalnızca nihai cevapları değil; ispat üretme, düzeltme, doğrulama ve doğrulamayı denetleme adımlarını da kapsıyordu. RL modeli ise modelin yetenek sınırına yakın 9.597 ispat problemiyle eğitildi. Her problem için modeller aday ispatlar üretti, bunları puanladı, eleştiriler yazdı ve en umut verici denemeleri düzeltti. Sistem tamamen doğal dilde çalıştı. Biçimsel ispat aracı, harici araç ya da internet kullanılmadı. Altı problemin dördünden tam puan alındı.

Açık modeller ve veriler

NVIDIA, Nemotron Labs IMO 2026 koleksiyonunda SFT ve RL kontrol noktalarını, iki eğitim veri setini ve 200 olimpiyat seviyesi problemden oluşan yeni Nemotron-IMO-Bench’i yayımladı. NeMo-Skills deposunda çıkarım hattı, istemler, gönderilen ispatlar ve tekrar üretim için hızlı başlangıç bulunuyor. Nemotron-3-Ultra-CC modeli de Hugging Face’te. Şirket, madalyaların ne tek başına ince ayardan ne de kaba kuvvet örneklemeden geldiğini, modelin, verinin ve çıkarım döngüsünün birlikte tasarlanmasının sonucu olduğunu vurguluyor.

Kaynak: NVIDIA / Hugging Face Blog — One Model Family, Two Gold-Level Results: Fine-Tuning Nemotron for IOI and IMO

— Paylaş

Beğendiysen yay.

Yapay Zeka Sohbetlerinde
Sosyal Medyada

Tartışma

Bu habere emoji ile tepki ver

Hizli:

Henüz yorum yok. İlk yorumu siz yapın!

Yapıcı ve saygılı yorumlar bekliyoruz. Topluluk kuralları