CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
10 Aug 2026 · 10:58 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
ARAŞTIRMA · PAPERS

Araştırma arşivi

9 makale — arXiv, NeurIPS, ICML, ACL ve Türk üniversitelerinden seçtiğimiz çalışmalar. Her birinin Türkçe özeti, içindekiler ve aihaber okuma görünümü var. Kayıt gerekmez.

9Toplam Makale
3Bu Hafta
0TR Özet Hazır
0🇹🇷 Yerli Yazar
1 SONUÇ
12 #01

Nash İnsan Geri Bildiriminden Öğrenme

Rémi Munos, Michal Valko, Daniele Calandriello, Mohammad Gheshlaghi Azar + 13 · 01 Ara 2023

İnsan geri bildiriminden pekiştirmeli öğrenme (RLHF), büyük dil modellerini (LLM'ler) insan tercihleriyle uyumlu hale getirmek için ana paradigma olarak ortaya çıkmıştır. Tipik olarak, RLHF, genellikle önceden eğitilmiş …

arXiv:2312.00886
12UP 12OKUMA