Anthropic, sınır laboratuvarlarında AI geliştirme temposunu görünür kılmak için bir ölçüm seti yayımladı. Yazı, dünyanın sınır AI geliştirmeyi yavaşlatmayı tartıştığı bir dönemde kamuya daha fazla bilgi gerektiğini savunuyor ve içeriden bir anlık görüntü paylaşıyor. CEO Dario Amodei’nin frontier’i tempo ile yönetme çağrısıyla uyumlu şekilde, koordinasyon olursa bu sayıların değişmesinin beklendiği not ediliyor.
Üç eksen
Ölçümler üç kritik boyuta bakıyor: (1) bir sonraki model sürümünün ne ölçüde AI tarafından, ne ölçüde insanlar tarafından inşa edildiği; (2) Anthropic sistemlerinde AI ajanlarının eylemlerini denetleme ve müdahale edebilme; (3) daha yetenekli modellere güç veren kaynaklar. Yetenek değerlendirmelerinin (RSP risk raporları) tamamlayıcısı olarak konumlandırılıyorlar; odak model çıktısından çok üretim sürecinde.
Üçüncü taraf denetim
Anthropic, birden fazla kuruluştan bağımsız değerlendiricileri laboratuvara yerleştirmeyi; iç risk ekiplerine benzer erişimle güvenlik uygulamalarını doğrulatmayı, olayları raporlamayı ve bu yazıdaki gibi metrikleri izlemeyi planladığını yazıyor. Advanced AI Framework (AAIF) önerisinde hükümetlerin isteyebileceği şeffaflık yükümlülükleri de anılıyor.
Ne için?
Amaç; kamu, üçüncü taraflar ve hükümetlerin sınır laboratuvarlarındaki tempo hakkında daha iyi görüşe sahip olması. Her ölçüm için ne ölçüldüğü, ne görüldüğü ve düzenli/doğrulanabilir yayının ne gerektirdiği anlatılıyor; yöntem ayrıntıları ekte.
Kaynak: Anthropic – Measurements for understanding the pace of AI development inside frontier labs
Henüz yorum yok. İlk yorumu siz yapın!