OpenAI, 6 Ekim 2026’da henüz kamuya açılmamış bir iç frontier modelin ürettiği geniş bir matematik sonuçları koleksiyonunu yayımladı. Sonuçlar bir GitHub deposunda (openai/math) paylaşıldı; depo, makale revizyonları ve atıflar için belirlenmiş protokoller de içeriyor. Şirket, bu sonuçları matematik topluluğuyla nasıl paylaşacağını belirlerken Princeton’daki Institute for Advanced Study bünyesindeki bağımsız Matematik ve Yapay Zeka Danışma Grubu’na danıştığını ve grubun kamuya açık önerilerinden yararlandığını belirtiyor.
Depoda neler var?
Deponun açıklamasına göre koleksiyon şu anda 372 “aile” altında toplanan 722 el yazması makale içeriyor. Bir aile; ana bir sonucu, ona eşlik eden argümanları, sonuçlarını ya da alternatif kanıtları bir araya getiriyor ve her aile matematik disiplinine göre sınıflandırılıyor. Depoda ailelerin açıklandığı bir genel bakış belgesi, tek tek makaleleri bulmak için bir içerik haritası ve PDF, kaynak dosyaları ile atıf talimatlarını içeren bir ön baskı klasörü yer alıyor.
OpenAI, kanıtların birçoğunun biçimsel hallerini de Lean’de paylaşıyor. Lean, matematiksel kanıtların bilgisayar tarafından denetlenmesini sağlayan bir programlama dili. Şirket, yeni biçimselleştirmeler elde ettikçe depoyu güncelleyeceğini söylüyor.
Akıl yürütme özetleri ve hesaplama verisi
Bilimsel şeffaflık amacıyla OpenAI, sonuçların nasıl elde edildiğine dair ek ayrıntılar da yayımladı. Bunlar arasında modelin akıl yürütmesinin kısaltılmış 10 özeti, harcanan hesaplamanın ChatGPT Pro kullanımı cinsinden tahmini ve denenen problem sayısına ilişkin istatistikler bulunuyor. Özetlenen başlıklar arasında π’nin irrasyonellik üssü, simetrik ve genel Mahler sanıları, aritmetik diziler için kuasipolinom sınırlar, karakteristik ikide Kaplansky’nin doğrudan sonluluk sanısı, seyreltilmiş spin camları için Mézard–Parisi formülü ve serbest grup faktörlerinin izomorfizmi gibi konular yer alıyor.
Depoya göre sonuçların büyük çoğunluğu, yayınlanmamış bir iç OpenAI modeliyle aynı prosedür kullanılarak elde edildi. Ortalama bir sonuç, yaklaşık üç saatlik ChatGPT Pro düşünme hesaplamasına denk geldi. Değerlendirme sürecinde modele yaklaşık 4.000 problem verildi; çıktılar aileler ve makaleler halinde toplanıp belirli bir önem seviyesi şartı uygulanarak bugünkü katalog oluşturuldu. Riemann zeta fonksiyonu için sıfırsız bölge çalışması ve CM abelyen çeşitleri için Hodge Sanısı’nın kanıtı bu sabit prosedürün istisnaları olarak belirtiliyor; zeta fonksiyonundaki bir sonucun metni ise okunabilirlik için insanlar tarafından düzenlendi.
Doğrulama düzeyi farklı
OpenAI, koleksiyondaki sonuçların farklı doğrulama aşamalarında olduğunu açıkça belirtiyor. Tüm makalelerin Lean biçimselleştirmesi yok ve depo açıklamasında “biçimselleştirilmemiş sonuçların bazılarında sorunlar olabileceği” ifade ediliyor; şirket bu tür sorunları hızla düzeltmeye çalışacağını söylüyor. Yani bu sonuçların tamamı henüz matematik topluluğu tarafından bağımsız olarak incelenmiş ya da hakemli dergilerde yayımlanmış değil. OpenAI, düzeltme ve revizyonların yeni sürümler olarak kaydedileceğini ve önceki sürümlerin erişilebilir kalacağını taahhüt ediyor. Depo, OpenAI’ın matematik değerlendirmelerini mevcut testlerdeki performans doygunluğa ulaştıktan sonra açık araştırma problemlerine genişlettiğini de not ediyor.
Sırada ne var?
Şirket, gelecekteki yayınlarda makalelerin kalitesini atıflar, matematiksel anlatım ve sunum açısından iyileştirmeye söz veriyor. Bunun yanında yapay zekanın ürettiği önemli sonuçların anlaşılmasına yönelik bir dizi çalıştay, konferans ve özel programı finanse edeceğini, ayrıntıları yakında paylaşacağını açıkladı. Topluluk tarafından barındırılan alternatif depolama seçenekleri de araştırılıyor.
OpenAI ayrıca bu sonuçları üreten modeli bilim insanlarına sorumlu bir şekilde sunmak için çalıştığını belirtiyor. Şirket, iç frontier modellerini matematik ve diğer bilim dallarında değerlendirmeye devam etmenin bu alanları ilerletecek araçların geliştirilmesini hızlandırmak açısından önemli olduğunu vurguluyor ve gelecekteki büyük bilimsel ilerlemeleri duyururken topluluk geri bildirimlerine göre standartlarını güncelleyeceğini söylüyor.
Kaynak: OpenAI — Sharing AI progress in mathematics; GitHub — openai/math
Henüz yorum yok. İlk yorumu siz yapın!