Yeni bir arastirma, AI scaffolding optimizasyonu yoluyla zayif yapay zeka modellerinin en guclu modellerin performansina yaklasabilecegini ortaya koydu. AutoDesign adli bu cerceve, modelin kendisini degistirmeden sadece cevresel bileşenleri optimize ediyor.
Scaffolding: Modelden Once Gelen Strateji
Arastirmacilar, scaffolding optimizasyonunun model gucuyle ters orantili bir sekilde deger kazandigini buldu. Yani bir model ne kadar zayifsa, scaffolding o kadar etkili oluyor.
Zayif bir modele iyi yapilmis scaffolding eklemek, frontier modeliyle arasindaki farkin buyuk kismini kapatabilir. Modeli yukseltmeden once kodunuzu duzeltin.
AutoDesign Nasil Calisiyor?
Sistem otomatik olarak tek bir bileşeni degistiriyor bir prompt, bir arac, bir dogrulama kontrolu veya bir yeniden deneme kurali. Bir degisiklik yalnizca egitim gorevlerinde skoru iyilestirir ve ayri tutulan bir test setinde performansi dusurmezse hayatta kaliyor.
AutoDesign Sonuclari: PosterBench te 78.32
AutoDesign, PosterBench te 78.32 puan elde etti ve kapali kaynak ticari sistem Claude Design i 7.45 puan farkla geride birakti. Yedi farkli kod-ajan-model yapilandirmasinda DesignHarness entegrasyonu ortalama PosterBench puanini 54.99 dan 67.39 a yukseltti yuzde 12.4 luk arts.
- PosterBench Ana Set: 78.32 puan (en yuksek)
- Claude Design farki: +7.45 puan
- 7 yapilandirmada ortalama arts: +12.4 puan
- Maliyet: 40 dakikada 3 dolarin altinda poster uretimi
Zayif Modeller Icin En Buyuk Kazanimlar
En dikkat cekici bulgu: En zayif modeller en buyuk kazanclari elde etti. Yedi yapilandirmanin her biri 5 ila 19.6 puan arasinda iyilestirme sagladi.
Pratik Cikarim
Arastirmacilar su oneri de bulunuyor: Daha pahali bir modele gecmeden once, mevcut modelin cevresindeki kontrolleri ve yeniden deneme mantigini iyilestirmeye bir hafta harcamayi deneyin.
Kagit: arxiv.org/abs/2608.13560
Kaynak: @rohanpaul_ai / X
Henüz yorum yok. İlk yorumu siz yapın!