CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
26 Aug 2026 · 23:47 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
YAPAY ZEKA HABERLERI SAYI #2.213 21 Ağu 2026 · Cuma

Gizemli Yapay Zeka Modeli DeepSWE Testinde Rekor Kirdi: Fable ve GPT-5.6-sol’u Geride Birakti

Sektorun yakinndan takip ettigi bir yapay zeka analisti, anonim olarak paylasilan bir modelin yazilim muhendisligi testlerinde sasirtici sonuclar elde ettigini bildirdi.

AiHaber Editör
Editör
2DK 10OKUMA

★ Hızlı Özet

  • Sektorun yakinndan takip ettigi bir yapay zeka analisti, anonim olarak paylasilan bir modelin yazilim muhendisligi testlerinde sasirtici sonuclar elde ettigini bildirdi.
  • Bir gelistirici olan Ben Davis, modeli 10 farkli DeepSWE gorevinden gecirdiginde model yuzde 80'in uzerinde basari orani gosterdi.

Sektorun yakinndan takip ettigi bir yapay zeka analisti, anonim olarak paylasilan bir modelin yazilim muhendisligi testlerinde sasirtici sonuclar elde ettigini bildirdi. Gizemli yapay zeka modeli olarak adlandirilan bu sistem, DeepSWE benchmark testlerinde yuzde 80’in uzerinde basari oranina ulasdi. Bu sonuc, Anthropic’in Fable modelinin yuzde 65’lik ve OpenAI’in GPT-5.6-sol’un yuzde 52’lik skorlarini geride birakarak sektrde buyuk yanki uyandirdi.

Bir gelistirici olan Ben Davis, modeli 10 farkli DeepSWE gorevinden gecirdiginde model yuzde 80’in uzerinde basari orani gosterdi. Ayni testlerde Fable yuzde 65, GPT-5.6-sol ise yuzde 52 oranlarinda kaldi. Bu fark, yapay zeka model piyasasinda yeni bir donemin basladigina isaret ediyor.

DeepSWE Benchmark Nedir ve Neden Onemli?

DeepSWE, yapay zeka modellerinin gercek dunya yazilim muhendisligi gorevlerindeki yeteneklerini olcen kritik bir degerlendirme standardidir. Modelin kod yazma, hata ayiklama ve yazilim mimarisi olusturma kapasitesini test eden bu benchmark, yapay zeka arastirmalarinda model performansinin en guvenilir gostergelerinden biri olarak kabul ediliyor. Gizemli yapay zeka modeli bu testlerde elde ettigi sonuclarla sektorun dikkatini cekmeyi basardi.

Gizemli Model Kimin?

Modelin hangi sirkete ait oldugu henuz bilinmiyor. Uzmanlar cin merkezli bir sirkete olabilecegini dusunuyor. GLM veya Kimi gibi cinli yapay zeka sirketlerinin yeni bir model piyasaya surdugu ihtimali uzerinde duruluyor. Sirket henuz resmi bir aciklama yapmadi ve model anonim olarak paylasildi.

Fable ve GPT-5.6-sol Karsilastirmasi

Anthropic’in Fable modeli uzun zamandir yazilim muhendisligi alaninda en guclu modellerden biri olarak kabul ediliyordu. OpenAI’in GPT-5.6-sol surumu ise ozellikle agent tabanli gorevlerde iddiali bir performans sergiliyordu. Her iki modelin de uzerinde performans gostermeyi basaran bu gizemli yapay zeka modeli, yapay zeka rekabetinde yeni bir donemin basladigina isaret ediyor.

Sektordeki Yansimalari

Bu gelisme, yapay zeka sirketleri arasindaki rekabetin ne kadar kizistigini bir kez daha gosterdi. Ozellikle cin merkezli sirketlerin ABD’li devlerle olan farki hizla kapattigi goruluyor. Analistler, onumuzdeki donemde cok daha guclu modellerin piyasaya cikmasini bekliyor. Modelin arkasindaki sirketin aciklanmasi ile birlikte sekorda yeni degerlendirmeler yapilmasi bekleniyor.

— Paylaş

Beğendiysen yay.

Yapay Zeka Sohbetlerinde
Sosyal Medyada

Tartışma

Bu habere emoji ile tepki ver

Hizli:

Henüz yorum yok. İlk yorumu siz yapın!

Yapıcı ve saygılı yorumlar bekliyoruz. Topluluk kuralları