CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
26 Aug 2026 · 23:50 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
YAPAY ZEKA HABERLERI SAYI #2.213 21 Ağu 2026 · Cuma

Gizemli Yapay Zeka Modeli DeepSWE Testinde Rekor Kirdi: Fable ve GPT-5.6-sol’u Geride Birakti

Sektörün yakından takip ettiği bir yapay zeka analisti, anonim olarak paylaşılan bir modelin yazılım mühendisliği testlerinde şaşırtıcı sonuçlar elde ettiğini bildirdi.

AiHaber Editör
Editör
3DK 8OKUMA

★ Hızlı Özet

  • Sektörün yakından takip ettiği bir yapay zeka analisti, anonim olarak paylaşılan bir modelin yazılım mühendisliği testlerinde şaşırtıcı sonuçlar elde ettiğini bildirdi.
  • Bir geliştirici olan Ben Davis, modeli 10 farklı DeepSWE görevinden geçirdiğinde model yüzde 80’in üzerinde başarı oranı gösterdi.

Sektörün yakından takip ettiği bir yapay zeka analisti, anonim olarak paylaşılan bir modelin yazılım mühendisliği testlerinde şaşırtıcı sonuçlar elde ettiğini bildirdi. Gizemli yapay zeka modeli olarak adlandırılan bu sistem, DeepSWE benchmark testlerinde yüzde 80’in üzerinde başarı oranına ulaştı. Bu sonuç, Anthropic’in Fable modelinin yüzde 65’lik ve OpenAI’ın GPT-5.6-sol’un yüzde 52’lik skorlarını geride bırakarak sektörde büyük yankı uyandırdı.

Bir geliştirici olan Ben Davis, modeli 10 farklı DeepSWE görevinden geçirdiğinde model yüzde 80’in üzerinde başarı oranı gösterdi. Aynı testlerde Fable yüzde 65, GPT-5.6-sol ise yüzde 52 oranlarında kaldı. Bu fark, yapay zeka model piyasasında yeni bir dönemin başladığına işaret ediyor.

DeepSWE Benchmark Nedir ve Neden Önemli?

DeepSWE, yapay zeka modellerinin gerçek dünya yazılım mühendisliği görevlerindeki yeteneklerini ölçen kritik bir değerlendirme standardıdır. Modelin kod yazma, hata ayıklama ve yazılım mimarisi oluşturma kapasitesini test eden bu benchmark, yapay zeka araştırmalarında model performansının en güvenilir göstergelerinden biri olarak kabul ediliyor. Gizemli yapay zeka modeli bu testlerde elde ettiği sonuçlarla sektörün dikkatini çekmeyi başardı.

Gizemli Model Kimin?

Modelin hangi şirkete ait olduğu henüz bilinmiyor. Uzmanlar çin merkezli bir şirket olabileceğini düşünüyor. GLM veya Kimi gibi çinli yapay zeka şirketlerinin yeni bir model piyasaya sürdüğü ihtimali üzerinde duruluyor. Şirket henüz resmi bir açıklama yapmadı ve model anonim olarak paylaşıldı.

Fable ve GPT-5.6-sol Karşılaştırması

Anthropic’in Fable modeli uzun zamandır yazılım mühendisliği alanında en güçlü modellerden biri olarak kabul ediliyordu. OpenAI’ın GPT-5.6-sol sürümü ise özellikle agent tabanlı görevlerde iddialı bir performans sergiliyordu. Her iki modelin de üzerinde performans göstermeyi başaran bu gizemli yapay zeka modeli, yapay zeka rekabetinde yeni bir dönemin başladığına işaret ediyor.

Sektördeki Yansımaları

Bu gelişme, yapay zeka şirketleri arasındaki rekabetin ne kadar kızıştığını bir kez daha gösterdi. Özellikle çin merkezli şirketlerin ABD’li devlerle olan farkı hızla kapattığı görülüyor. Analistler, önümüzdeki dönemde çok daha güçlü modellerin piyasaya çıkmasını bekliyor. Modelin arkasındaki şirketin açıklanması ile birlikte sektörde yeni değerlendirmeler yapılması bekleniyor.

— Paylaş

Beğendiysen yay.

Yapay Zeka Sohbetlerinde
Sosyal Medyada

Tartışma

Bu habere emoji ile tepki ver

Hizli:

Henüz yorum yok. İlk yorumu siz yapın!

Yapıcı ve saygılı yorumlar bekliyoruz. Topluluk kuralları