Keenable AI arama benchmark’ı yapay zeka dünyasında önemli bir tartışma başlattı. Şirketin CEO’su Andrey Styskin’in paylaştığı NEEDLE benchmark’ı, AI ajanlarının web içeriğinin önemli bir bölümünü kaçırdığını ortaya koydu. Bu bulgu, AI ajanı geliştiricilerin “hangi model en akıllı” tartışmasından önce arama katmanlarına odaklanmaları gerektiğini gösteriyor.
NEEDLE Benchmark’ı Nedir?
Keenable AI tarafından geliştirilen NEEDLE benchmark’ı (The Benchmark Your Search Engine Can’t Memorize), AI ajanlarının arama yeteneklerini test etmek için tasarlandı. Benchmark, günlük olarak değişen canlı web verilerini kullanarak modellerin ezberci yaklaşımlarını engelliyor. Böylece gerçek dünya performansı ölçülebiliyor.
Çarpıcı Sonuçlar
Keenable AI benchmark sonuçları şu şekilde:
- En iyi arama aracı: İçeriğin yüzde 75’ini buluyor
- Google API: Yüzde 53 oranında başarı
- En zor sorgularda: En iyi araç bile yüzde 50’ye yakın içerik kaçırıyor
Bu veriler, AI ajanlarının yarı kör olduğu gerçeğini netleştiriyor.
Model Seçimi Değil, Arama Altyapısı Önemli
Andrey Styskin ve ekibi, sektördeki yanlış önceliğe dikkat çekiyor. Geliştiriciler hangi LLM’in en akıllı olduğunu tartışırken, ajanlarının dörtte bir interneti göremediğinin farkında değil.
Styskin, “Prompt’ınızı optimize etmeden önce arama katmanınızı düzeltin” mesajını veriyor.
Keenable AI: AI Ajanları İçin En İyi Arama Çözümü
Keenable AI, bu soruna çözüm olarak konumlanıyor. Şirket, AI ajanlarının web içeriğinin tamamına yakınını görebilmesi için özel bir arama altyapısı geliştiriyor. Eski Yandex Search CEO’su olan Styskin’in bu alandaki deneyimi, ürünün güvenilirliğini artırıyor.
AI ajanı üreticileri ve kurumsal AI geliştiricileri için bu benchmark sonuçları, yatırım önceliklerini yeniden değerlendirme fırsatı sunuyor. Kaynak: X (Twitter): @styskin, 27 Ağustos 2026
Henüz yorum yok. İlk yorumu siz yapın!