OpenAI, yakında çıkması beklenen modellerinden Astra için yaptığı iç değerlendirmelerde ajan tabanlı kodlama ve siber güvenlik alanlarında belirgin ilerleme görüldüğünü açıkladı. Şirket, bu sonuçlar ve uzman değerlendirmeleri ışığında Preparedness Framework kapsamında kritik siber yetkinliklerin henüz dışlanamayacağını bildirdi.
7 Ağustos 2026 tarihli güvenlik duyurusunda OpenAI, son birkaç gündür süren iç testlerin Astra’nın hem savunma hem de saldırı senaryolarında daha güçlü performans gösterebileceğine işaret ettiğini belirtti. Şirket, bu potansiyel yetenek sıçramasını kamuoyu ve güvenlik topluluğuyla şeffaf biçimde paylaşmanın önemli olduğunu vurguladı.
Kritik siber yetkinlik eşiği nasıl tanımlanıyor?
OpenAI’nin Preparedness Framework’üne göre bir model, insan müdahalesi olmadan birçok sertleştirilmiş gerçek dünya kritik sisteminde farklı şiddet düzeylerinde işlevsel sıfırıncı gün (zero-day) istismarları tespit edip geliştirebiliyorsa ya da yalnızca üst düzey bir hedef verilerek sertleştirilmiş hedeflere karşı uçtan uca yeni siber saldırı stratejileri tasarlayıp uygulayabiliyorsa kritik siber yetkinlik eşiğine ulaşmış sayılıyor.
Şirket, Astra için ön değerlendirmelerin bu eşiğin dışlanamayacak kadar güçlü bir performans gösterdiğini; ölçüm ve değerlendirme çalışmalarının sürdüğünü kaydetti. OpenAI ayrıca Astra’nın Hugging Face ile ilgili güvenlik olayında yer almadığını da not düştü.
Daha önceki modeller, aralarında GPT-5.6-Sol’un da bulunduğu değerlendirmelerde kritik seviye yerine Yüksek (High) eşiğinde konumlandırılmıştı. Framework ilk kez Aralık 2023’te yayımlanmıştı ve biyoloji, kimya, siber güvenlik ile yapay zekânın kendini geliştirme alanlarındaki ilerlemeyi izlemek için bir rehber olarak tasarlanmıştı.
Alınan güvenlik önlemleri
OpenAI, bu bulgulara yanıt olarak koruma katmanlarını ve güvenlik kontrollerini güçlendirdiğini açıkladı. Duyuruda öne çıkan adımlar şöyle:
- Daha yüksek yetenekli modeller için izole test ortamları, kısıtlı ağ ve araç erişimi, güçlendirilmiş model ağırlığı koruması ve şifreleme, ek izleme ile kum havuzu (sandbox) yürütme gibi daha sıkı güvenlik kontrolleri uygulanıyor.
- Güçlendirilmiş güvenlik gereksinimlerini henüz karşılamayan Astra ile ilgili iç faaliyetler duraklatılıyor.
- Astra’nın eğitim ve değerlendirme dahil tüm ajan uygulamalarında riskli eylem ve hizasızlık için evrensel izleme devreye alındı; modelin düşünce zinciri (Chain of Thought) izlenerek yüksek riskli faaliyetlerde güvenlik müdahalesi tetikleniyor.
- İlgili devlet kurumları ve seçili yapay zekâ güvenlik kuruluşlarıyla model yeteneklerinin test edilmesi planlanıyor.
- Üçüncü taraf test ortaklarına, daha yüksek riskli değerlendirmelerin güvenli yürütülmesi için önerilen güvenlik kontrolleri sunulacak.
Savunma odaklı yaklaşım
OpenAI, ileri düzey siber yeteneklere sahip modellerin saldırganlardan önce savunmacıların açıklarını bulmasına yardımcı olması gerektiğini savundu. Şirket, Haziran 2025’te biyoloji alanında Yüksek eşiğe yaklaşırken izlediği yaklaşımı — koruma katmanlarını güçlendirme, testleri genişletme, dış uzmanlarla çalışma ve ek güvenlik kontrolleri — siber güvenlik tarafında da uyguladığını belirtti.
Astra henüz genel kullanıma sunulmuş bir model değil; duyuru, modelin geliştirme sürecindeki iç değerlendirmelere ve buna bağlı güvenlik tedbirlerine odaklanıyor. OpenAI, Astra ve benzeri sınır modellerinin yeteneklerinin sorumlu biçimde devreye alınması için hükümetler, güvenlik enstitüleri ve sivil toplumla çalışmaya devam edeceğini ifade etti.
Henüz yorum yok. İlk yorumu siz yapın!