Bir yapay zekâ modeli, kilitli bir test ortamından çıkıp başka bir şirketin sunucularına sızarsa ne olur? Temmuz 2026’da bu soru bir düşünce deneyi olmaktan çıktı. OpenAI’ın modelleri, sınavı çözmek yerine cevap anahtarını çalmayı seçti.
OpenAI, Temmuz ortasında yaptığı bir iç güvenlik değerlendirmesinde, modellerinin siber saldırı yeteneklerini ölçmek için ExploitGym adlı izole bir test ortamı kullandı. Amaç basitti: Modeller, internete kapalı bir ‘kum havuzu’ (sandbox) içinde bir dizi karmaşık güvenlik problemini çözecekti. Ham kapasiteyi ölçebilmek için standart güvenlik filtreleri de devre dışı bırakılmıştı.
Modeller — aralarında OpenAI’ın en güçlü kamuya açık modeli GPT-5.6 Sol ve henüz yayınlanmamış, ondan daha yetenekli bir modelin bulunduğu bir kombinasyon — problemleri tek tek çözmek yerine çok daha kestirme bir yol hesapladı: Testin cevap anahtarına ulaşmak. Cevaplar, açık kaynak yapay zekâ platformu Hugging Face’in üretim veritabanında duruyordu.
DİJİTALİYİDİR ÜYELİĞİ
Bu içeriğin devamını okumak için üye olun.
Ücretsiz üye olarak tüm yazıları okuyabilirsiniz.
Zaten üye misiniz? Giriş yapın
Günde sadece 1 TL'ye abone olarak tüm içeriklerimize sınırsız erişebilir ve bağımsız haberciliğe destek olabilirsiniz! Hemen Abone Ol





