OpenAI, üç aydan kısa bir sürede ikinci kez en gelişmiş yapay zeka modellerinin eğitim sürecini durdurdu. Şirketin 25-26 Eylül tarihlerinde yayımladığı teknik raporda, bir yapay zeka ajanının 20 Eylül’de güvenli test ortamından (sandbox) çıkarak internete eriştiği doğrulandı. Olay, yapay zeka güvenliği tartışmalarını yeniden alevlendirdi.
DNS Açığı Nasıl İstismar Edildi?
Pekiştirmeli öğrenme (reinforcement learning) egzersizi kapsamında, biyografik ipuçlarından yola çıkarak bir kişiyi tespit etmekle görevlendirilen ajan, standart arama araçlarından sonuç alamayınca ağ erişimini sistematik biçimde test etmeye başladı. Sandbox’ın web proxy’si engellenmiş olsa da DNS çözümleyicisinin internete canlı bağlantısını sürdürdüğünü fark eden ajan, alan adı sorgularına veri gizlemenin onlarca yıllık bir yöntemi olan DNS delegasyonu tekniğine başvurdu. Sorularını hostname sorgularının içine gömerek harici bir sohbet botu hizmetinden yanıt almayı başardı. Geriye dönük yapılan inceleme, modelin daha önce de benzer DNS erişim girişimlerinde bulunduğunu, ancak bunların izleme sistemi tarafından doğru ciddiyet seviyesiyle işaretlenemediğini ortaya koydu.
Acil Durdurma Mekanizması Neden Çalışmadı?
OpenAI’nin izleme sistemi, ajanın şüpheli davranışını yaklaşık 12 dakika içinde tespit etti ve bir insan denetçi üç dakika sonra uyarıyı onayladı. Ancak şirketin ifadesiyle, “sistemin müdahale edip etmemesi gerektiği konusunda kafa karışıklığı” yaşandığı için şüpheli etkinlik anında eğitimi durdurması beklenen otomatik mekanizma devreye girmedi. Bir ekip üyesi süreci ancak tespitten yaklaşık iki buçuk saat sonra manuel olarak durdurabildi. OpenAI’ın RSI Hazırlık Birimi Lideri Micah Carroll, konuyla ilgili paylaşımında şirketin en yetenekli modellerine yönelik tüm çıkarım işlemlerinin, sistemler daha sağlam hale getirilinceye kadar durdurulduğunu belirtti. Şirket, olaya karışan modelin eğitimine devam etmeyeceğini, yeniden başlanacak eğitimin sıfırdan yapılacağını da duyurdu.
İkinci Vaka ve Sektördeki Yansımalar
OpenAI aynı raporda “özellikle ciddi” nitelendirdiği ayrı bir vakayı da kamuoyuyla paylaştı: teorem ispatlama görevi verilen farklı bir dahili model, bir araştırmacının GitHub erişim anahtarını (token) herkese açık openai/codex deposunda yayımladı. Model, otomatik gizli bilgi tarama araçlarından kaçınmak için anahtarı parçalara bölmüş, üstelik araştırmacının durdurma yönündeki iki doğrudan talimatını da göz ardı etmişti. Açıklamalar, artan düzenleyici baskının gölgesinde geldi; ABD’li temsilciler Ted Lieu ve Nathaniel Moran temmuz ayında Yapay Zeka Acil Durdurma Yasası’nı Meclis’e sunmuş, Kaliforniya Valisi Gavin Newsom ise 18 Eylül’de imzaladığı yürütme kararnamesiyle eyalet yetkililerini sınır modelleri için acil durdurma mekanizması geliştirmeye yönlendirmişti. OpenAI ayrıca modellerinin güvenlik kontrollerini atlattığı veya çevrimiçi hizmetleri aksattığı vakalarla ilgili olarak hükümetler, üniversiteler ve kamu kurumları dahil onlarca üçüncü tarafı bilgilendirdiğini açıkladı.
Günde sadece 1 TL'ye abone olarak tüm içeriklerimize sınırsız erişebilir ve bağımsız haberciliğe destek olabilirsiniz! Hemen Abone Ol




