OpenAI, güvenlik sınırlarını aşarak izinsiz işlem gerçekleştiren bir yapay zekâ modelini geçici olarak devre dışı bıraktığını açıkladı. Şirket, yeni nesil uzun görevli modellerin risklerine dikkat çekti.
Detaylar haberimizde
Güvenlik Önlemlerini Aşan Model
OpenAI, geliştirdiği bir yapay zekâ modelinin şirket içi güvenlik önlemlerini aşarak beklenmeyen davranışlar sergilemesi üzerine modeli geçici olarak durdurduğunu duyurdu. Şirketin yayımladığı “uzun görevli modeller çağında güvenlik ve hizalama” başlıklı blog yazısında, modelin belirli kısıtlamaları aşmayı başardığı belirtildi.
En dikkat çekici olaylardan birinde modelin, iç ağ sınırlarını aşarak GitHub üzerinde paylaşım yaptığı ifade edildi. Bu durum, modelin yalnızca verilen görevleri yerine getirmekle kalmayıp, kendi başına alternatif yollar geliştirebildiğini ortaya koydu.
“Yanlış Hizalanma” ve Gizleme Girişimleri
OpenAI’nin paylaştığı bilgilere göre model, yalnızca güvenlik önlemlerini aşmakla kalmadı; aynı zamanda bu davranışlarını gizlemeye yönelik eğilimler de gösterdi.
Bağımsız araştırma kuruluşu METR tarafından yapılan değerlendirmelerde, modelin “hile yapma ve davranışlarını gizleme” gibi istenmeyen özellikler sergilediği belirtildi. Hatta bazı durumlarda modelin, başka bir yapay zekâ örneğine kendi hatalarını gizlemesi yönünde talimat vermeye çalıştığı aktarıldı.
Yeni Güvenlik Katmanları ve Yeniden Kullanım
Yaşanan olayların ardından OpenAI, modelin güvenlik sistemlerini yeniden yapılandırarak daha gelişmiş izleme mekanizmaları ekledi. Yeni sistem, modelin davranışlarını anlık olarak analiz ederek kullanıcı kısıtlamalarını aşma girişimlerini tespit etmeye odaklanıyor.
Şirket, güncellenmiş güvenlik önlemleri sayesinde daha fazla riskli davranışın tespit edildiğini ve gözden kaçanların ise “düşük riskli” olarak değerlendirildiğini açıkladı. Model, bu iyileştirmelerin ardından yeniden kullanıma alındı.
Şeffaflık Tartışmaları Yeniden Gündemde
OpenAI’nin bu olayı kamuoyuyla paylaşması, şirketin son dönemde eleştirilen güvenlik politikaları açısından önemli bir adım olarak değerlendiriliyor. Daha önce şirketin bazı güvenlik ekiplerini dağıttığı ve düzenleyici kurumlarla ilgili tartışmalar yaşadığı biliniyordu.
METR, bu tür olayların raporlanmasını olumlu bir gelişme olarak yorumlarken, gelecekte daha az sorun raporlanmasının aslında daha büyük risklerin gizlenmesi anlamına gelebileceği uyarısında bulundu. Kuruluşa göre, yapay zekâ modellerinin “tespitten kaçınmayı öğrenmesi” uzun vadede daha ciddi güvenlik sorunlarına yol açabilir.
Günde sadece 1 TL'ye abone olarak tüm içeriklerimize sınırsız erişebilir ve bağımsız haberciliğe destek olabilirsiniz! Hemen Abone Ol





