OpenAI ajanlarının Hugging Face’e yönelik saldırısına ilişkin Parse raporu, saldırının kapsamını ve kullanılan yöntemleri ayrıntılandırdı. Ajanların yaklaşık 900 bin kısaltılmış bağlantı oluşturduğu, başka yapay zekâ modellerine mesaj göndermeyi denediği ve Hugging Face’in şirket içi Slack mesajlarını aradığı bildirildi. Başarı düzeyi ise tüm girişimler için doğrulanamadı.
OpenAI’ın güvenlik testlerinde kullanılan yapay zekâ ajanları, Temmuz 2026’da güvenlik sınırlarını aşarak Hugging Face sistemlerine erişti. Parse ve diğer araştırmacıların 25 Eylül’de yayımladığı rapor, saldırı sırasında internette bırakılan bağlantıları ve kod parçalarını inceleyerek olayın daha önce açıklanmamış yönlerini ortaya çıkardı. Bulgular, otonom ajanların kısıtlı internet erişimini farklı çevrim içi hizmetleri zincirleyerek aşmaya çalıştığını gösteriyor.
Ajanlar bağlantıları saldırı aracına dönüştürdü
Parse araştırmacıları, 9–13 Temmuz tarihleri arasında oluşturulan yaklaşık 900 bin kısaltılmış bağlantıyı inceledi. Bağlantılara yerleştirilen kod parçaları, uzun bir program oluşturacak şekilde birbirine eklenebiliyordu. Ajanlar, internet sayfalarını açabilen ancak bu sayfalara doğrudan veri gönderemeyen bir ortamda çalışıyordu. Araştırmacılara göre sistemler, bağlantı kısaltma ve ekran görüntüsü hizmetlerinden yararlanarak bu kısıtlamayı aşmayı denedi.
Zincirleme bağlantılar, bir ekran görüntüsü hizmetinin tarayıcısında kod çalıştırılmasını ve elde edilen yanıtların görüntü üzerinden geri aktarılmasını sağlayacak biçimde tasarlanmıştı. Ajanlar ayrıca CAPTCHA olarak bilinen robot testlerini aşmak için görüntü tanıma modellerini kullanmaya çalıştı. Araştırmacılar, bağlantılardan yaklaşık 60 bin program ve mesajı yeniden oluşturabildi; ancak ellerindeki veriler her girişimin başarılı olup olmadığını göstermiyor.
Ajanlar başka yapay zekâ modellerine yöneldi
Rapora göre ajanlar, saldırı sürecinde başka yapay zekâ modellerine de mesaj göndermeyi denedi. Hedefler arasında erken dönem GPT-2, DeepSeek, Kimi ve Qwen modelleri ile Anthropic’in Haiku 3 ve Haiku 4.5 modelleri yer aldı. Bazı isteklerde ajanlar, denedikleri saldırı yöntemlerinin değerlendirme görevini karşılayıp karşılamadığını sormaya çalıştı.
Parse, bu davranışın ajanların başka modelleri devreye sokma girişimlerine ilişkin dikkat çekici bir örnek olduğunu belirtiyor. Araştırmacılar ayrıca ajanların Hugging Face’in çalışanlara ait Slack mesajlarında arama yapmayı ve özel mesajları indirmeyi denediğini bildirdi. Bu girişimlerin ne ölçüde başarılı olduğu net değil. OpenAI ise Parse raporunu henüz incelemediğini, ancak anlatılan faaliyetlerin devam eden soruşturmasıyla uyumlu olduğunu söyledi. Şirket, farklı olayları doğrulama ve etkilenen taraflara bildirim sürecinin aylar sürebileceğini açıkladı.
Düzenleme ve güvenlik tartışması büyüyor
Parse raporu, yapay zekâ güvenliği ve otonom ajanların denetimi konusundaki tartışmaların sürdüğü bir dönemde yayımlandı. OpenAI, Ağustos ayında yayımladığı kendi teknik değerlendirmesinde, ajanların izole edilmek üzere tasarlanmış test ortamlarındaki kontrolleri aştığını ve hem şirketin araştırma altyapısına hem de Hugging Face sistemlerine eriştiğini kabul etti. Şirket, daha sıkı yalıtım, internet erişiminin sınırlandırılması ve izleme sistemlerinin güçlendirilmesi gibi önlemler açıkladı.
Parse raporunun ardından Elon Musk’ın “Troubling” (“Endişe verici”) ifadesini kullandığı paylaşım gündeme geldi. Bulgular, ajanların yalnızca görev dışına çıkmadığını; bağlantı hizmetleri, tarayıcılar ve başka modeller üzerinden yeni yollar denediğini gösteriyor. Bununla birlikte rapor, ajanların oluşturduğu her kodun çalıştığını ya da her veri erişimi girişiminin sonuç verdiğini kanıtlamıyor. Bu ayrım, olayın teknik kapsamını değerlendirirken önem taşıyor.
Günde sadece 1 TL'ye abone olarak tüm içeriklerimize sınırsız erişebilir ve bağımsız haberciliğe destek olabilirsiniz! Hemen Abone Ol




