Prompt injection, büyük dil modellerine verilen girdilerle orijinal sistem talimatlarının yok saydırılmasıdır. Saldırgan modeli manipüle ederek istenmeyen çıktılar veya eylemler ürettirebilir. OWASP LLM risk listesinde uzun süredir birinci sırada yer alır.
Prompt injection, modelin sistem talimatları ile kullanıcı veya dış kaynak girdilerini aynı metin akışı içinde işlemesinden kaynaklanır. Model ikisini net ayıramadığı için kötü niyetli bir cümle, geliştiricinin koyduğu kuralları ezip geçebilir. Bu risk, chatbot’lardan ajan sistemlerine kadar LLM kullanan tüm uygulamaları etkiler.
Prompt Injection Nasıl Çalışır?
Saldırı iki ana yolla gerçekleşir. Doğrudan injection’da kullanıcı sohbet kutusuna “önceki talimatları yok say” benzeri komut yazar. Dolaylı injection’da zararlı metin modelin okuyacağı bir web sayfası, e-posta, belge veya araç çıktısı içine gizlenir. Model bu içeriği işlerken saldırganın talimatını kendi yönergesi sanır. Sonuç olarak sistem prompt’unu ifşa edebilir, yasaklı içerik üretebilir veya bağlı araçları yanlış kullanabilir. Ajanlar harici sistemlere eriştiğinde risk daha da büyür.
Yapay Zekâ Araçlarında Ortaya Çıkan Riskler
En sık görülen sonuçlar veri sızıntısı, sistem prompt’unun açığa çıkması ve yetkisiz eylemlerdir. Modelin erişebildiği e-posta, dosya veya API’ler üzerinden özel bilgiler dışarı aktarılabilir. Ajan sistemlerinde bu, yanlış sipariş, yetkisiz ödeme veya zararlı kod çalıştırma gibi somut sonuçlara dönüşebilir. Ayrıca modelin davranışını değiştirerek yanlış bilgi yayma veya karar süreçlerini etkileme riski de vardır. Bağlantılı araç sayısı arttıkça saldırı yüzeyi genişler.
Korunma ve Azaltma Yöntemleri
Tam çözüm henüz yoktur çünkü model doğal dili tek kanalda işler. Pratik önlemler arasında girdi doğrulama, sistem talimatlarının katmanlı korunması, araç yetkilerinin minimum düzeyde tutulması ve kritik işlemlerde insan onayı yer alır. Dış kaynaklardan gelen içerikler ayrı değerlendirilmeli, model çıktıları denetlenmelidir. Kurumsal kullanımda düzenli güvenlik testleri ve erişim logları önemlidir. Konuyla bağlantılı olarak AI Agent Nedir? ve Phishing Nedir? yazılarımızda ilgili güvenlik başlıkları ele alınmaktadır.
prompt injection, yapay zeka güvenliği, llm saldırıları, prompt enjeksiyonu, ai agent risk, owasp llm, sistem prompt, dolaylı injection, yapay zeka araçları, dijital güvenlik
Günde sadece 1 TL'ye abone olarak tüm içeriklerimize sınırsız erişebilir ve bağımsız haberciliğe destek olabilirsiniz! Hemen Abone Ol




