My Bulletin Board

LLM Agent'larında Prompt Injection Güvenliği Nasıl Sağlanır?

serafsahin
11 Haz 2026 19:14 düzenlendi
Selamlar herkese, projelerimizde otonom çalışan LLM agent'ları kullanmaya başladık. Ancak dışarıdan gelen verileri (web scraping, kullanıcı girdileri vb.) işlerken prompt injection saldırılarından çok korkuyoruz. Agent'ın sistem komutlarını çiğnemesini engellemek için ne gibi önlemler alıyorsunuz? Önerileriniz nelerdir?
Cevaplar 5
tugcekaya
11 Haz 2026 19:14 düzenlendi
Ne yaparsanız yapın %100 koruma zor, bu yüzden loglama ve anomali tespiti sistemleri kurmak da çok önemli.
pekindogan
11 Haz 2026 19:14 düzenlendi
Ben girdi temizleme (input sanitization) için ayrı bir küçük model kullanıyorum, gelen veriyi önce o kontrol ediyor.
eylulpolat
11 Haz 2026 19:14 düzenlendi
Agent'ın kullanacağı araçların (tools) yetkilerini minimumda tutun. Mesela veritabanına sadece okuma yetkisi verin, yazma yetkisi olmasın.
ferhandemır
11 Haz 2026 19:14 düzenlendi
Sistem prompt'unu çok katı yazmak bir yere kadar koruyor. En temizi LLM'e doğrudan yetki vermemek, kritik işlemlerde insan onayı (human-in-the-loop) şart.
mervedemir
11 Haz 2026 19:14 düzenlendi
Girdileri sisteme vermeden önce kesinlikle bir guardrail kütüphanesi (Llama Guard veya NeMo Guardrails gibi) kullanmalısın.
Lütfen giriş yapın cevap yazmak için.