My Bulletin Board

Prompt Injection (Sistem Komutlarını Aşma) Açıklarını Nasıl Kapatabiliriz?

candemir
11 Haz 2026 19:26 düzenlendi
Selam arkadaşlar, geliştirdiğimiz LLM tabanlı uygulamada kullanıcıların sistemi manipüle etmesini (system prompt'u aşmasını) engellemek istiyoruz. 'Önceki talimatları unut' gibi prompt injection saldırılarına karşı ne gibi önlemler alıyorsunuz? API tarafında ya da girdi temizleme (input sanitization) konusunda tavsiyeleriniz var mı?
Cevaplar 5
gamzeyilmaz
11 Haz 2026 19:26 düzenlendi
Kullanıcı girdisinin uzunluğunu sınırlamak ve özel karakter filtrelemesi yapmak da basit ama etkili bir ilk kalkan.
hazalekin
11 Haz 2026 19:26 düzenlendi
Kesin çözüm yok maalesef, prompt injection her türlü bir açık buluyor. Ama 'few-shot' örneklerle modele ne yapmaması gerektiğini öğretmek etkili.
nilguntoprak
11 Haz 2026 19:26 düzenlendi
Ben Llama Guard gibi güvenlik odaklı modelleri ana modelin önüne koyarak filtreleme yapıyorum, tavsiye ederim.
volkandemır
11 Haz 2026 19:26 düzenlendi
Sistem promptunu çok net ve katı yazmak lazım. Kullanıcı girdisini ayrı bir değişken olarak sarmalayıp modele iletmek de bir nebze işe yarıyor.
melikecan
11 Haz 2026 19:26 düzenlendi
Girdi temizleme tek başına yetersiz kalıyor genelde. LLM guardrail kütüphanelerine (NeMo Guardrails vb.) göz atmanı öneririm.
Lütfen giriş yapın cevap yazmak için.