Sicherung von KI-Systemen1 / 5
Welche Sicherheitsmaßnahme wirkt als Filter zwischen Benutzereingaben und einem LLM, um bösartige Prompts zu erkennen und zu blockieren?
RichtigFalsch
Alex
Eine Prompt-Firewall ist eine KI-spezifische Sicherheitsmaßnahme, die dafür gebaut ist, Benutzereingaben zu filtern und zu prüfen, bevor sie das Sprachmodell erreichen. Sie funktioniert ähnlich wie eine Web Application Firewall, ist aber eigens für LLM-Interaktionen entwickelt. Prompt-Firewalls analysieren eingehende Prompts auf Muster, die mit Prompt Injection, Jailbreak-Versuchen und Richtlinienverstößen zusammenhängen. Sie können bösartige Eingaben blockieren oder bereinigen und verdächtige Aktivitäten protokollieren. Manche Prompt-Firewalls prüfen außerdem die Modellausgaben auf abfließende sensible Daten oder schädliche Inhalte. Das ist eine zentrale Gateway-Kontrolle in der SecAI+-Prüfung und gehört neben Rate Limits, Token-Limits und Zugriffskontrollen für Endpoints in die Kategorie der Model Security Controls. Prüfungstipp: Prompt-Firewalls sind KI-Sicherheitsmaßnahmen auf der Eingabeseite — sie sitzen am Gateway zwischen Nutzern und Modell.
Antworten auf Rückfragen bekommst du in der App. Erstelle ein kostenloses Konto — ohne Kreditkarte.
Frage 1 von 5
Kostenloses Konto erstellen