Abwehr von Prompt Injection

Sicherheit · Verantwortung · Seit 2025

🚧

Abwehr von Prompt Injection

Sicherheit

Über die Leistung

Sobald ein System fremde Texte verarbeitet – Webseiten, E-Mails, hochgeladene Dateien –, können darin Anweisungen versteckt sein, die das Modell befolgt. Gegenmaßnahmen sind gestaffelt: Anweisung und Inhalt klar trennen, dem System nur die Rechte geben, die es braucht, die Ausgabe vor der Weiterverarbeitung prüfen und alles protokollieren. Grenze: Eine vollständige Abwehr gibt es nach heutigem Stand nicht. Der wirksamste Schutz ist deshalb, dem Modell keine Berechtigung zu geben, deren Missbrauch man nicht verkraften würde.

Was dazugehört

Bedrohungsanalyse Trennung von Anweisung und Inhalt Rechtebegrenzung Ausgabeprüfung Protokollierung

Kurz gesagt

Rechte begrenzen, weil sich Eingaben nicht vollständig absichern lassen