🚧
Abwehr von Prompt Injection
Sicherheit
Über die Leistung
Sobald ein System fremde Texte verarbeitet – Webseiten, E-Mails, hochgeladene Dateien –, können darin Anweisungen versteckt sein, die das Modell befolgt. Gegenmaßnahmen sind gestaffelt: Anweisung und Inhalt klar trennen, dem System nur die Rechte geben, die es braucht, die Ausgabe vor der Weiterverarbeitung prüfen und alles protokollieren. Grenze: Eine vollständige Abwehr gibt es nach heutigem Stand nicht. Der wirksamste Schutz ist deshalb, dem Modell keine Berechtigung zu geben, deren Missbrauch man nicht verkraften würde.
Was dazugehört
Bedrohungsanalyse
Trennung von Anweisung und Inhalt
Rechtebegrenzung
Ausgabeprüfung
Protokollierung
Kurz gesagt
Rechte begrenzen, weil sich Eingaben nicht vollständig absichern lassen