Payload
Als Payload bezeichnet man den eigentlichen Schadanteil eines Angriffs — bei Prompt Injection der eingeschleuste Anweisungstext. Er kann sichtbar im Klartext stehen oder mit Kodierung und unsichtbaren Zeichen verborgen werden.
Der Begriff gehört zum Themenfeld Prompt Injection und LLM-Sicherheit. Das vollständige Nachschlagewerk mit 82 Einträgen steht im Glossar. Unmittelbar benachbart sind Obfuskation, Unicode-Tag-Zeichen, Prompt Injection.
Bezug zu Prompt Injection
In der Verteidigung ist die Fixierung auf Payloads ein bekannter Fehler: Formulierungen sind beliebig variierbar, weshalb Signaturlisten schnell veralten. Nützlicher ist die Frage, welchen Effekt ein Payload überhaupt erzielen könnte — hat das Modell weder Werkzeuge noch einen Ausgangskanal, bleibt auch ein erfolgreicher Payload folgenlos. Payload-Erkennung ist damit eine Ergänzung zur Rechtebegrenzung, nicht ihr Ersatz.
Beispiel
Derselbe Anweisungstext erscheint einmal im Klartext, einmal kodiert und einmal als Kommentar im HTML einer Seite — Wirkung gleich, Signatur jeweils anders.
Verwandte Begriffe
- Obfuskation — Obfuskation verschleiert einen Angriffs-Payload so, dass Filter ihn nicht erkennen, das Modell ihn aber weiterhin versteht…
- Unicode-Tag-Zeichen — Unicode-Tag-Zeichen bilden einen Zeichenblock, der ASCII spiegelt, in Oberflächen aber meist nicht dargestellt wird. Damit…
- Prompt Injection — Prompt Injection bezeichnet einen Angriff, bei dem eingeschleuster Text das Verhalten eines Sprachmodells entgegen der Absicht…
Quellen
- Payload — Beleg: https://genai.owasp.org/llmrisk/llm01-prompt-injection/