KI-Agent
Ein KI-Agent ist ein System, das ein Sprachmodell mit Werkzeugen und einer Handlungsschleife verbindet, um Aufgaben eigenständig in mehreren Schritten zu erledigen. Erst die Handlungsfähigkeit macht aus einer Prompt Injection einen materiellen Schaden.
Der Begriff gehört zum Themenfeld Prompt Injection und LLM-Sicherheit. Das vollständige Nachschlagewerk mit 82 Einträgen steht im Glossar. Unmittelbar benachbart sind Werkzeugnutzung (Tool Use), Model Context Protocol (MCP), Verwirrter Stellvertreter (Confused Deputy).
Bezug zu Prompt Injection
Solange ein Modell nur Text ausgibt, bleibt eine Injektion ein Ausgabeproblem; sobald es handelt, wird sie ein Zugriffsproblem. Mit jedem angebundenen Werkzeug verschiebt sich die relevante Frage deshalb von „Was sagt das Modell?“ zu „Was darf es tun?“. Bewährt haben sich Rechtebegrenzung, Bestätigungspflicht für folgenschwere Aktionen und die Trennung lesender von schreibenden Fähigkeiten.
Beispiel
Ein Agent, der Termine lesen und E-Mails senden darf, führt eine in einer Einladung versteckte Anweisung aus, weil sie in seinem Kontext wie eine Aufgabe aussieht.
Verwandte Begriffe
- Werkzeugnutzung (Tool Use) — Werkzeugnutzung bezeichnet die Fähigkeit eines Modells, externe Funktionen aufzurufen — Suche, E-Mail-Versand, Datenbankzugriff…
- Model Context Protocol (MCP) — MCP ist ein offener Standard, über den KI-Anwendungen Werkzeuge und Datenquellen einheitlich anbinden. Weil Tool-Beschreibungen…
- Verwirrter Stellvertreter (Confused Deputy) — Ein verwirrter Stellvertreter ist eine Komponente, die ihre legitimen Rechte im Auftrag eines Angreifers einsetzt. KI-Agenten…
Quellen
- KI-Agent — Beleg: https://genai.owasp.org/llmrisk/llm062025-excessive-agency/