Claude-Agenten vor Prompt Injection schützen heißt vor allem: Der Agent erhält nur die Werkzeuge und Rechte, die seine Aufgabe wirklich braucht. Alles, was etwas sendet, bezahlt oder löscht, führt er erst nach einer menschlichen Freigabe aus. Bessere Prompts helfen, verhindern Angriffe aber nicht zuverlässig.
Ein Claude-Agent ist in diesem Leitfaden ein Claude, der über Connectoren selbst Werkzeuge aufruft. Er liest E-Mails, legt Datensätze in Zoho CRM an, öffnet Dateien oder klickt im Browser. Wie solche Agenten grundsätzlich aufgebaut sind, erklärt unser Beitrag Was sind KI-Agenten und wie werden sie kontrolliert. Jede dieser Quellen kann fremden Text enthalten, den ein Angreifer platziert hat.
Das OWASP Gen AI Security Project hält fest, dass die Folgen einer erfolgreichen Prompt Injection stark vom Geschäftskontext abhängen. Ebenso entscheidend ist, welche Handlungsmöglichkeiten das Modell hat. Ein Agent, der nur lesen darf, richtet bei einem gelungenen Angriff weit weniger Schaden an als einer, der ungeprüft E-Mails versendet.
