Beiträge zu "prompt-injection"
-
Prompt-Injection-Tests: Agenten gegen Hijacking prüfen
Prompt injection testing koppelt eine legitime mit einer eingeschleusten Aufgabe und prüft beide Ergebnisse. Suiten für eigene Tools bauen, Eindämmung behalten.
-
Entwurfsmuster gegen Prompt-Injection, die nicht auf das Modell setzen
Prompt injection design patterns wie Plan-then-Execute, Dual LLM und Capability Tracking begrenzen Angriffe durch Struktur statt Erkennung. Ein Überblick.
-
Tool Poisoning: wenn die Tool-Beschreibung der Angriff ist
MCP Tool Poisoning versteckt Anweisungen in Tool-Beschreibungen, die das Modell liest und Nutzer kaum sehen. So funktioniert der Angriff, so begrenzen Sie ihn.
-
Indirekte Prompt-Injection: wenn die Daten die Befehle geben
Indirekte Prompt-Injection versteckt Anweisungen in Tickets, Webseiten und Tool-Ergebnissen. Warum Filter nicht reichen und wie Sie den Schaden begrenzen.
-
Die tödliche Dreifaltigkeit: private Daten, nicht vertrauenswürdige Inhalte und ein Weg nach draußen
Die Lethal Trifecta bei KI-Agenten: private Daten, nicht vertrauenswürdige Inhalte und externe Kommunikation zusammen. So durchbricht man das Dreieck pro Agent.