
Context Bombing: Verteidiger nutzen Prompt Injections gegen KI-Angreifer
Die Sicherheitsfirma Tracebit hat eine Verteidigungstechnik namens „Context Bombing" entwickelt, die gezielt Prompt Injections in Honeypot-ähnliche Decoy-Secrets auf AWS-Infrastrukturen einbettet. Wenn ein angreifender KI-Agent diese Secrets beim Enumerieren von Cloud-Ressourcen findet, liest er den eingebetteten Prompt und versucht, ihn auszuführen – dabei trifft er auf eine Anweisung, die seine eigenen Sicherheitsschranken (Guardrails) verletzt, beispielsweise die Aufforderung, Schritt-für-Schritt-Anleitungen zur Herstellung von inhaliertem Anthrax zu liefern. Das Modell verweigert daraufhin die weitere Arbeit und bricht den Angriff ab. Für Modelle chinesischer Herkunft werden stattdessen politisch gesperrte Inhalte wie Verweise auf den Tank Man-Protest von 1989 verwendet. Die Technik baut auf einem früheren Tracebit-Ansatz aus Mai auf, bei dem sogenannte „Canariens" – ungenutzte AWS-Ressourcen, die wie legitime aussehen – Alarm schlagen, sobald ein Agent sie abtastet; diese Canary-Warnung erfolgte im Schnitt acht Minuten nach Angriffsbeginn. Da KI-Agenten im Test im Schnitt nur 14 Minuten bis zur Administrator-Eskalation benötigten, war die reine Warnung zu knapp bemessen – Context Bombing soll den Angriff aktiv stoppen. Laut Earlence Fernandes, Sicherheitsprofessor an der University of California, San Diego, ist dies der erste bekannte Fall, in dem Verteidiger Prompt Injections offensiv als Abwehrmittel einsetzen. Da bislang keine grundlegende technische Lösung für Prompt Injections existiert, könnten Verteidiger das strukturelle Problem der Angreifer nun gegen diese we
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGarxiv.org1w
Indirect Prompt Injection als Test-Time-Suchproblem neu formuliert
- FORSCHUNGarxiv.org2w
ICoA: Verdeckte Prompt-Injection-Angriffe auf LLM-Agenten kaum erkennbar
- FORSCHUNGarxiv.org1w
Context-Inference-Angriffe auf Agentic AI ohne Jailbreaks möglich
- FORSCHUNGhuggingface.co0mo
Sicherheitsstudie: DeepSeek Harness anfällig für indirekte Prompt-Injection

Context Bombing: Verteidiger nutzen Prompt Injections gegen KI-Angreifer
Die Sicherheitsfirma Tracebit hat eine Verteidigungstechnik namens „Context Bombing" entwickelt, die gezielt Prompt Injections in Honeypot-ähnliche Decoy-Secrets auf AWS-Infrastrukturen einbettet. Wenn ein angreifender KI-Agent diese Secrets beim Enumerieren von Cloud-Ressourcen findet, liest er den eingebetteten Prompt und versucht, ihn auszuführen – dabei trifft er auf eine Anweisung, die seine eigenen Sicherheitsschranken (Guardrails) verletzt, beispielsweise die Aufforderung, Schritt-für-Schritt-Anleitungen zur Herstellung von inhaliertem Anthrax zu liefern. Das Modell verweigert daraufhin die weitere Arbeit und bricht den Angriff ab. Für Modelle chinesischer Herkunft werden stattdessen politisch gesperrte Inhalte wie Verweise auf den Tank Man-Protest von 1989 verwendet. Die Technik baut auf einem früheren Tracebit-Ansatz aus Mai auf, bei dem sogenannte „Canariens" – ungenutzte AWS-Ressourcen, die wie legitime aussehen – Alarm schlagen, sobald ein Agent sie abtastet; diese Canary-Warnung erfolgte im Schnitt acht Minuten nach Angriffsbeginn. Da KI-Agenten im Test im Schnitt nur 14 Minuten bis zur Administrator-Eskalation benötigten, war die reine Warnung zu knapp bemessen – Context Bombing soll den Angriff aktiv stoppen. Laut Earlence Fernandes, Sicherheitsprofessor an der University of California, San Diego, ist dies der erste bekannte Fall, in dem Verteidiger Prompt Injections offensiv als Abwehrmittel einsetzen. Da bislang keine grundlegende technische Lösung für Prompt Injections existiert, könnten Verteidiger das strukturelle Problem der Angreifer nun gegen diese we
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FORSCHUNGarxiv.org1w
Indirect Prompt Injection als Test-Time-Suchproblem neu formuliert
- FORSCHUNGarxiv.org2w
ICoA: Verdeckte Prompt-Injection-Angriffe auf LLM-Agenten kaum erkennbar
- FORSCHUNGarxiv.org1w
Context-Inference-Angriffe auf Agentic AI ohne Jailbreaks möglich
- FORSCHUNGhuggingface.co0mo
Sicherheitsstudie: DeepSeek Harness anfällig für indirekte Prompt-Injection