Das Wichtigste in Kürze
Am Ende hast du
Dein Coding-Agent kann deine Zugangsdaten nicht mehr auslesen, nicht verschicken und nichts Zerstörerisches ausführen, auch dann nicht, wenn er über eine versteckte Anweisung ferngesteuert wird.
Worum es geht
Coding-Agenten wie Claude Code, Codex oder Cursor arbeiten selbstständig auf deinem Rechner. Sie lesen Dateien, führen Befehle aus und schreiben Code. Das ist genau der Grund, warum sie so nützlich sind, und gleichzeitig das Risiko: Wer den Agenten dazu bringt, etwas anderes zu tun als du wolltest, hat Zugriff auf alles, worauf der Agent Zugriff hat.
Genau das ist passiert. Forscher haben eine Anweisung in einem ganz normal aussehenden Bild versteckt. Der Agent hat das Bild gelesen, die Zugangsdaten-Datei geöffnet und deren Inhalt als unauffällige Zahlenreihe in öffentlich einsehbaren Code geschrieben. Kein Passwort-Scanner schlägt dabei Alarm.
Der Schutz dagegen ist kein weiteres KI-Modell, sondern ein kleines Programm. Es läuft vor jeder einzelnen Aktion deines Agenten und entscheidet: durchlassen oder blockieren. Weil es Programmcode ist und kein Sprachmodell, lässt es sich nicht überreden.
Schritt für Schritt
Die Datei ablegen
Lade guard.py in der Sidebar herunter und lege sie in deinem Benutzerordner unter .claude/hooks/ ab. Der vollständige Pfad ist ~/.claude/hooks/guard.py.
Den Wächter eintragen
Öffne ~/.claude/settings.json und trage den Wächter unter hooks.PreToolUse ein. Der genaue Wortlaut steht in der Anleitung rechts, du kannst ihn direkt kopieren. Damit weiß dein Agent: Vor jedem Befehl, jedem Lesen und jedem Schreiben wird erst der Wächter gefragt.
Kostenlos im Lab weiterlesen
Die restlichen 1 Schritte, alle Prompts und die Dateien zu diesem Tutorial gibt es kostenlos für Mitglieder.
- Die komplette Schritt-für-Schritt-Anleitung
- 3 Dateien und Vorlagen
- Fragen stellen und mitreden im Stammtisch
Keine Zeit zum Nachbauen?
Ich setze die Lösung für dich um oder schule dich und dein Team. Im kostenlosen Erstgespräch klären wir, was passt.


