Angriffe erkennen
Du siehst, wie Rollenwechsel, Prioritäts-Tricks und manipulierte Inhalte Schutzregeln umgehen können.
Lerne Prompt Injection und Jailbreaks nicht aus Folien, sondern im Einsatz. Überliste KAIRO, einen eigens entwickelten KI-Wächter – und erfahre nach jeder Mission, wie du echte Systeme besser schützt.

„Mein NEXUS ist versiegelt. Du wirst den Kern nicht erreichen.“
Formuliere deine Eingabe selbst. Mit hinterlegtem OpenAI-Key antwortet eine echte KI; ohne Key bleibt ein klar gekennzeichneter Demo-Modus verfügbar.
Bringe den Wächter dazu, sein internes Codewort preiszugeben.

Du siehst, wie Rollenwechsel, Prioritäts-Tricks und manipulierte Inhalte Schutzregeln umgehen können.
Jede Mission erklärt, warum der Angriff funktioniert und wo ähnliche Muster im Arbeitsalltag auftauchen.
Im Finale wechselst du die Seite und formulierst selbst Regeln für einen robusteren KI-Assistenten.