A.E.G.I.S

KI/SEC 26

Leuchtender abstrakter KI-Kern, umgeben von zwei Ringen aus Lichtpartikeln als Sinnbild für Schutz und Überwachung
Drei
große
Angriffs­vektoren

Prompt-Injection, Data Poisoning und Modelldiebstahl – verständlich erklärt, mit konkreten Gegenmaßnahmen.

Dunkles neuronales Netzwerk aus Lichtlinien

Ein Wissenshub für sichere KI-Systeme.

Von der Bedrohungsanalyse bis zur Härtung der eigenen Modelle: alle Themen auf einer Seite.

26Themen
01 / Bedrohungen

Angriffe auf KI-Systeme folgen selten der Gewalt klassischer Hackerangriffe. Sie arbeiten mit Sprache, Daten und Geduld – und genau deshalb muss man ihre Mechanik verstehen.

01

Prompt-Injection

Versteckte Anweisungen in Texten, Dokumenten oder Webseiten überschreiben die eigentlichen Regeln eines Sprachmodells – und lenken es zu fremden Zwecken.

GegenmaßnahmeEingaben strikt von Anweisungen trennen, System-Prompts härten und jede Modellantwort vor der Weiterverarbeitung prüfen.

02

Data Poisoning

Vergiftete Trainingsdaten schleusen gezielt Schwächen in Modelle ein: Das Modell lernt falsche Muster – und trifft später sicher wirkende, aber falsche Entscheidungen.

GegenmaßnahmeDatenquellen prüfen und protokollieren, Trainingsläufe versionieren und Modelle vor dem Einsatz gegen veränderte Muster testen.

03

Modelldiebstahl

Über viele gezielte Abfragen rekonstruieren Angreifer ein fremdes Modell – inklusive seiner Schwächen. Das geistige Eigentum wird zur Angriffsfläche.

GegenmaßnahmeAPI-Zugriffe drosseln und überwachen, Antwortmuster auf Abnormitäten prüfen und Modelle nur verschleiert ausliefern.

94%

der Unternehmen in Deutschland nutzen bereits KI – oft, ohne ihre Angriffsflächen zu kennen.

68%

aller dokumentierten Angriffe auf Sprachmodelle laufen über Prompt-Injection.

312+

bekannte Angriffsmuster gegen KI-Systeme sind in öffentlichen Datenbanken erfasst.

24/7

muss Monitoring laufen: Angriffe auf Modelle kennen keine Bürozeiten.

02 / Wissen

Sechs Bereiche, aufgebaut wie eine Kette: vom Verständnis der Angriffsmechanik bis zum betriebsfähigen Schutz. Jeder Beitrag ist in unter zwölf Minuten gelesen.

01

Prompt-Sicherheit

Warum Sprachmodelle Anweisungen nicht unterscheiden können – und wie man Eingaben trotzdem eingrenzt.

Grundlagen · 8 Min
02

Datenvergiftung erkennen

Wie vergiftete Trainingsdaten aussehen, wo sie eingeschleust werden und welche Signale auf einen Befund hindeuten.

Analyse · 11 Min
03

Adversariale Beispiele

Millimeterfeine Störungen genügen, damit ein Bildmodell einen Stopp-Schilder-Verkehr zur Freigabe erklärt.

Grundlagen · 7 Min
04

Modell-Diebstahl

Abfrage-Angriffe verstehen, Rate-Limits richtig setzen und eigene Modelle gegen Rekonstruktion schützen.

Schutz · 9 Min
05

Compliance & EU AI Act

Welche Pflichten das Gesetz für KI-Systeme vorsieht – und wie Sicherheit zum Beleg wird.

Regulatorik · 12 Min
06

Monitoring & Betrieb

Anomalie-Erkennung im Betrieb, Protokollierung von Modellentscheidungen und der Ernstfall-Playbook.

Betrieb · 10 Min
03 / Lernpfad

Verstehen

Zuerst die Mechanik: Wie denken Angreifer, welche Werkzeuge nutzen sie, warum genügt einer einzigen Eingabe der Umsturz eines Modells.

Erkennen

Dann die Signatur: Welche Muster im Datenverkehr, in Trainingsdaten und in Modellantworten verraten einen laufenden Angriff, bevor Schaden entsteht.

Abwehren

Zuletzt die Praxis: Härtung, Rate-Limits, Playbooks. Jeder Beitrag endet mit Maßnahmen, die du direkt am eigenen System prüfen kannst.

04 / FAQ
Für wen ist dieser Wissenshub gedacht?

Für alle, die KI-Systeme bauen, kaufen oder verantworten: Entwicklerinnen und Entwickler, Product Owner, Datenschutz- und Sicherheitsverantwortliche – und jede Person, die verstehen will, wie Angriffe auf KI wirklich funktionieren.

Brauche ich Vorwissen in Sicherheitstechnik?

Nein. Die Grundlagen-Reihe beginnt bei der Mechanik der Modelle und erklärt jeden Angriff am konkreten Beispiel. Wer schon Erfahrung hat, springt direkt in die Schutz- und Betriebs-Themen.

Sind die Gegenmaßnahmen direkt umsetzbar?

Ja. Jeder Beitrag endet mit einer geprüften Maßnahmenliste: von Prompt-Härtung und Rate-Limits bis zum Playbook für den Ernstfall – ohne Produktwerbung, nur Verfahren.

Wie aktuell sind die Inhalte?

Die Bedrohungslage verändert sich schnell. Alle Beiträge nennen ihr Prüfdatum, und die Zahlen zur Lage werden regelmäßig gegen öffentliche Datenbanken abgeglichen.

05 / Anfang

Wissen
schützt.

Der beste Zeitpunkt, KI-Sicherheit zu verstehen, war vor dem ersten Angriff. Der zweitbeste ist jetzt.