# Was ist Adversarial Machine Learning?

> Adversarial Machine Learning ist das Feld, das sich mit Angriffen befasst, die Machine-Learning-Systeme ausnutzen, sowie mit Methoden, diese Angriffe zu verstehen und zu entschärfen.

- Kanonische URL: https://yellowcube.eu/de/glossary/adversarial-machine-learning/
- Herausgeber: Yellow Cube
- Sprache: de
- Kontakt: hello@yellowcube.eu

## Inhalt

Es untersucht, wie ein Gegner Daten, Modelle, Eingaben, Ausgaben oder umgebende Workflows beeinflussen kann, um Vertraulichkeits-, Integritäts-, Verfügbarkeits- oder Acceptable-Use-Ziele zu verletzen. Es ist ein Korpus von Angriffs- und Abwehrwissen, nicht der Name eines bestimmten Exploits.

NISTs aktuelle Taxonomie ordnet Angriffe über Dimensionen wie Lebenszyklusphase, Ziel, Zielsetzung, Fähigkeit und Wissen des Gegners. Relevante Familien umfassen Evasion zur Inferenzzeit, Poisoning während des Trainings, Privacy-Angriffe und Missbrauch generativer Systeme über Prompting oder Fehlgebrauch. Reale Systeme erben zudem konventionelle Schwächen in Identitäten, APIs, Software, Cloud-Diensten und Lieferketten — eine Adversarial-ML-Bewertung sollte Modellverhalten daher mit der vollständigen Anwendung verknüpfen.

### Wichtigste Punkte

- **Angriffsphase:** Bestimmen, ob der Gegner Datenerhebung, Training, Modellverteilung, Bereitstellung, Inferenzeingaben, Retrieval, Feedback oder verbundene Aktionen beeinflussen kann.
- **Gegnerbedingungen:** Festlegen, welchen Zugriff, welches Wissen, welche Kontrolle, Ressourcen und Abfragemöglichkeiten ein Angriff annimmt; ein Ergebnis unter vollem Modellzugriff überträgt sich möglicherweise nicht auf einen Remote-Dienst.
- **Sicherheitsziele:** Verfügbarkeitsausfälle, ungezielte oder gezielte Integritätsverletzungen, Privacy-Verlust, Modellklau und Missbrauch gegen Konsequenzen bewerten, die im eingesetzten Kontext bedeutsam sind.
- **Defensive Praxis:** Modellebene-Evaluation mit Provenance, Zugriffskontrolle, sicherem Engineering, Monitoring, Incident Response und Beschränkungen nachgelagerter Entscheidungen oder Aktionen kombinieren.
- **Wichtige Einschränkung:** Robustheit gegen einen bekannten Benchmark oder eine Angriffsmethode ist keine allgemeine Sicherheit. Angreifer passen sich an, Forschungsannahmen variieren, und Kontrollen, die eine Eigenschaft verbessern, können Anwendungs- oder menschliche Vertrauensgrenzen offen lassen.

### Verwandte Begriffe

[AI Security](<https://yellowcube.eu/de/glossary/ai-security/>) · [Data Poisoning](<https://yellowcube.eu/de/glossary/data-poisoning/>) · [Model Poisoning](<https://yellowcube.eu/de/glossary/model-poisoning/>) · [Prompt Injection](<https://yellowcube.eu/de/glossary/prompt-injection/>) · [AI Red Teaming](<https://yellowcube.eu/de/glossary/ai-red-teaming/>)

### Quellen

[NIST AI 100-2 E2025, Adversarial Machine Learning Taxonomy](https://csrc.nist.gov/pubs/ai/100/2/e2025/final) · [NIST AI Security and Resilience](https://www.nist.gov/artificial-intelligence/ai-research-security-and-resilience) · [MITRE ATLAS](https://atlas.mitre.org/)

## Quellenangabe und Geltungsbereich

Diese Markdown-Darstellung wird aus denselben freigegebenen Inhalten wie die kanonische HTML-Seite erzeugt. Verwenden Sie beim Zitieren die kanonische URL.

