# Was ist Fehlertoleranz?

> Fehlertoleranz ist eine Systemeigenschaft, die es erlaubt, eine erforderliche Funktion korrekt fortzusetzen, wenn ein oder mehrere antizipierte Hardware- oder Softwarefehler auftreten.

- Kanonische URL: https://yellowcube.eu/de/glossary/fault-tolerance/
- Herausgeber: Yellow Cube
- Sprache: de
- Kontakt: hello@yellowcube.eu

## Inhalt

Ein fehlertolerantes Design erkennt, begrenzt, maskiert oder rekonfiguriert sich um Fehler herum, sodass der Betrieb innerhalb der angegebenen Korrektheits-, Kapazitäts-, Timing- und Safety-Grenzen bleibt — teils auf einem bewusst degradierten Service-Niveau.

Die Anforderung muss definieren, welche Fehler, Kombinationen und Dauern das System tolerieren soll. Designs können Replikation, Voting, Fehlerkorrektur, unabhängige Strom- oder Kommunikationspfade, diverse Implementierungen, Zustandsabgleich und graceful Degradation nutzen, gestützt durch Monitoring und Reparatur.

### Wichtigste Punkte

- **Korrekten Dienst definieren:** Wesentliche Funktionen, erlaubte Degradation, Fehlerannahmen, Erkennungszeit, Wiederherstellungsverhalten und den Punkt spezifizieren, ab dem ein sicheres Abschalten dem Weiterbetrieb vorzuziehen ist.
- **Unabhängigkeit schaffen:** Replikas und unterstützende Stromversorgung, Netzwerke, Identitäten, Administration und Standorte trennen, wo das Bedrohungsmodell es erfordert; Diversität gegen gemeinsame Defekte erwägen.
- **Zustand schützen:** Replikation, Reihenfolge, Quorum, Konsistenz, Korruptionserkennung und Wiederintegration so kontrollieren, dass redundante Komponenten weder fehlerhafte Daten verbreiten noch konfliktierende Aktionen erzeugen.
- **Wichtige Einschränkung:** Redundanz allein ist keine Fehlertoleranz. Common-Mode-Ausfälle, geteilte Abhängigkeiten, Designfehler, korrelierte Angriffe, erschöpfte Kapazität und falsche Fehlererkennung können jedes Replikat besiegen, während zusätzliche Komplexität neue Fehler einführen kann.

### Verwandte Begriffe

[Failover](<https://yellowcube.eu/de/glossary/failover/>) · [Cyber-Resilienz](<https://yellowcube.eu/de/glossary/cyber-resilience/>) · [Business Continuity](<https://yellowcube.eu/de/glossary/business-continuity/>) · [Disaster Recovery](<https://yellowcube.eu/de/glossary/disaster-recovery/>) · [Recovery Time Objective (RTO)](<https://yellowcube.eu/de/glossary/recovery-time-objective/>)

### Quellen

[NIST, Fault Tolerant](https://csrc.nist.gov/glossary/term/fault_tolerant) · [NIST SP 800-160 Vol. 2 Rev. 1, Developing Cyber-Resilient Systems](https://csrc.nist.gov/pubs/sp/800/160/v2/r1/final) · [NIST SP 800-82 Rev. 3, Guide to Operational Technology Security](https://csrc.nist.gov/pubs/sp/800/82/r3/final)

## Quellenangabe und Geltungsbereich

Diese Markdown-Darstellung wird aus denselben freigegebenen Inhalten wie die kanonische HTML-Seite erzeugt. Verwenden Sie beim Zitieren die kanonische URL.

