Observability
Unbekannte Probleme aus Systemzustand erklärbar machen
Zielt darauf ab, auch unbekannte oder neuartige Probleme aus dem Systemzustand heraus erklärbar zu machen — geht über klassisches Monitoring bekannter Metriken hinaus.
Passende Übungsfragen
✅Observability erklärt auch unbekannte/neuartige Probleme aus dem Systemzustand, nicht nur bekannte Metriken
❌Beide Begriffe sind exakt identisch
❌Observability betrifft ausschließlich die Benutzeroberfläche
❌Monitoring ist umfassender als Observability
Observability zielt darauf ab, aus Systemzustand auch unbekannte/neuartige Probleme erklärbar zu machen, nicht nur bekannte Metriken zu überwachen.
✅Die Fähigkeit, den internen Zustand eines Systems anhand seiner Ausgaben zu verstehen, auch bei unbekannten Problemen
❌Ein anderer Begriff für regelmäßige, geplante Wartungsfenster
❌Die Fähigkeit eines Teams, Meetings virtuell abzuhalten
❌Ein Synonym für Service Level Agreement
Observability beschreibt, wie gut sich der interne Zustand eines Systems anhand seiner nach außen sichtbaren Ausgaben (z.B. Logs, Metriken, Traces) verstehen und nachvollziehen lässt — auch bei Problemen, die vorher nicht bekannt waren.
✅Monitoring prüft bekannte Zustände, Observability erlaubt auch das Verstehen unbekannter, neuer Probleme
❌Monitoring und Observability sind vollständig austauschbare Begriffe
❌Observability betrifft ausschließlich die Netzwerkebene
❌Monitoring ist ein Teilbereich der Wertschöpfungskette, Observability nicht
Monitoring prüft im Wesentlichen bekannte, vorab definierte Zustände und Schwellenwerte. Observability geht weiter: sie liefert genug Kontext, um auch unbekannte, neuartige Probleme zu diagnostizieren, für die noch kein Alarm eingerichtet wurde.
✅Logs (protokollierte Ereignisse)
✅Metriken (numerische Messwerte über die Zeit)
❌Handbücher für Endanwender
❌Vertragsdokumente mit Lieferanten
Die drei klassischen Säulen der Observability sind Logs, Metriken (Metrics) und Traces — hier abgefragt sind Logs und Metriken als zwei der drei.
✅Sie liefert die Datengrundlage, um Zuverlässigkeitsziele/Fehlerbudgets zu überwachen und Ursachen schnell zu finden
❌SRE und Observability sind laut ITIL zwei Namen für dieselbe Practice
❌Observability ersetzt in SRE-Teams die Notwendigkeit von Incident Management vollständig
❌Sie betrifft ausschließlich die Design-Phase des Lebenszyklus
SRE arbeitet mit klar definierten Zuverlässigkeitszielen (SLOs) und Fehlerbudgets — ohne gute Observability lässt sich weder erkennen, ob diese Ziele eingehalten werden, noch lässt sich die Ursache einer Verletzung schnell finden.