SRE & Observability

Zuverlässigkeit als messbare Größe: SLOs und Error Budgets, Multi-Burn-Rate-Alerts, die vier goldenen Signale, Incident-Severity und eine belastbare Definition von „wiederhergestellt“. Dazu Observability mit eBPF und OpenTelemetry — und Fallen wie HTTP/2 im internen Traffic.