Viele Umgebungen sammeln Daten, aber niemand schaut hinein – und wenn doch, findet niemand die relevante Zeile. Dieser Tag räumt damit auf.
Inhalte
- Was überhaupt messen? Die vier goldenen Signale und warum Festplattenauslastung allein nichts aussagt
- Prometheus – Datenmodell, Exporter, Scraping, Aufbewahrung
- PromQL – Abfragen schreiben, die eine Frage beantworten
- Grafana – Dashboards für den Alltag und für den Notfall
- Loki – Protokolle zentral sammeln und mit Metriken verknüpfen
- Alerting – Schwellwerte, Wartezeiten, Eskalation; Alarmmüdigkeit vermeiden
- Serviceziele – SLI und SLO praktisch formuliert, ohne Konzernvokabular
- Betrieb des Monitorings selbst – wer überwacht die Überwachung?
Voraussetzungen
Linux-Grundkenntnisse. Erfahrung mit Containern ist hilfreich.
Was Sie mitnehmen
Fertige Dashboard-Vorlagen, eine Sammlung bewährter Alarmregeln und eine Checkliste zur Einführung im eigenen Betrieb.
