Betrieb, Monitoring & Support¶
Dieser Bereich beschreibt die operativen Werkzeuge und Konzepte für den laufenden Betrieb, die Überwachung (Monitoring) und den Support der Open Data Infrastruktur (ODI).
Für den zuverlässigen Betrieb der Microservice-Architektur kommen zentralisierte Werkzeuge für Metrics (VictoriaMetrics), Logs (Loki) und Visualisierung (Grafana) zum Einsatz.
Schnellzugriff: Fehleranalyse & Request ID Suche Dashboard
- 🚀 Produktion (Prod): grafana.odi.schleswig-holstein.de/d/betrieb-request-id-v1/request-id-suche
- 🧪 Staging (Stage): grafana.odi-stage.schleswig-holstein.de/d/betrieb-request-id-v1/request-id-suche
Themen in diesem Bereich¶
-
Grafana Dashboards
Übersicht über die verfügbaren Grafana-Dashboards für System-Performance, HTTP-Durchsatz und das spezialisierte Fehleranalyse Dashboard. -
Logging-Kontext & Single-Line JSON-Logging
Aufbau und Vorteile des strukturierten, einzeiligen JSON-Loggings (LOG_JSON=true) auf Stage & Produktion, dynamischecontext-Ermittlung (Ursprungsklasse/Service) und strukturierte Fehler-Objekte. -
Fehleranalyse & Request ID (Correlation Tracing)
End-to-End-Nachverfolgung von Anfragen über mehrere Microservices hinweg mittelsx-request-id. Schritt-für-Schritt-Anleitung zur gezielten Fehlersuche bei Support-Anfragen.
Zielgruppen & Nutzung¶
- Systemadministratoren & DevOps: Überwachung von Ressourcenauslastung (CPU/RAM), Pod-Neustarts und Cluster-Gesundheit.
- Support & Betriebs-Team: Schnelle Lokalisierung von Fehlerursachen bei fehlerhaften HTTP-Anfragen (5xx/4xx) mittels Request ID und Log-Streams.
- Entwickler: Nachvollziehbarkeit von Ausnahmen (Exceptions), verschachtelten Fehlerketten (
internalError) und Stacktraces in den Laufzeitumgebungen.