Zum Inhalt

Betrieb, Monitoring & Support

Dieser Bereich beschreibt die operativen Werkzeuge und Konzepte für den laufenden Betrieb, die Überwachung (Monitoring) und den Support der Open Data Infrastruktur (ODI).

Für den zuverlässigen Betrieb der Microservice-Architektur kommen zentralisierte Werkzeuge für Metrics (VictoriaMetrics), Logs (Loki) und Visualisierung (Grafana) zum Einsatz.

Schnellzugriff: Fehleranalyse & Request ID Suche Dashboard


Themen in diesem Bereich

  • Grafana Dashboards
    Übersicht über die verfügbaren Grafana-Dashboards für System-Performance, HTTP-Durchsatz und das spezialisierte Fehleranalyse Dashboard.

  • Logging-Kontext & Single-Line JSON-Logging
    Aufbau und Vorteile des strukturierten, einzeiligen JSON-Loggings (LOG_JSON=true) auf Stage & Produktion, dynamische context-Ermittlung (Ursprungsklasse/Service) und strukturierte Fehler-Objekte.

  • Fehleranalyse & Request ID (Correlation Tracing)
    End-to-End-Nachverfolgung von Anfragen über mehrere Microservices hinweg mittels x-request-id. Schritt-für-Schritt-Anleitung zur gezielten Fehlersuche bei Support-Anfragen.


Zielgruppen & Nutzung

  • Systemadministratoren & DevOps: Überwachung von Ressourcenauslastung (CPU/RAM), Pod-Neustarts und Cluster-Gesundheit.
  • Support & Betriebs-Team: Schnelle Lokalisierung von Fehlerursachen bei fehlerhaften HTTP-Anfragen (5xx/4xx) mittels Request ID und Log-Streams.
  • Entwickler: Nachvollziehbarkeit von Ausnahmen (Exceptions), verschachtelten Fehlerketten (internalError) und Stacktraces in den Laufzeitumgebungen.