Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
JetBrains erklärt, wie in ihren Entwicklungsumgebungen eine Service Map auf Grundlage von OpenTelemetry-Traces erstellt wird, die während des Betriebs aus dem System eintreffen, anstatt sich auf statische Diagramme oder eine statische Codeanalyse zu stützen. Die Funktion verarbeitet verspätete und ungeordnete Daten, um die Beziehungen zwischen Services, Datenbanken und Integrationspunkten von Nachrichtensystemen schrittweise zu aktualisieren.
Der CNCF-Artikel erläutert, dass die Überwachung von Kubernetes nicht bei Dashboards und Alarmen enden sollte, sondern Metriken mit Logs, Traces und Profiling-Daten verknüpfen muss, um Ursache und Verlauf eines Fehlers zu verstehen. Er stellt eine Reihe praktischer Maßnahmen vor, mit denen sich die Qualität der Signale verbessern, das Alarmrauschen reduzieren und die Untersuchung von Vorfällen beschleunigen lässt.
Atlassian stellt eine Methodik zur Ursachenanalyse vor, die Metriken, Protokolle und Tracing-Spuren zeitlich sowie über einen Graphen der Service-Abhängigkeiten miteinander verknüpft. Ziel ist es, große Mengen an Monitoringdaten in priorisierte, überprüfbare Hypothesen umzuwandeln und zugleich die Rolle der Ingenieure bei Validierung und Entscheidungsfindung zu bewahren.