Suivez les dernières actualités, explications et histoires technologiques associées.
JetBrains explique le mécanisme de construction de la Service Map au sein de ses environnements de développement, en s’appuyant sur les traces OpenTelemetry provenant du système pendant son exécution, plutôt que sur des schémas statiques ou une analyse statique du code. La fonctionnalité traite les données tardives et désordonnées afin de mettre progressivement à jour les relations entre les services, les bases de données et les points d’intégration des messages.
Un article de la CNCF explique que la surveillance de Kubernetes ne devrait pas s’arrêter aux tableaux de bord et aux alertes, mais qu’elle doit relier les métriques aux journaux, aux traces distribuées et aux données de profilage afin de comprendre la cause et le cheminement d’une panne. Il présente un ensemble de pratiques concrètes pour améliorer la qualité des signaux, réduire le bruit des alertes et accélérer l’investigation des incidents.
Atlassian présente une méthode d’analyse des causes profondes fondée sur la mise en relation temporelle et au moyen d’un graphe de dépendances des services des métriques, des journaux et des traces. L’objectif est de transformer de grandes quantités de données de surveillance en hypothèses classées et vérifiables, tout en préservant le rôle de l’ingénieur dans la validation et la prise de décision.