Transverse
Les couches de l'observabilité
Pour : ingénieurs et SRE · architectesPrérequis : Aucun.
On parle d’observabilité comme d’un seul sujet, alors que l’automaticien, l’ingénieur réseau, l’équipe plateforme, le développeur, l’ingénieur de données et l’équipe ML n’observent ni les mêmes choses, ni avec les mêmes signaux, ni avec les mêmes outils. Ce schéma les empile à la manière du modèle OSI, du terrain industriel jusqu’aux modèles d’IA, avec deux bandes qui les traversent toutes : la sécurité et le coût rapporté à la valeur métier. Les outils cités sont des exemples, open source et commerciaux, rangés par ordre alphabétique et sans ordre de préférence.
Cliquez sur une couche ou une bande, ou parcourez-les au clavier (Tab, ou flèches haut et bas). L'exemple suit une mesure d'atelier fictive jusqu'à un modèle de prévision de panne ; l'infrastructure porte la plateforme sans être sur le chemin logique.
À essayer
Section intitulée « À essayer »- Suivre l’exemple de bout en bout : une mesure de vibration d’un atelier fictif traverse le terrain, le réseau, la plateforme, l’application de supervision et les données avant d’alimenter un modèle de prévision de panne. Demandez-vous à chaque étape quel signal vous préviendrait si elle cassait.
- Comparer deux couches voisines : ouvrez Infrastructure puis Applications. La méthode USE regarde les ressources, la méthode RED regarde les requêtes ; un service lent avec des serveurs au repos oriente l’enquête ailleurs que l’inverse.
- Ouvrir le Terrain puis les Données : dans les deux cas, une valeur peut arriver à l’heure et être fausse. Le code qualité OPC UA et les tests de données répondent au même besoin à deux couches différentes.
- Ouvrir les deux bandes : la sécurité et le coût ne sont pas des couches de plus. Chacune pose une question à toutes les autres : qui a accès et combien cela coûte au regard de ce que cela rapporte.
La règle à retenir
Section intitulée « La règle à retenir »Un symptôme se lit avec la couche du dessous et celle du dessus. La couche du dessous en donne souvent la cause, celle du dessus en mesure l’impact. Une pile d’observabilité qui ne couvre qu’une couche répond bien à la question « est-ce que ça marche ici ? » et mal à la question « pourquoi le métier ne voit-il pas ce qu’il attend ? ».
Pour aller plus loin : l’architecture cliquable pour un exemple de pile qui collecte et stocke ces signaux, l’explorateur de traces pour la couche applicative et la formation observabilité des LLM pour la couche IA.