Contexte
Dans le cadre de mon alternance au service IT de l'AGIRC-ARRCO à Saint-Jean-de-Braye, j'ai pris en charge la conception et le déploiement de dashboards de supervision via Grafana, alimentés par des métriques collectées avec Prometheus.
L'objectif est de fournir aux équipes infrastructure une vision en temps réel de l'état de santé des équipements : disponibilité, charge CPU/mémoire, latence réseau, saturation des disques — le tout centralisé dans une interface claire et actionnable.
AGIRC-ARRCO — Saint-Jean-de-Braye (45)
Organisme de retraite complémentaire. Service IT interne gérant une infrastructure d'entreprise variée : réseaux, serveurs, applications métier et environnements conteneurisés.
Stack technique
Réalisations
Conception des dashboards
Création de dashboards organisés par thème : infrastructure réseau, serveurs Linux, applications et clusters Kubernetes.
Requêtes PromQL
Écriture de requêtes PromQL pour extraire les métriques pertinentes : disponibilité, saturation, erreurs et latences.
Règles d'alerting
Configuration de seuils d'alerte pour notifier les équipes en cas d'anomalie sur les équipements supervisés.
Infrastructure variée
Supervision de différents types d'assets : switches, serveurs, pods Kubernetes, bases de données et services applicatifs.
Documentation
Rédaction de la documentation technique associée aux dashboards : description des métriques, seuils retenus et procédures.
Travail en équipe IT
Collaboration avec les équipes infrastructure pour identifier les besoins et adapter les dashboards aux usages réels.
Captures du dashboard
Les captures ci-dessous illustrent les dashboards déployés en production. Certaines données ont été anonymisées pour respecter la confidentialité de l'entreprise.
Bilan & compétences développées
Ce projet m'a permis de monter en compétences sur l'ensemble de la chaîne d'observabilité : de la collecte de métriques avec Prometheus à leur visualisation et leur exploitation dans Grafana, en passant par la compréhension des différents types d'infrastructure supervisée.
La diversité des environnements vus en alternance — réseaux d'entreprise, serveurs Linux, clusters Kubernetes — m'a donné une vision transversale de l'infrastructure IT, directement utile pour comprendre ce qu'on supervise et pourquoi.