Contexte
Un éditeur SaaS opérant plusieurs serveurs (VPS) répartis pour héberger ses applications avait besoin d’un point de vérité unique pour son infrastructure : conteneurs Docker, ressources machines, sauvegardes, routage — jusque-là suivis serveur par serveur, en ligne de commande.
L’enjeu
Offrir aux équipes techniques une supervision d’infrastructure en temps réel, consolidée sur plusieurs serveurs, sans jamais avoir à ouvrir un terminal SSH — pour gagner en réactivité face aux incidents et fiabiliser l’exploitation au quotidien.
Notre intervention
- Tableau de bord multi-serveurs : agrégation en un seul écran des conteneurs Docker répartis sur plusieurs VPS, avec recherche, filtres et vue détaillée par conteneur.
- Monitoring temps réel : flux en direct (Server-Sent Events) des métriques CPU, RAM et disque, par conteneur et par serveur, alimentés par Prometheus et cAdvisor.
- Observabilité étendue : centralisation des journaux applicatifs (Grafana Loki), suivi de l’état des sauvegardes, du routage / reverse-proxy et des certificats TLS (Traefik).
- Alerting : notifications automatiques vers Slack, Discord et ntfy en cas d’anomalie détectée sur un conteneur ou un serveur.
- Sécurité & UX : authentification SSO (Logto / OIDC), interface avec thème clair/sombre, pensée pour une lecture rapide en situation d’astreinte.
Résultat
Une console unique qui remplace l’accès SSH serveur par serveur : les équipes techniques diagnostiquent et pilotent leur infrastructure en temps réel, avec des alertes proactives et une vision consolidée de tous les environnements hébergés.
Stack
Nuxt 4 (Vue 3) · Nitro · TypeScript · Docker / Dockerode · Prometheus · cAdvisor · Grafana Loki · Traefik · SSE · Logto (SSO OIDC)
