ECI-SRV-11

Supervision, MCO et support opérationnel

Une panne qui dure plusieurs jours sans qu’aucune alerte ne remonte n’est pas un incident isolé : c’est un défaut de supervision. Nous construisons la chaîne complète — instrumentation, alertes actionnables, inventaire tenu à jour — et nous pouvons en assurer l’exploitation à vos côtés.

Périmètre d’intervention

  • Déploiement d’une plateforme de supervision et de journalisation centralisée.
  • Instrumentation des serveurs, hyperviseurs, plateformes cloud, stockage et réseau.
  • Conception d’alertes actionnables et réduction du bruit d’alerte.
  • Gestion du parc, cycle des correctifs et supervision des sauvegardes.
  • Support opérationnel et maintien en condition, avec engagement de délai.

Livrables

  • Plateforme de supervision en production, avec tableaux de bord dédiés.
  • Catalogue d’alertes documenté et matrice d’escalade.
  • Inventaire du parc et tableau de bord de conformité.
  • Procédures d’exploitation, fiches réflexes et rapports périodiques.

Technologies

  • Zabbix, Prometheus, Grafana, Loki, OpenTelemetry.
  • Supervision spécialisée d’OpenStack, de Ceph, des clusters et des conteneurs.
  • Chaînes de correctifs Linux et Windows, supervision des sauvegardes.

Niveaux de support

Le maintien en condition opérationnelle s’exerce selon trois niveaux, choisis au contrat en fonction de la criticité de la plateforme.

NiveauEngagement
EssentielAssistance à distance en heures ouvrées, prise en charge sous quatre heures ouvrées, gestion des correctifs et revue trimestrielle.
AvancéAssistance étendue, prise en charge sous deux heures ouvrées, supervision déléguée, intervention sur site et revue mensuelle.
CritiqueCouverture continue, prise en charge sous une heure, astreinte, référent technique nommé et exercices de reprise annuels.

Modalités

Projet de mise en place, puis contrat de support mensuel ou annuel avec volume d’heures, délais de prise en charge et revue périodique.

Déroulé de la prestation

Phase 1 — Périmètre et priorités

  • Définition des services critiques et des indicateurs attendus.
  • Identification des angles morts de la supervision actuelle.

Phase 2 — Mise en place

  • Déploiement de la plateforme et instrumentation du parc.
  • Journalisation centralisée et normalisation des formats.

Phase 3 — Alertes et restitution

  • Conception des alertes, des dépendances et des escalades.
  • Tableaux de bord d’astreinte et de direction.

Phase 4 — Exploitation

  • Gestion des incidents, des correctifs et des sauvegardes.
  • Revue périodique et amélioration continue de la couverture.

Ce que comprend chaque prestation

  • Un devis détaillé, établi après cadrage
  • Un chef de projet identifié
  • La documentation d’exploitation livrée
  • Le transfert de compétences à vos équipes
  • Une intervention sur site ou à distance
  • Un support après la mise en production

Aucune intervention en production sans plan de retour arrière écrit.

Demander un cadrage

Ou contactez-nous directement :

Parlons de votre contexte

Toute prestation fait l’objet d’un cadrage préalable et d’un devis détaillé.

Prendre rendez-vous