DATAROCKSTARS
Réf. INF-RES-42Revenir au menu
Catalogue entreprises › Formations informatiques › Réseaux, virtualisation, Cloud / DevOps

Kubernetes : diagnostic et résolution d’incidents

Diagnostiquer et résoudre méthodiquement les incidents d'un cluster Kubernetes

2 jours · 14 h Niveau intermédiaire Présentiel, distanciel synchrone, hybride Inter · Intra · Sur mesure

Descriptif

Kubernetes : diagnostic et résolution d’incidents est une formation de 2 jours (14 heures), de niveau intermédiaire, rattachée au domaine « Réseaux, virtualisation, Cloud / DevOps ». Diagnostiquer et résoudre méthodiquement les incidents d'un cluster Kubernetes. Conçue et animée par des praticiens en activité, elle alterne apports ciblés (30 %) et mises en pratique (70 %) sur des laboratoires individuels accessibles depuis un navigateur, avec des cas inspirés des secteurs banque, assurance et services publics. Le parcours s'appuie sur 9 laboratoires dédiés, provisionnés à la demande et accessibles trente jours après la session. Disponible en inter-entreprises, en intra sur catalogue et en version sur mesure adaptée au contexte de l'entreprise.

Objectifs pédagogiques

À l'issue de la formation, le participant sera capable de :

  • Méthode de diagnostic et lecture des symptômes
  • Ateliers de résolution sur pannes injectées

Programme détaillé

N°Contenus et activités Durée
Jour 1
1Ouverture : partage d'incidents vécus par les participants et remise des clusters de panne individuels0,5 h
2Méthode de diagnostic : du symptôme à la cause, couches à interroger et ordre des vérifications1,5 h
3Travaux pratiques : outiller le diagnostic avec kubectl get, describe, events, logs et kubectl debug2 h
4Travaux pratiques : résoudre des pods en Pending, CrashLoopBackOff, ImagePullBackOff et Init:Error2 h
5Travaux pratiques : investiguer avec un conteneur éphémère dans un pod dépourvu de shell1 h
Jour 2
6Incidents de plateforme : nœuds NotReady, pression disque et mémoire, certificats expirés, etcd et contrôleurs1,5 h
7Travaux pratiques : résoudre trois pannes injectées sur les nœuds et le plan de contrôle, en temps limité2,5 h
8Travaux pratiques : diagnostiquer une latence applicative en croisant métriques, journaux et profil de charge1,5 h
9Mise en situation : cellule de crise, priorisation, contournement puis correctif, rédaction du compte rendu post-incident1 h
10Synthèse : arbre de décision de diagnostic et évaluation des acquis0,5 h

Méthodes pédagogiques

  • Pédagogie active : 71 % du temps en pratique encadrée — laboratoires cloud provisionnés par participant, travaux pratiques guidés, fil rouge applicatif —, le reste en apports structurés, démonstrations commentées, cadrage et évaluation
  • répartition calculée sur le déroulé détaillé de cette formation, et non annoncée de façon uniforme
  • classe inversée avec prérequis sur le LMS
  • apprentissage adaptatif selon le positionnement initial
  • travaux en binômes
  • classe virtuelle en séquences de 3 h 30 maximum sur Microsoft Teams
  • support clair, complet et paginé remis à chaque participant

Technologies et outils mobilisés

kubectl, events, logs, ephemeral containers, métriques, scénarios de panne

Modalités d'évaluation et de validation

  • Positionnement initial en ligne
  • quiz de validation à chaque séquence
  • évaluation finale des acquis (QCM et mise en situation)
  • satisfaction à chaud
  • questionnaire de transfert à 30 jours
  • attestation de fin de formation

Plateforme, laboratoires et ressources

  • Plateforme LMS DATAROCKSTARS : parcours, quiz et supports. Environnements de laboratoire provisionnés à la demande, isolés par participant et accessibles depuis un navigateur — 9 laboratoires dédiés à ce programme. Accès maintenu trente jours après la session

Fiche mise à jour le 21/09/2026 — version 1.0. Les programmes sont révisés chaque trimestre et à chaque évolution majeure des technologies, normes ou référentiels de certification concernés.