Descriptif
Kubernetes : diagnostic et résolution d’incidents est une formation de 2 jours (14 heures), de niveau intermédiaire, rattachée au domaine « Réseaux, virtualisation, Cloud / DevOps ». Diagnostiquer et résoudre méthodiquement les incidents d'un cluster Kubernetes. Conçue et animée par des praticiens en activité, elle alterne apports ciblés (30 %) et mises en pratique (70 %) sur des laboratoires individuels accessibles depuis un navigateur, avec des cas inspirés des secteurs banque, assurance et services publics. Le parcours s'appuie sur 9 laboratoires dédiés, provisionnés à la demande et accessibles trente jours après la session. Disponible en inter-entreprises, en intra sur catalogue et en version sur mesure adaptée au contexte de l'entreprise.
Objectifs pédagogiques
À l'issue de la formation, le participant sera capable de :
- Méthode de diagnostic et lecture des symptômes
- Ateliers de résolution sur pannes injectées
Programme détaillé
| N° | Contenus et activités | Durée |
|---|---|---|
| Jour 1 | ||
| 1 | Ouverture : partage d'incidents vécus par les participants et remise des clusters de panne individuels | 0,5 h |
| 2 | Méthode de diagnostic : du symptôme à la cause, couches à interroger et ordre des vérifications | 1,5 h |
| 3 | Travaux pratiques : outiller le diagnostic avec kubectl get, describe, events, logs et kubectl debug | 2 h |
| 4 | Travaux pratiques : résoudre des pods en Pending, CrashLoopBackOff, ImagePullBackOff et Init:Error | 2 h |
| 5 | Travaux pratiques : investiguer avec un conteneur éphémère dans un pod dépourvu de shell | 1 h |
| Jour 2 | ||
| 6 | Incidents de plateforme : nœuds NotReady, pression disque et mémoire, certificats expirés, etcd et contrôleurs | 1,5 h |
| 7 | Travaux pratiques : résoudre trois pannes injectées sur les nœuds et le plan de contrôle, en temps limité | 2,5 h |
| 8 | Travaux pratiques : diagnostiquer une latence applicative en croisant métriques, journaux et profil de charge | 1,5 h |
| 9 | Mise en situation : cellule de crise, priorisation, contournement puis correctif, rédaction du compte rendu post-incident | 1 h |
| 10 | Synthèse : arbre de décision de diagnostic et évaluation des acquis | 0,5 h |
Méthodes pédagogiques
- Pédagogie active : 71 % du temps en pratique encadrée — laboratoires cloud provisionnés par participant, travaux pratiques guidés, fil rouge applicatif —, le reste en apports structurés, démonstrations commentées, cadrage et évaluation
- répartition calculée sur le déroulé détaillé de cette formation, et non annoncée de façon uniforme
- classe inversée avec prérequis sur le LMS
- apprentissage adaptatif selon le positionnement initial
- travaux en binômes
- classe virtuelle en séquences de 3 h 30 maximum sur Microsoft Teams
- support clair, complet et paginé remis à chaque participant
Technologies et outils mobilisés
kubectl, events, logs, ephemeral containers, métriques, scénarios de panne
Modalités d'évaluation et de validation
- Positionnement initial en ligne
- quiz de validation à chaque séquence
- évaluation finale des acquis (QCM et mise en situation)
- satisfaction à chaud
- questionnaire de transfert à 30 jours
- attestation de fin de formation
Plateforme, laboratoires et ressources
- Plateforme LMS DATAROCKSTARS : parcours, quiz et supports. Environnements de laboratoire provisionnés à la demande, isolés par participant et accessibles depuis un navigateur — 9 laboratoires dédiés à ce programme. Accès maintenu trente jours après la session
