Un runbook de production pour séparer DNS, dépendance distante, NetworkPolicy, conntrack et pression SNAT Azure sur AKS avant de modifier le chemin de sortie du cluster.
Un runbook de production pour séparer métrique bruitée, requests mal calibrées, démarrage lent et capacité nœud avant de modifier les bornes d'un Horizontal Pod Autoscaler AKS.
Un runbook de production pour séparer resolver du pod, CoreDNS, chemin de service, DNS upstream et panne liée à un nœud avant redémarrage ou rollback du DNS AKS.
Un runbook de production pour prouver si un trafic AKS est refusé par une policy Kubernetes ou Cilium, avec sélecteurs, deux sens du flux, DNS, preuves bornées et rollback.
Un runbook de production pour distinguer réplication ACR, routage régional, digest, identité et réseau avant de relancer ou rollbacker un déploiement de conteneurs.
Un runbook de production pour isoler métrique, target et labels responsables d’une hausse de séries AKS avant de filtrer la collecte, demander plus de capacité ou rollbacker.
Un runbook de production pour localiser un rollout AKS bloqué entre Deployment, ReplicaSet, scheduling, image et readiness, puis reprendre ou revenir à une révision connue avec des critères d’arrêt.
Un runbook de production pour figer un digest ACR, vérifier sa signature Notation, borner la politique de confiance, promouvoir par digest et revenir en arrière sans désactiver le contrôle.
Un runbook de production pour isoler un échec Microsoft Entra Workload ID entre pod, ServiceAccount, webhook, token OIDC, identité managée et RBAC, puis valider ou revenir en arrière sans secret client.
Un runbook de production pour relier un signal de vulnérabilité ACR aux pods AKS, geler la promotion, revenir à un digest connu, valider le rollout puis conserver ou supprimer l'image suspecte.
Un runbook de production pour diagnostiquer un drain AKS bloqué par un PodDisruptionBudget, retrouver la marge de disruption, corriger capacité ou readiness, puis valider ou reporter l’upgrade sans supprimer les garde-fous.
Un runbook de production pour qualifier un échec de pull ACR avec identité, réseau, DNS, pare-feu, logs, cache de nœud, validation et rollback avant de relancer le déploiement.
Un runbook opérationnel pour qualifier les incidents de sortie Azure liés à NAT Gateway, aux ports SNAT, aux UDR, aux NSG, aux firewalls, aux allowlists et au rollback.
Construire un runbook opérationnel pour les pannes d'ingress privé AKS en séparant DNS, Application Gateway, ingress controller, services Kubernetes, endpoints, readiness des pods et preuves de rollback.