Prenez contact avec nous

Plan du cours

Fondements des opérations cloud sur AWS

  • Rôles et responsabilités opérationnels dans le cloud.
  • Structure des comptes AWS, organisations et stratégie multi-comptes.
  • Services opérationnels de base : CloudWatch, CloudTrail, AWS Config.

Infrastructure as Code et provisionnement

  • Principes de l'IaC et de l'infrastructure immuable.
  • Provisionnement avec Terraform et AWS CloudFormation.
  • Gestion de l'état, des modules et de la promotion des environnements.

CI/CD et stratégies de déploiement

  • Conception de pipelines CI/CD pour les applications cloud-native.
  • Déploiements bleu/vert, canari et progressifs (rolling).
  • Automatisation du rollback, des vérifications de santé et de la validation des relâches.

Surveillance, observabilité et alerting

  • Métriques, journaux et traçage : envoi, stockage et analyse.
  • Utilisation de CloudWatch, X-Ray et d'outils d'observabilité tiers.
  • Définition des SLO/SLI, des politiques d'alerting et des pratiques de garde.

Sécurité opérationnelle et gestion des identités

  • Meilleures pratiques IAM, moindre privilège et accès inter-comptes.
  • Gestion des secrets, KMS et dépôts de paramètres sécurisés.
  • Sécurité opérationnelle : stratégies de correctifs, scan de vulnérabilités et journaux d'audit.

Résilience, sauvegarde et reprise après sinistre

  • Conception pour la tolérance aux pannes et la haute disponibilité.
  • Stratégies de sauvegarde, automatisation des instantanés et procédures de restauration.
  • Planification de la reprise après sinistre et création de runbooks.

Optimisation des coûts et gouvernance

  • Visibilité des coûts : facturation, balisage et stratégies d'allocation des coûts.
  • Dimensionnement, instances réservées/plans d'économie et contrôles budgétaires.
  • Gouvernance : politiques, garde-fous et automatisation pour la conformité.

Conteneurs, serverless et opérations d'exécution

  • Considérations opérationnelles pour ECS, EKS et Lambda.
  • Découverte de services, auto-scaling et limites de ressources.
  • Journalisation, traçage et débogage des charges de travail conteneurisées.

Réponse aux incidents, playbooks et ingénierie du chaos

  • Réponse aux incidents basée sur des runbooks et pratiques de post-mortem.
  • Automatisation de la remédiation et schémas d'auto-guérison.
  • Introduction aux expériences de chaos pour valider la résilience.

Atelier pratique : Exploiter une charge de travail d'exemple

  • Déployer une application d'exemple à l'aide de l'IaC et d'un pipeline CI/CD.
  • Mettre en place la surveillance, les alertes et un script de remédiation automatisé.
  • Simuler des incidents et pratiquer la réponse basée sur des runbooks.

Résumé et prochaines étapes

Pré requis

  • Une compréhension de base des concepts cloud et du réseau.
  • Une familiarité avec la ligne de commande Linux et la scripting.
  • Une expérience avec la gestion de sources (Git) et les concepts de base de CI/CD.

Public cible

  • Ingénieurs en opérations cloud.
  • SREs et ingénieurs de plateforme.
  • Ingénieurs DevOps et chefs d'équipe techniques.
 21 Heures

Nombre de participants


Prix par participant

Nos clients témoignent (1)

Cours à venir

Catégories Similaires