Get in Touch

Course Outline

Cloud Operations Fundamentals on AWS

  • Operational duties and responsibilities within cloud environments
  • AWS account hierarchies, organizational structures, and multi-account architectures
  • Key operational services: CloudWatch, CloudTrail, and AWS Config

Infrastructure as Code and Resource Provisioning

  • Core IaC principles and the concept of immutable infrastructure
  • Utilizing Terraform and AWS CloudFormation for provisioning
  • Managing state files, modularization, and environment promotion workflows

CI/CD Pipelines and Deployment Methodologies

  • Architecting CI/CD pipelines for cloud-native applications
  • Implementing blue/green, canary, and rolling deployment strategies
  • Automating rollback mechanisms, health checks, and release verification

Monitoring, Observability, and Alerting Systems

  • Handling metrics, logs, and traces: ingestion, storage, and analysis
  • Leveraging CloudWatch, X-Ray, and third-party observability solutions
  • Establishing SLOs/SLIs, alerting policies, and on-call protocols

Security Operations and Identity Governance

  • IAM best practices, least privilege models, and cross-account access control
  • Managing secrets, KMS encryption, and secure parameter stores
  • Operational security measures: patching strategies, vulnerability assessment, and audit logs

Resilience, Backup, and Disaster Recovery

  • Designing for fault tolerance and high availability
  • Backup strategies, automated snapshots, and restoration procedures
  • Formulating disaster recovery plans and creating operational runbooks

Cost Optimization and Governance

  • Achieving cost visibility through billing, tagging, and allocation strategies
  • Rightsizing resources, utilizing reserved instances/savings plans, and budget controls
  • Governance frameworks: policies, guardrails, and compliance automation

Containers, Serverless, and Runtime Management

  • Operational aspects of managing ECS, EKS, and Lambda
  • Service discovery, autoscaling configurations, and resource constraint management
  • Logging, tracing, and debugging techniques for containerized workloads

Incident Response, Playbooks, and Chaos Engineering

  • Runbook-based incident management and post-incident review practices
  • Automating remediation processes and self-healing mechanisms
  • Introduction to chaos experiments for validating system resilience

Practical Workshop: Managing a Sample Workload

  • Deploying a sample application via IaC and CI/CD pipelines
  • Setting up monitoring, alerts, and automated remediation scripts
  • Simulating incidents to practice runbook-guided responses

Recap and Future Recommendations

Requirements

  • Foundational knowledge of cloud architectures and networking principles
  • Proficiency in Linux command-line operations and scripting
  • Practical experience with version control (Git) and introductory CI/CD concepts

Target Audience

  • Cloud operations specialists
  • SREs and platform engineers
  • DevOps engineers and technical leads
 21 Hours

Number of participants


Price per participant

Testimonials (1)

Upcoming Courses

Related Categories