Thank you for sending your enquiry! One of our team members will contact you shortly.
Thank you for sending your booking! One of our team members will contact you shortly.
Course Outline
Foundations of Cloud Operations on AWS
- Defining operational roles and responsibilities in a cloud environment.
- Understanding AWS account structures, organizations, and multi-account strategies.
- Overview of core operational services, including CloudWatch, CloudTrail, and AWS Config.
Infrastructure as Code and Provisioning
- Core principles of IaC and the benefits of immutable infrastructure.
- Practical provisioning techniques using Terraform and AWS CloudFormation.
- Managing state, modules, and strategies for environment promotion.
CI/CD and Deployment Strategies
- Designing efficient CI/CD pipelines for cloud-native applications.
- Exploring blue/green, canary, and rolling deployment models.
- Automating rollback procedures, health checks, and release validation.
Monitoring, Observability, and Alerting
- Handling metrics, logs, and traces: collection, storage, and analysis.
- Utilizing CloudWatch, X-Ray, and third-party observability tools effectively.
- Defining SLOs/SLIs, establishing alerting policies, and implementing on-call best practices.
Security Operations and Identity Management
- Applying IAM best practices, least privilege principles, and cross-account access management.
- Managing secrets, KMS, and secure parameter stores.
- Operational security measures, including patching strategies, vulnerability scanning, and maintaining audit trails.
Resilience, Backup, and Disaster Recovery
- Architecting for fault tolerance and high availability.
- Developing backup strategies, automating snapshots, and defining restore procedures.
- Creating disaster recovery plans and actionable runbooks.
Cost Optimization and Governance
- Enhancing cost visibility through billing, tagging, and cost allocation strategies.
- Implementing rightsizing, reserved instances/savings plans, and budgeting controls.
- Establishing governance frameworks via policies, guardrails, and compliance automation.
Containers, Serverless, and Runtime Operations
- Operational considerations for ECS, EKS, and Lambda.
- Managing service discovery, autoscaling, and resource limits.
- Logging, tracing, and debugging techniques for containerized workloads.
Incident Response, Playbooks, and Chaos Engineering
- Implementing runbook-driven incident response and structured postmortem practices.
- Automating remediation processes and self-healing patterns.
- Introduction to chaos experiments for validating system resilience.
Hands-on Workshop: Operate a Sample Workload
- Deploying a sample application using IaC and a CI/CD pipeline.
- Setting up monitoring, alerts, and automated remediation scripts.
- Simulating incidents and practicing runbook-based response procedures.
Summary and Next Steps
Requirements
- Foundational knowledge of cloud concepts and networking principles.
- Proficiency with the Linux command line and basic scripting.
- Practical experience with source control systems (Git) and a solid grasp of basic CI/CD concepts.
Target Audience
- Cloud operations engineers.
- Site Reliability Engineers (SREs) and platform engineers.
- DevOps engineers and technical team leads.
21 Hours
Testimonials (1)
I've find out new interesting things about Lambda and Serverless