Thank you for sending your enquiry! One of our team members will contact you shortly.
Thank you for sending your booking! One of our team members will contact you shortly.
Course Outline
Foundations of Cloud Operations on AWS
- Defining operational roles and responsibilities in the cloud.
- AWS account structures, organizations, and multi-account strategies.
- Key operational services: CloudWatch, CloudTrail, and AWS Config.
Infrastructure as Code and Provisioning
- Core principles of IaC and immutable infrastructure.
- Provisioning workflows using Terraform and AWS CloudFormation.
- Managing state, modules, and environment promotion.
CI/CD and Deployment Strategies
- Designing CI/CD pipelines for cloud-native applications.
- Implementing blue/green, canary, and rolling deployment methods.
- Automating rollbacks, health checks, and release validation.
Monitoring, Observability, and Alerting
- Handling metrics, logs, and traces: shipping, storing, and analyzing data.
- Utilizing CloudWatch, X-Ray, and third-party observability tools.
- Establishing SLOs/SLIs, alerting policies, and on-call practices.
Security Operations and Identity Management
- IAM best practices, least privilege principles, and cross-account access.
- Secrets management, KMS, and secure parameter stores.
- Operational security measures: patching strategies, vulnerability scanning, and audit trails.
Resilience, Backup, and Disaster Recovery
- Architecting for fault tolerance and high availability.
- Backup strategies, snapshot automation, and restore procedures.
- Disaster recovery planning and developing runbooks.
Cost Optimization and Governance
- Enhancing cost visibility through billing, tagging, and allocation strategies.
- Rightsizing resources, managing reserved instances/savings plans, and budgeting controls.
- Governance frameworks: policies, guardrails, and compliance automation.
Containers, Serverless, and Runtime Operations
- Operational considerations for ECS, EKS, and Lambda.
- Managing service discovery, autoscaling, and resource limits.
- Logging, tracing, and debugging containerized workloads.
Incident Response, Playbooks, and Chaos Engineering
- Runbook-driven incident response and postmortem analysis.
- Automating remediation and implementing self-healing patterns.
- Introduction to chaos experiments for validating resilience.
Hands-on Workshop: Operating a Sample Workload
- Deploying a sample application using IaC and a CI/CD pipeline.
- Implementing monitoring, alerts, and automated remediation scripts.
- Simulating incidents and practicing runbook-based response.
Summary and Next Steps
Requirements
- A foundational understanding of cloud concepts and networking.
- Proficiency with the Linux command line and scripting.
- Experience with source control (Git) and basic CI/CD concepts.
Target Audience
- Cloud operations engineers.
- SREs and platform engineers.
- DevOps engineers and technical team leads.
21 Hours
Testimonials (1)
I've find out new interesting things about Lambda and Serverless