Liên hệ với chúng tôi

Đề cương khóa học

Nền tảng của Vận hành Đám mây trên AWS

  • Vai trò và trách nhiệm vận hành trong đám mây
  • Cấu trúc tài khoản AWS, tổ chức và chiến lược đa tài khoản
  • Các dịch vụ vận hành cốt lõi: CloudWatch, CloudTrail, AWS Config

Infrastructure as Code (IaC) và Cấp phát hạ tầng

  • Nguyên tắc của IaC và hạ tầng bất biến (immutable infrastructure)
  • Cấp phát với Terraform và AWS CloudFormation
  • Quản lý trạng thái (state), module và thăng cấp môi trường

CI/CD và Chiến lược Triển khai

  • Thiết kế đường ống CI/CD cho ứng dụng cloud-native
  • Triển khai Blue/green, canary (thử nghiệm) và rolling (cuộn)
  • Tự động hóa hồi quy (rollback), kiểm tra sức khỏe và xác thực phát hành

Giám sát, Khả năng quan sát và Cảnh báo

  • Chỉ số (metrics), nhật ký (logs) và vết (traces): gửi, lưu trữ và phân tích
  • Sử dụng CloudWatch, X-Ray và các công cụ khả năng quan sát bên thứ ba
  • Định nghĩa SLO/SLI, chính sách cảnh báo và thực hành trực ca (on-call)

Vận hành Bảo mật và Quản lý Danh tính

  • Thực hành tốt nhất của IAM, đặc quyền tối thiểu và truy cập đa tài khoản
  • Quản lý bí mật (secrets), KMS và kho tham số an toàn
  • Bảo mật vận hành: chiến lược vá lỗi, quét lỗ hổng và dấu vết kiểm toán

Bền bỉ, Sao lưu và Khắc phục Thảm họa

  • Thiết kế cho khả năng chịu lỗi và khả năng sẵn sàng cao
  • Chiến lược sao lưu, tự động hóa snapshot và quy trình khôi phục
  • Lập kế hoạch khắc phục thảm họa và tạo runbook

Tối ưu hóa Chi phí và Quản trị

  • Minh bạch chi phí: hóa đơn, tag (thẻ phân loại) và chiến lược phân bổ chi phí
  • Tối ưu kích thước (rightsizing), instance đặt trước (reserved instances)/kế hoạch tiết kiệm (savings plans) và kiểm soát ngân sách
  • Quản trị: chính sách, rào chắn (guardrails) và tự động hóa cho tuân thủ

Container, Serverless và Vận hành Runtime

  • Các yếu tố cần xem xét về mặt vận hành cho ECS, EKS và Lambda
  • Khám phá dịch vụ (service discovery), tự động mở rộng (autoscaling) và giới hạn tài nguyên
  • Ghi log, truy vết (tracing) và gỡ lỗi khối lượng công việc container

Phản hồi Sự cố, Playbook và Kỹ thuật Hỗn mang (Chaos Engineering)

  • Phản hồi sự cố dựa trên runbook và thực hành tổng kết hậu sự cố (postmortem)
  • Tự động hóa khắc phục và các mô hình tự chữa lành
  • Giới thiệu về các thử nghiệm hỗn mang (chaos experiments) để xác minh tính bền bỉ

Hội thảo Thực hành: Vận hành một khối lượng công việc mẫu

  • Triển khai một ứng dụng mẫu sử dụng IaC và đường ống CI/CD
  • Triển khai giám sát, cảnh báo và một script khắc phục tự động
  • Mô phỏng sự cố và thực hành phản hồi dựa trên runbook

Tóm tắt và Các bước tiếp theo

Yêu cầu

  • Hiểu biết cơ bản về các khái niệm đám mây và mạng
  • Nắm vững dòng lệnh Linux và viết script (lệnh chạy)
  • Kinh nghiệm với kiểm soát phiên bản (Git) và các khái niệm CI/CD cơ bản

Đối tượng tham gia

  • Kỹ sư vận hành đám mây
  • SRE và kỹ sư nền tảng
  • Kỹ sư DevOps và các trưởng nhóm kỹ thuật
 21 Giờ

Số người tham gia


Giá cho mỗi học viên

Đánh giá (1)

Các khóa học sắp tới

Các danh mục liên quan