Get in Touch
 Duration 35 hours

Course Outline

SRE Anti-patterns

  • Spotting practices that hinder performance
  • Assessing how anti-patterns affect system reliability
  • Exploring best practices and corrective measures

Using SLOs as a Metric for Customer Satisfaction

  • Establishing Service Level Indicators (SLIs) and Service Level Objectives (SLOs)
  • Overseeing error budgets to strike a balance between innovation and reliability
  • Comprehending the constraints inherent in distributed systems

Constructing Secure and Reliable Systems

  • Architecture strategies for fault tolerance and resilience
  • Weaving security principles into reliability engineering
  • Tactics for scalability and safeguarding data

End-to-End Observability

  • Setting up instrumentation and gathering metrics
  • Utilizing distributed tracing and synthetic monitoring
  • Adopting an observability-centric development approach

Platform Engineering and AIOps

  • Employing platform-centric engineering models
  • Applying automation and orchestration within SRE frameworks
  • Utilizing DataOps and operational intelligence

Incident Management within SRE

  • Defining roles and duties in incident response
  • Implementing frameworks such as OODA
  • Leveraging automated remediation and AI/ML-driven resolution

Chaos Engineering

  • Core principles and methods for resilience testing
  • Organizing and carrying out “game day” simulations
  • Gaining insights from controlled failure scenarios

SRE as a Distinct Evolution of DevOps

  • Merging SRE principles into DevOps workflows
  • Fostering cultural alignment and team collaboration
  • Facilitating organizational transformation via SRE

Post-Session Assignments

  • Case studies on designing large-scale systems
  • Advanced scenarios for instrumentation and monitoring
  • Tackling real-world reliability challenges

Review and Exam Readiness

  • Comprehensive recap of the DevOps Institute SRE Practitioner syllabus
  • Sample items and mock assessments
  • Tips and strategies for the exam experience

Conclusion and Future Directions

Requirements

  • Solid grasp of fundamental Site Reliability Engineering concepts
  • Practical experience with DevOps methodologies and associated tooling
  • Working knowledge of system monitoring, incident handling, and automation

Target Audience

  • SRE specialists pursuing the DevOps Institute SRE Practitioner certification
  • DevOps engineers looking to transition into or expand their roles in reliability engineering
  • Operations leaders tasked with defining and executing reliability strategies

Number of participants


Price per participant

Testimonials (2)

Provisional Upcoming Courses (Require 5+ participants)

Related Categories