Get in Touch
 Duration 35 hours

Course Outline

SRE Anti-patterns

  • Detecting counterproductive operational practices
  • Assessing the effect of anti-patterns on system reliability
  • Applying best practices and corrective measures

SLOs as an Indicator of Customer Satisfaction

  • Establishing Service Level Indicators (SLIs) and Service Level Objectives (SLOs)
  • Governing error budgets to balance innovation against reliability
  • Comprehending the constraints of distributed systems

Constructing Secure and Reliable Systems

  • Engineering for fault tolerance and resilience
  • Embedding security within reliability engineering processes
  • Strategies for scalability and data protection

Full-stack Observability

  • System instrumentation and metrics acquisition
  • Distributed tracing and synthetic monitoring techniques
  • Development practices driven by observability

Platform Engineering and AIOps

  • Engineering approaches centered on platform design
  • The role of automation and orchestration in SRE
  • Utilizing DataOps and operational intelligence

Incident Management in SRE

  • Defining roles and responsibilities during incident response
  • Utilizing frameworks such as OODA
  • Automated remediation and resolution assisted by AI/ML

Chaos Engineering

  • Core principles and strategies for resilience testing
  • Planning and conducting “game day” simulations
  • Gaining insights from controlled failure experiments

SRE as a Pure Form of DevOps

  • Integrating SRE principles into DevOps workflows
  • Fostering cultural alignment and collaborative practices
  • Driving organizational transformation through SRE

Post-class Exercises

  • Case studies on large-scale system design
  • Scenarios involving advanced instrumentation and monitoring
  • Problem-solving applied to real-world reliability challenges

Review and Exam Preparation

  • Comprehensive review of the DevOps Institute SRE Practitioner syllabus
  • Sample questions and mock assessments
  • Strategies and recommendations for exam success

Summary and Next Steps

Requirements

  • A solid grasp of fundamental Site Reliability Engineering principles
  • Professional experience with DevOps methodologies and associated tooling
  • Knowledge of system monitoring, incident management, and automation

Target Audience

  • SRE professionals pursuing the DevOps Institute SRE Practitioner credential
  • DevOps engineers looking to transition into reliability-centric roles
  • Operations leaders tasked with strategy and execution for system reliability

Number of participants


Price per participant

Testimonials (2)

Upcoming Courses

Related Categories