10 packages found
Site Reliability Engineering — SLOs, error budgets, toil reduction, incident mgmt
Terraform IaC — modules, state management, multi-cloud provisioning
Chaos engineering experiments — failure injection, blast radius analysis, game days
Define and implement SLOs/SLIs — error budgets, alerting, reliability targets
SLO design, alert optimization, dashboard generation for production systems
Google Cloud architecture — compute, data, networking, security design
Azure architecture — service design, governance, cost management
AWS architecture — service selection, cost optimization, Well-Architected Framework
Incident response playbook — severity classification, PIR generation
DevOps expertise — CI/CD, containers, monitoring, infrastructure as code