Description
The role is a Site Reliability Engineer focused on designing and operating scalable, fault-tolerant distributed systems on Azure. Responsibilities include delivering new functionality, resolving reliability issues, standardizing services, automating deployment and management, supporting agile operations, and participating in 12-hour on-call shifts. Required expertise includes .NET/IIS, Docker, Kubernetes, Terraform, Azure DevOps, C#, observability, SLOs, ArgoCD, Argo Workflows, and load testing.
