Description
Tyk is hiring a remote-first Site Reliability Engineer to maintain and improve its global Tyk Cloud platform, manage reliability and incidents, automate operations, expand multi-region and multi-cloud infrastructure, define metrics and dashboards, document SRE processes, and support continuous operational improvement. The role requires advanced Kubernetes, AWS/EKS, and Linux experience, proficiency with Terraform and Helm, familiarity with Go, database and cache cluster operations, observability systems, networking, and participation in an on-call rotation.
