Beskrivning
Den seniora Site Reliability Engineer-rollen ska leda arbetet med driftsäkerhet, observerbarhet, incidenthantering, produktionsstabilitet och kostnadsoptimering över en komplex multicloudplattform. Ansvarsområden omfattar att bygga en enhetlig arkitektur för mätvärden, loggar och spår; etablera SLI/SLO:er och felbudgetar; optimera kostnader för AWS och GCP; förbättra Kubernetes-kluster och återställningsmekanismer; samt utveckla ramverk för incidenthantering och driftsättning. Rollen kräver minst fem års erfarenhet av DevOps, SRE eller molnplattformar, erfarenhet av tekniskt ledarskap, erfarenhet av distribuerade system i produktionsmiljö, djupgående kunskaper i Kubernetes och erfarenhet av att etablera lösningar för observerbarhet. Tjänsten är placerad i Göteborg. Engelska krävs och kunskaper i mandarin är meriterande.
