Beschreibung
Der Site-Reliability-Engineer verbindet Software- und Systemtechnik, um großskalige, verteilte, fehlertolerante Systeme für Google Cloud zu entwickeln und zu betreiben. Zu den Aufgaben gehört der gesamte Service-Lebenszyklus – von der Konzeption über die Bereitstellung bis zur kontinuierlichen Verbesserung – einschließlich Unterstützung vor dem Go-Live, Überwachung der Verfügbarkeit und Latenz, Skalierung von Systemen durch Automatisierung sowie die Durchführung von Incident-Response-Maßnahmen und „blameless“ Postmortems. Für die Rolle wird ein Bachelorabschluss oder eine gleichwertige praktische Erfahrung erwartet, ergänzt um umfangreiche Erfahrung in der Softwareentwicklung, Netzwerktechnik, verteilten Systemen und der Leitung teamübergreifender Projekte sowie ausgeprägte Fähigkeiten in Problemlösung und Kommunikation.
