Beschreibung
trivago sucht einen Site Reliability Engineer für sein SRE Data Squad in Düsseldorf. Die Rolle umfasst den Betrieb und die Verbesserung von Kafka, Flink, Cassandra, Redis und zugehörigen Datendiensten in der Produktionsumgebung über die Google Cloud Platform und eine lokale Infrastruktur hinweg, einschließlich Überwachung, Observability, Automatisierung, Dokumentation, Fehlersuche und Reaktion auf Vorfälle. Bewerber benötigen praktische Erfahrung mit Kubernetes und Kafka in Produktionsumgebungen, Erfahrung mit Cloud- und lokaler Infrastruktur, ausgeprägte Fähigkeiten zur Fehlerbehebung bei verteilten Systemen sowie Interesse an KI-gestützter Automatisierung. Die Stelle bietet hybrides Arbeiten, Unterstützung bei Visa, Umzugshilfe und weitere Mitarbeiterleistungen.
