Zum Hauptinhalt springen

Senior Site Reliability Engineer at CloudFactory

Abteilung: Engineering

Sprache
Arbeitsmodell
Hybrides Arbeiten
Standort
Berlin, Deutschland
Anstellungsart
Vollzeit
Karrierestufe
senior
Gepostet

Beschreibung

CloudFactory stellt einen Site Reliability Engineer ein, der für die Zuverlässigkeit, Observability, Entwicklerwerkzeuge, Automatisierung und standardmäßig sichere Infrastruktur seiner KI-Plattform und Kerndienste verantwortlich ist. Die Rolle umfasst Model Serving und Inferenzinfrastruktur, GPU-gestützte Endpunkte, Autoscaling, SLOs, Incident Response, ML- und LLM-Observability, GitOps, Terraform und wiederverwendbare Plattformkomponenten. Bewerber benötigen mindestens fünf Jahre Erfahrung in den Bereichen Infrastruktur, DevOps oder SRE, Erfahrung im Produktionsbetrieb mit Kubernetes, Cloud- und Skripting-Kenntnisse sowie eine ausgeprägte funktionsübergreifende Zusammenarbeit; Erfahrung mit KI-Plattformen ist ausdrücklich erwünscht.

Trendige Jobsuchen

Bei jeder Abfrage werden aktuelle Rollen, Gehaltsbeispiele und Marktnachfrage angezeigt – tippen Sie auf eine Suche, um sie sofort auszuführen.

Holen Sie mehr aus Metaintro heraus

Profitieren Sie von einer leistungsstarken Jobsuche, personalisierten Empfehlungen und umfassenden Karriereeinblicken aus umfassenden, marktführenden Daten und Live-Marktsignalen.

Für Arbeitssuchende

Sind Sie bereit, eine Rolle zu finden, die wirklich passt?

Laden Sie Ihren Lebenslauf hoch, starten Sie einen Thread zur Jobsuche und lassen Sie Metaintro echte Stellenangebote anhand Ihrer Erfahrungen bewerten – und Sie dann von der Suche bis zum Angebot begleiten.

Abgleich

Vergleiche aktuelle Stellen mit deiner vorhandenen Evidenz.

Positionierung

Mache Nachweisprojekte zu rollenspezifischen Bewerbungen.

Verbesserung

Nutze Marktfeedback, um den Kompetenzplan aktuell zu halten.

Zurück zur Navigation