Beschreibung
Runware stellt einen Site Reliability Engineer ein, um die Verlässlichkeit, Verfügbarkeit, Performance, Observability und operative Widerstandsfähigkeit über die Produktions‑KI‑Infrastruktur hinweg zu verbessern. Die Rolle ist äußerst hands-on und umfasst verteilte Systeme, APIs, Netzwerke, Queues, Datenbanken, workloads mit GPU-Unterstützung, Incident Response, On-Call‑Support, Automatisierung, Kapazitätsplanung und Sicherheit bei Deployments. Das Unternehmen arbeitet Remote-first, bietet flexible Arbeitszeiten, sinnvolle Aktienoptionen, bezahlten Urlaub, Elternzeit sowie zwei jährliche Retreats.
