Descrizione
ToolsGroup sta assumendo un/una Senior Site Reliability Engineer esperto/a per guidare le operazioni dei servizi IT e un piccolo team IT/Ops, fungendo al contempo da punto di escalation tecnica senior per i servizi di produzione. Il ruolo si concentra su diagnosi dei guasti dei sistemi distribuiti, guida di incidenti maggiori, troubleshooting di Windows, Linux, Kubernetes, sistemi cloud, networking, identity, database e API, automazione del lavoro operativo, miglioramento di osservabilità e affidabilità e traduzione delle decisioni tecniche in priorità di business. I candidati devono avere almeno cinque anni di esperienza di produzione/production engineering, responsabilità tecnica diretta degli incidenti ad alta severità e esperienza hands-on con cloud, container, osservabilità, automazione e infrastructure as code. La posizione offre uno stipendio di 55.000–68.000 all’anno più un bonus del 10%.
