Passa al contenuto principale

Ingegnere senior di affidabilità dei siti, DGX Cloud at NVIDIA

Reparto: Site Reliability Engineering

Linguaggio
Modalità
Remoto
Posizione
Zurigo, Zurigo, Svizzera · Cina
Livello
senior
Inserito

Descrizione

NVIDIA assume un ingegnere senior di affidabilità dei siti per mantenere e migliorare cluster Kubernetes su larga scala a supporto di DGX Cloud per ricercatori nel campo dell’IA e clienti aziendali. Il ruolo comprende l’affidabilità operativa, la gestione di SLO/SLI e dei budget di errore, il lancio dei servizi e il monitoraggio successivo al lancio, l’ottimizzazione dei carichi di lavoro GPU presso i principali provider cloud, l’automazione, il triage degli incidenti, l’analisi delle cause principali e il supporto di reperibilità. I candidati devono avere una laurea triennale (BS) in informatica o in un campo tecnico correlato, oppure esperienza equivalente, almeno 10 anni di esperienza nelle operazioni di servizi in produzione e competenze in Kubernetes, containerizzazione, microservizi, automazione dell’infrastruttura, programmazione, Linux, reti, sicurezza cloud, osservabilità e pratiche SRE.

Per chi cerca lavoro

Pronto a trovare un ruolo adatto?

Carica il tuo curriculum, avvia un thread di ricerca di lavoro e lascia che Metaintro classifichi le reali opportunità in base alla tua esperienza, quindi ti guidi dalla ricerca all'offerta.

Corrispondenza

Confronta i ruoli aperti con le tue evidenze attuali.

Posizionamento

Trasforma i progetti di prova in candidature specifiche per il ruolo.

Miglioramento

Usa il feedback del mercato per tenere aggiornato il piano di competenze.

Ritorna alla navigazione