description
Cerebras Systems recrute un ingénieur de cluster pour créer et exploiter des logiciels qui gèrent des milliers de wafers, de serveurs et de commutateurs Cerebras comme un cloud. Le poste couvre l’automatisation déclarative pilotée par des CRD, la mise en réseau bare metal, les systèmes d’exploitation, les logiciels applicatifs, l’installation de clusters et l’application de correctifs de sécurité, les opérateurs Kubernetes pour les charges de travail d’inférence, les services gRPC du plan de contrôle, les pipelines de métriques et de journaux, la détection des défaillances, la haute disponibilité et la reprise. Le poste exige au moins cinq ans d’expérience en systèmes distribués de production ou en logiciels d’infrastructure, une solide maîtrise de Go et Python, une connaissance approfondie de Kubernetes, la capacité à déboguer des systèmes distribués, une expertise de Prometheus et Grafana, ainsi qu’une utilisation démontrée de l’IA dans les flux de travail d’ingénierie.
