Beschreibung
Anthropic sucht eine Forschungsingenieurin oder einen Forschungsingenieur für das Post-Training-Team, um Post-Training-Techniken wie Constitutional AI, RLHF und andere Alignment-Methoden für Frontier-Modelle zu implementieren, zu optimieren und zu skalieren. Die Rolle umfasst die Entwicklung von Fine-Tuning- und Evaluierungspipelines, die Messung der Modellleistung, die Fehlerbehebung bei Trainingsproblemen und die Überführung von Forschung in produktionsreife Systeme. Bewerberinnen und Bewerber sollten über fundierte Erfahrung in Softwareentwicklung und maschinellem Lernen, Vertrautheit mit großen Sprachmodellen sowie Kenntnisse in Python, Deep-Learning-Frameworks und verteiltem Rechnen verfügen. Die Stelle ist hybrid, erfordert mindestens einen Bachelorabschluss in einem relevanten Fachgebiet und kann kurzfristige Reaktionen auf Vorfälle beinhalten.

