Descrizione
Anthropic assume un ingegnere di ricerca per il suo team Post-Training, con il compito di implementare, ottimizzare e scalare tecniche di post-addestramento come Constitutional AI, RLHF e altri metodi di allineamento sui modelli di frontiera. Il ruolo prevede lo sviluppo di pipeline di fine-tuning e valutazione, la misurazione delle prestazioni dei modelli, il debug dei problemi di addestramento e la trasformazione della ricerca in sistemi pronti per la produzione. I candidati dovrebbero avere una solida esperienza nell'ingegneria del software e nel machine learning, familiarità con i modelli linguistici di grandi dimensioni e competenze in Python, framework di deep learning e calcolo distribuito. Il ruolo è ibrido, richiede almeno una laurea triennale in un campo pertinente e può comportare la gestione di incidenti con breve preavviso.

