Opis
NVIDIA zatrudnia Starszego Inżyniera Oprogramowania specjalizującego się w Deep Learning Inference, aby projektować, tworzyć i optymalizować oprogramowanie przyspieszane przez GPU do obsługi modeli językowych na dużą skalę oraz modeli generatywnej AI. Rola koncentruje się na usprawnianiu SGLang, vLLM, FlashInfer i powiązanych bibliotek inference; zwiększaniu wydajności na GPU w centrach danych oraz na edge SoCs; oraz wykorzystywaniu CUDA, CUTLASS, OAI Triton, NCCL i innych narzędzi open-source. Kandydaci muszą posiadać tytuł magistra lub stopień doktora (PhD) w pokrewnej dziedzinie, co najmniej pięć lat doświadczenia w tworzeniu oprogramowania, silne umiejętności w C/C++ oraz doświadczenie w zakresie inference modeli DL, profilowania lub architektury GPU.
