설명
AI 플랫폼 직무는 vLLM, Dynamo, Triton과 같은 대규모 LLM 및 임베딩 모델 서빙 프레임워크를 운영하고 개선하며, 신뢰할 수 있는 실시간 서빙 환경을 구축하고 모니터링합니다. 또한 리소스 효율성, 추론 속도 및 확장성을 최적화하고, 인시던트 대응, 배포 안정성, 오케스트레이션 및 자동화를 지원합니다. GPU 및 LLM 내부 구조, 서빙 프레임워크, 운영 안정성, 고성능 서빙 관련 경험을 갖춘 인재를 찾으며, 범용 AI/ML 플랫폼 경험이 있으면 추가적인 강점이 됩니다.
