설명
GPU 인프라 엔지니어는 베어메탈 및 퍼블릭 클라우드 환경 전반에서 AI/ML 워크로드를 위한 GPU 컴퓨팅 클러스터를 설계, 구축, 운영 및 확장합니다. 담당 업무에는 GPU 아키텍처 선정 및 검증, 운영 체제와 소프트웨어 스택 구성, 노드 프로비저닝, 고성능 네트워크 및 스토리지 설계, GPU 리소스 모니터링 및 진단, 운영 자동화가 포함됩니다. 이 직무에는 대규모 Linux 인프라를 다룬 시스템 엔지니어링 경력 3년 이상, 운영 체제, 커널 또는 드라이버 관련 실무 경험, GPU 서버를 사용하는 HPC 또는 AI 클러스터 경험이 필요합니다.
