说明该职位负责为大规模 AI 模型(包括 LLM、嵌入模型、STT 和 TTS)设计、构建和维护可扩展的模型托管与推理系统。工作范围涵盖推理优化、框架集成、性能监控、硬件协作和生产环境可靠性,以及端到端模型微调流水线。该职位要求具备相关高级学位、至少三年的团队领导经验,以及五年或以上 AI 经验,涉及推理优化、托管和微调流水线开发。