AI训练推理测试工程师
岗位摘要
负责AI训练与推理相关测试工作,保障模型性能与系统稳定性;参与深度学习框架(如PyTorch)、分布式训练框架(如Megatron-LLM、DeepSpeed)及推理引擎(如vLLM、SGLang)的测试方法设计、测试系统搭建和测试开发
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责AI训练与推理相关测试工作,保障模型性能与系统稳定性
- 参与深度学习框架(如PyTorch)、分布式训练框架(如Megatron-LLM、DeepSpeed)及推理引擎(如vLLM、SGLang)的测试方法设计、测试系统搭建和测试开发
- 设计并执行测试用例,分析测试结果,输出问题报告并推动问题解决
- 协同研发团队完成测试环境搭建与测试工具优化
任职要求
- 具备较强的逻辑分析能力和问题定位能力
- 熟悉Python等编程语言,掌握常用测试框架和工具
- 对AI模型训练与推理流程有基本理解,具备相关测试经验优先
- 熟悉基于PyTorch/TensorFlow/PaddlePaddle框架和常用算子精度和性能验证方法
- 熟悉常见的分布式框架如Megatron-LM/DeepSpeed,能够理解框架训练的基本流程,理解常见的分布式切分策略
- 熟悉常见的推理引擎如vLLM/SGLang,有大模型推理性能、精度测试经验
- 具备基于AI Agent的自动化框架设计或落地经验,能够利用AI Agent实现测试用例自动生成
福利待遇
- 具有竞争力的薪酬待遇(25-40K·15薪)
- 参与前沿AI大模型训练与推理技术测试,积累宝贵经验
- 与专业研发团队协同工作,共同推动技术创新
工作地址
上海闵行区上海临港浦江国际科技城发展有限公司10-16
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。