AIGC大模型评测工程师
岗位摘要
研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系
- 深入参与团队内部模型训练的性能分析与评估,聚焦基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析
- 分析评测结果,挖掘模型潜在瓶颈并提出改进建议,持续提升模型的质量与用户体验
- 参与制定模型评测的中长期规划,推动评测工具与流程自动化和标准化,构建业界领先的评测体系
任职要求
- 计算机、人工智能相关专业本科及以上学历
- 有机器学习、数据挖掘或算法评测相关工作经验,了解当前模型的评测方法和指标体系
- 熟练掌握Python/Java/C++中至少一种编程语言,了解常见深度学习框架(如PyTorch、TensorFlow)以及常见的评测框架(如OpenCompass/VLMEvalKit/EvalScope等)
- 具备优秀的分析问题与解决问题的能力,对前沿技术具备敏锐的洞察力
- 有大模型训练、模型应用落地和性能优化相关经历者优先
- 有大规模模型评测框架搭建或优化经验,或熟悉业界主流评测工具与方法者优先
- 在NeurIPS、ICML、ACL、SIGKDD、CVPR等国际顶级会议上发表论文,或有相关竞赛获奖经历者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。