AI评测开发工程师
岗位摘要
参与多模态大模型评测体系建设,包括文本、语音、图片、视频生成等多模态模型及Agent,制定评测方案与评测指标,构建评测集形成行业基准;开发自动化、可扩展、可靠的评测系统,提升自动评估占比,缩短整体评测周期
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与多模态大模型评测体系建设,包括文本、语音、图片、视频生成等多模态模型及Agent,制定评测方案与评测指标,构建评测集形成行业基准
- 开发自动化、可扩展、可靠的评测系统,提升自动评估占比,缩短整体评测周期
- 针对阶段性迭代重点和行业变化动态调整评测集,持续探索模型和Agent的能力边界
- 深入分析模型与Agent能力表现,明确当前版本的优势与缺陷,拦截能力下限问题
- 持续追踪大模型行业发展动态,对重点版本模型和Agent进行横向对比评测,量化行业能力水平
任职要求
- 计算机、人工智能等相关专业本科及以上学历
- 具备AI模型评测或相关开发经验
- 熟悉多模态大模型(文本、语音、图像、视频)的技术原理与应用场景
- 具备良好的数据分析能力和逻辑思维能力
- 对大模型行业发展保持高度关注,具备快速学习能力
福利待遇
- 具有竞争力的薪酬福利(30-50K)
- 参与前沿大模型评测体系建设,接触行业顶尖技术
- 良好的团队氛围与职业发展空间
工作地址
北京海淀区蓟门壹号8楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。