模型&Agent评测系统工程师
岗位摘要
负责模型&Agent通用评测平台系统的设计与架构规划,完成功能模块的开发与实现;设计构建Benchmark,参与评测集构建与pipeline搭建,推动评测往自动化方向转化;设计构建各类Agent执行环境,包括工具调用、测试执行与结果验证等核心环节
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责模型&Agent通用评测平台系统的设计与架构规划,完成功能模块的开发与实现
- 设计构建Benchmark,参与评测集构建与pipeline搭建,推动评测往自动化方向转化
- 设计构建各类Agent执行环境,包括工具调用、测试执行与结果验证等核心环节
- 持续改进优化评测平台和评测框架,提升系统稳定性与复测效率
- 与算法团队深度协作,解决各类评测技术难题,构建各类数据生产工具
任职要求
- 本科及以上学历,计算机等相关专业,具备3年及以上前后端开发经验
- 具备扎实的软件工程能力,熟练掌握Python、Go、Java、TypeScript等开发语言至少一种,具备全栈开发能力
- 熟练掌握各类开发语言生态框架与中间件应用,具备一定架构设计能力,能合理利用技术框架与工具解决实际技术问题
- 有评测类平台或框架的设计开发经验,具备Agent开发经验及LLM evaluation/Benchmark构建经验
- 有大模型、算法工程相关工作经历,具备较强自驱力,能够独立承担并解决复杂问题
- 有开源项目参与经验优先,熟练应用各类Agent框架,具备AI Native思维
福利待遇
- 薪酬40-70K,16薪,提供具有竞争力的薪资待遇
- 工作地点位于北京海淀区大恒科技大厦,交通便利
- 与算法团队深度协作,接触大模型前沿技术领域
- 鼓励自驱创新,提供独立负责项目的机会
工作地址
北京海淀区大恒科技大厦南座F9层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。