模型&Agent评测系统工程师
岗位摘要
负责模型&Agent通用评测平台的设计与开发工作;设计构建Benchmark,包括评测集构建、Pipeline搭建,推动Benchmark往自动化评测转化;设计构建各类Agent执行环境,包括工具调用、测试与结果验证等
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责模型&Agent通用评测平台的设计与开发工作
- 设计构建Benchmark,包括评测集构建、Pipeline搭建,推动Benchmark往自动化评测转化
- 设计构建各类Agent执行环境,包括工具调用、测试与结果验证等
- 改进优化评测平台和框架,提升评测稳定性和复测效率
- 与算法团队深度协作,解决各类评测问题,构建各类数据生产工具
任职要求
- 本科及以上学历,计算机等相关专业,具备3年及以上前后端开发经验
- 扎实的软件工程能力,熟练掌握Python、Go、Java、TypeScript等开发语言,精通至少一种,具备全栈开发能力
- 熟练掌握各类开发语言生态框架、中间件应用,具备一定架构设计能力,能够合理利用各类技术框架、组件、工具解决技术问题
- 负责或参与过评测类平台、框架的设计开发,有一定Agent开发经验,具备LLM evaluation/Benchmark构建经验
- 有大模型、算法工程相关工作经历,有较强自驱力,能够独立负责和解决问题
- 有开源项目或参与过开源项目经验优先,熟练应用各类Agent,具备AI Native思维
福利待遇
- 提供有竞争力的薪酬(35-65K·16薪)
- 知名AI科技公司平台,职业发展前景广阔
工作地址
北京海淀区大恒科技大厦12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。