模型&Agent评测系统工程师
岗位摘要
负责模型&Agent评测平台系统的评测框架设计与功能开发;设计构建评测集(benchmark),参与pipeline搭建,推动自动化评测转化;设计构建各类Agent执行环境,包括工具调用、测试与结果验证等
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责模型&Agent评测平台系统的评测框架设计与功能开发
- 设计构建评测集(benchmark),参与pipeline搭建,推动自动化评测转化
- 设计构建各类Agent执行环境,包括工具调用、测试与结果验证等
- 改进优化评测平台和框架,提升评测稳定性和复测效率
- 与算法深度协作,解决各类评测问题,构建各类数据生产工具
任职要求
- 本科及以上学历,计算机等相关专业,3年及以上前后端开发经验
- 扎实的软件工程能力,熟练掌握Python、Go、Java、TypeScript等开发语言,精通至少一种,具备全栈开发能力
- 熟练掌握各类开发语言生态框架、中间件应用,具备一定架构设计能力
- 负责或参与过评测类平台、框架的设计开发,有Agent开发经验及LLM evaluation/benchmark构建经验
- 有大模型、算法工程相关工作经历,有较强自驱力,能够独立负责和解决问题
- 有开源项目参与经验优先,熟练应用各类Agent,具备AI native思维
福利待遇
- 薪资40-70K·16薪,具有竞争力的薪酬待遇
- 工作地点位于北京海淀区大恒科技大厦,核心地段办公
- 公司为上海阶跃星辰智能科技,实力企业平台
工作地址
北京海淀区大恒科技大厦9
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。