Agent 数据策略工程师
岗位摘要
提升模型在 Agent 方向的专业能力,围绕代码生成、通用 Agent 等场景设计高质量的训练语料;构建端到端的测试用例,从可用性、代码规范、工程质量、任务完成度等多维度评估模型表现
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 提升模型在 Agent 方向的专业能力,围绕代码生成、通用 Agent 等场景设计高质量的训练语料
- 构建端到端的测试用例,从可用性、代码规范、工程质量、任务完成度等多维度评估模型表现
- 设计并构造高质量的 Agent 评测数据集,能够精准区分不同模型的能力边界
- 针对 Agent 的规划、工具调用、多轮交互、指令跟随等核心能力构建多样化的测试场景与用例
- 持续迭代评测标准,确保评测体系跟进业界前沿并反映真实用户需求
- 探索不同数据标注策略对模型 Agent 能力的影响路径,参与数据与强化学习结合的实验设计
- 基于 Claude Code、OpenClaw 等主流 Agent 产品的实践经验,分析模型的能力短板与失败模式
- 针对性地构建补齐数据与边界测试用例,推动模型在弱项上的持续迭代与突破
任职要求
- 具备 Claude Code、Cursor、OpenClaw 等 AI 编程工具的重度使用经验,对 LLM 辅助开发有自己的理解与思考
- 熟练掌握 Python,能够独立编写数据处理、评测脚本等工具
- 对大语言模型有基础认知且对探索大模型能力边界具有较高的热情
- 具备良好的自主能动性,能够独立发现问题、定义问题并推动解决
- 善于跨团队协作,能够与研发、算法团队高效配合
- 具有多年工程开发经验、完成过大型项目的经历者优先
- 有前端开发经验,熟悉 React 或 Vue 等主流框架,对前端设计有独立的审美与品味者优先
- 有大模型数据标注、评测体系设计或数据质量管理经验者优先
加分项
- 有前端开发经验,熟悉 React 或 Vue 等主流框架,对前端设计有独立的审美与品味
- 有大模型数据标注、评测体系设计或数据质量管理经验
- 罗女士 刚刚活跃
福利待遇
- 具有竞争力的薪酬:40-70K·14薪
- 接受无数据开发经验,开放包容的招聘政策
- 参与前沿大模型 Agent 能力的研发与迭代
- 与研发、算法团队高效协作,跨团队协作氛围良好
- 公司为深度求索(DeepSeek),技术氛围浓厚
工作地址
北京海淀区海淀区融科资讯中心C座5F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。