返回岗位列表

DeepSeek

Agent 数据策略工程师

地点:北京 薪资:30-60K 日期:2026-06-26

岗位摘要

提升模型在Agent方向的专业能力,围绕代码生成、通用Agent等场景设计高质量训练语料;构建端到端测试用例,从可用性、代码规范、工程质量、任务完成度等多维度评估模型表现;设计并构造高质量的Agent评测数据集,精准区分不同模型的能力边界

岗位职责

  • 提升模型在Agent方向的专业能力,围绕代码生成、通用Agent等场景设计高质量训练语料
  • 构建端到端测试用例,从可用性、代码规范、工程质量、任务完成度等多维度评估模型表现
  • 设计并构造高质量的Agent评测数据集,精准区分不同模型的能力边界
  • 结合日常Agent使用场景与实际工作流程,设计贴近真实需求的多样化测试用例
  • 持续迭代评测标准
  • 探索不同数据标注策略对模型Agent能力的影响路径
  • 参与数据与强化学习结合过程中的实验设计,研究模型能力的可控性检测方法
  • 基于深度使用Claude Code、OpenClaw等主流Agent产品的实践经验,系统性分析当前模型的能力短板与失败模式
  • 针对性地构建补齐数据与边界测试用例,推动模型在弱项上的持续迭代与突破

任职要求

  • 具备Claude Code、Codex、OpenClaw等AI编程工具的重度使用经验,对LLM辅助开发有自己的理解与思考
  • 具备良好的自主能动性,能够独立发现问题、定义问题并推动解决
  • 善于跨团队协作,能够与研发、算法团队高效配合
  • 具有多年工程开发经验,完成过大型项目的交互
  • 加分项:在某些技术领域具备较深的积累和独到的见解(如前端开发经验、CTF竞赛或软件漏洞挖掘等安全方向实战经历)
  • 加分项:有大模型数据标注、评测体系设计或数据质量管理经验
  • 加分项:对大语言模型有基础认知且对探索大模型能力边界具有较高的热情

加分项

  • 在某些技术领域具备较深的积累和独到的见解(例如:拥有前端开发经验,熟悉 React 或 Vue 等主流框架,对前端设计有独立的审美品味
  • 或在 CTF 竞赛、软件漏洞挖掘等安全方向有实战经历及相关奖项)
  • 有大模型数据标注、评测体系设计或数据质量管理经验
  • 对大语言模型有基础认知且对探索大模型能力边界具有较高的热情

福利待遇

  • 薪资范围:30-60K·14薪
  • 工作地点:北京海淀区融科资讯中心C座

工作地址

北京海淀区融科资讯中心C座