返回岗位列表

DeepSeek

AI Agent 研究员/工程师(实习/全职)

地点:北京 薪资:薪资未公开 日期:2026-06-27

岗位摘要

定义并推进大模型在真实任务场景中的Agent能力,深入办公与日常生活等复杂环境,使模型能自主规划、执行并交付完整结果,持续识别能力瓶颈,驱动模型迭代优化;围绕AI搜索及自主任务执行的全流程,设计并落地多维度自动化评测与归因体系,建立能区分“能用”与“好用”的评测标准,覆盖端到端任务完成度与过程行为…

岗位职责

  • 定义并推进大模型在真实任务场景中的Agent能力,深入办公与日常生活等复杂环境,使模型能自主规划、执行并交付完整结果,持续识别能力瓶颈,驱动模型迭代优化
  • 围绕AI搜索及自主任务执行的全流程,设计并落地多维度自动化评测与归因体系,建立能区分“能用”与“好用”的评测标准,覆盖端到端任务完成度与过程行为质量,打通人工评估与自动化评估,精准定位模型短板
  • 针对各类AI搜索与Agent任务,定义回答及执行结果的理想态,设计并迭代高质量、高多样性的数据生产管线,系统性提升搜索回答与Agent产物的准确性、完整性和用户体验

任职要求

  • 拥有主流AI搜索及Agent产品的深度使用经验,熟悉当前主流Agent架构与产品形态,能够敏锐感知模型能力差异,定位背后的数据需求与问题
  • 对任务质量有清晰的判断标准与内在追求,对“好”有明确的界定能力,能精准辨识输出质量的层级差异,并能将主观感受拆解为可传达、可检验的具体维度
  • 理解模型训练与优化的基本原理,熟悉模型评测方法,精通prompt engineering和(vibe)coding;动手能力强,有丰富的使用自动化手段解决真实问题的经验
  • 对AI Agent领域有真实的热情,持续关注前沿进展,对AI能力的边界保持探索欲与想象力。相信Agent终将深度改变人机协作的方式,让工作更高效,让创造更自由
  • 有以下经验者优先:Agent产品深度使用或构建、自动化工作流设计、评测体系搭建或大模型数据构造经验

福利待遇

  • 参与前沿AI Agent技术研发,推动人机共生新文明
  • 与顶尖团队合作,深度探索AI能力边界
  • 实习或全职岗位灵活选择,提供有竞争力的薪酬