大模型算法实习生-代码智能与自主Agent系统
岗位摘要
参与SWE-bench、LiveCodeBench等主流Code/Agent Benchmark模型能力训练,覆盖Repo级代码理解、长程Agent规划、自动化代码修复与跨文件工程任务
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与SWE-bench、LiveCodeBench等主流Code/Agent Benchmark模型能力训练,覆盖Repo级代码理解、长程Agent规划、自动化代码修复与跨文件工程任务
- 参与模型代码与Agent能力后训练,基于SFT/RLHF训练模型并面向真实软件工程任务评测
- 识别和分析数据合成链路效果瓶颈,设计Multi-Agent协同的数据生成与验证方案
- 应用AI-as-Judge与自动化对齐技术,构建代码任务的Reward Model与强化学习环境
任职要求
- 计算机、人工智能或相关专业在读,本科及以上学历
- 熟悉PyTorch等深度学习框架,具备扎实的编程与工程实现能力
- 掌握NLP/深度学习算法,对Transformer、Post-training有深度理解和实战经验
- 对代码大模型、复杂Agent系统、软件工程智能化有浓厚兴趣,有相关项目经验者优先
- 在NeurIPS/ICML/ICLR/ACL/EMNLP/PLDI等顶级会议发表过论文者优先
福利待遇
- 深入最先进生产力工具建设,积累真实复杂工程任务的稀缺经验
- 定义未来程序员与AI的协作方式
- 薪资340-350元/天
工作地址
北京海淀区科建大厦4层
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。