大模型强化学习研发工程师/研究员(RL方向)
岗位摘要
研究基于Long CoT的大模型强化学习相关技术,包括算法与系统层面的创新;推动推理能力(Reasoning)方向的技术突破与工程实现;探索智能体(Agent)方向的前沿技术与应用场景
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 研究基于Long CoT的大模型强化学习相关技术,包括算法与系统层面的创新
- 推动推理能力(Reasoning)方向的技术突破与工程实现
- 探索智能体(Agent)方向的前沿技术与应用场景
- 研究其他通往AGI/ASI的前沿技术路径
任职要求
- 985/211高校研究生及以上学历或优秀本科生,计算机科学、人工智能、机器学习等相关专业背景
- 熟悉强化学习和大模型相关技术,具有相关实践和研究经验者优先
- 有大模型基础设施(infra)相关研发经验者优先考虑
- 具备大模型与Agent结合的研发经验者优先
- 拥有一定的研究经历,在ICLR、NeurIPS、CoRL、ICML、CVPR等顶级会议发表过论文者优先
- 具备扎实的Python编程基础,具有优秀的工程能力,ACM等编程竞赛获奖者优先
- 具备良好的团队协作能力和沟通能力
福利待遇
- 薪资55-85K·16薪,顶尖人才薪资不设上限
- 参与大模型前沿核心技术研发,接触AGI/ASI领域最新研究方向
- 与全球顶尖技术人才共事,获得快速成长机会
工作地址
北京海淀区京东科技大厦13F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。