研究工程师/研究科学家,强化学习/推理
岗位摘要
推进AI对齐与能力的前沿研究;开发并应用尖端的强化学习方法;训练智能、对齐且通用的代理系统;参与大规模生成模型的构建与部署;快速迭代并优化大型机器学习代码库;具备强化学习研究背景;能够快速迭代并高效编码
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 推进AI对齐与能力的前沿研究
- 开发并应用尖端的强化学习方法
- 训练智能、对齐且通用的代理系统
- 参与大规模生成模型的构建与部署
- 快速迭代并优化大型机器学习代码库
任职要求
- 具备强化学习研究背景
- 能够快速迭代并高效编码
- 对机器学习和机器学习应用有深入理解
- 喜欢处于强化学习和语言模型研究的前沿
- 能够主动提出并主导想法直至完成
- 重视原则性方法、简单实验和可靠结论
- 适应快节奏、动态且技术复杂的环境
- 能够深入大型ML代码库进行调试和改进
福利待遇
- 混合工作模式(每周3天办公室办公)
- 为新员工提供搬迁援助
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。