研究工程师/研究科学家,强化学习/推理
岗位摘要
推进AI对齐与能力的前沿研究;开发并应用尖端的强化学习方法;训练智能、对齐且通用的代理系统;参与大规模生成模型的构建与部署;快速迭代并优化大型机器学习代码库;具备强化学习研究背景;能够快速迭代并高效编码
岗位职责
- 推进AI对齐与能力的前沿研究
- 开发并应用尖端的强化学习方法
- 训练智能、对齐且通用的代理系统
- 参与大规模生成模型的构建与部署
- 快速迭代并优化大型机器学习代码库
任职要求
- 具备强化学习研究背景
- 能够快速迭代并高效编码
- 对机器学习和机器学习应用有深入理解
- 喜欢处于强化学习和语言模型研究的前沿
- 能够主动提出并主导想法直至完成
- 重视原则性方法、简单实验和可靠结论
- 适应快节奏、动态且技术复杂的环境
- 能够深入大型ML代码库进行调试和改进
福利待遇
- 混合工作模式(每周3天办公室办公)
- 为新员工提供搬迁援助