AI工程师
岗位摘要
探索更多可 scalable 的 verifier 信号,并通过 RL 提升模型的各项能力;提升 reward model 在创作、人类偏好、指令遵循等各专项上的能力,减少reward hacking和bias
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 探索更多可 scalable 的 verifier 信号,并通过 RL 提升模型的各项能力
- 提升 reward model 在创作、人类偏好、指令遵循等各专项上的能力,减少reward hacking和bias
- 研究 reasoning path压缩和外推,实现更高质量的推理思考
- 将LLM的推理能力和Agent以及其他模态相结合,探索统一模态的reasoning
任职要求
- 计算机、机器学习等方向相关专业,博士及硕士优先
- training 或强化学习相关方向经验
- 精通 Python 以及 Pytorch 等深度学习框架,具有较强的代码工程能力
- 熟悉LLM推理引擎(如vLLM,SGLang)的实现
- 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于NeurIPS、ICLR、ICML、ACL等
- 拥有知名开源项目,在开源社区具有较好的影响力
加分项
- 熟悉LLM推理引擎(如vLLM,SGLang)的实现
- 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于NeurIPS、ICLR、ICML、ACL等
- 拥有知名开源项目,在开源社区具有较好的影响力
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。