LLM研究员
岗位摘要
参与LLM system2推理相关的研究,提升模型的复杂推理能力;参与数据合成和人机协同研究,提升reward信号的质量和多样性;参与Reward、Self-Play RL等训练框架开发、模型优化和效果评测
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与LLM system2推理相关的研究,提升模型的复杂推理能力
- 参与数据合成和人机协同研究,提升reward信号的质量和多样性
- 参与Reward、Self-Play RL等训练框架开发、模型优化和效果评测
- 参与LLM Post-Train相关的研发和论文
任职要求
- 计算机或数理相关专业背景,在读硕士或博士优先
- 扎实的编程能力,精通Linux、Python和Pytorch
- 熟悉GPT架构和大模型基础知识、了解相关训练框架
- 具备良好的研究能力:能够高效阅读论文、复现论文和验证实验
- 具备良好的自驱力、执行力和沟通协作能力
加分项
- 独立开发或贡献过知名开源项目
- 参与过知名大模型项目,并在关键技术上有实践经验
福利待遇
- 深度参与知名LLM公司的核心技术研发,与团队共同探索前沿技术
- 享受充足的算力和技术支持,快速提升专业技能
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。