LLM研究员
岗位摘要
参与LLM system2推理相关的研究,提升模型的复杂推理能力;参与数据合成和人机协同研究,提升reward信号的质量和多样性;参与Reward、Self-Play RL等训练框架开发、模型优化和效果评测
岗位职责
- 参与LLM system2推理相关的研究,提升模型的复杂推理能力
- 参与数据合成和人机协同研究,提升reward信号的质量和多样性
- 参与Reward、Self-Play RL等训练框架开发、模型优化和效果评测
- 参与LLM Post-Train相关的研发和论文
任职要求
- 计算机或数理相关专业背景,在读硕士或博士优先
- 扎实的编程能力,精通Linux、Python和Pytorch
- 熟悉GPT架构和大模型基础知识、了解相关训练框架
- 具备良好的研究能力:能够高效阅读论文、复现论文和验证实验
- 具备良好的自驱力、执行力和沟通协作能力
加分项
- 独立开发或贡献过知名开源项目
- 参与过知名大模型项目,并在关键技术上有实践经验
福利待遇
- 深度参与知名LLM公司的核心技术研发,与团队共同探索前沿技术
- 享受充足的算力和技术支持,快速提升专业技能