大语言模型Post Train算法工程师/研究员
岗位摘要
参与通用推理大模型对齐(Alignment)方向的研发工作;构建数据循环体系,系统性探究监督微调(SFT)与强化学习(RL)阶段的数据使用策略;深入探索对齐阶段的数据与算法在大规模训练中的可扩展性与优化路径
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与通用推理大模型对齐(Alignment)方向的研发工作
- 构建数据循环体系,系统性探究监督微调(SFT)与强化学习(RL)阶段的数据使用策略
- 深入探索对齐阶段的数据与算法在大规模训练中的可扩展性与优化路径
- 参与构建世界领先的高性能通用推理大模型
- 确保模型在多项客观评测指标中保持行业领先
任职要求
- 国内外计算机、数学、人工智能等相关专业的博士或优秀研究生
- 对数据有一定的敏感度,熟知开源社区各数据渠道源,有数据处理的经验和认知
- 对大模型相关研究前沿进展比较熟悉,如Reasoning RL、Agent RL等,具有大模型研发经验者优先
- 有一定的相关研究经历,发表过顶级会议论文者优先,如ICLR、NeurIPS、ICML等
- 具备扎实的编程基础,有优秀的工程能力,具有NOI、ACM/ICPC等编程竞赛金牌获奖者优先
- 具备良好的团队协作能力和沟通能力
工作地址
北京海淀区大恒科技大厦南座
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。