大模型推理与对齐算法工程师
岗位摘要
针对DeepResearch、CodeAgent等复杂推理任务开发专门的能力提升方案;探索长思维链推理机制,提升模型在Agent相关任务上的表现和泛化能力;研究模型通过长思维链推理在Agent任务上的效果提升,实现不同Agent任务间的能力迁移与扩展
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 针对DeepResearch、CodeAgent等复杂推理任务开发专门的能力提升方案
- 探索长思维链推理机制,提升模型在Agent相关任务上的表现和泛化能力
- 研究模型通过长思维链推理在Agent任务上的效果提升,实现不同Agent任务间的能力迁移与扩展
- 探索新型对齐训练范式,整合多类型监督信号进行训练优化
- 研究不同监督条件下的训练可扩展性,推动后训练效果向预训练scaling效果靠拢
- 针对数学、代码、复杂推理等特定能力领域进行数据构造、筛选和优化
- 设计数据合成策略,控制对齐数据的质量和多样性
任职要求
- 985高校计算机、电子、自动化等相关专业硕士或博士学位(优秀本科生亦可考虑)
- 深入理解常用的大模型算法
- 具备后训练及数据处理相关项目经验者优先
- 在CCF-A类会议发表过相关论文者优先考虑
- 熟练运用Pytorch、transformers、megatron等主流框架
- 工作态度认真负责,具备良好的团队协作能力
- 在ACL、NeurIPS、ICLR、EMNLP、ICML等顶级会议或期刊上发表过论文者优先
- 熟悉并行训练框架,有多机多卡训练经验者优先
加分项
- 在ACL,NeurIPS,ICLR,EMNLP,ICML等顶级会议或期刊上发表过论文者优先
- 熟悉并行训练框架,有多机多卡训练经验者优先
- 智谱官网直接投递
- 邮箱投递:shuangshuang.wei@zhipuai.cn;邮件标题:职位名称+姓名+毕业时间
福利待遇
- 参与前沿大模型推理与对齐研究
- 与顶级科研团队合作
- 发表高水平论文机会
- 具有竞争力的薪酬待遇
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。