返回岗位列表

智谱AI

社招-大模型算法工程师-Agent

地点:北京 薪资:薪资未公开 日期:2025-06-03

岗位摘要

作为GLM系列中最新的迭代,GLM-4.6(https://docs.z.ai/guides/llm/glm-4.6)实现了跨多个领域的全面增强,包括真实世界编码,长文本处理,推理,搜索,书写和代理应用程序. 详情如下

岗位职责

  • 作为GLM系列中最新的迭代,GLM-4.6(https://docs.z.ai/guides/llm/glm-4.6)实现了跨多个领域的全面增强,包括真实世界编码,长文本处理,推理,搜索,书写和代理应用程序. 详情如下
  • 更长的上下文窗口 : 上下文窗口已经从128K扩展至200K令牌,使模型能够处理更复杂的代理任务.
  • 高级编码性能:该模型在代码基准上实现更高的分数,并在克劳德代码(Claude Code),Cline,Roo代码(Kilo Code)和Kilo代码(Kilo Code)等应用中表现出更好的现实世界性能,包括生成视觉光泽的前端页面的改进.
  • 高级推理:GLM-4.6显示推理性能明显提高,在推论期间支持工具使用,导致整体能力更强.
  • 能力更强的代理商:GLM-4.6在工具使用和基于搜索的代理商方面表现出更强的性能,并在代理商框架内更有效地整合.
  • 精细写作:在风格和可读性上更好地与人类偏好保持一致,在角色扮演情景中更自然地发挥.
  • 目前的语言模型在日常对话和基础的推理和任务处理上已经取得了不错的性能,然而在处理Agent复杂推理任务上(包括 DeepResearch,CodeAgent等),如何实现模型长时间思考来解决复杂任务,模型的能力和人类还存在较大差距。因此提升模型高阶推理能力是进一步提升模型“智力”的重点。OpenAI o3 / claude 等展示了模型通过长思考显著提升模型Agent和推理能力,模型能够自主探索和尝试复杂任务的正确求解方法。我们关注提升模型自我探索和长思考的能力,期望模型在推理阶段能够通过更长的思考提升解决复杂逻辑推理和真实问题的能力。同时,我们关注在后训练阶段能够实现接近预训练阶段算力与模型效果的 scaling,让模型在训练阶段实现自我提升和迭代优化

任职要求

  • 高阶推理能力提升:针对DeepResearch、CodeAgent等复杂推理任务开发专门的能力提升方案;探索长思维链推理机制,提升模型在Agent相关任务上的表现和泛化能力
  • 复杂推理训练扩展性研究:探索模型通过长思维链推理在Agent相关任务上的效果提升;实现不同- Agent任务间的能力迁移和扩展
  • 对齐训练范式探索:探索新型对齐训练范式,整合多类型监督信号进行训练优化;研究不同监督条件下的训练可扩展性,推动后训练效果向预训练scaling效果靠拢
  • 对齐数据构造与优化:针对特定能力领域(数学、代码、复杂推理等)进行数据构造、筛选和优化;设计数据合成策略,控制对齐数据的质量和多样性
  • 985高校计算机、电子、自动化等相关专业硕士或博士学位(优秀本科生亦可考虑)
  • 5 年相关工作经验
  • 深入理解常用的大模型算法;具备后训练及数据处理相关项目经验者优先
  • 在CCF-A类会议发表过相关论文者优先考虑
  • 熟练运用Pytorch、transformers、megatron等主流框架
  • 工作态度认真负责,具备良好的团队协作能力