AIAR-GLM(4)-代理代理
岗位摘要
结合基于Docker的容器环境,构建可扩展的Agent任务评测环境,支持多个模型×多个框架×多个Agent任务上的快速统一评测;构建可用于训练的Agent Environment环境
岗位职责
- 结合基于Docker的容器环境,构建可扩展的Agent任务评测环境,支持多个模型×多个框架×多个Agent任务上的快速统一评测
- 构建可用于训练的Agent Environment环境
- 与RL Infra配合对接,实现可扩展的Agent RL扩展训练
任职要求
- 对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的LLM和VLM模型架构,有分布式训练经验
- 精通Python编程语言,熟悉PyTorch深度学习框架和Megatron分布式训练框架
- 有大规模预训练优化/MoE训练优化经验的优先考虑
工作地址
北京海淀区智谱华章科技有限公司1