通用多模态Agent算法研究员(实习)
岗位摘要
针对人类工作中的真实场景,设计和优化预训练、SFT、强化学习流程,扩展多模态Agent模型能力边界;探索下一代多模态训练范式,包括Reward Model、多轮/多智能体强化学习算法及强化学习预训练方法等前沿技术
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 针对人类工作中的真实场景,设计和优化预训练、SFT、强化学习流程,扩展多模态Agent模型能力边界
- 探索下一代多模态训练范式,包括Reward Model、多轮/多智能体强化学习算法及强化学习预训练方法等前沿技术
- 参与构建世界上第一代通用人工智能,确保其能够与赛博世界交互并端到端完成真实世界任务
任职要求
- 计算机科学、人工智能、软件工程等相关专业的在读研究生或博士
- 扎实的工程基础,熟悉大模型背景下的分布式编程技术
- 熟悉至少一种深度学习框架(PyTorch/TensorFlow/JAX等)
- 具备深度学习基础知识,了解Transformer架构及其在多模态领域的应用
- 具备良好的沟通能力和团队协作精神,能独立解决复杂技术问题
- 有大规模分布式训练系统开发经验,熟悉DeepSpeed/Megatron等并行训练框架者优先
- 在顶级会议/期刊(NeurIPS、ICML、CVPR、ACL、ICLR等)发表过相关论文者优先
- 参与过大模型项目贡献或有LLM相关实习经历者优先
- 有ACM-ICPC、CCPC、NOI/IOI等算法竞赛经历者优先
加分项
- 有大规模分布式训练系统开发经验,熟悉DeepSpeed/Megatron(威震天)等并行训练框架
- 在顶级会议/期刊(NeurIPS、ICML、CVPR、ACL、ICLR等)发表过相关论文
- 参与过大模型项目的贡献或有LLM 相关实习经历
- 有算法竞赛经历如:ACM
- ICPC、CCPC、NOI/IOI等
- 高淳 刚刚活跃
- 上海阶跃星辰智能科技 · 校招HR
福利待遇
- 实习薪资300-500元/天
工作地址
北京海淀区大恒科技大厦12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。