多模态Agent算法研究员/工程师
岗位摘要
针对GUI Agent场景,设计和优化预训练、SFT、强化学习流程,扩展模型能力边界;探索下一代多模态训练范式,包括但不仅限于Reward Model、多轮多智能体强化学习算法和强化学习预训练方法等前沿方法
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 针对GUI Agent场景,设计和优化预训练、SFT、强化学习流程,扩展模型能力边界
- 探索下一代多模态训练范式,包括但不仅限于Reward Model、多轮多智能体强化学习算法和强化学习预训练方法等前沿方法
- 参与构建第一代通用人工智能,确保其能够通过GUI与世界交互,完成真实世界任务
任职要求
- 预计毕业于2025年9月至2026年8月的计算机科学、人工智能、电子工程等相关专业的博士或优秀硕士研究生
- 扎实的工程基础,熟悉大模型背景下的分布式编程技术
- 熟悉至少一种深度学习框架(PyTorch/TensorFlow/JAX等)
- 具备深度学习基础知识,理解Transformer架构及其在多模态领域的应用
- 具备良好的沟通能力和团队协作精神,能独立解决复杂技术问题
加分项
- 有大规模分布式训练系统开发经验,熟悉DeepSpeed/Megatron等并行训练框架
- 在顶级会议/期刊(NeurIPS、ICML、CVPR、ACL、ICLR等)发表过相关论文
- 参与过大模型项目的贡献或有LLM 相关实习经历
- 有算法竞赛经历如:ACM
- ICPC、CCPC、NOI/IOI等
- 高淳 刚刚活跃
- 上海阶跃星辰智能科技 · 校招HR
福利待遇
- 具有竞争力的薪酬,30-35K·16薪
- 加入银河系顶级多模态团队,与行业精英共同探索AGI前沿
- 参与定义下一代通用人工智能的核心技术方向
- 扁平化的团队管理,开放创新的工作氛围
工作地址
北京海淀区大恒科技大厦12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。