工程师
岗位摘要
针对GUI Agent场景,设计和优化预训练、SFT(监督微调)、强化学习流程,以扩展模型能力边界;探索下一代多模态训练范式,包括但不限于奖励模型(Reward Model)、多轮/多智能体强化学习算法以及强化学习预训练方法等前沿技术
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 针对GUI Agent场景,设计和优化预训练、SFT(监督微调)、强化学习流程,以扩展模型能力边界
- 探索下一代多模态训练范式,包括但不限于奖励模型(Reward Model)、多轮/多智能体强化学习算法以及强化学习预训练方法等前沿技术
任职要求
- 国内外计算机科学、人工智能、电子工程等相关专业的博士或优秀研究生学历
- 具备扎实的工程基础,熟悉大模型背景下的分布式编程技术
- 熟悉至少一种深度学习框架(如PyTorch、TensorFlow、JAX)
- 具备深度学习基础知识,了解Transformer架构及其在多模态领域的应用
- 具备良好的沟通能力和团队协作精神,能独立解决复杂技术问题
加分项
- 有大规模分布式训练系统开发经验,熟悉DeepSpeed/Megatron等并行训练框架
- 在顶级会议/期刊(NeurIPS、ICML、CVPR、ACL、ICLR等)发表过相关论文
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。