多模态Agent基座模型研发工程师
岗位摘要
设计并训练具备多模态交互能力的Agent基座模型,包括架构设计与多模态融合策略探索;结合强化学习(如PPO、DPO)提升Agent的自主推理与决策能力,实现长期规划和复杂任务执行;研发Agent的环境感知与动作执行机制,涵盖ComputerUse、FunctionCall等模块开发
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 设计并训练具备多模态交互能力的Agent基座模型,包括架构设计与多模态融合策略探索
- 结合强化学习(如PPO、DPO)提升Agent的自主推理与决策能力,实现长期规划和复杂任务执行
- 研发Agent的环境感知与动作执行机制,涵盖ComputerUse、FunctionCall等模块开发
- 构建完全自主的搜索研究Agent,支持GUI操控、API调用及机器人控制等功能
- 跟踪国内外前沿技术动态,提出并验证创新解决方案
任职要求
- 具备LLM Agent模型相关研发经验,能够独立完成模型设计、开发、训练与调优工作
- 拥有大规模模型训练的实战经验,熟悉分布式训练架构与优化技术
- 具备多模态技术背景,能够将语言、视觉等多模态信息进行有效融合与建模
- 具备较强的编程能力和优秀的沟通能力
- 有ComputerUse项目经验者优先,如AndroidEnv或GUI操控
- 熟悉Function Calling架构设计,实现过复杂工具调用系统者优先
- 在人工智能顶会发表过相关论文或有影响力的Technical Report者优先
- 主导或参与开源Agent项目核心模块开发,具有业界影响力技术贡献者优先
加分项
- 有ComputerUse(如AndroidEnv/GUI操控)项目经验
- 熟悉Function Calling架构设计,实现过复杂工具调用系统
- 在人工智能顶会发表过相关论文或有影响力的Technical Report
- 主导/参与开源Agent项目核心模块开发,在业界有影响力的技术贡献,如顶会论文、开源项目等
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。