返回岗位列表

面壁智能

多模态大模型机器人算法工程师

地点:北京 薪资:薪资未公开 日期:2026-07-20

岗位摘要

负责多模态大模型在机器人场景中的研发与应用,涵盖SFT、RL、Agent、RAG等方向,探索前沿训练与优化方法;基于具体业务场景,设计视觉感知与大模型决策的微调方案及端到端算法解决方案,推动模型在真实机器人平台落地

岗位职责

  • 负责多模态大模型在机器人场景中的研发与应用,涵盖SFT、RL、Agent、RAG等方向,探索前沿训练与优化方法
  • 基于具体业务场景,设计视觉感知与大模型决策的微调方案及端到端算法解决方案,推动模型在真实机器人平台落地
  • 跟踪前沿技术动态,探索VLM(视觉语言模型)/VLA(视觉语言行动模型)在公共服务、民生机器人场景中的智能化应用,推动相关领域技术创新

任职要求

  • 硕士及以上学历,在模型训练与应用领域有工作经验
  • 熟悉计算机视觉基础任务,如目标检测、图像分类、分割等,有实际使用YOLO系列或其他主流检测/识别模型的DNN应用经验
  • 具备出色的问题解决能力和创新能力,能够解决复杂的技术挑战(如多模态对齐、真实场景泛化等)
  • 良好的团队合作和沟通能力,能够与跨职能团队协作,推动项目进展
  • 加分项:有VLM(视觉语言模型)或VLA(视觉语言行动模型)相关经验(如微调、部署、推理优化),或发表过相关领域的学术论文/专利

加分项

  • 有 VLM(视觉语言模型)或 VLA(视觉语言行动模型) 相关经验(如微调、部署、推理优化),或发表过相关领域的学术论文/专利