返回岗位列表

小米

具身智能VLA算法研究员

地点:北京 薪资:薪资未公开 日期:2026-07-20

岗位摘要

研究并构建融合世界建模和动作生成的VLA模型;结合机器人数据、视频数据、视觉语言数据等,构建可扩展的数据引擎和训练pipeline;开展大规模的VLA训练,建立真实可靠的评测系统,持续迭代模型能力提升

岗位职责

  • 研究并构建融合世界建模和动作生成的VLA模型
  • 结合机器人数据、视频数据、视觉语言数据等,构建可扩展的数据引擎和训练pipeline
  • 开展大规模的VLA训练,建立真实可靠的评测系统,持续迭代模型能力提升

任职要求

  • 硕士及以上学历,计算机、人工智能、机器人、自动化、数学等相关专业,具备扎实的机器学习、深度学习和概率建模基础
  • 熟悉具身智能、多模态大模型、视频生成或动作生成等方向,理解主流方法原理与适用场景,如Transformer、Diffusion、VAE、VQ、MoE等
  • 具备较强的算法研发能力,熟练使用PyTorch等深度学习框架,有从模型设计、训练调优到实验分析的完整研发经验
  • 熟悉多模态数据建模,理解图像、视频、语言、动作轨迹等数据在训练与评测中的关键问题,有跨模态建模或生成任务经验者优先
  • 在机器人、具身智能、多模态、生成式AI等方向顶会/顶刊(如RSS、CoRL、ICRA、CVPR、ICCV、NeurIPS、ICLR等)发表论文,或有代表性开源项目/研究成果者优先
  • 具备优秀的问题分析与科研协作能力,对具身智能方向有强烈兴趣,能够快速学习并验证