返回岗位列表

小米

VLA多模态大模型算法研究员

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

开展VLA多模态大模型在自动驾驶/机器人场景中的算法研究(场景理解、语义决策、时空建模等);主导VLA基座大模型预研,构建可泛化、高可解释性模型架构;与高校团队协作探索VLA长期发展方向(表征学习、具身智能、系统蒸馏等)

岗位职责

  • 开展VLA多模态大模型在自动驾驶/机器人场景中的算法研究(场景理解、语义决策、时空建模等)
  • 主导VLA基座大模型预研,构建可泛化、高可解释性模型架构
  • 与高校团队协作探索VLA长期发展方向(表征学习、具身智能、系统蒸馏等)
  • 撰写顶级会议论文与技术文档,提升学术影响力(CVPR/NeurIPS/ICLR等)

任职要求

  • 计算机/人工智能/机器人学等相关领域博士学历或同等研究经验
  • 具备VLA大模型在自动驾驶/机器人领域的构建与优化经验
  • 扎实的机器学习理论基础及多模态交叉研究背景(视觉/NLP/决策)
  • 精通Python及PyTorch/TensorFlow等框架,有大规模训练经验
  • 在NeurIPS/CVPR等顶会有论文发表或学术竞赛获奖经历
  • 具备计算机视觉、NLP与机器人学的跨学科融合能力

加分项

  • 在大规模预训练模型(如LLM、VLM、VLA等)微调、蒸馏等方面有深入研究
  • 具有实际项目经验,尤其是涉及具身多模态大模型 (如RT2、OpenVLA、Octo等) 开发经验者优先
  • 具有机器人或自动驾驶平台(如MuJoCo、CARLA、Waymo、nuScenes等)上的实验经验