返回岗位列表

小米

手机影像视觉大模型算法研发工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

负责手机影像相关视觉大模型算法的研发,包括多模态大模型(VLM、MLLM)、生成式大模型(AIGC)及相关计算机视觉感知理解算法(检测、关键点、识别、跟踪)等;参与和主导上述模型在自研芯片平台上的设计、开发与优化

岗位职责

  • 负责手机影像相关视觉大模型算法的研发,包括多模态大模型(VLM、MLLM)、生成式大模型(AIGC)及相关计算机视觉感知理解算法(检测、关键点、识别、跟踪)等
  • 参与和主导上述模型在自研芯片平台上的设计、开发与优化
  • 负责数据集构建及预处理工作,包括收集图像数据,标注数据,数据增强和数据的清洗
  • 负责模型的架构设计、开发和优化工作,提升模型的性能和效率,支撑算法在手机影像应用场景的商用落地
  • 与芯片、系统架构、软件、验证、调试工程师等共同完成相应实现方案的开发工作
  • 结合AI技术与硬件特性实现对创新方案的探索与预研,撰写相关专利

任职要求

  • 计算机科学、应用数学、模式识别、计算机视觉、人工智能或相关专业硕士或博士学历
  • 具备3年以上图像处理、计算机视觉、深度学习、AI芯片等相关领域研发经验,有视频或图像生成、视觉多模态项目经历者优先
  • 精通图像处理算法(如OpenCV)及深度学习框架(如PyTorch、TensorFlow等),有利用较大规模数据训练模型的经验,包括大模型预训练、后训练、强化学习等
  • 参加过完整算法特性的设计,过往经历中有大规模AI算法和产品的完整研发落地经验者优先
  • 在视觉生成大模型、多模态大模型等领域发表高质量计算机视觉相关期刊、会议论文者优先,高质量学术竞赛获奖者优先