返回岗位列表

小米

音频AI研究员

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

聚焦音效(V2A,T2VA,空间音频)生成、编辑、声音分离等大模型技术研究,涵盖多模态融合;探索和落地先进的音频处理与计算声学技术,解决复杂声学场景下的核心挑战;落地汽车、手机、音箱等小米应用场景,每年发表顶会论文1-2篇或申请专利2-3项

岗位职责

  • 聚焦音效(V2A,T2VA,空间音频)生成、编辑、声音分离等大模型技术研究,涵盖多模态融合
  • 探索和落地先进的音频处理与计算声学技术,解决复杂声学场景下的核心挑战
  • 落地汽车、手机、音箱等小米应用场景,每年发表顶会论文1-2篇或申请专利2-3项

任职要求

  • 硕士及以上学历,计算机、人工智能、声学等相关专业
  • 精通主流的音频生成模型框架(如Diffusion, Transformer, VAE等),并对AIGC领域的最新进展有深入的理解
  • 具备将前沿算法落地到实际产品的完整项目经验,深刻理解模型训练、优化、部署的全链路流程
  • 在音频/语音AIGC(如音效生成、音乐生成)领域有深入的研发经验
  • 熟悉以下一项或多项技术并有相关项目经验者优先:空间音频与沉浸式体验技术(如Dolby Atmos, 3D Audio Rendering)、多扬声器重放技术(如声场控制、模拟声浪等)
  • 在相关领域的顶级学术会议或期刊(如ICASSP, INTERSPEECH, NeurIPS, ICML等)发表过论文者优先
  • 有高质量开源项目开发和贡献经验者优先