音频AI研究员
岗位摘要
聚焦音效(V2A,T2VA,空间音频)生成、编辑、声音分离等大模型技术研究,涵盖多模态融合;探索和落地先进的音频处理与计算声学技术,解决复杂声学场景下的核心挑战;落地汽车、手机、音箱等小米应用场景,每年发表顶会论文1-2篇或申请专利2-3项
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 聚焦音效(V2A,T2VA,空间音频)生成、编辑、声音分离等大模型技术研究,涵盖多模态融合
- 探索和落地先进的音频处理与计算声学技术,解决复杂声学场景下的核心挑战
- 落地汽车、手机、音箱等小米应用场景,每年发表顶会论文1-2篇或申请专利2-3项
任职要求
- 硕士及以上学历,计算机、人工智能、声学等相关专业
- 精通主流的音频生成模型框架(如Diffusion, Transformer, VAE等),并对AIGC领域的最新进展有深入的理解
- 具备将前沿算法落地到实际产品的完整项目经验,深刻理解模型训练、优化、部署的全链路流程
- 在音频/语音AIGC(如音效生成、音乐生成)领域有深入的研发经验
- 熟悉以下一项或多项技术并有相关项目经验者优先:空间音频与沉浸式体验技术(如Dolby Atmos, 3D Audio Rendering)、多扬声器重放技术(如声场控制、模拟声浪等)
- 在相关领域的顶级学术会议或期刊(如ICASSP, INTERSPEECH, NeurIPS, ICML等)发表过论文者优先
- 有高质量开源项目开发和贡献经验者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。