返回岗位列表

阿里巴巴

音频模型研究员/工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

参与Qwen3-Music项目研究以及开源,构建世界级的影响力项目;围绕Qwen基座模型展开音频处理及音频交互相关的基础研究与应用;支持开发实时交互系统;计算机科学、语音交互、人工智能、机器学习等领域的博士/硕士毕业生

岗位职责

  • 参与Qwen3-Music项目研究以及开源,构建世界级的影响力项目
  • 围绕Qwen基座模型展开音频处理及音频交互相关的基础研究与应用
  • 支持开发实时交互系统

任职要求

  • 计算机科学、语音交互、人工智能、机器学习等领域的博士/硕士毕业生
  • 必须具备实际的AI音乐生成项目经验(如旋律生成、伴奏合成、歌声合成、音色建模、MusicLM类模型训练等),有完整项目落地、上线或开源者优先
  • 熟练掌握Python、PyTorch/TensorFlow,熟悉音频处理工具链(librosa、torchaudio、audiocraft等)
  • 对Transformer、扩散模型、自回归模型、音频编解码器(如EnCodec、SoundStream)有深入理解
  • 具备良好的工程实现能力,具有相关数据处理经验,能独立完成从实验到部署的全流程
  • 关注技术影响力,具有开源开放精神,对基础模型的前沿问题有持续热情,具备独立思考能力和系统性研究思维,敢于挑战现有范式,能够独立应用技术解决复杂问题

加分项

  • 熟悉音乐理论(调式、和弦进行、曲式结构)、有 DAW 使用经验、参与过音乐类创业项目、在 GitHub 有高质量开源项目
  • 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于:InterSpeech、CVPR、ECCV、NeurIPS、ICML、ICLR、ACL、TPAMI等国际顶级计算机会议/期刊

福利待遇

  • 参与全球领先的全模态模型技术体系研发
  • 推动AI在企业服务、开发者生态、个人用户等领域的深度应用
  • 引领下一代人工智能的发展