音频模型研究员/工程师
岗位摘要
参与Qwen3-Music项目研究以及开源,构建世界级的影响力项目;围绕Qwen基座模型展开音频处理及音频交互相关的基础研究与应用;支持开发实时交互系统;计算机科学、语音交互、人工智能、机器学习等领域的博士/硕士毕业生
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与Qwen3-Music项目研究以及开源,构建世界级的影响力项目
- 围绕Qwen基座模型展开音频处理及音频交互相关的基础研究与应用
- 支持开发实时交互系统
任职要求
- 计算机科学、语音交互、人工智能、机器学习等领域的博士/硕士毕业生
- 必须具备实际的AI音乐生成项目经验(如旋律生成、伴奏合成、歌声合成、音色建模、MusicLM类模型训练等),有完整项目落地、上线或开源者优先
- 熟练掌握Python、PyTorch/TensorFlow,熟悉音频处理工具链(librosa、torchaudio、audiocraft等)
- 对Transformer、扩散模型、自回归模型、音频编解码器(如EnCodec、SoundStream)有深入理解
- 具备良好的工程实现能力,具有相关数据处理经验,能独立完成从实验到部署的全流程
- 关注技术影响力,具有开源开放精神,对基础模型的前沿问题有持续热情,具备独立思考能力和系统性研究思维,敢于挑战现有范式,能够独立应用技术解决复杂问题
加分项
- 熟悉音乐理论(调式、和弦进行、曲式结构)、有 DAW 使用经验、参与过音乐类创业项目、在 GitHub 有高质量开源项目
- 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于:InterSpeech、CVPR、ECCV、NeurIPS、ICML、ICLR、ACL、TPAMI等国际顶级计算机会议/期刊
福利待遇
- 参与全球领先的全模态模型技术体系研发
- 推动AI在企业服务、开发者生态、个人用户等领域的深度应用
- 引领下一代人工智能的发展
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。