返回岗位列表

小米

算法研发工程师(音乐生成方向)

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

设计并优化基于深度学习(如Transformer、Diffusion、GAN、VAE等)的音乐生成模型,涵盖旋律、和声、节奏、音色等多维度生成任务;探索多模态音乐生成(如文本/图像/视频驱动音乐创作、哼唱转谱等)

岗位职责

  • 设计并优化基于深度学习(如Transformer、Diffusion、GAN、VAE等)的音乐生成模型,涵盖旋律、和声、节奏、音色等多维度生成任务
  • 探索多模态音乐生成(如文本/图像/视频驱动音乐创作、哼唱转谱等)
  • 研究音乐符号(MIDI/乐谱)与音频(波形/频谱)的联合建模技术
  • 将算法部署到生产环境,优化推理效率(模型压缩、蒸馏、边缘端适配)
  • 构建高质量音乐数据集,设计数据清洗、标注与评估流程
  • 与音乐制作人合作调试生成结果的艺术性,平衡“可控性”与“创造性”
  • 参与产品需求定义,将技术转化为用户可感知的音乐创作工具

任职要求

  • 计算机科学、人工智能、信号处理、音乐技术等相关专业本科及以上学历
  • 熟悉Pytorch等深度学习框架,具备4年以上序列建模或多模态生成经验
  • 熟悉音乐理论(和声/调式/节奏)或具备数字音频处理(DSP)基础,能解读乐谱/MIDI
  • 主导过1个以上音乐AI项目(如旋律生成、歌声合成、风格迁移等)的完整生命周期
  • 发表过ICLR/NeurIPS/ISMIR等顶会论文,或拥有音乐生成相关专利(加分项)
  • 精通音频信号处理(STFT、CQT、声码器如HiFi-GAN、NSF)(加分项)
  • 熟悉音乐制作工具(Ableton Live、Logic Pro)或DAW插件开发(VST/AU)(加分项)
  • 参与过开源音乐AI项目(如Magenta、Jukebox、MusicLM)(加分项)

加分项

  • 发表过ICLR/NeurIPS/ISMIR等顶会论文,或拥有音乐生成相关专利
  • 精通音频信号处理(STFT、CQT、声码器如HiFi-GAN、NSF)
  • 熟悉音乐制作工具(Ableton Live、Logic Pro)或DAW插件开发(VST/AU)
  • 参与过开源音乐AI项目(如Magenta、Jukebox、MusicLM)