语音合成算法工程师
岗位摘要
参与新一代语音合成系统的研究与开发,包括但不限于大语言模型(LLM)语音合成、零样本/少样本语音克隆、情感与风格可控合成等;探索前沿语音合成架构(如Qwen3-TTS、CosyVoice、VALL-E等),优化合成质量、自然度及推理效率
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与新一代语音合成系统的研究与开发,包括但不限于大语言模型(LLM)语音合成、零样本/少样本语音克隆、情感与风格可控合成等
- 探索前沿语音合成架构(如Qwen3-TTS、CosyVoice、VALL-E等),优化合成质量、自然度及推理效率
- 负责声学模型与声码器的训练、压缩、部署及工程落地,支持公司GPU芯片的算法适配与性能调优
- 跟踪ICASSP、Interspeech等顶级会议最新进展,将前沿成果转化为技术突破或产品竞争力
- 与团队协作完成技术文档撰写、模型迭代及项目交付
任职要求
- 计算机、人工智能、信号处理、数学等相关专业硕士或博士学历(2026届毕业生)
- 具备扎实的机器学习/深度学习理论基础,熟悉语音合成、数字信号处理相关算法
- 熟练掌握Python或C++编程,具备良好的代码能力和工程思维
- 熟悉至少一种主流深度学习框架(如PyTorch、TensorFlow),有实际模型训练经验
- 在语音领域顶级会议或期刊(如ICASSP、Interspeech、ASRU、TASLP、Speech Communication等)发表过论文者优先
- 在语音合成、语音相关竞赛或编程赛事(如Blizzard Challenge、Kaggle、DCASE)中取得优异成绩者优先
- 深入理解以下任一方向者优先:LLM-based TTS、Qwen3-TTS、CosyVoice等先进语音合成模型,或LLM-based ASR、声码器(HiFi-GAN、Vocos等),或音频3A算法(回声消除、噪声抑制、增益控制)
- 有开源项目贡献或大型代码库维护经验者优先
加分项
- 在语音领域顶级会议或期刊(如ICASSP、Interspeech、ASRU、TASLP、Speech Communication等)发表过论文
- 在语音合成、语音相关竞赛或编程赛事(如Blizzard Challenge、Kaggle、DCASE)中取得优异成绩
- 深入理解以下任一方向:LLM
- based TTS、Qwen3
- TTS、CosyVoice等先进语音合成模型,或LLM
- based ASR、声码器(HiFi
- GAN、Vocos等),或音频3A算法(回声消除、噪声抑制、增益控制)
- 有开源项目贡献或大型代码库维护经验
- 蔡猛 本月活跃
- 摩尔线程 · 技术总监
福利待遇
- 薪资范围25-50K
- 工作地点在北京朝阳区望京国际研发园
- 面向在校/应届硕士毕业生
- 有机会参与前沿语音合成技术研究
- 与顶级技术团队协作
工作地址
北京朝阳区望京国际研发园
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。