返回岗位列表

阿里巴巴

语音生成大模型算法工程师

地点:北京 薪资:薪资未公开 日期:2026-01-29

岗位摘要

参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等;探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现;针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题

岗位职责

  • 参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等
  • 探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现
  • 针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题

任职要求

  • 计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历
  • 具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术
  • 熟练至少一种大模型训练框架(Deepspeed、Megatron),有大模型训练经验
  • 有较强的学习能力和问题解决能力,有自驱力,能快速掌握新技术并应用于实践
  • 发表过相关领域顶级会议论文(NeurIPS、ICML、ICLR、ACL、Interspeech、ICASSP等)、参与行业有影响力项目或者ACM竞赛获奖者优先