语音生成大模型算法工程师
岗位摘要
参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等;探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现;针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等
- 探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现
- 针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题
任职要求
- 计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历
- 具备扎实的机器学习、深度学习理论基础,精通语音生成相关技术
- 熟练至少一种大模型训练框架(Deepspeed、Megatron),有大模型训练经验
- 有较强的学习能力和问题解决能力,有自驱力,能快速掌握新技术并应用于实践
- 发表过相关领域顶级会议论文(NeurIPS、ICML、ICLR、ACL、Interspeech、ICASSP等)、参与行业有影响力项目或者ACM竞赛获奖者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。