AI音乐和音频-语音合成算法工程师
岗位摘要
开发、训练、微调用于语音合成任务的模型,并应用至配音、自然语音对话等场景;随时了解语音合成技术的最新进展,重点关注LLM和Diffusion等技术的音频应用;推动语音合成模型的主客观测试方案
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发、训练、微调用于语音合成任务的模型,并应用至配音、自然语音对话等场景
- 随时了解语音合成技术的最新进展,重点关注LLM和Diffusion等技术的音频应用
- 推动语音合成模型的主客观测试方案
- 推动语音合成数据集的收集、构建和注释,以针对不同的任务构建训练数据
- 在协作团队环境中帮助创新、发现问题、推荐解决方案和执行分类
- 与各个团队就新产品功能和现有产品的改进进行协作
任职要求
- 计算机科学、电气工程、人工智能或应用数学硕士学位(或同等经验)或博士学位,具有行业经验
- 熟悉语音合成领域的前沿算法技术(如SPEAR-TTS、BARK、Natural Speech、BaseTTS、CosyVoice等),实现过其中任一项或类似框架
- 具有TTS大模型开发与实际应用落地经验者优先
- 了解语音合成系统开发方法的步骤、推理和工具
- 优秀的PyTorch和Python编程技能,具有扎实的编程、优化和软件设计基础
福利待遇
- 薪资50-70K·13薪
工作地址
北京东城区明阳国际中心111
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。