音频生成大模型研究员
岗位摘要
负责音频生成大模型的相关研究,包括但不限于TTS和VC;跟进音频生成大模型的最新研究进展,负责相关技术的研发实现;提出和优化最前沿的算法,保持算法在工业界和学术界的领先;负责音频生成模型在大数据量,多机多卡并行训练
岗位职责
- 负责音频生成大模型的相关研究,包括但不限于TTS和VC
- 跟进音频生成大模型的最新研究进展,负责相关技术的研发实现
- 提出和优化最前沿的算法,保持算法在工业界和学术界的领先
- 负责音频生成模型在大数据量,多机多卡并行训练
任职要求
- 有扎实的算法与数理基础以及工程实现能力,至少精通 Python,熟悉 C++
- 语音合成,大语言模型以及多模态学习方面有一定研究基础,熟悉主流模型和算法
- 关注领域内的最新进展,能够跟进和实现新的算法
- 熟练掌握 Pytorch 等深度学习框架,具有模型创建、训练、调优和测试的经验
- 具备阅读英文文献和技术资料的能力
- 具备较强的分析问题和解决问题的能力
- 具有良好的沟通表达能力和团队协作能力
- 具有责任心和使命感