语音大模型研发工程师
岗位摘要
负责语音方向(ASR / TTS)大模型的研发与应用,探索前沿训练与优化方法;基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用;深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责语音方向(ASR / TTS)大模型的研发与应用,探索前沿训练与优化方法
- 基于业务场景,设计模型微调方案及算法/系统解决方案,推动模型落地应用
- 深入调研音频和大模型领域前沿技术,参与语音大模型前沿技术研发
任职要求
- 熟练掌握 Python 编程和 PyTorch 深度学习框架
- 拥有计算机科学、人工智能、语音处理、机器学习或相关领域的硕士或博士学位
- 至少2年在语音生成、语音理解、语音翻译、声音复刻、音乐生成或相关领域的研究研发经验;或是至少1年在大模型预训练、对齐、后训练、强化学习或相关领域的研究研发经验
- 良好的团队合作和沟通能力,能够与跨职能团队合作,推动项目进展
加分项
- 对前沿的端到端语音系统有相关的研发经验
- 在相关国际会议或主流期刊上发表论文(ICASSP、Interspeech、ASRU、IEEE/ACM Transactions等)
- 语音相关比赛或机器学习相关比赛拿到国际领先名次,ACM/NOI/IOI/TopCoder等编程比赛获奖
- 参与过有影响力开源项目
福利待遇
- 对前沿的端到端语音系统有相关的研发经验
- 在相关国际会议或主流期刊上发表论文(ICASSP、Interspeech、ASRU、IEEE/ACM Transactions等)
- 语音相关比赛或机器学习相关比赛拿到国际领先名次,ACM/NOI/IOI/TopCoder等编程比赛获奖
- 参与过有影响力开源项目
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。