语音大模型算法专家
岗位摘要
主导语音大模型的前沿算法研究及产业落地;研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型;持续跟踪前沿技术动态,对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践支撑模型能力提升
岗位职责
- 主导语音大模型的前沿算法研究及产业落地
- 研发具有语音理解、生成、对话能力的端到端模型,开发流式全模态(语音/文本/视觉)大模型
- 持续跟踪前沿技术动态,对领域最新技术进行及时吸纳和改进,通过技术创新和工程实践支撑模型能力提升
- 通过论文和技术报告等形式提升团队的技术影响力
任职要求
- 硕士及以上学历,计算机相关专业
- 三年以上语音算法开发经验,深入参与过语音交互类全链路模型及产品建设
- 熟悉 ASR/TTS/LLM/端到端语音大模型等语音AI相关技术原理,并有深入理解和思考
- 掌握AI产品开发的开源工具和框架(如TensorFlow、PyTorch)
- 具备出色的编程能力和工程能力,熟练掌握Python或其他相关编程语言,具有良好的代码编写习惯和程序开发经验
- 具备良好的团队合作精神、沟通能力以及分析和解决问题的能力
福利待遇
- 具有竞争力的薪酬待遇,50-80K·15薪
- 参与前沿语音大模型研究,有广阔的成长空间
- 技术氛围浓厚,鼓励技术创新与论文发表
工作地址
北京海淀区科建大厦面壁智能