语音识别算法工程师(2026届校招)
岗位摘要
参与下一代语音识别系统的研究与开发,包括端到端ASR、热词增强、远场识别等方向;探索大语言模型与语音识别的前沿融合技术,优化基于LLM的ASR模型性能;负责语音识别模型的训练、压缩、部署及工程落地,支持公司AI芯片的算法适配与性能调优
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与下一代语音识别系统的研究与开发,包括端到端ASR、热词增强、远场识别等方向
- 探索大语言模型与语音识别的前沿融合技术,优化基于LLM的ASR模型性能
- 负责语音识别模型的训练、压缩、部署及工程落地,支持公司AI芯片的算法适配与性能调优
- 跟踪学术界和工业界最新进展,将前沿成果转化为技术突破或产品竞争力
- 与团队协作完成技术文档撰写、模型迭代及项目交付
任职要求
- 计算机、人工智能、信号处理、数学等相关专业硕士或博士学历(2026届毕业生)
- 具备扎实的机器学习/深度学习理论基础,熟悉语音识别、语音信号处理相关算法
- 熟练掌握Python或C++编程,具备良好的代码能力和工程思维
- 熟悉PyTorch,有实际模型训练经验
- 在语音领域顶级会议或期刊(如ICASSP、Interspeech、ASRU、TASLP等)发表过论文者优先
- 在Kaggle、DCASE、Blizzard Challenge等国际竞赛或编程赛事中取得优异成绩者优先
- 深入理解LLM-based ASR、Paraformer、Whisper等先进语音识别模型,或LLM-based TTS、声码器,或音频3A算法者优先
- 有开源项目贡献或大型代码库维护经验者优先
加分项
- 在语音领域顶级会议或期刊(如ICASSP、Interspeech、ASRU、TASLP等)发表过论文
- 在Kaggle、DCASE、Blizzard Challenge等国际竞赛或编程赛事中取得优异成绩
- 深入理解以下任一方向:LLM-based ASR、Paraformer、Whisper等先进语音识别模型,或LLM-based TTS、声码器,或音频3A算法(回声消除、噪声抑制、增益控制)
- 有开源项目贡献或大型代码库维护经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。