语音大模型算法研究员(实习)
岗位摘要
探索研究语音大模型的Pretrain、SFT、RL全链路训练方法;从数据合成、效果评测、模型优化等角度提升多模态大模型基础能力;探索语音交互、音频理解与生成、音频Reasoning等大模型进阶能力
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 探索研究语音大模型的Pretrain、SFT、RL全链路训练方法
- 从数据合成、效果评测、模型优化等角度提升多模态大模型基础能力
- 探索语音交互、音频理解与生成、音频Reasoning等大模型进阶能力
- 研究Omni模型与Voice Agent等前沿技术方向
任职要求
- 硕士及以上学历在读,人工智能、计算机、自动化、数学相关专业优先
- 可长期实习半年或以上
- 扎实的大模型算法基础,熟悉Pytorch、Megatron等深度学习框架
- 良好的英文读写能力和扎实的数学基础
- 责任心强,积极主动,有良好的沟通能力和团队合作能力
- 在NeurIPS/ICLR/ICML/CVPR/ECCV/ICCV/Interspeech/ICASSP等顶级会议发表论文者优先
- 在多模态、计算机视觉或机器学习比赛中获得优异成绩者优先
- 具备优秀代码能力,熟练掌握C/C++或Python编程,ACM/ICPC、NOI/IOI、Kaggle等比赛获奖者优先
加分项
- 在NeurIPS/ICLR/ICML/CVPR/ECCV/ICCV/Interspeech/ICASSP等顶级会议上发表论文
- 在多模态、计算机视觉或机器学习领域的比赛中获得过优异成绩者
- 具有优秀的代码能力,熟练掌握C/C++或Python编程语言,ACM/ICPC、NOI/IOl、Top Coder、Kaggle等比赛获奖者
福利待遇
- 日薪400-500元,薪酬具有竞争力
- 参与前沿大模型研究,探索语音AI前沿技术
- 与顶尖团队合作,积累大模型全链路研发经验
- 可长期实习,职业发展前景广阔
工作地址
北京海淀区大恒科技大厦12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。