音频研究员
岗位摘要
开发音频编解码器和表示方法;获取和合成高质量的音频数据;训练大规模语音语言模型和大型音频扩散模型;开发将连续信号整合到大型语言模型中的新颖架构;构建先进的端到端对话系统、语音/音频理解模型和语音合成能力
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 开发音频编解码器和表示方法
- 获取和合成高质量的音频数据
- 训练大规模语音语言模型和大型音频扩散模型
- 开发将连续信号整合到大型语言模型中的新颖架构
- 构建先进的端到端对话系统、语音/音频理解模型和语音合成能力
- 与预训练、微调、强化学习、生产推理和产品等多个团队紧密合作,将先进的音频技术从早期研究推向高影响力的实际部署
任职要求
- 具备训练音频模型的实践经验(如对话语音转语音、语音翻译、语音识别、文本转语音、说话人日志、编解码器或生成式音频模型)
- 真正享受研究和工程工作,理想的工作分配比例约为50/50
- 能够跨抽象层次工作,从信号处理基础到大规模模型训练和推理优化
- 精通JAX、PyTorch或大规模分布式训练,并能调试全栈性能问题
- 在快速变化的环境中茁壮成长,能够适应最重要问题的变化
- 沟通清晰,协作有效,能与公司内多个团队紧密合作
- 对构建感觉自然、可控且安全的对话式AI充满热情
- 关心语音AI的社会影响,并希望帮助负责任地塑造这些系统的开发方式
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。