返回岗位列表

Anthropic

音频研究员

地点:远程 薪资:$350,000-$500,000 日期:2026-01-29

岗位摘要

开发音频编解码器和表示方法;获取和合成高质量的音频数据;训练大规模语音语言模型和大型音频扩散模型;开发将连续信号整合到大型语言模型中的新颖架构;构建先进的端到端对话系统、语音/音频理解模型和语音合成能力

岗位职责

  • 开发音频编解码器和表示方法
  • 获取和合成高质量的音频数据
  • 训练大规模语音语言模型和大型音频扩散模型
  • 开发将连续信号整合到大型语言模型中的新颖架构
  • 构建先进的端到端对话系统、语音/音频理解模型和语音合成能力
  • 与预训练、微调、强化学习、生产推理和产品等多个团队紧密合作,将先进的音频技术从早期研究推向高影响力的实际部署

任职要求

  • 具备训练音频模型的实践经验(如对话语音转语音、语音翻译、语音识别、文本转语音、说话人日志、编解码器或生成式音频模型)
  • 真正享受研究和工程工作,理想的工作分配比例约为50/50
  • 能够跨抽象层次工作,从信号处理基础到大规模模型训练和推理优化
  • 精通JAX、PyTorch或大规模分布式训练,并能调试全栈性能问题
  • 在快速变化的环境中茁壮成长,能够适应最重要问题的变化
  • 沟通清晰,协作有效,能与公司内多个团队紧密合作
  • 对构建感觉自然、可控且安全的对话式AI充满热情
  • 关心语音AI的社会影响,并希望帮助负责任地塑造这些系统的开发方式