返回岗位列表

xAI

多模态音频工程师

地点:美国 薪资:$180,000-$440,000 日期:2026-01-29

岗位摘要

创建并推动研究议程,以提升多模态音频能力,包括视频音频生成、音频理解、音频生成、音乐生成和语音生成;改进音频和多模态数据集的数据质量,开发先进的标注、过滤、增强和合成数据生成技术,并进行深入的数据研究

岗位职责

  • 创建并推动研究议程,以提升多模态音频能力,包括视频音频生成、音频理解、音频生成、音乐生成和语音生成
  • 改进音频和多模态数据集的数据质量,开发先进的标注、过滤、增强和合成数据生成技术,并进行深入的数据研究
  • 设计针对音频的评估框架、指标和内部基准
  • 设计并实施有效且高效的算法,以实现最先进的模型性能

任职要求

  • 在显著提升神经网络能力和性能的研究方面有良好记录,无论是通过更好的数据还是更好的建模
  • 具备数据驱动实验设计和系统性分析经验,用于迭代模型调试
  • 有开发或使用大规模分布式机器学习系统的经验
  • 具备图形引擎和渲染技术的经验者优先
  • 有能力采取一切必要措施,提供最佳的端到端用户体验
  • 具备音频相关数据处理和模型训练经验