多模态音频工程师
岗位摘要
创建并推动研究议程,以提升多模态音频能力,包括视频音频生成、音频理解、音频生成、音乐生成和语音生成;改进音频和多模态数据集的数据质量,开发先进的标注、过滤、增强和合成数据生成技术,并进行深入的数据研究
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 创建并推动研究议程,以提升多模态音频能力,包括视频音频生成、音频理解、音频生成、音乐生成和语音生成
- 改进音频和多模态数据集的数据质量,开发先进的标注、过滤、增强和合成数据生成技术,并进行深入的数据研究
- 设计针对音频的评估框架、指标和内部基准
- 设计并实施有效且高效的算法,以实现最先进的模型性能
任职要求
- 在显著提升神经网络能力和性能的研究方面有良好记录,无论是通过更好的数据还是更好的建模
- 具备数据驱动实验设计和系统性分析经验,用于迭代模型调试
- 有开发或使用大规模分布式机器学习系统的经验
- 具备图形引擎和渲染技术的经验者优先
- 有能力采取一切必要措施,提供最佳的端到端用户体验
- 具备音频相关数据处理和模型训练经验
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。