语音大模型数据专家
岗位摘要
深度参与语音大模型数据全链路工作,针对模型训练和评测环节构建高质量数据集,助力语音基座模型能力提升和应用场景扩展;探索应用各种工具搭建高效的数据生产和模型评测链路,设计可信的数据标准、质量评价和优化体系,保障数据生产的高效率、高质量
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 深度参与语音大模型数据全链路工作,针对模型训练和评测环节构建高质量数据集,助力语音基座模型能力提升和应用场景扩展
- 探索应用各种工具搭建高效的数据生产和模型评测链路,设计可信的数据标准、质量评价和优化体系,保障数据生产的高效率、高质量
- 持续追踪技术和产品趋势,产生业务洞察,协同产品、算法对数据和评测模式进行试验探索、方法迭代
任职要求
- 本科及以上学历,AI行业经验(不限制语音方向),熟悉大模型数据和评测方法,具备全链路视角,有团队管理或主导复杂项目的经验
- 对LLM领域的技术和产品趋势保持好奇,具备敏捷、高效获取知识和实践验证的能力,有日常重度使用的LLM工具
- 加分项:交叉学科(如计算语言学)或理工科背景,有Agent搭建经验,有代码能力(低代码)
- 要求具备C/C++和Python编程能力
- 要求有数据架构经验,计算机相关专业优先
加分项
- 交叉学科(如计算语言学)或理工科,有Agent搭建经验,有代码能力(低代码)
工作地址
北京海淀区搜狐网络大厦搜狐大厦9楼
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。