大模型应用数据生产与评估专家
岗位摘要
负责对服体大模型构建的通用垂类应用进行数据生产交付和效果质量评估;通过与产品研发团队的紧密合作,制定评估标准和体系,准确分析评估效果;为应用的优化和改进提供支持,以提升应用的性能、用户体验和市场竞争力
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责对服体大模型构建的通用垂类应用进行数据生产交付和效果质量评估
- 通过与产品研发团队的紧密合作,制定评估标准和体系,准确分析评估效果
- 为应用的优化和改进提供支持,以提升应用的性能、用户体验和市场竞争力
- 负责评估基于服体大模型所构建的通用垂类应用的效果和质量,包括语言理解准确性、生成内容的合理性等
- 参与设计测试数据集,涵盖不同场景、用户需求和输入条件,确保应用稳定性和可用性
- 参与收集和分析用户反馈数据,对应用的性能和用户体验进行综合评估
- 理解业务需求和产品目标,制定详细、明确的评估标准和指标体系
- 确保评估数据的可用性和置信度,为评估体系的持续改进提供数据支持
- 与产品、算法、运营、业务方协同,制定业务规划、目标管理及团队人员管理
- 设计和实现大语言模型方向AI训练流程,优化迭代,带领团队完成标注和内容生产项目
- 管理标注团队,推动标注工具、组织流程及交付流程优化,提升团队交付能力
任职要求
- 紧跟人工智能行业的前沿进展,接触新技术和行业趋势
- 参与AI大模型数据生产到模型评测全流程,具备理论到工程实践的全面技能
- 能与一流的人工智能团队合作,快速成长并提升自身能力
福利待遇
- 接触到人工智能行业前沿技术和趋势
- 参与从数据生产到模型评测的全流程实践
- 与一流团队合作,快速提升个人能力
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。