通用AI大模型评测与应用专家
岗位摘要
负责通用AI大模型相关的评测与应用的规划、落地以及平台化能力建设;构建通用AI大模型评测基准,覆盖文生文、多模态理解、多模态(音视频/3D/图/视频生成)生成等多模态场景;设计全面、准确的多维度评测指标
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 负责通用AI大模型相关的评测与应用的规划、落地以及平台化能力建设
- 构建通用AI大模型评测基准,覆盖文生文、多模态理解、多模态(音视频/3D/图/视频生成)生成等多模态场景
- 设计全面、准确的多维度评测指标
- 构建自动化评测工具链
- 随着模型能力演进,持续探索全模态的评测基准
- 基于数据泛化等能力,构建领域增强型评测数据集生产链路
- 支持多模态场景的自动化数据扩增与效果验证
- 探索并实现各个模态大模型的自动化评测机制
- 探索并实现模型缺陷归因分析机制
任职要求
- 计算机科学、人工智能或相关专业本科及以上学历
- 具备通用AI大模型评测、自然语言处理或多模态理解生成的相关工作经验
- 熟悉多模态大模型的评测基准设计、指标体系和自动化评测方法
- 掌握Python等编程语言,具备自动化评测工具链开发能力
- 具备数据集构建、数据泛化及模型缺陷归因分析的技术能力
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。