返回岗位列表

腾讯

通用AI大模型评测与应用专家

地点:深圳 薪资:薪资未公开 日期:2026-01-29

岗位摘要

负责通用AI大模型相关的评测与应用的规划、落地以及平台化能力建设;构建通用AI大模型评测基准,覆盖文生文、多模态理解、多模态(音视频/3D/图/视频生成)生成等多模态场景;设计全面、准确的多维度评测指标

岗位职责

  • 负责通用AI大模型相关的评测与应用的规划、落地以及平台化能力建设
  • 构建通用AI大模型评测基准,覆盖文生文、多模态理解、多模态(音视频/3D/图/视频生成)生成等多模态场景
  • 设计全面、准确的多维度评测指标
  • 构建自动化评测工具链
  • 随着模型能力演进,持续探索全模态的评测基准
  • 基于数据泛化等能力,构建领域增强型评测数据集生产链路
  • 支持多模态场景的自动化数据扩增与效果验证
  • 探索并实现各个模态大模型的自动化评测机制
  • 探索并实现模型缺陷归因分析机制

任职要求

  • 计算机科学、人工智能或相关专业本科及以上学历
  • 具备通用AI大模型评测、自然语言处理或多模态理解生成的相关工作经验
  • 熟悉多模态大模型的评测基准设计、指标体系和自动化评测方法
  • 掌握Python等编程语言,具备自动化评测工具链开发能力
  • 具备数据集构建、数据泛化及模型缺陷归因分析的技术能力