大模型评测研究员
岗位摘要
构建科学有效的评测方案,为现阶段大模型提供评测和分析手段,并储备未来评测技术;结合训练和评测,对模型能力进行建模及深入研究,包括能力体系构建、训练阶段分析等;探索模型能力边界,发现当前训练范式的局限性,寻求能力突破
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 构建科学有效的评测方案,为现阶段大模型提供评测和分析手段,并储备未来评测技术
- 结合训练和评测,对模型能力进行建模及深入研究,包括能力体系构建、训练阶段分析等
- 探索模型能力边界,发现当前训练范式的局限性,寻求能力突破
- 负责Agent评测构建与方案探索,包括通用模型的Agent能力评测及产品级Agent评测方案
- 开展长周期人机协作与Agent能力边界探索,包括异步交互、记忆管理等能力的评测实践
任职要求
- 具备AI模型评测或相关领域的研究经验
- 熟悉大模型技术及评测方法
- 有Agent能力评测或相关实践经验者优先
- 具备较强的研究能力和创新思维
- 能够与跨学科团队协作,共同推进项目
福利待遇
- 美团拥有大量复杂性极高的业务难题,提供丰富的学习和成长机会
- 业界前列的NV GPU和非GPU算力规模,支持大模型研究
- 团队具备国内头部竞争力,产出高质量论文及研究工作
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。