大模型评测工程师
岗位摘要
评测体系构建:参与设计、开发和优化自动化评测框架与工具,构建高质量、多样化的评测数据集;模型深度评测:执行全面、细致的模型评测,深入分析模型能力边界、输出效果,撰写客观详实的评测报告,为模型训练迭代提供明确的改进方向和数据支持
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 评测体系构建:参与设计、开发和优化自动化评测框架与工具,构建高质量、多样化的评测数据集
- 模型深度评测:执行全面、细致的模型评测,深入分析模型能力边界、输出效果,撰写客观详实的评测报告,为模型训练迭代提供明确的改进方向和数据支持
- 前沿技术追踪:积极跟踪大模型领域的前沿进展与最新评测方法,探索和创新评测分析的技术路径,推动评测效能的提升
任职要求
- 人工智能、计算机、数据学科等相关方向在读
- 深入了解大语言模型的基本原理,对大语言模型评测有浓厚的兴趣和热情,日常高频使用大模型解决实际问题
- 拥有优秀的问题定义、拆解和独立分析能力,以及良好的沟通能力和团队协作精神
- 熟悉主流开源大语言模型评测数据集、评测方式,有大模型评测相关经验者优先
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。