大模型评测算法实习生
岗位摘要
参与大模型自动化评测框架的设计、开发与维护;支持训练框架上的联动开发,持续提升评测流程的稳定性、可扩展性和执行效率;跟进学术界与工业界最新的大模型评测基准,负责将其快速、准确地集成到现有评测平台中
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 参与大模型自动化评测框架的设计、开发与维护
- 支持训练框架上的联动开发,持续提升评测流程的稳定性、可扩展性和执行效率
- 跟进学术界与工业界最新的大模型评测基准,负责将其快速、准确地集成到现有评测平台中
- 负责评测数据集的清洗、处理与管理,对海量评测结果进行统计分析、深度挖掘和可视化呈现
- 协助团队完成多维度、多场景下的模型能力评测,并参与撰写发版模型技术报告
任职要求
- 具备扎实的 Python 编程功底,代码风格良好,追求高质量的代码实现
- 计算机科学、软件工程、人工智能、电子信息等相关专业在读本科或研究生
- 能保证连续线下实习 3 个月及以上,每周出勤不少于 4 天
- 具备优秀的逻辑思维能力、快速学习能力和解决问题的能力
- 具备良好的沟通和团队协作精神
- 在 ACM/ICPC、信息学奥林匹克竞赛等编程竞赛中获得过优异成绩者优先
- 发表过 LLM 顶级会议论文或在主流开源 LLM 框架上有开发经验者优先
- 工程基础扎实,熟练使用 AI Agent 辅助 coding,有个人项目或开源社区贡献经验者优先
加分项
- haves): 竞赛经历:在 ACM/ICPC、信息学奥林匹克竞赛(NOI / OI / CSP)等编程竞赛中获得过优异成绩者优先
- 大模型基础:发表过 LLM 顶级会议论文 / 在主流开源 LLM 框架上有开发经验 / 大模型 Agent 系统开发经验者优先
- 工程能力:工程基础扎实,熟练使用 AI Agent 辅助 coding,有个人项目或开源社区贡献经验者优先
福利待遇
- 实习薪资 500-600 元/天
- 参与前沿大模型评测技术研究
- 与顶尖团队合作,积累实战经验
工作地址
北京海淀区大恒科技大厦南座
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。