大模型基建 & Code Agent 工程师
岗位摘要
构建真实编程工作场景下的 Code Task Benchmark,基于 Docker 实现标准化代码任务评测环境;设计并实现 Agent 执行环境框架,包含代码运行、自动化测试与结果验证机制
登录后保留你的岗位线索
邮箱登录后可继续查看完整职责、任职要求和原岗位入口,并使用收藏与浏览记录沉淀适合自己的机会。
岗位职责
- 构建真实编程工作场景下的 Code Task Benchmark,基于 Docker 实现标准化代码任务评测环境
- 设计并实现 Agent 执行环境框架,包含代码运行、自动化测试与结果验证机制
- 研发 Code Agent 框架,实现任务规划、代码生成、执行与迭代的完整闭环
- 构建 Agent Runtime 系统,完成工具调用、环境管理与执行状态控制
- 搭建可扩展的多模型对比评测系统(Multi-Model Evaluation),支持大规模实验
- 持续优化 Agent 执行稳定性、可复现性与评测效率
- 推动研究能力向工程系统转化,支持模型与 Agent 的快速迭代上线
任职要求
- 具备扎实的软件工程能力,熟练掌握 Python、Go、TypeScript 等开发语言
- 熟悉 Docker / Linux 环境与自动化执行流程,具备生产环境部署经验
- 深入理解 LLM Agent 工作机制与工具调用模式,有实际项目经验
- 具备复杂系统设计与工程落地能力,能主导从 0 到 1 的系统建设
- 熟悉测试体系、任务执行与自动化 Workflow 设计规范
福利待遇
- 提供 30-60K × 16 薪的极具竞争力的薪酬体系
- 深耕 AI 大模型赛道,与行业顶尖技术团队并肩工作
- 专业级大模型基建研发,积累稀缺的核心技术经验
- 完善的职业晋升通道与技术成长路径
工作地址
北京海淀区大恒科技大厦12F
登录后查看完整岗位详情
使用邮箱验证码登录后,可查看完整职责、任职要求、原岗位入口,并继续使用收藏和浏览记录。列表摘要保持公开,完整详情用于保护数据质量和降低恶意抓取。