返回岗位列表

智谱AI

代码代理{}

地点:北京 薪资:薪资未公开 日期:2026-01-05

岗位摘要

Code Agent 框架开发与迭代:参与公司自研或开源Code Agent框架的设计、开发与迭代,优化其代码理解、工具调用、多轮交互、记忆管理及任务规划等核心能力;评测体系与基准构建:面向主流Code Agent(如 Claude Code、Roo Code、Cline等)及自研框架,设计并执行…

岗位职责

  • Code Agent 框架开发与迭代:参与公司自研或开源Code Agent框架的设计、开发与迭代,优化其代码理解、工具调用、多轮交互、记忆管理及任务规划等核心能力
  • 评测体系与基准构建:面向主流Code Agent(如 Claude Code、Roo Code、Cline等)及自研框架,设计并执行系统化评测。构建覆盖真实开发任务、长程多轮交互、完整工具链(构建/测试/部署)的基准测试集
  • 自动化评测框架研发:设计并开发高可扩展的自动化评测平台,支持多Agent并行评测、环境隔离、过程可观测、结果自动化分析与可视化报告生成
  • 评测算法与缺陷挖掘创新:创新评测方法论,通过设计算法自动识别Agent的典型失败模式(如指令偏移、上下文遗忘、测试投机等),并产出可复现的缺陷诊断包与回归用例
  • 深度洞察与产品驱动:基于评测数据与框架开发经验,输出深度分析报告,为Agent框架的优化与产品方向提供可落地的数据洞察与建议

任职要求

  • 框架开发经验:具备AI Agent框架或复杂开发工具链的实际开发或深度迭代经验,熟悉其架构设计与核心模块
  • 深度用户视角:拥有一年以上深度使用AI编程工具(如 Cursor、Copilot、Claude Code等)进行实际项目开发或大规模代码重构的经验,对其工作流与局限性有切身理解
  • 熟练掌握 Python 及至少一门系统级语言(如 Go/Rust/TypeScript),具备独立负责关键模块的设计与实现能力
  • 具备优秀的软件工程素养,熟悉设计模式、代码规范与自动化测试
  • 评测与数据思维:具备强大的逻辑思维与数据分析能力,能够从复杂交互中抽象出可量化的指标与科学对比实验方法
  • 开源经历:在AI辅助开发、开发者工具等领域有活跃的开源项目贡献或独立项目经历,GitHub有高质量公开代码
  • 平台工程背景:具备复杂系统、效能平台或工具链开发背景,熟悉高标准的工程实践与协作流程
  • 评测工程专长:在Benchmark设计、回归测试体系、CI/CD集成、容器化评测等方面有直接经验
  • 产品化思维:能从终端开发者视角出发,将技术洞察转化为清晰的产品优化建议或特性需求

加分项

  • 开源经历:在AI辅助开发、开发者工具等领域有活跃的开源项目贡献或独立项目经历,GitHub有高质量公开代码
  • 平台工程背景:具备复杂系统、效能平台或工具链开发背景,熟悉高标准的工程实践与协作流程
  • 评测工程专长:在Benchmark设计、回归测试体系、CI/CD集成、容器化评测等方面有直接经验
  • 产品化思维:能从终端开发者视角出发,将技术洞察转化为清晰的产品优化建议或特性需求