AI资讯 / Agent

Agent / 分析

Codex 用户半年增 10 倍至 700 万,单日再涨 100 万,Claude Code 落后了吗

Latent Space

OpenAI 团队成员 Tibo 在社交平台披露,Codex 与 ChatGPT Work 在 48 小时内新增 600 万活跃用户,随后不到一天又突破 700 万大关。相较今年 1 月约 55 万至 70 万的基数,Codex 半年内实现超过 10 倍增长。此前 3 月公布的活跃用户约为 200 万。Claude Code 方面,最近一次披露停留在今年 2 月的约 200 万周活用户与 25 亿美元年化收入,此后未更新数据。文章还梳理了 Prime Intellect 发布的 verifiers v1、Agent 评测从单 token 价格向单任务成本迁移的趋势,以及 GPT-5.6 Sol 在 Arena 智能体榜单中排名第二等多项动态。

OpenAI 团队成员 Tibo 在 X 平台披露,Codex 与 ChatGPT Work 在 48 小时内新增约 600 万活跃用户;不到一天后,他再次发文宣布活跃用户总数已突破 700 万。两次发帖间隔约 24.5 小时,浏览量分别达到 429 万与 94.7 万。Tibo 同时宣布临时取消 Plus、Business 与 Pro 计划的 5 小时使用限制,并补充了周度额度的补偿重置。

回顾今年 3 月 OpenAI 董事会主席 Fidji Simo 曾披露 Codex 活跃用户约为 200 万,而 1 月 1 日的基数约为 55 万至 70 万。按此推算,Codex 在不到半年时间内实现了超过 10 倍的用户增长,并在最近一周进一步出现加速。

相比之下,Anthropic 的 Claude Code 自今年 2 月披露约 200 万周活用户与 25 亿美元年化收入后,未再公布更新数据。文章推测,一种可能的解释是 Anthropic 已将主要编码场景迁移至 Slack 中的 Claude Fable,从而导致 CLI 形态的 Claude Code 用户增长统计出现停滞,但具体原因仍未获官方确认。

除 Codex 数据外,本期还汇总了多项 AI 行业动态。Prime Intellect 正式发布 verifiers v1,将环境拆分为 taskset、harness 与 runtime 三层抽象,并把 rollout trace 存储改为消息 DAG 结构,使长链路多模态训练的存储复杂度由 O(n²) 降至 O(n)。

在评测层面,多位从业者指出竞争重心正从单 token 价格转向单任务成本。LangChain 提出任务专用 harness 将取代通用包装,Factory 推出指向式 UI 编辑的 design mode。基准测试方面,Arena 基于 7800 个真实会话将 GPT-5.6 Sol 排在智能体榜单第二,Grok-4.5 升至第十三;Cognition 报告 Devin Fusion 在切换至 Fable 5 后单任务成本反而低于 Opus 4.8,因为更强的判断力减少了无效动作。

要点

  • Codex 活跃用户半年内从约 55 万至 70 万增长至 700 万,增幅超过 10 倍,最近 48 小时净增约 600 万
  • Anthropic 的 Claude Code 自今年 2 月后未再披露用户数据,与 Codex 形成鲜明对比,可能源于向 Claude Fable 的迁移
  • Prime Intellect verifiers v1 把环境拆成 taskset、harness、runtime 三层,并通过消息 DAG 把 trace 存储复杂度从 O(n²) 降到 O(n)
  • Agent 评测指标正从单 token 价格转向单任务成本,Cognition 数据显示更强模型的单任务成本反而更低
  • Arena 将 GPT-5.6 Sol 排在真实会话智能体榜第二,Grok-4.5 跃升至第十三
查看原始来源

原始标题:[AINews] Codex usage up >10x in 6 months to 7M users, +1M in the past ~day; did Codex overtake Claude Code??

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。