
图片来源:Unsplash
01 计划将ChatGPT、Codex 及其浏览器 Atlas 整合成一个桌面端“超级应用”
去年初, 在 Anthropic 发布其编码工具 Claude Code 预览版后,OpenAI 意识到自己让这家当时规模较小的人工智能竞争对手在编码领域超越了它。大约在同一时间,OpenAI 将资源投入到一个新的专门团队,该团队将专注于开发用于编码的人工智能工具。
近 18 个月后,OpenAI 的领导者——包括负责该新团队的 Thibault Sottiaux——得出了一个严峻的结论:该公司的 Codex 编码工具在许多任务上比其旗舰人工智能服务 ChatGPT 表现更佳。例如,Sottiaux 在接受采访时表示,Codex 在完成长时间运行的多步骤任务、使用外部工具以及编写代码来完成编辑复杂电子表格等任务方面优于 ChatGPT。
其结果是,OpenAI 现在将 Codex 定位为一款不仅能用于编程、还能被开发者之外的广泛人群使用的工具。该公司周二发布的一份关于 Codex“正成为面向所有人的生产力工具”的研究报告,凸显了这一转变。OpenAI 表示,Codex 正在“帮助各行各业的人们自动化日常工作、加快工作节奏,并消除现代知识工作中的瓶颈。”
同样在周二,OpenAI 表示,此前宣布的将 ChatGPT、Codex 及其浏览器 Atlas 整合成一个桌面端“超级应用”的计划,将在未来几周内推出。OpenAI 的领导层曾表示,通过整合这些应用,OpenAI 希望将精力集中在其最成功的产品上——而近来,这意味着 Codex。
过去几个月,OpenAI 推出了更擅长处理与调整大型企业代码库的模型,这帮助 Codex 在开发者中赢得了更多追随者——而此前大多数开发者更青睐 Anthropic 的 Claude Code。该公司表示,Codex 在 5 月底突破 500 万周活跃用户,此前一个月刚超过 400 万,再往前两周则达到 300 万。
据知情人士透露,OpenAI 联合创始人兼总裁格雷格·布罗克曼上月对员工表示,Codex 来自企业客户的收入周环比增长 50%。该人士称,CEO 山姆·奥特曼也在最近一次全员会议上提到,Codex 整体使用量日均增长 5%。
据知情人士透露,Codex 的 500 万周活跃用户中,大部分为付费用户,但仍有相当比例尚未付费。Anthropic 未披露其编程及通用智能体 Claude Code 和 Claude Cowork 的用户数据,但这两款产品仅向付费用户开放。
Anthropic 来自这些产品的收入可能已超过当前 Codex 的营收。Claude Code 在开发者中的受欢迎程度,推动 Anthropic 截至上月的年化收入超过 470 亿美元,是年初时的五倍。OpenAI 自 3 月宣布年化收入为 250 亿美元后,便未再披露最新数据,不过 《The Information》近期报道称,OpenAI 已突破 300 亿美元年化收入。
通过打造这款超级应用,OpenAI 旨在将 Codex 带给其超过 9 亿的消费者用户,从而提升营收。这一举措至关重要,因为两家公司都在竞相推进上市计划,上市后将能获得更大规模的资金池,用于购买 AI 芯片和招募研究人员。
Codex 与 ChatGPT 应用的整合,对于 OpenAI 开发能够更广泛地为知识工作者自动化任务的智能体而言同样至关重要,正如 Anthropic 的 Claude Code 促成了其更通用的 Claude Cowork 工具一样。

图片来源:The Information
02 编码是关键
早在 Anthropic 于 2025 年 2 月发布 Claude Code 研究预览版之前,OpenAI 就已对 Claude 的编码能力感到担忧。2024 年秋季,根据内部评估指标,Claude 已领先于 OpenAI 的模型 。这尤其令人警惕,因为 OpenAI 长期认为,用于编码的 AI 将加速研究进程,而这一进程对开发超级智能 AI 至关重要。
2025 年 1 月,OpenAI 发布了 Operator——一款用于自动化完成旅行规划或订购日用品等任务的浏览器操作代理。但据知情人士透露,OpenAI 的领导者很快意识到,让 AI 在浏览器中点击操作速度太慢,而编写代码可能是 AI 更高效地操控电脑完成诸如制作电子表格等任务的方式。
工程师客户表示,OpenAI 通过开发更擅长处理及调整大型企业代码库的模型来应对 Claude 的进步,并在 2 月推出 Codex 桌面应用后吸引了更多用户。
一个关键因素是成立了专门的 Codex 团队。Sottiaux 表示,该团队在 OpenAI 内部几乎像是一个初创公司中的小型初创公司。OpenAI 企业产品负责人、此前曾领导 Codex 产品团队的 Alexander Embiricos 指出,例如,该团队开源了 Codex 背后的代码,这使得团队能够更轻松地从用户那里获得关于如何改进代码的反馈和建议。允许员工公开分享如此重要的代码,在大多数公司中都是罕见的选择。
一些 OpenAI 员工认为,Codex 相比 ChatGPT 更具优势,因为其模型与产品由同一团队协同开发。相比之下,OpenAI 的应用部门独立于负责模型研发的研究组织,开发了许多其他产品。
Sottiaux 表示,Codex 更优越的“工具调用框架”——即帮助 AI 代理代表用户使用工具并执行操作的软件——是公司现在希望将其与 ChatGPT 整合为单一应用的关键原因之一。
Codex 团队的成功也是 OpenAI 在 1 月份重组团队的原因之一,目的是让产品团队与负责这些产品底层模型的相关研究人员更紧密地协作。
OpenAI 现已围绕 Codex 进行了重组。上个月,该公司合并了负责 ChatGPT、Codex 及其应用程序接口的团队,组建为一个由 Sottiaux 领导的统一组织,他目前负责“核心产品与平台”。
Codex 与 ChatGPT 最大的区别之一在于:ChatGPT 运行在云端,而 Codex 则本地运行于用户设备上,并能访问设备中的文件。Sottiaux 表示,他目前面临的主要挑战之一,就是如何将这两种模式融合。
他必须在公司即将推出的超级应用中完成这一融合。Embiricos 表示,短期内,OpenAI 的目标是将 Codex 的功能整合到 ChatGPT 中,让用户自行选择由 Codex 还是 ChatGPT 来回答他们的查询。这样一来,用户就能更清楚地了解,现在通过 ChatGPT 中的 Codex 可以完成哪些更复杂的任务。
从长远来看,用户无需思考不同任务需要哪种工具,模型将自行决定是在用户设备上还是在云端执行任务,他表示。

图片来源:OpenAI
03 开发者反响
Codex 重获青睐的主要原因是它重新赢得了开发者的认可,如今许多开发者更倾向于使用 Codex 而非 Claude Code。例如,上月纽约 AI 会计初创公司 Basis 的联合创始人 Mitch Troyanovsky 表示,该公司的软件工程师因触及企业信用卡额度上限而无法继续使用 Codex。
特罗扬诺夫斯基在工程师们用 Slack 消息轰炸他、表达不满后,提高了使用上限。他们仍能使用 Claude Code——公司也在为此付费——但这款工具实在缺乏吸引力,以至于一位工程师在 Slack 上分享了一张士兵把枪递给猴子的 GIF 动图,仿佛在暗示 Claude Code 就是那只猴子。特罗扬诺夫斯基补充说,Basis 公司一些经常使用 Claude Code 的工程师对此并不介意。
Sottiaux 表示,近几个月发布的几款模型使 Codex 的使用量大幅增长。其中包括去年 12 月推出的 GPT-5.2,它提升了 Codex 处理长期任务的能力,以及今年 4 月发布的 GPT-5.5。这是自去年 2 月 OpenAI 推出反响平平的 GPT-4.5 以来,首次在其旗舰 AI 中集成新的基础模型。
开发者们一致认为,近期的发布显著提升了 Codex 的性能。思科 AI 软件与平台部门高级副总裁兼总经理 DJ Sampath 表示,与以往模型相比,GPT-5.5 在无需人类用户频繁指导的情况下,处理长期运行任务的能力有了显著提升。
“从 GPT-5 开始,Codex 的表现就一直更胜一筹,但到了 GPT-5.5 版本,这种差距已经大到无法忽视。”Basis 公司的 Troyanovsky 表示。
多位开发者指出,当工程师有明确计划需要编码代理执行时,Codex 表现更佳;而 Anthropic 的 Claude Code 则更适合初级工程师,或当工程师不确定解决方案具体形态时使用。这是因为 Claude Code 擅长预判用户意图 ,即便用户未精确描述所需任务,也无需过多上下文或细节就能理解。
“如果我真的不知道解决方案可能是什么样子,需要模型自己提出想法并尝试,Claude Code 在这方面感觉稍好一些;而当我有一个明确的规格说明时,我更信任 Codex 来执行。”AI 生产力初创公司 Notion 的软件工程师 Varun Rau 表示。
Embiricos 表示,借助更新的模型和全新的 Codex 应用,即使指令模糊不清,Codex 也能更好地理解用户的意图。
Rau 补充说,Codex 在修复漏洞方面"毫不留情"。例如,当他和同事们开发一个用于启动新服务器来运行 Codex 的工具时,他们花了数周时间才发现代码中存在一个漏洞——因为每次启动服务器时,Codex 都会自动修复这个漏洞。直到他们尝试使用另一个编码代理时,才意识到最初存在这个漏洞。
不过,开发者表示,有时 Codex 和 Claude Code 各自的优势反而会成为缺点。例如,Claude Code 的自主思考能力有时会导致它陷入思维误区,或无法遵循开发者的指令。而 Rau 指出,Codex 的"穷追不舍"特性意味着,即便开发者只要求进行微小改动,它也可能去追踪大量漏洞。
多位开发者表示,当 OpenAI 在 2 月份推出 Codex 桌面应用时,他们便转而使用该工具。开发者历来通过终端(一种纯文本窗口,用于输入计算机命令)使用 Claude Code。(Anthropic 最初于 11 月宣布用户将能在其桌面版 Claude 应用中运行 Claude Code,但直到 4 月才对该应用进行重新设计。)
开发者表示,对于非技术用户或希望让多个编码代理同时处理不同任务的开发者而言,应用方式更为理想。Notion 产品负责人马克斯·舍宁表示,他尤其喜欢能在电脑上启动编码任务,随后通过本月早些时候发布的 Codex 移动应用随时查看进度的功能。
Codex 的负责人还经常重置该应用的使用限制,例如当 Codex 的周活跃用户数达到某个里程碑,或者应用出现故障时。
“我的原则之一是,如果我们搞砸了某件事,就必须补偿用户,”Sottiaux 表示,“这就是传统的由来——每次出现故障,无论持续五分钟、一小时还是四小时,我们都会进行补偿,并重置所有人的速率限制。”
参考资料:
https://www.theinformation.com/articles/inside-openais-decision-combine-codex-chatgpt?rc=p2bxcy







