编辑|冬梅
OpenAI 的 ChatGPT 和 Codex 负责人 Tibo Sottiaux,昨晚在 X 上给团队立下了一份可以逐日检查的承诺:未来 28 天,每天要么推出一项对大多数 Codex 和 Work 用户明显有用的改进,要么进行一次完整的额度重置。

这份承诺把判断权交到了用户手里。产品有没有变好,不能只看发布了多少功能,还要看用户在日常工作中是否真正受益。至于额度重置,Tibo 在最近的一场访谈中,恰好解释了自己为什么能直接拍板。
“只要有必要,而且我认为合适,我就可以按下额度重置按钮。”他表示,这种自主权让他能够更直接地贴近社区,“我不需要让这件事经过层层审批”。
当主持人 Lenny 问,接下来还能期待多少次额度重置时,Tibo 的回答带着一点自嘲:“取决于我们把东西弄坏多少次。”他随后补充,出了问题会重置,有值得庆祝的事情也会重置。他还坦承,自己加入 OpenAI 的第三天,就曾把生产环境弄宕机。
不过,比“还能领多少额度”更值得关注的,是这位产品负责人对 AI 使用体验的判断:就连他自己,也已经受够了越来越复杂的选择。
该选哪个模型?推理强度设多高?用多智能体模式,还是 Ultra 模式?这些选项到底有什么区别?在访谈最后,Tibo 直言,自己也会被它们弄得疲惫:“你简直需要拿一个‘模型选择器博士学位’。”他希望尽快摆脱这些负担,让应用本身逐渐退到幕后。
这种对简单体验的追求,也来自他自己的工作变化。如今,分析业务趋势、研究下一个功能、检查此前发布的产品表现,所需的大量代码都由 Codex 编写。手写代码,则成了偶尔在周末刷几道 LeetCode 题时的放松活动。
他也没有一味追求同时运行更多智能体。随着智能体速度提高,他反而重新找回了工作的心流:想法不必在漫长的等待中被打断,通过语音就能推动构建,注意力可以更集中地放在创造本身。“这种心流和过去不一样,但我已经不再怀念过去的那种状态了。”
在 Tibo 看来,接下来的产品设计需要考虑三个变化:互联网上的大多数操作将由智能体完成;模型会迅速变得更便宜、更快;不同模态之间的交互会更加顺畅。这也是他对外界一些产品提出质疑的原因:如果认真设想一年后这些能力比今天强十倍,开发者就会采用不同的构建方式。
从这个角度看,28 天的改进承诺,与他在访谈中反复强调的方向相互呼应:让更强的能力,变成更容易使用的产品。
在 DevDay 期间接受 Lenny 采访时,Tibo 进一步谈到了个人智能体平台 Dots、Codex 与 ChatGPT 的整合,以及为什么手动搭建循环、反复调整智能体工作流可能只是一个过渡阶段。他也回答了更贴近从业者的问题:AI 接管更多执行工作之后,哪些技能会更重要?人是否必须因此做更多事情?智能体开始主动行动时,又该如何控制风险?

以下为完整访谈,经 InfoQ 编译:
Lenny:谢谢你接受采访。你们最近发布了很多东西。最近睡得怎么样?状态还好吗?
Tibo Sottiaux: 我状态很好,很幸运拥有一支优秀的团队。我睡觉的时候,他们大半个晚上都还醒着。办公室里有一个很棒的房间,叫“图书馆”。我们把它完全改造成了一个大型作战室。那里的氛围非常好,大家一直忙到很晚。
Lenny:你做了很多年工程师。现在还写代码吗?还会提交 PR,也就是代码合并请求吗?还是主要在写文档、开会?
Tibo Sottiaux: 你所说的,到底什么才算“写代码”?
Lenny:比如提交 PR,偶尔合并一些代码。
Tibo Sottiaux: 从技术上说,为了完成各种分析,确实有大量代码在替我编写。比如了解趋势、了解业务、研究下一个功能,以及分析之前发布的产品表现如何。这些工作所需的大量代码,都是 Codex 写的。我显然已经不再手写这些代码了。
偶尔到了周末,我会手写几道 LeetCode 题,享受一点放松、解压的时间。但这是我现在唯一还会亲手写代码的场景。
Lenny:在日常工作中,你通常会同时运行多少个智能体?
Tibo Sottiaux: 以前我会同时运行更多智能体。后来,我们很幸运地在超高速能力方面取得了突破。现在,我感觉自己又能保持在工作的心流状态里了。一个速度更快的智能体,对我的帮助很大。
同时运行多少个智能体,其实会变化。当我不断探索能力边界时,我会组建越来越大的智能体团队。但当模型取得下一次突破时,我突然发现,一个能力更强的智能体就能完成所有工作,把全部信息保存在记忆中,并持续学习。于是,我又会缩小团队规模。
这个过程就是不断扩张、收缩,再扩张。
AI 将如何继续改变工作
Lenny:能进一步解释一下吗?这让我想到,之前大家都在讨论循环,后来又开始讨论执行图。你说的是否在某种程度上是这些方式的进一步演变?
Tibo Sottiaux: 搭建循环、反复调整循环,再弄清楚它们应该如何运作,可能曾让一些人感到兴奋。但我不认为未来会以这种方式运作。
我认为,未来的方式更接近我们对 Dots 的定位,以及这次推出的产品:你拥有一个非常聪明的智能体,它每周七天、每天二十四小时持续工作,理解你的目标、了解你的偏好,并从反馈中学习。
我们这次推出的产品并不完美。把它开放给所有 Pro 用户后,我们会从中学到很多东西。但长期来看,你需要的是一个能够根据你想实现的目标不断学习的系统。你不应该非得思考:“为了得到结果,我必须让它严格按照这种方式循环。”
Lenny:现在有 Codex、ChatGPT Work、面向消费者的 ChatGPT,还有 Dots。听起来,你认为我们正在走向这样一种未来:Dots 成为人与 AI 交互的主要入口,再由它启动其他这些工具或服务。是这样吗?
Tibo Sottiaux: 是的。但如果退一步看,无论最终是不是 Dots,根本目标都是让人摆脱技术本身的束缚。
你拥有一种持续存在、始终活跃的智能能力。它知道自己需要做什么,而且可以通过任何客户端、任何屏幕与你交互。你也可以给它打电话。比如,你走进会议室,它就出现在会议中,帮你记笔记。之后,你可以通过邮件接着与它沟通;需要它的时候,也可以给它发消息。
你不需要一直守着笔记本电脑,也不需要始终盯着手机。需要它时,它就在;不需要它时,它也不会妨碍你。我迫不及待地想看到这成为现实。现在,我们到哪里都要带着笔记本电脑,就像随身带着一块砖。你被技术拴住了,而不是技术在为你工作。
Lenny:我今天也想问你这个问题:过去两年,我们的工作方式似乎已经发生了很多变化。尤其是工程师,但也包括许多其他岗位,日常工作都已经明显不同了。
你认为,我们是否正在逐渐接近未来工作的基本形态?比如未来五年——不过五年似乎太遥远了,那就说未来两年。还是说,我们的工作方式仍然会发生更剧烈的变化?
Tibo Sottiaux: 我认为,它还会继续发生相当剧烈的变化。
即使到了今天,语音、多模态输入和输出等技术似乎终于开始结合起来,但使用起来仍然有些笨拙。我认为,这种感觉会一直持续,直到某一天它突然不再笨拙。到那时,你会发现:“我可以像我们现在这样,直接和它交谈。它能准确地记住所有事情。如果我想构思、头脑风暴,我们可以随手画点东西,我还有一个可以共同协作的界面。”
你可以设想,我们拥有一块共享白板,人和人之间、智能体和智能体之间,都可以共同协作。
我认为,这会超越对话,也会超越今天的许多客户端形态。毕竟,这些东西今天还没有真正运转起来。所以,我们还会经历一轮重大的新变革。
Dots 未来发展方向
Lenny:听起来,Dots 是未来的重要组成部分。这个 AI 助手可以替你处理各种事情,你不再需要区分什么时候用 Codex、什么时候用 ChatGPT,对吗?
Tibo Sottiaux: 是的。对于 Codex 和 ChatGPT,我们会做整合。现在,我们有聊天模式,也有 Work 模式的切换开关。我们已经非常明确地听到了用户反馈:大家喜欢 Work 的能力,但有时也想用聊天模式,因为它速度更快、用起来更舒服。
所以,我们正在把这些体验整合起来,降低复杂度。最终,我们也会把 Dots 的所有能力直接带到聊天模式中,提高我们这 12 亿用户所能获得的基础能力。当然,到那个时候,用户数量是多少,我们再看。
我们希望整个体验真正做到无缝衔接。Dots 有一点让我非常兴奋:它没有模型选择器,也不需要各种配置,你只需要和它交谈。唯一需要配置的是,你希望通过哪些渠道与它沟通。
Lenny:这很像电影《她》所描绘的世界。你会想到这部电影吗?就是这样一种设想……
Tibo Sottiaux: 我看过一次。我觉得这个设想很有意思。不过,我更多想到的是三四十年前的科幻作品,以及它们当时有多么富有远见。
Lenny:有没有哪部科幻作品对你的影响特别大?
Tibo Sottiaux: 比如《神经漫游者》这样的书,还有最初的《星际迷航》。我经常想到这些作品。《星际迷航》有一点让我印象很深:里面的技术非常实用。你可以直接和计算机说话,它就替你做事;你可以和飞船说话,它就会行动。
这些事情正在变成现实。我们正在进入那个时代。
Lenny:我们今天是在现场观众面前录制这场访谈。门外排起了长队,大家都在等着见你、听你分享。你怎么看自己现在所处的位置,以及这份责任?你们正在开发的东西会影响人们的生活。这是一种什么样的感受?
Tibo Sottiaux: 我认为,成为社区的一部分,与大家一起构建产品,非常重要。
某种意义上,我们是在共同探索这项技术,以及我们能一起用它做些什么。每次和人交流,我都会发现:“原来你在用它做这件事,这是我之前完全没有想到的。”
它以某种方式影响了你的生活,也影响了另一个人的生活。把这些体验放在一起,会让人感到谦卑,也很受启发。我认为,要做出真正对人有用的东西,这个过程必不可少。我不知道,如果没有社区,我们该怎么做到这一点。
Lenny:我经常听开发 AI 产品的人说,产品发布之前,他们并不真正知道自己做出了什么。只有发布之后,看到人们如何使用、有哪些新用法涌现出来,才会逐渐理解它。听起来,你的意思也是与大家一起构建,而不是说:“这就是我们的愿景,我们已经把一切想清楚了。”
Tibo Sottiaux: 就连 Twitter 社区,总体上也对我们很友好。
Lenny:你很擅长用 Twitter。虽然有时会有点针锋相对,但确实很擅长。 你怎么还能抽出时间发推?我不太理解,像你这样的人怎么有时间刷 Twitter、发帖、回复。
Tibo Sottiaux: 我每天大概花半个小时,刷一刷。受到启发、觉得有值得分享的内容时,就做点什么。很多内容都是当下想到的。
Lenny:这正是适合 Twitter 的能力。
Tibo Sottiaux: 另外,我还有一个 Dot。我们还没有推出团队形式的 Dots,但今天发布了可以由用户配置的主 Dot。你可以把它连接到自己的应用,逐渐了解一个 Dot 能做些什么。之后,我们会开放创建多个 Dot 的能力。我自己就有一个专门负责 Twitter 的 Dot。
Lenny:能具体说说吗?现在每个人只有一个 Dot,还不能添加更多,对吗?以后大家可以拥有多个 Dot。这个方向会怎样发展?
Tibo Sottiaux: 是的。我们希望先从一个主 Dot 开始。它很可能也是你会通过消息联系的那个助手,而且会最深入地了解你的偏好。
我们想先看看大家会用它做什么,看看系统需要怎样调整,通过与社区共同使用和探索来学习。
很快,你就可以添加第二个、第三个、第四个 Dot,按需要创建任意数量的 Dot,组成自己的虚拟团队,并给它们分配具体角色。
我并不认为这在所有情况下都绝对必要。但有时,我有一项需要投入大量工作的任务,比如替我持续关注 Twitter。它的工作量可能大到足以占用一整个 Dot。这样的 Dot,你可以有几个。
OpenAI 的开放生态与插件收入分成
Lenny:回顾最近发布的所有东西,Dots 可能是最吸引眼球的。有没有什么你认为还没有得到应有关注,但未来会变得非常重要的东西?也就是大家还没充分意识到、却对整体愿景很重要的部分。
Tibo Sottiaux: 我认为,被低估的是生态系统:把整个体系开放出来,以及我们对全面开放的坚定承诺。我们已经签下了 16 家合作伙伴,我对此非常自豪。
这件事其实是去年很自然地开始的。当时,我和 Pi、OpenCode 的开发者交流,觉得用户理所当然应该能使用 Codex 登录,并使用自己的额度。
于是,我们相当于在线上握了握手,说:“你们直接用这个认证机制就好,我们相信你们不会做什么不当的事情。”
后来,这种方式越来越受欢迎。现在,我们把它变成了一项正式支持的机制,与许多合作伙伴共同推进。我很期待迅速扩大这方面的合作。另一方面,我们也在开放基础设施,以及我们构建 ChatGPT 的方式,包括插件扩展、插件发现,让任何人都有机会把自己的产品带给大约 12 亿用户,并从这样的分发能力中受益。
我们还设计了收益分享机制,只是没有在主题演讲中提到。对于受欢迎、使用量大的插件,我们会支付报酬,它们也会获得一部分收入分成。
我认为,这种对开放生态的承诺,会带来非常令人期待的发展。
Lenny:举个例子,假设有人在 ChatGPT Work 里使用 Notion 或 Figma 插件,Notion、Figma 就能因为用户在应用内使用它们而获得收入,对吗?
Tibo Sottiaux: 是的。我们有很多使用 ChatGPT 的订阅用户,他们会获得一定的使用额度。当用户把这些额度用在插件上,或者通过“使用 ChatGPT 登录”在其他产品里使用额度时,我们会与相应的合作伙伴分享收益,让它们获得报酬。
Lenny:插件和生态系统让人兴奋的一个原因,是它们能成为分发平台,帮助产品被发现:“人们发现了我的应用,然后它迅速火了起来。”对于希望自己的插件脱颖而出、被更多人发现的开发者,你有什么建议?
Tibo Sottiaux: 做一个好的插件。我们的机制是这样的,当然,系统还会继续调整:我们会看用户留存数据,看插件是否成功、质量如何,再据此开始在对话中向用户推荐。这样,你的插件就有机会被推荐给相当一部分用户。但如果插件不够好,系统就会停止推荐。
Lenny:你们会关注使用某个插件的用户是否留下来,这一点很有意思。
Tibo Sottiaux: 我们要看,它是否真的增加了实用价值,是否让 ChatGPT 能够完成更多事情。
Lenny: 明白了。所以,重点并不是做 AEO,也就是通过选对词、让更多人写文章提到你,来提高被 AI 推荐的机会;而是人们是否持续使用你的产品,是否愿意留下来。
Tibo Sottiaux: 是的。
Lenny:所以,你认为这是一项目前被低估、以后会变得很重要的东西。我知道,这也算你们的第二次尝试,之前已经做过应用市场。
Tibo Sottiaux: 这次的方向是对的。
Lenny: 好,这次会成功。我们再回到 Dots,因为它似乎是未来愿景的重要组成部分。
Dots 背后的研究积累
Lenny:你们什么时候开始做 Dots 的?之前,OpenClaw 引发了很大关注,Peter 加入了你们,也成立了一个基金会。此外,还有 Grokbot、Muse、Instinct 等产品。你们已经做了多久?为什么到现在才推出产品?
Tibo Sottiaux: 你还记得 Codex Cloud 吗?
Lenny:记得,就是最早那个版本,大概是一年前,对吧?
Tibo Sottiaux: 如果回头看看 Codex Cloud,以及我们当时使用的那段小动画,我觉得,那可能就是 Grokbot 的灵感来源。它们非常相似,我甚至会说,相似得有些不可思议。但认真来说,在研究层面,我们开展持续运行、长时间跨度任务的研究,已经超过两年了。能够保持连贯一致的记忆系统,我们也研究了差不多同样长的时间。
其中很多能力,我们已经直接放进了 ChatGPT。我觉得,用户很喜欢 ChatGPT 能够了解这么多与自己有关的信息。我和很多人聊天时,他们都会分享这样的故事:“我生病了,ChatGPT 居然记得,我之前参加过一次烧烤,用过青柠,还调过龙舌兰酒。所以,我手上的灼伤可能与青柠有关,是一种晒伤。”他们会问:“它怎么会知道这些?”
这是因为,ChatGPT 的记忆功能已经运作得非常好了。我们在这方面投入了大量研究。
这些能力结合在一起,以 Codex 的智能体运行框架,也就是 harness 为基础,再加上能够全天候持续运行、有效完成工作的能力,就形成了这次发布的 Dots。所以,这是经过很多个月工作积累的成果。
另外,确保产品的安全性和系统安全也非常重要。这也是我们选择搭载 Astra 推出 Dots 的原因:它是我们最安全、最符合对齐目标的模型。为了让 Dots 真正安全、可靠,我们投入了更多努力。
Lenny:我喜欢问来参加播客的嘉宾一个问题:随着 AI 承担越来越多的工作,你认为自己在哪些工作中仍然不可或缺?长期来看,人类大脑在哪些方面仍然有用,或者最有价值?
Tibo Sottiaux: 我认为,这在很大程度上取决于我们如何构建技术。在 OpenAI,我们设计所有东西时,都把人放在中心,把技术构建成人的延伸,成为你的意志和品味的延伸,让它真正成为一种赋予人能力的工具。
只要我们继续沿着这个方向走,让技术帮助你实现想做的事情,扩展你的创造力和品味,而且在使用时让你感觉非常好,那么它实际上就是一种创作工具。
未来,我们可能不再有专门写代码的人,但会有比以往更多的创造者。我认为,这件事里仍然会保留一些深刻的人性:人们希望学习,也希望看看其他人正在创造什么。
我更感兴趣的也是这些。我在这里,是在和你交谈,而不是在和 Dot 交谈。我认为,这一点在很长、很长一段时间里都不会改变。
Lenny:工程师的工作生活发生变化后,出现了一个现象:他们需要更频繁地切换上下文。还有一种逐渐出现的孤独感,因为他们整天都在和智能体交谈,而不是和其他人交流。你会在多大程度上考虑 AI 对人们生活的这些影响?有没有办法解决这些问题,或者让这种体验不那么烦人?
Tibo Sottiaux: 会,我们一直在考虑。减少配置带来的疲劳,是其中一个方向。另一个方向,是改变与智能体交互像是一场“独自冒险”的状态:你只和自己的一个智能体对话,之后又有了很多智能体,要把大量事情分别委派给它们。
很多方面的改进会结合起来,让整个体验更加愉快。我和团队都花了很多时间思考这些问题。
对我来说,理想的工作方式,是让它直接存在于你所在的物理空间里。我们像现在这样交谈,它能够观察、理解我们提出的想法。
我们可以在纸上写点东西,它就能接收这些内容,开始在后台构建。然后,你说:“其实,我还有另一个想法。”它就开始构建另一件东西。
你可以把结果投到屏幕上,直接和它说话。它也能参与人与人之间的对话。这样,你就不需要一直盯着屏幕、不断琢磨该怎么写提示词,也就没有了这种疲劳感。整个过程会变得非常自然。
这就是我们正在走向的方向。今天还没有完全做到,但未来会做到。
因为 AI 能做更多
人就必须做更多吗?
Lenny: 沿着这个话题,还有一个已经出现的负面影响:因为我们能做更多,所以就承受了必须做更多的压力。大家会说:“来吧,同时运行 30 个智能体。你为什么没有交付更多?别人都在交付更多。”你认为这个问题能够解决吗?还是说,这就是人的天性:既然能做更多,那就做更多?
Tibo Sottiaux: 我们也听到 Sam 谈过这项技术的承诺:减少噪声,让你把注意力放在自己真正想关注的地方。现在有很多事情,也许重要,也许不重要,但都在争夺你的注意力。我们希望降低这些干扰,让你能够专注于真正需要关注的事情。
我发现一个很明显的现象:每次度假,用一周时间彻底断开与工作的联系后,我就会开始用不同的、更有创造力的方式思考。我非常期待看看,我们能否把这种状态带进日常生活。也许你需要参加的会议可以更少,也许你不需要做那么多事情。实际上,如果休息得更好,你可能反而更有生产力。
我认为,整个行业都需要一起弄清楚这件事。但这才是 AI 所承诺的价值,而不是让你每秒再多输入一条提示词。
Lenny:我现在正在做一个机器人,类似于“精力审计助手”。它会查看我的日历,然后问我:“这件事是在给你补充精力,还是在消耗你的精力?这件事能不能交给别人做?”我觉得,AI 应该会对我说:“Lenny,也许你可以删掉这些安排,让自己过得更开心。”
最近,你有没有用 AI 做过什么特别有意思的事情,让你觉得:“这太厉害了,真的让我大开眼界。”或者,你有没有听别人分享过这样的案例?
Tibo Sottiaux: 确实有一件有意思的事。不过,刚才的现场演示当着所有人的面失败了,这本身当然不是什么好事。但实际上,我的 Dot 知道我正在参加 DevDay。当时,我们的 ChatGPT 生产环境出了故障,它就在最后一场演示开始前五分钟提醒了我。
这其实让人很紧张。它说:“生产环境出故障了。你想让我试着修复吗?”我当时想:“小 Dot,我觉得你还没有这个能力,不过谢谢你愿意试一试。”之后,我联系了工程团队,我们开始排查发生了什么。现在,问题已经修复了。
让我觉得了不起的是,它能够理解这些事情之间的关系:有一场很重要的活动,叫 DevDay;有一个生产系统;还有一场现场演示,而这场演示很可能会用到这个生产系统。所以,这两件事情是有关联的。演示将在五分钟后开始,我应该提醒他,因为他很可能希望知道这个情况。
我认为,这相当了不起。
Lenny:确实很了不起。它知道接下来要发生什么,然后提前告诉了你。而且,我很喜欢它主动提出修复问题,你则说:“还不行,你还没到那个水平。”
Tibo Sottiaux: 我没有说:“那你去试试,让我刮目相看吧。”不过,如果真那么做了,这个故事可能会更精彩。
Lenny:你怎么看给它开放这么多访问权限?比如,它能访问生产环境的代码库吗?
Tibo Sottiaux: 它可以访问部分生产系统,但有相应的安全限制。我们刚才谈到过专门承担某些任务的 Dot。这些专用 Dot 会在额外的安全限制和监控下运行,并使用各自的硬件。实际上,我们有些 Dot 就运行在 Mac mini 上。
我们构建 Dots 的方式有一个根本区别:智能体运行框架,也就是 harness,并不运行在它所操作的那台机器上。大家可能还没有意识到,这意味着它可以连接任意数量的设备。它有自己的计算机,你也可以把它连接到自己的笔记本电脑上。以后,你可能会把它连接到十台不同的设备,而它可以控制所有这些设备,有点像一只章鱼。
Lenny:所以,你是在和自己的 Dot 交谈。它存在于某个地方的一台虚拟机里?
Tibo Sottiaux: 它可能运行在虚拟机里,也可能不是。它是一个独立的系统,可以连接多台设备。
AI 时代,哪些技能正在变得更重要?
Lenny:我知道你们正在大量招聘,你也参与面试。在你考察的能力中,哪些技能正在变得越来越重要,越来越能决定一个人能否取得成功?又有哪些技能的重要性正在下降,让你觉得:“我们已经没有那么需要它了”?
Tibo Sottiaux: 一个重要性正在下降的技能,是打字快。它已经没有那么有用了。越来越重要的技能,包括出色的品味、从用户的角度思考,以及与自己服务的用户建立联系。很多曾经创业的人,或者连续创业者,现在都表现得非常出色。我们在 OpenAI 的招聘中也发现了这一点,公司里有很多创业者。
我想,目前 OpenAI 有超过 120 位曾经参加过 YC 的创业者。这里就像一家巨型初创公司。
那种希望做出真正有意义的东西的热情和渴望,以及知道什么才是好的东西,比以往任何时候都更重要。
Lenny:我一直认为,产品经理会在这个时代发展得很好,因为这基本上就是产品经理的工作:判断应该做什么,帮助别人把它做出来,再判断它是否正确、是否足够好,然后不断迭代。
Tibo Sottiaux: 我同意。另外,岗位之间的界限也正在变得模糊。你以前可能只做设计,或者只做工程,而且总觉得自己被这样的角色限制着,有些不自在。现在,正是你发挥的时候。
Lenny:你会怀念工作中做工程的部分吗?我以前也做过工程师,做了十年,你可能不知道。做工程时会进入一种心流状态。单纯地构建东西,看着它运行成功或者失败,本身就有一种美感。
你会怀念这些吗?还是觉得:“那已经是我过去的生活了”?
Tibo Sottiaux: 有一段时间,我确实很怀念。但现在,随着速度变得非常快,我又找回了这种感觉。所以,我非常希望尽可能让更多人都能获得这样的体验。
要让它真正普及,让超过十亿用户都能用上,还需要一段时间。但我们的速度已经很惊人了,即使我们在公司内部,也会惊讶:“原来我们已经能做到这些了。”这也与我们使用 Astra 有关,我们发现可以把它的能力推得很远。
有了这样的速度,尤其是能够通过语音控制之后,你会重新进入一种非常有创造力的思考状态,重新进入心流。这种心流和过去不一样,但我已经不再怀念过去的那种状态了。
OpenAI 内部如何开发和发布产品
Lenny: 说到 OpenAI 内部的工作方式,有哪些事情会让外界感到意外?从外面看,你们似乎一直在写代码、发布产品。整个过程有点混乱,但又很精彩。真正置身 OpenAI,有哪些情况会出乎大家的意料?
Tibo Sottiaux: 我不知道这是否会让人意外,但正如我刚才所说,我们有很多曾经创业的人,大家会自下而上提出许多令人兴奋的想法。
比如,Decisions API 就是在很短时间内做出来的。我们意识到,Luna 是一个非常好的模型,可以做一些约束采样,再通过一种不同于 Responses API 的接口形式把它发布出去。这样做,速度更快,在一些场景下的使用体验也很好。
如果你深入看看背后的过程,就会发现:最初是建了一个 Slack 频道,四个人在一个周末动手尝试。之后,它被开放给公司内部使用,大家开始感到兴奋,围绕它构建东西。
有人发现:“我们可以支持视觉输入,这甚至比外面已有的东西更好。”大家越来越兴奋,开始加入进来。整个过程看起来完全没有固定的组织结构,但大家会一路把它推进下去,最后发布成产品。
同时,我们也努力维持较高的质量标准。如果某些东西还不够好,就会在发布之前叫停,或者让它再打磨一段时间。原本还有更多东西可能在 DevDay 发布,但我们觉得:“今天已经很多了,先留下一些,把发布节奏分散开。”
所以,接下来还会有更多发布。这里有一种非常强烈的、自下而上的活力,人们会主动承担相应角色,把这些力量引导到能够产生实际成果的方向上。
Lenny:OpenAI 有一个非常明显、也很独特的特点:你似乎拥有很大的自主权。你可以随时按下额度重置按钮,也可以直接在 Twitter 上发表观点。这种文化很特别,赋予了你很大的自主权,我想背后也有很强的信任。能否谈谈这种文化理念?我觉得,这是 OpenAI 能够行动得更快的一个优势。
Tibo Sottiaux: 你会获得很大的自主权,但也必须为自己的决定负责。我们信任大家能够做出好的选择。如果出了问题,就迅速修复,或者从错误中学习。到目前为止,效果很好。这是一个能充分激发个人能力的环境。
确实,只要有必要,而且我认为合适,我就可以按下额度重置按钮。这是一种特权,也让我能够以其他情况下很难做到的方式,贴近社区。我不需要让这件事经过层层审批。
Lenny:你说过,有时大家也会犯错。在拥有这么多自主权和信任的情况下,你有没有搞砸过什么事情?
Tibo Sottiaux: 有。我觉得,有些时候,我本可以更好地激励团队,去构建复杂度更低的东西,持续朝着更简单的方向努力。Codex 早期也有几次由我造成的服务故障。
我刚加入 OpenAI 的第三天,就把生产环境弄宕机了。不过,出了这件事之后,我还留在公司,也从中吸取了教训。
Lenny:大家还希望我问你:未来一个月或者一周,可以期待多少次额度重置?
Tibo Sottiaux: 取决于我们把东西弄坏多少次。
Lenny:所以,这就是你们的原则:出了问题,就重置额度?
Tibo Sottiaux: 是的。出了问题会重置,有值得庆祝的事情也会重置。
Lenny:我们把视角拉远一点。关于未来的发展方向和即将发生的变化,你认为有哪些事情,大家还没有充分考虑到,也没有看得足够清楚?
Tibo Sottiaux: 我觉得,还有很多事情没有被充分考虑进去。第一,互联网上的大多数操作,将由智能体完成。第二,模型会以相当惊人的速度,变得更便宜、更快。第三,我们终于能够以真正无缝的方式,把所有模态整合起来。
这三点让我经常在看到外界正在开发的东西时,觉得:“你们还没有真正理解这件事。”
你们已经接近了,但如果再逼自己往前想一步,认真设想一年后,这些能力大致会比今天强十倍,你就会用不同的方式来构建产品。
Lenny:在大多数操作都由智能体完成的世界里,会出现什么进一步的影响?可能连大多数流量都会来自智能体。
Tibo Sottiaux: 是的。
Lenny:你认为,这会带来哪些后续变化?
Tibo Sottiaux: 会有很多。首先,如果希望自己的产品在智能体用户中取得成功,就必须按照相应的规模来构建它。比如,我们和 Notion 有非常紧密的合作。当他们构建了 MCP 接口后,突然之间,所有这些能够真正执行工作的智能体,都可以访问并使用它。
于是,他们看到了大量涌入的流量。这显然会给系统带来很大压力,而且你必须弄清楚背后的成本和收益关系。
这就带来了一种矛盾:开发产品时,你究竟要不要提供这样的接口?你可以暂时推迟,但这个趋势不可避免。大多数产品和服务都会由智能体来使用,所以,为这样的未来做好准备非常重要。
另一方面,我认为,我们对面向人的全新体验投入还不够。这些体验应该充分利用所有模态,真正让人用起来感到愉快。
Lenny:最后一个问题。现在的应用里,有什么东西让你觉得特别烦,忍不住想:“我们必须把它改掉”?
Tibo Sottiaux: 我觉得,模型的能力已经接近那个水平了,但还差一点:让应用本身几乎完全退到幕后。我迫不及待地想真正实现极致的简单。就连我自己,也会被模型选择器、推理强度,以及到底该用多智能体模式还是 Ultra 模式这些选项弄得疲惫。甚至连这些选项究竟做什么,都需要弄清楚。
你简直需要拿一个“模型选择器博士学位”。我只想尽快摆脱所有这些东西。
参考链接:
https://www.youtube.com/watch?v=MM-C3JqCXBk&t=2s
https://x.com/search?q=tibo&src=typeahead_click
声明:本文为 InfoQ 原创,不代表平台观点,也不构成投资建议,未经许可禁止转载。







