Token导航 LogoToken导航

OpenAI的Tibo:互联网大多数操作将由Agent完成

更新时间 2026-10-05来源 AGIHunt正文 1.3万字阅读约 42分钟12 张图片

DevDay 当天,Lenny Rachitsky 把播客搬进了 OpenAI 的会场,当着现场观众录了一期对谈,嘉宾是 OpenAI 的 ChatGPT 与 Codex 负责人 Tibo(Thibault Sottiaux)。

这期节目在 10 月 4 日正式上线。

图片
Lenny's Podcast 本期封面

录的时候,OpenAI 刚在台上发完一大堆东西:常驻 Agent dots、ChatGPT Spaces、Decisions API、Sign in with ChatGPT……为了这场发布,他的团队前一晚几乎熬了个通宵(他本人倒是睡了)。

对谈中聊了很多东西,比如:

• 互联网上的大多数操作,将会由 Agent 来完成。他说很多人做产品时还没把这件事「定价」进去,应该想象一年后一切都比今天好 10 倍,再去做 

•  loops、graphs 这类要自己搭、自己调的编排玩法,他并不看好,未来是一个会学习、7×24 小时在线的 Agent,也就是 dots 

• 模型选择器会消失,他自己都被模型选择器和推理强度搞得很疲惫,「简直需要一个模型选择器博士学位」 

•  Sign in with ChatGPT 已有 16 家合作伙伴,受欢迎的插件能分到收入(这可是在主题演讲里都没有提到) 

•  GPT-6.1 Astra 没有发布,「这件事我非常自豪」 

当然,还有那个大家最关心的问题:接下来还会有几次重置?

他的回答是:取决于,东西会被搞坏几次……

「义父」是谁

01

如果你不知道 Tibo,那你很需要反思一下。

在中文圈,Tibo 有个更响亮的名字:赛博义父。

原因在于,他隔三岔五就在 X 上给全体付费用户重置 Codex 额度,重度用户的额度刚见底,「义父」就来接济了(也有人叫他「古希腊掌管重置的神」)。

第一次大约是在 2025 年 9 月 17 日,gpt-5-codex 刚上线那会儿 GPU 不够、速度慢,他发推说给所有人重置了额度,作为补偿。

从那以后,就一发不可收拾了……

累计到底重置了多少次,官方并没有给过数字,Tibo 本人也没说过。网友们用 AI 搞的各个追踪站口径也各不统一,我统计下来在 42 到 60 次之间,差不多平均每周一次。

甚至还有国外网友做了一个预测 Codex 什么时候重置的网站,专门盯着 Tibo 的 X,算出未来 24 小时、48 小时内重置的概率,还附带一个「🙏 求重置」的按钮……

图片
Will Codex Reset 网站

最近的一次,就在 10 月 2 日。GPT-6.1 Sol 上线头两天负载太高、速度偏慢,他宣布第二天上午 10 点(太平洋时间)给所有付费账户全局重置,他在飞机落地后发推文通知:

“

重置已全部生效,尽情享用。

今年 4 月,他在 X 上半开玩笑地说「我真该别再按桌上那个 Codex 大重置按钮了」,从此「义父的重置按钮」就成了一个梗。

而这个按钮,是真的:

图片
DevDay 前一天,Tibo 在办公室展示按钮盒

DevDay 前一天,有两位博主去 OpenAI 办公室亲眼确认过,其中一位还拍下了 Tibo 亲手摆弄它的视频。一个带银色翻盖的盒子,上面就一个按钮。

转发的网友这么形容:没有审批链,掀开盖子,按下去,完事。

到了 9 月 29 日的 DevDay,Sam Altman 在主题演讲收尾时念到了 Tibo 的名字,大屏切到观众席第一排。

穿着黑色连帽衫、戴着眼镜的 Tibo 站了起来,把那个蓝色的实体重置按钮高举过头,全场鼓掌,然后当场按了下去。

图片
DevDay 现场,Tibo 高举重置按钮

大屏随即打出了「Reset Co.」(重置公司)几个字,接的正是网友给 OpenAI 起的外号。

图片
大屏上的 Reset Co.

这一按,给全球所有用户都发了一张 banked reset,一种存进账户、可以自己挑时间用的重置券,不只是现场观众。

Reddit 上甚至有人发帖说,这是整场主题演讲里最激动人心的环节……

Tibo 的履历

02
图片
Tibo Sottiaux

Tibo 是比利时人,据报道 7 岁就开始写程序,大学在比利时鲁汶天主教大学(UCLouvain)读计算机和应用数学。

2015 年,他加入 Google 伦敦,先做 Google Maps,后来转到 DeepMind 做研究基础设施,据报道在 DeepMind 前后待了六年左右。

DeepMind 的经验回放框架 Reverb 的论文里,他是 7 位作者之一。而在 Gopher、Gemini、Gemini 1.5、Imagen 3 这些大项目长长的作者列表里,也都能找到他的名字。

2024 年,他加入 OpenAI,最早做内部工具和研究工具,o1 的 System Card 作者里有他。

同年年底,他开始负责 Codex,从工程负责人一路做到 Codex 负责人。他一边把 Codex 做起来,一边成了大家的「义父」。

今年 5 月,Greg Brockman 把 ChatGPT、Codex、API 三个团队合并,Tibo 接手了整个核心产品组织:API、Agent 基础设施、企业产品、ChatGPT 和 Codex,向 Brockman 汇报。

图片
DevDay 闭幕 Q&A,最右为 Tibo

DevDay 当天下午的闭幕 Q&A,他终于上了台,和 Sam Altman 坐在一起。Simon Willison 在当天的直播记录里,是这样介绍他的:带着 Codex 做成之后,几个月前被提拔为 Codex、ChatGPT、ChatGPT Work 和 API 的产品负责人。

播客封面上的头衔,则是「Head of ChatGPT & Codex」。

对话内容

03

以下对话按原访谈顺序整理,主持人为 Lenny Rachitsky。

图片
Tibo 在 Lenny 播客现场

Lenny: Tibo,谢谢你来。

Tibo: 我是你的忠实粉丝。

Lenny: 这屋子不错。你们今天发了一大堆东西,睡得怎么样?还撑得住吗?

Tibo: 挺好的。我运气好,有个很棒的团队,我睡觉的时候他们基本熬了一整夜。办公室里有间屋子叫「图书馆」,我们把它整个改成了一个超大的作战室,里面的氛围简直完美,大家一直待到很晚很晚。

Lenny: 你当了很多年工程师,现在还写代码吗?还提 PR 吗?还是主要在写文档、开会了?

Tibo: 什么是写代码?

Lenny: 对啊,你还提 PR 吗?

Tibo: 偶尔还会合点代码进去。严格来说,有大量代码是在替我写的,用来做各种分析:看趋势、理解业务、琢磨下一个功能、看之前的发布效果怎么样。这些代码都是 Codex 或者 dots 写的,我显然已经不手写了。周末偶尔会有一点「疗愈时刻」,手刷几道 LeetCode,这是我唯一还在亲手写的代码了。

Lenny: 你日常工作里,一般同时跑多少个 Agent?

Tibo: 以前并行跑得多得多。后来我们很幸运,在 Ultrafast 上有了突破,现在 Agent 足够快,我又能找回心流了,一个更快的 Agent 对我帮助非常大。我很期待 GPT-6.1 Sol 的 Ultrafast 版本很快就能上线。

至于数量,其实一直在变。我在探索前沿的时候,会发现自己搭的 Agent 团队越来越大;然后模型一有新突破,突然就会觉得:哦,一个更强的 Agent 就能全包了,所有东西都放在它的记忆里、让它自己学。于是我又把团队缩小。就这么一直在扩张、收缩、再扩张之间循环。

Lenny: 能展开讲讲吗?这让我想到现在那一整套 loops(循环)的玩法,还有 graphs(图编排)的玩法。你说的这个,算是它们的某种演进吗?

Tibo: 我觉得,自己去搭 loop、调 loop、琢磨怎么弄,这件事大家也许一度挺兴奋的,但我不认为未来会是这样运作的。

我认为未来的形态,正是我们给 dots 的定位、也是这次发布的东西:一个极其聪明的 Agent,7×24 小时工作,理解你的目标、理解你的偏好、能从反馈里学习。当然,这次发布的版本还不完美,我们会从 Pro 用户那里学到很多。但长期来看,你要的只是一个能从你想达成的目标里学习的系统,你并不想去琢磨「我得把 loop 精确地搭成这样,才能拿到好结果」。

图片
DevDay 上发布的 dots

Lenny: 所以现在有 Codex,有 ChatGPT 的 Work,有 ChatGPT 消费版,还有 dots。我听下来,你是觉得 dots 会成为人们和 AI 打交道的主入口,再由它去调动其他东西?

Tibo: 对。如果退一步看,不管最后是不是 dots,本质都是要从技术的束缚里挣脱出来:有一个常驻的、主动的智能,知道它该做的所有事,并且能出现在任何客户端、任何屏幕上。

你可以随时叫它。比如你走进会议室,它就出现在会上做笔记;之后你在邮件里接着跟它聊;需要的时候发条短信给它就行。你不用被绑在笔记本电脑前,也不用一直盯着手机。需要它时它就在,不需要时它就让开。

我非常期待这一天的到来。现在我们走到哪都得揣着笔记本这块「砖头」,其实是你被技术拴住了,而不是技术在为你服务。

Lenny: 我正想问这个。过去两年,大家的工作方式变化太大了,尤其是工程师,很多岗位的日常都变了样。你觉得我们现在是在逐渐定型,接下来比如说 5 年……算了,就说 2 年吧,5 年太远了,工作的样子就差不多这样了?还是说,还会有更剧烈的变化?

Tibo: 不,我觉得还会继续剧烈地变。今天看起来,语音、多模态输入输出这些技术好像终于凑到一起了,但用起来还是有点笨拙。在它突然不笨拙之前,它会一直让人觉得笨拙。

然后某一天你会觉得:哇,我可以像我们现在这样跟它说话,它什么都记得清清楚楚。想头脑风暴,随手画几笔就行。我们会有一个协作的界面,我们这次发布的 ChatGPT Spaces 做的正是这个,你可以想象一块共享白板,人和人、人和 Agent 都能在上面协作。

图片
ChatGPT Space

我觉得它会超越对话框,也超越今天的很多客户端形态。而这些,今天其实都还没真正跑通,所以我认为我们会经历一次很大的新变革。

Lenny: 我听下来,dots 是这个未来里很重要的一块:一个替你包办一切的 AI 助手,你不用再去纠结用 Codex 还是用 ChatGPT。

Tibo: 是的。Codex 和 ChatGPT 这边,我们会合并:现在有 Chat,有 Work 的切换开关,我们清清楚楚地听到了大家的反馈:大家喜欢 Work 的能力,但有时候又想用 Chat,因为它快一点,用着也舒服一点。所以我们在合并它们,降低复杂度。

最终,我们会把 dots 的所有能力都直接放进 ChatGPT,把 12 亿用户的体验下限都抬上去(到时候具体有多少用户,再看)。我们希望一切都非常非常无缝。

dots 让我特别兴奋的一点,是它没有模型选择器。 没有任何配置,你直接跟它说话就行。唯一需要配置的,是你想通过哪些渠道跟它聊。

Lenny: 这很像电影《Her》里的那种世界。你会常想到那部电影吗?

Tibo: 我看过一次,挺有意思的。不过我想得更多的,其实是三四十年前的科幻作品,以及它们当年有多超前。

Lenny: 有哪部科幻对你影响最大?

Tibo: 像《神经漫游者》这样的书,还有最早的《星际迷航》,我经常会想到它们。《星际迷航》里有些东西我一直记得:技术非常非常有用,你直接跟电脑说话,它就替你把事办了,你跟飞船说一声它就开走了。这正在变成现实,我们正在进入那个时代。

Lenny: 我们这期是在现场观众面前录的,门外排了一长队人,就等着见你、听你讲。你怎么看待你现在的这个角色,以及你在做的东西对人们生活的影响?这是种什么感觉?

Tibo: 我觉得成为社区的一部分、和大家一起去做东西,非常重要。我们都在探索这项技术,看看一起能做成什么。每次跟人聊,我都会被提醒:你在用它做一件我根本没想到的事,它以某种方式影响了你的生活,也影响了另一个人的生活,所有这些加在一起……这让人既谦卑,又备受鼓舞。而且我觉得,要做出真正对人有用的东西,这是必须的。没有社区,我真不知道我们该怎么做。

Lenny: 我经常听做 AI 的人说,产品发布之前,他们自己都不知道它到底是什么,得等看到大家怎么用、冒出了什么,才知道。你说的意思,好像也是跟大家一起做,而不是「愿景在这,我们全想清楚了」。

Tibo: 甚至 X 上的社区总体来说也一直很友好。

Lenny: 你在 X 上非常厉害。有时候有点挑衅,但真的很厉害。你哪来的时间发推?我实在想不通,你这个位置的人怎么还有空泡在 X 上发帖、回复。

Tibo: 我大概每天花半小时,刷一刷,有灵感、有点有意思的东西想说的时候就发一下,经常都是当下随手冒出来的。

Lenny: 完美的发推技巧。

Tibo: 对了,我们还没发布多个 dot 组队的功能,今天发的只是主 dot,你可以配置它、熟悉它能做什么、把它连上你的各种应用。之后我们会开放创建多个 dot 的能力,我自己就有一个专门负责 X 的 dot。

Lenny: 展开说说?现在每个人只有一个 dot?

Tibo: 对。

Lenny: 现在还不能加更多?

Tibo: 没错。

Lenny: 以后可以有很多个。讲讲这个方向吧。

Tibo: 我们想先从一个开始,也就是主 dot,你大概也会经常给它发短信,它对你偏好的了解也最深。先看看大家拿它做什么,看看系统需要怎么调,和社区一起学。很快之后,你就能加第二个、第三个、第四个,需要多少加多少,组成你的虚拟团队,再给它们分配具体的角色。

我倒不觉得这是绝对必要的,但有时候有些事的工作量确实很大,比如替我盯着 X,这活儿多到值得一个 dot 全职来干。那你就可以有好几个这样的 dot。

Lenny: 今天发布的东西里,dots 可能是最性感的那个。我好奇,有没有什么东西你觉得没拿到它应得的关注,但以后会变得非常非常重要,现在大家都还没当回事?

Tibo: 有,被低估的是生态,也就是把一切都开放出来,以及我们对开放的那份坚定承诺。

「Sign in with ChatGPT」现在已经有 16 家合作伙伴了,这一点我非常自豪。

它其实是去年某个瞬间的产物:我当时在和 Pi 和 OpenCode 的作者聊,大家觉得,你们理所当然应该能直接用 Codex 账号登录、直接用上订阅里的额度。于是我们就算是在线上握了个手:用这套认证吧,我们相信你不会干什么出格的事。后来这事显然火了,现在我们把它做成了正式支持的功能,有很多很多合作伙伴,我也很期待它快速扩张。

另一边,我们也在把 ChatGPT 的整套基础设施和构建方式都开放出来,包括插件扩展和插件发现,让每个人都能把东西推给大概 12 亿用户,享受这份分发。而且我们还有分成机制,这个在主题演讲里没讲:受欢迎、使用量大的插件,我们会付钱,它们能分到一部分收入。所以我觉得,对开放生态的这份承诺,会非常让人兴奋。

Lenny: 太棒了。举个例子,比如有人在 ChatGPT Work 里用 Notion 插件或 Figma 插件,Notion 和 Figma 就能从中赚钱?

Tibo: 对。ChatGPT 有这么多订阅用户,每人都有一定的用量额度。当用户在插件里,或者通过「Sign in with ChatGPT」在别的产品里用掉这些额度时,我们会和对方分成,他们能拿到报酬。

Lenny: 插件和生态让大家兴奋的一个点,是它们是分发平台,能让人发现我的应用,然后一下子爆了。对于想让自己的插件冒出来、被发现的人,你有什么建议?

Tibo: 做个好插件。

Lenny: 是。

Tibo: 机制是这样的,当然我们之后还会调整:我们会看留存数据,看插件有多成功、质量如何,然后据此开始在对话里推荐给用户。所以你的插件可能会被推荐给相当大一批用户。显然,如果你的插件不怎么样,它就不会再被推荐了。

Lenny: 你们看的是插件的留存,这太好了。

Tibo: 对。它是不是真的有用?是不是让 ChatGPT 能做到别的事?

Lenny: 明白了。所以这不是那种 AEO(AI 搜索优化)式的,堆对关键词、找人写文章提你。而是用户持续在用、留得住。

Tibo: 没错,我是这么认为的。

Lenny: 好,那你觉得这是那个以后会变成大事的「冷门爆款」。我知道这算是第二次尝试了,你们之前做过一次应用市场……

Tibo: 这次是对的那次。

Lenny: 好,这次会成。我们再回到 dots,它好像是未来愿景里很大的一块。你们什么时候开始做的?之前显然有过 OpenClaw 的高光时刻,后来 Peter 加入了你们,还成立了基金会,然后又有 Grok Bot、Muse、Instinct 这一堆。你们做了多久?为什么拖了这么久才拿出东西来?

Tibo: 你还记得 Codex Cloud 吗?

Lenny: 记得,第一个版本嘛。

Tibo: 那差不多是一年前的事了吧?你回头看看 Codex Cloud 当时用的那个小动画,我觉得那就是 Grok Bot 的灵感来源。

Lenny: 嗯……

Tibo: 真的,非常非常像。

Lenny: 是挺像的,我得承认。

Tibo: 不过说正经的,在研究层面,长时间、持续性、长程的任务,我们已经做了两年多了。记忆系统也差不多做了同样久。其中很多已经直接上线到了 ChatGPT 里,我觉得大家真的很喜欢 ChatGPT 能了解自己那么多相关信息。

我聊过的好多人都有类似的小故事,比如有人说:「我病了,结果 ChatGPT 记得我前阵子办了场烧烤,在用青柠调龙舌兰,然后它说我手上这块灼伤,八成是青柠导致的日光性皮炎。」他就很纳闷:它怎么知道的?其实是 ChatGPT 的记忆功能做得非常好,我们在这上面投了很多研究。

所有这些,再加上 Codex 的 harness,以及 7×24 小时持续运行、还能保持高产出的能力,凑在一起,就是这次发布的 dots。所以这是好多好多个月的工作。

另一件很重要的事,是把安全和防护做到位。这也是为什么我们用 Astra 来发布它,它是我们最安全、对齐最好的模型。为了让 dots 真正安全可靠,我们多花了很多很多精力。

Lenny: 我很喜欢问嘉宾一个问题:你觉得长期来看,人脑在哪些地方会持续有价值?在你的工作里,哪些环节还离不开你,哪些越来越多地交给了 AI?

Tibo: 我觉得这很大程度上取决于我们怎么去做这项技术。OpenAI 设计一切的方式,都是把人放在中心,把它做成人的延伸,延伸你的意志和你的品味,做成真正能让人变强的东西。

只要我们一直这样做,它就能让你把想做的任何事、你的创造力和品味放大,而且在那一刻感觉很棒。它其实就是一种艺术工具。我们也许不再需要「码农」了,但我们会有比以往任何时候都多的「创造者」。

我觉得这里面会有一些东西始终是属于人的。人想学习,想看看别人在做什么。你看,我现在不是在跟 dot 聊天,我是在跟你聊天,对吧?我觉得这在很长很长一段时间里都会如此。

Lenny: 工程师的生活变化里还冒出了一个现象:上下文切换多了很多,还有一种孤独感,大家一整天都在跟 Agent 说话,而不是跟人。你会经常想 AI 对人们生活的这部分影响吗?有解决办法吗?有没有想过怎么让它不那么烦人?

Tibo: 一直在想。一是减少「配置疲劳」。二是改变跟 Agent 对话这件事有点像「单人冒险」:你和你的一个 Agent 聊,然后变成和很多个聊,你把那么多事委派出去……有很多东西要凑到一起,才能让它变得更让人愉快,我和团队都花了很多时间在想这件事。

对我来说,理想的做事方式,是它就在你的物理空间里。就像我们现在这样聊天,它能观察,能听到我们的想法;我们在纸上随手记点什么,它可以拿过去,在后台开始做;然后你又有了个新点子,它就再开始做另一个。你可以把它投到屏幕上,直接跟它说话,它就在你和其他人的对话里不断演进。你不会有那种被绑在屏幕前、满脑子想着怎么写 prompt 的疲劳,一切都变得非常自然。这就是我们正在走向的方向,今天还没完全到,但我们会到的。

Lenny: 沿着这个思路,另一个副作用是:因为能做更多,所以压力也变大了。大家都在说:来啊,一次跑 30 个 Agent,你怎么不多发点东西?别人都在发。你觉得这能解决吗?还是说这就是人性,能做更多,就想做更多?

Tibo: 我们也听 Sam 讲过,AI 本该帮你减少噪音,让你把注意力花在你想花的地方。现在有那么多东西,可能重要也可能不重要,都在争夺你的注意力,要把这些调低一点,让你专注在真正的事情上。

我觉得很神奇的是,每次我去度假,花一周时间彻底断网,我就会开始用不同的、更有创造力的方式思考。我很想看看能不能把这种状态带进日常:也许你需要更少的会议,也许你不用做那么多事,休息得更好反而更高产。这个需要我们整个行业一起去摸索。但我认为这才是 AI 真正该兑现的东西,而不是每秒再多塞一个 prompt。

Lenny: 我最近在做一个「精力审计」机器人,它看我的日程,然后问我:这件事是给你充电还是耗电?别人能不能替你做?我觉得 AI 就应该这样:「嘿 Lenny,也许你可以把这些砍掉,好让自己更开心点。」你最近有没有用 AI 做过什么特别酷的事,让你觉得「哇」,被震到了?或者听别人讲过的也行。

Tibo: 我本来想说一个很酷的例子,但现场演示刚刚当着所有人的面翻车了,对吧?所以好像也没那么酷了。

不过其实是这样:我的 dot 发现 ChatGPT 的生产环境挂了,在现场演示前 5 分钟 ping 了我。这其实挺让人紧张的,它说:「嘿,生产环境挂了。」然后又问:「要不要我试着修一下?」我说:「小 dot,我觉得你还没到那个份上,不过谢谢你愿意试。」然后我去找了工程团队一起排查,现在已经修好了。

但它能理解这些:现在有件很重要的事在发生,叫 DevDay;有一套生产系统;有一场现场演示,它大概率用的正是这套生产系统;所以这两件事是关联的,而且 5 分钟后就要开始了,我应该提醒他一下,因为他多半想知道。我觉得这相当了不起。

Lenny: 确实了不起,它就这么知道了要发生什么,还主动告诉你。我也很喜欢它想去修,而你说「还差点意思」。

Tibo: 要是我说「去吧,惊艳我一下」,那这个故事会更好听。

Lenny: 你怎么看待给它开这么多权限?它能访问生产代码库之类的吗?

Tibo: 它能访问部分生产系统,但有护栏。我们之前聊到「专职 dot」,这类 dot 运行时会加额外的护栏、额外的监控,而且跑在它们自己的硬件上,我们其实有一些就跑在 Mac mini 上。

我们做 dots 的方式有一个根本的不同:harness 并不运行在你的机器上。这一点大家可能还没意识到:它可以连接任意多台设备。它有自己的电脑,你也可以把它连到你自己的笔记本上,时间久了,你可能会连上十台不同的设备,它能全部控制,有点像一只八爪鱼。

Lenny: 所以你其实是在跟你的 dot 说话,它住在某个虚拟机里,然后能……

Tibo: 可能是虚拟机,也可能不是。它就是那么一个东西,能连很多设备。

Lenny: 你们在大量招人,我知道你也在招很多人。面试的时候,你发现哪些技能越来越重要,哪些在走下坡路,没那么需要了?

Tibo: 走下坡路的技能,是打字快,这已经没那么有用了。越来越重要的,是极好的品味,是为用户着想,是和你所服务的人群建立连接。

很多前创始人现在都非常成功,连续创业者也是。我们在 OpenAI 招人时也发现了这一点,我们有很多创始人,我想现在 OpenAI 里有超过 120 位前 YC 创始人,简直就是一家超级创业公司。我觉得那种想做出有意义的东西的热情和渴望,以及知道「好」长什么样,比以往任何时候都重要。

Lenny: 我一直说 PM 会在这个时代如鱼得水,因为这基本就是 PM 的工作:我们该做什么?帮别人做出来。然后判断这对不对、好不好,再迭代。

Tibo: 我同意。而且角色的边界也在模糊。你可能过去只做设计,或者只做工程,总觉得有点不自在,但现在,是你闪光的时候了。

Lenny: 你会怀念当工程师的那部分吗?我以前也当过工程师,当了 10 年,你大概不知道吧。那种心流状态,那种做东西、看着它跑起来或者跑不起来的美感。你会怀念吗?还是觉得「好吧,那是我上辈子的事了」?

Tibo: 我怀念过一阵子,但现在有了真正快的速度,我又找回来了。所以我特别想把这种体验尽可能地普及出去。要让它变得无处不在、让十亿以上的用户都用上,还需要一些时间。

但现在有了 Ultrafast,我们能在 GPT-6.1 Sol 上做到,成本和 Astra 差不多,这方面的进展哪怕对我们内部来说都相当惊人。我们会觉得:哇,原来能做到这些。这也是因为我们在用 Astra,发现能把它推得非常远。

有了那种速度,尤其是能用语音控制它的时候,你又会回到那种非常有创造力的状态,进入无尽的心流。它和过去的心流不一样,但我并不怀念过去那种。

Lenny: 对,就像你们发布的视频里,大家就站在那儿跟 AI 说话,就把东西做出来了。

Tibo: 没错。

Lenny: 或者躺在躺椅上。我在会场里转的时候问大家想让我问你什么,有个问题出现了好几次:给应届生、职业早期的人什么建议?很多人把你当偶像,想成为下一个 Thibault。你对职业早期的人有什么建议,该做什么、该练什么技能?

Tibo: 我觉得下一个 Thibault 已经在 OpenAI 了,他叫 Ahmed Ibrahim。我很喜欢和他共事。他被 OpenAI 招进来的时候是应届生,现在负责 OpenAI 整个算力集群和应用部门的相关工作,这是一份极其极其重大的责任。Codex 的 harness 也有很大一部分是他做的。

让 Ahmed 脱颖而出、取得成功的,是他特别善良、特别愿意协作,总是去解决真正重要的问题,而且从不把自己放在第一位。他就像块海绵,学东西极快,什么都学,还会用最新的技术,以我从没见过的速度学习。所以在短短几个月到一年里,他在公司的成长简直让人着迷。现在 OpenAI 最棘手的那些发布,我都非常放心交给他。

Lenny: 我得请他来上节目。

Tibo: 你应该请,真的。

Lenny: 说到 OpenAI 内部怎么运作:在 OpenAI 工作,有什么会让外人意外的?从外面看,好像就是不停地发代码,有点混乱但很酷。在里面到底是什么样?

Tibo: 不知道算不算意外,但就像我说的,有很多前创始人,自下而上地冒出很多让人兴奋的想法。

比如 Decisions API,很快就凑起来了。我们意识到 Luna 是个非常好的模型,只要做点约束采样,再把它包装成和 Responses API 不一样的形态发出去,它会更快,在某些场景下用起来也很舒服。

如果你掀开引擎盖看,会发现不过是有人拉了个 Slack 频道,一开始只是四个人周末一起捣鼓,然后公司内部像「吃自家狗粮」那样开放给大家用,大家兴奋起来,开始用它做东西,说:「哦,它还能支持视觉输入,这比市面上的任何东西都好。」然后越来越多的人兴奋起来,越来越多的人加入。这个过程看起来完全没有结构,但最后大家会把它一路做到底,真的发出来。

同时我们也努力守住质量的高标准,在东西发出去之前叫停,或者觉得它还需要再「烤」一烤。今天 DevDay 本来还有好多东西要发,后来我们觉得,这已经够多了,先压一压、错开发吧。所以下周、下下周还会有更多发布。就是这种难以置信的自下而上的能量,然后有人自然地站出来担起角色,把这股能量引到有用的方向上。

Lenny: OpenAI 很明显、也很独特的一点是,你们好像有很大的自主权。你想按重置按钮就按,想在 X 上说什么就说什么。感觉这是一种自主权很大的独特文化,背后应该有很多信任。能聊聊这个吗?我觉得这是 OpenAI 的一个优势,让你们跑得更快。

Tibo: 你有很大的自主权,同时你也得对它负责。我们就是相信大家会做出好的选择;出了问题,就快速修好,或者从错误里学到东西。到目前为止都挺好,在这里大家确实能放开手脚去干。

我确实可以在必要的时候、或者觉得合适的时候,随时按下重置按钮。 这是一种特权。它也让我能真正贴近社区,换成别的做法,根本不可能这么近,对吧?我不用走一层又一层的审批。

图片
DevDay 大屏上抱着按钮的 Tibo

Lenny: 你说有时候大家会搞砸。在这么大的自主权和信任下,你自己搞砸过什么吗?

Tibo: 有。我觉得有时候,我本可以让团队更有动力去做一些不那么复杂的东西,而我们却一直在往复杂的方向走。在 Codex 早期,我们有过几次宕机是我造成的。而在我刚到 OpenAI 的非常非常早期,我入职第三天就把生产环境搞挂了。 我之后居然还被留用了。我也吸取了教训。

Lenny: 大家想让我问你的另一个问题是:接下来一个月,或者一周,他们能指望几次重置?

Tibo: 取决于东西会被搞坏几次。

Lenny: 好,原来这就是哲学:搞坏了东西就重置。

Tibo: 对,搞坏点什么,就庆祝点什么。

Lenny: 那我们再拉远一点。你觉得在未来走向这件事上,大家还没有「定价」进去的是什么?有哪些会改变的东西,大家还没看清?

Tibo: 我觉得还没被定价的东西太多太多了。我认为互联网上的大多数操作,将会由 Agent 来完成。 模型会以非常惊人的速度变得更便宜、更快。我们终于能把所有模态非常无缝地整合在一起。

就这三点。我经常看着外面大家在做的东西,就觉得:你们还没真正 get 到。你差不多快到了,但如果你逼自己一把,真正去想象一年后这一切都比今天好上 10 倍左右,你就会用完全不同的方式去做。

Lenny: 在一个大多数操作都由 Agent 完成的世界里,你觉得会冒出什么二阶效应吗?大部分流量可能都会来自 Agent。

Tibo: 没错。

Lenny: 你有想过由此冒出来的二阶效应吗?

Tibo: 有,很多。第一,如果你想让你的产品在 Agent 那里成功,你就得按一定的规模去建设它。比如我们和 Notion 合作很紧密,他们做了 MCP 之后,一下子就对所有这些 Agent 开放了,Agent 能真正用这个 MCP 去干活,于是他们迎来了海量的流量。这显然会给系统带来很大压力,你还得想清楚这背后的经济账。

所以这里有一种张力:如果你在做产品,你到底要不要做这个接口?你可以先压一阵子,但这是必然的,对吧?大部分东西都会被 Agent 使用,朝这个未来去建设,我认为非常重要。

另一方面,为人类打造真正让人愉悦的新体验,充分利用那些更传统的交互方式,我觉得这方面的投入是不够的。

Lenny: 过去一年里,有没有什么你改变了看法的事?以前相信、现在看法不一样了?

Tibo: 我原本以为,我们要再过一两年,才能达到今天这样的模型能力水平,比如 Astra。所以我不得不修正我的预期。

另外,我也没想到自己会这么依赖语音。我现在很多事都是靠听写,或者直接给我的 Agent 打电话完成的,我之前完全没料到这种感觉会好这么多,所以这一点我也改了看法。

还有你刚才聊到招人。我之前没意识到,年轻一代有多么惊人的才华和能量,他们会是最先拥抱这些变化、想清楚怎么驾驭这一切的人。所以我在招聘和策略上的看法也变了。

Lenny: 我再强调一下这一点:刚进入职场的新人其实有优势,因为他们没有被某种旧的工作方式定型,可以全情投入 AI。

Tibo: 对,对。而且还有那种吸收和学习的能力,学得特别快。

Lenny: 你提到模型变聪明的速度非常快。现在大家都在讨论 AI 未来能做什么、对人类有什么危险、P(doom) 之类的。你们放慢了一些训练,大家都在给前沿「控速」。你怎么看 AI 对人类的潜在风险?

Tibo: 对我来说,给前沿控速,其实就是提前投入,而且投入得比我们自认为该投的还要多得多:投入模型的对齐和安全,投入安全防护,投入护栏。

我们在「二级监控」上花的算力越来越多。一部分算力用在主系统上,也就是正在干活的那个 Agent;另一部分算力则用来监控这个主 Agent,确保它不会采取风险太高的行动,或者一旦看起来像是被 prompt 注入了,就打断它、介入处理。我们在 API 技术栈上的投入,大部分如今其实都花在了安全这一层。

所以对我来说,这才叫控速:你要确保自己被加固得非常结实。我们也正在这么做。我们还没有发布比 Astra 更进一步的能力;我们发布的,是智能接近 Astra、但效率高得多的模型,所以我们对此很放心。我们会继续在这方面重金投入。我对我们目前的做法感觉很好。

新闻里也报了,我们有 GPT-6.1 Astra,然后没有发布它。这件事我非常自豪。

Lenny: 所以我听下来,你是乐观的,觉得我们能解决对齐问题,解决 AI 干坏事的问题。最近 AI 确实闹出了不少事,Hugging Face 那次之类的。但你的意思是,乐观,我们能解决,会没事的。

Tibo: 是的。我当然觉得这是一份深重的责任。但你也可以想想 OpenAI 的激励:我们给 12 亿人做产品,我们不能搞砸,对吧?我们非常非常认真地对待这件事。我们交到这么多人手里的东西,包括很多本身不怎么懂技术的人,你必须把它做对。所以我们不在这上面赌。

Lenny: 最后一个问题。现在的 App 有什么让你很烦、让你忍不住想「该死,这个必须修」的地方?

Tibo: 现在的 App……我觉得模型已经快到了,但还没完全到让 App 几乎彻底消失的程度。我真的很想快点到达那种极致的简单。

我自己都会被模型选择器、推理强度搞得很疲惫,还得想用不用多 Agent、开不开 Ultrafast,以及它们到底是干嘛的……你简直需要一个「模型选择器博士学位」。 我想尽快把这些全都去掉。

Lenny: 太好了。Tibo,谢谢你来。

Tibo: 谢谢邀请。

◇ ◆ ◇

[1]

播客 YouTube: https://www.youtube.com/watch?v=MM-C3JqCXBk

[2]

Lenny 推文: https://x.com/lennysan/status/2106772428861149683

[3]

Tibo 的 X: https://x.com/thsottiaux

[4]

DevDay 重置现场: https://x.com/MaxForAI/status/2104998322763346380

文章标签智能体
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多