DevDay 当天,Lenny Rachitsky 把播客搬进了 OpenAI 的会场,当着现场观众录了一期对谈,嘉宾是 OpenAI 的 ChatGPT 与 Codex 负责人 Tibo(Thibault Sottiaux)。
这期节目在 10 月 4 日正式上线。

录的时候,OpenAI 刚在台上发完一大堆东西:常驻 Agent dots、ChatGPT Spaces、Decisions API、Sign in with ChatGPT……为了这场发布,他的团队前一晚几乎熬了个通宵(他本人倒是睡了)。
对谈中聊了很多东西,比如:
• 互联网上的大多数操作,将会由 Agent 来完成。他说很多人做产品时还没把这件事「定价」进去,应该想象一年后一切都比今天好 10 倍,再去做
• loops、graphs 这类要自己搭、自己调的编排玩法,他并不看好,未来是一个会学习、7×24 小时在线的 Agent,也就是 dots
• 模型选择器会消失,他自己都被模型选择器和推理强度搞得很疲惫,「简直需要一个模型选择器博士学位」
• Sign in with ChatGPT 已有 16 家合作伙伴,受欢迎的插件能分到收入(这可是在主题演讲里都没有提到)
• GPT-6.1 Astra 没有发布,「这件事我非常自豪」
当然,还有那个大家最关心的问题:接下来还会有几次重置?
他的回答是:取决于,东西会被搞坏几次……
「义父」是谁
如果你不知道 Tibo,那你很需要反思一下。
在中文圈,Tibo 有个更响亮的名字:赛博义父。
原因在于,他隔三岔五就在 X 上给全体付费用户重置 Codex 额度,重度用户的额度刚见底,「义父」就来接济了(也有人叫他「古希腊掌管重置的神」)。
第一次大约是在 2025 年 9 月 17 日,gpt-5-codex 刚上线那会儿 GPU 不够、速度慢,他发推说给所有人重置了额度,作为补偿。
从那以后,就一发不可收拾了……
累计到底重置了多少次,官方并没有给过数字,Tibo 本人也没说过。网友们用 AI 搞的各个追踪站口径也各不统一,我统计下来在 42 到 60 次之间,差不多平均每周一次。
甚至还有国外网友做了一个预测 Codex 什么时候重置的网站,专门盯着 Tibo 的 X,算出未来 24 小时、48 小时内重置的概率,还附带一个「
求重置」的按钮……

最近的一次,就在 10 月 2 日。GPT-6.1 Sol 上线头两天负载太高、速度偏慢,他宣布第二天上午 10 点(太平洋时间)给所有付费账户全局重置,他在飞机落地后发推文通知:
“重置已全部生效,尽情享用。
今年 4 月,他在 X 上半开玩笑地说「我真该别再按桌上那个 Codex 大重置按钮了」,从此「义父的重置按钮」就成了一个梗。
而这个按钮,是真的:

DevDay 前一天,有两位博主去 OpenAI 办公室亲眼确认过,其中一位还拍下了 Tibo 亲手摆弄它的视频。一个带银色翻盖的盒子,上面就一个按钮。
转发的网友这么形容:没有审批链,掀开盖子,按下去,完事。
到了 9 月 29 日的 DevDay,Sam Altman 在主题演讲收尾时念到了 Tibo 的名字,大屏切到观众席第一排。
穿着黑色连帽衫、戴着眼镜的 Tibo 站了起来,把那个蓝色的实体重置按钮高举过头,全场鼓掌,然后当场按了下去。

大屏随即打出了「Reset Co.」(重置公司)几个字,接的正是网友给 OpenAI 起的外号。

这一按,给全球所有用户都发了一张 banked reset,一种存进账户、可以自己挑时间用的重置券,不只是现场观众。
Reddit 上甚至有人发帖说,这是整场主题演讲里最激动人心的环节……
Tibo 的履历

Tibo 是比利时人,据报道 7 岁就开始写程序,大学在比利时鲁汶天主教大学(UCLouvain)读计算机和应用数学。
2015 年,他加入 Google 伦敦,先做 Google Maps,后来转到 DeepMind 做研究基础设施,据报道在 DeepMind 前后待了六年左右。
DeepMind 的经验回放框架 Reverb 的论文里,他是 7 位作者之一。而在 Gopher、Gemini、Gemini 1.5、Imagen 3 这些大项目长长的作者列表里,也都能找到他的名字。
2024 年,他加入 OpenAI,最早做内部工具和研究工具,o1 的 System Card 作者里有他。
同年年底,他开始负责 Codex,从工程负责人一路做到 Codex 负责人。他一边把 Codex 做起来,一边成了大家的「义父」。
今年 5 月,Greg Brockman 把 ChatGPT、Codex、API 三个团队合并,Tibo 接手了整个核心产品组织:API、Agent 基础设施、企业产品、ChatGPT 和 Codex,向 Brockman 汇报。

DevDay 当天下午的闭幕 Q&A,他终于上了台,和 Sam Altman 坐在一起。Simon Willison 在当天的直播记录里,是这样介绍他的:带着 Codex 做成之后,几个月前被提拔为 Codex、ChatGPT、ChatGPT Work 和 API 的产品负责人。
播客封面上的头衔,则是「Head of ChatGPT & Codex」。
对话内容
以下对话按原访谈顺序整理,主持人为 Lenny Rachitsky。

Lenny: Tibo,谢谢你来。
Tibo: 我是你的忠实粉丝。
Lenny: 这屋子不错。你们今天发了一大堆东西,睡得怎么样?还撑得住吗?
Tibo: 挺好的。我运气好,有个很棒的团队,我睡觉的时候他们基本熬了一整夜。办公室里有间屋子叫「图书馆」,我们把它整个改成了一个超大的作战室,里面的氛围简直完美,大家一直待到很晚很晚。
Lenny: 你当了很多年工程师,现在还写代码吗?还提 PR 吗?还是主要在写文档、开会了?
Tibo: 什么是写代码?
Lenny: 对啊,你还提 PR 吗?
Tibo: 偶尔还会合点代码进去。严格来说,有大量代码是在替我写的,用来做各种分析:看趋势、理解业务、琢磨下一个功能、看之前的发布效果怎么样。这些代码都是 Codex 或者 dots 写的,我显然已经不手写了。周末偶尔会有一点「疗愈时刻」,手刷几道 LeetCode,这是我唯一还在亲手写的代码了。
Lenny: 你日常工作里,一般同时跑多少个 Agent?
Tibo: 以前并行跑得多得多。后来我们很幸运,在 Ultrafast 上有了突破,现在 Agent 足够快,我又能找回心流了,一个更快的 Agent 对我帮助非常大。我很期待 GPT-6.1 Sol 的 Ultrafast 版本很快就能上线。
至于数量,其实一直在变。我在探索前沿的时候,会发现自己搭的 Agent 团队越来越大;然后模型一有新突破,突然就会觉得:哦,一个更强的 Agent 就能全包了,所有东西都放在它的记忆里、让它自己学。于是我又把团队缩小。就这么一直在扩张、收缩、再扩张之间循环。
Lenny: 能展开讲讲吗?这让我想到现在那一整套 loops(循环)的玩法,还有 graphs(图编排)的玩法。你说的这个,算是它们的某种演进吗?
Tibo: 我觉得,自己去搭 loop、调 loop、琢磨怎么弄,这件事大家也许一度挺兴奋的,但我不认为未来会是这样运作的。
我认为未来的形态,正是我们给 dots 的定位、也是这次发布的东西:一个极其聪明的 Agent,7×24 小时工作,理解你的目标、理解你的偏好、能从反馈里学习。当然,这次发布的版本还不完美,我们会从 Pro 用户那里学到很多。但长期来看,你要的只是一个能从你想达成的目标里学习的系统,你并不想去琢磨「我得把 loop 精确地搭成这样,才能拿到好结果」。

Lenny: 所以现在有 Codex,有 ChatGPT 的 Work,有 ChatGPT 消费版,还有 dots。我听下来,你是觉得 dots 会成为人们和 AI 打交道的主入口,再由它去调动其他东西?
Tibo: 对。如果退一步看,不管最后是不是 dots,本质都是要从技术的束缚里挣脱出来:有一个常驻的、主动的智能,知道它该做的所有事,并且能出现在任何客户端、任何屏幕上。
你可以随时叫它。比如你走进会议室,它就出现在会上做笔记;之后你在邮件里接着跟它聊;需要的时候发条短信给它就行。你不用被绑在笔记本电脑前,也不用一直盯着手机。需要它时它就在,不需要时它就让开。
我非常期待这一天的到来。现在我们走到哪都得揣着笔记本这块「砖头」,其实是你被技术拴住了,而不是技术在为你服务。
Lenny: 我正想问这个。过去两年,大家的工作方式变化太大了,尤其是工程师,很多岗位的日常都变了样。你觉得我们现在是在逐渐定型,接下来比如说 5 年……算了,就说 2 年吧,5 年太远了,工作的样子就差不多这样了?还是说,还会有更剧烈的变化?
Tibo: 不,我觉得还会继续剧烈地变。今天看起来,语音、多模态输入输出这些技术好像终于凑到一起了,但用起来还是有点笨拙。在它突然不笨拙之前,它会一直让人觉得笨拙。
然后某一天你会觉得:哇,我可以像我们现在这样跟它说话,它什么都记得清清楚楚。想头脑风暴,随手画几笔就行。我们会有一个协作的界面,我们这次发布的 ChatGPT Spaces 做的正是这个,你可以想象一块共享白板,人和人、人和 Agent 都能在上面协作。

我觉得它会超越对话框,也超越今天的很多客户端形态。而这些,今天其实都还没真正跑通,所以我认为我们会经历一次很大的新变革。
Lenny: 我听下来,dots 是这个未来里很重要的一块:一个替你包办一切的 AI 助手,你不用再去纠结用 Codex 还是用 ChatGPT。
Tibo: 是的。Codex 和 ChatGPT 这边,我们会合并:现在有 Chat,有 Work 的切换开关,我们清清楚楚地听到了大家的反馈:大家喜欢 Work 的能力,但有时候又想用 Chat,因为它快一点,用着也舒服一点。所以我们在合并它们,降低复杂度。
最终,我们会把 dots 的所有能力都直接放进 ChatGPT,把 12 亿用户的体验下限都抬上去(到时候具体有多少用户,再看)。我们希望一切都非常非常无缝。
dots 让我特别兴奋的一点,是它没有模型选择器。 没有任何配置,你直接跟它说话就行。唯一需要配置的,是你想通过哪些渠道跟它聊。
Lenny: 这很像电影《Her》里的那种世界。你会常想到那部电影吗?
Tibo: 我看过一次,挺有意思的。不过我想得更多的,其实是三四十年前的科幻作品,以及它们当年有多超前。
Lenny: 有哪部科幻对你影响最大?
Tibo: 像《神经漫游者》这样的书,还有最早的《星际迷航》,我经常会想到它们。《星际迷航》里有些东西我一直记得:技术非常非常有用,你直接跟电脑说话,它就替你把事办了,你跟飞船说一声它就开走了。这正在变成现实,我们正在进入那个时代。
Lenny: 我们这期是在现场观众面前录的,门外排了一长队人,就等着见你、听你讲。你怎么看待你现在的这个角色,以及你在做的东西对人们生活的影响?这是种什么感觉?
Tibo: 我觉得成为社区的一部分、和大家一起去做东西,非常重要。我们都在探索这项技术,看看一起能做成什么。每次跟人聊,我都会被提醒:你在用它做一件我根本没想到的事,它以某种方式影响了你的生活,也影响了另一个人的生活,所有这些加在一起……这让人既谦卑,又备受鼓舞。而且我觉得,要做出真正对人有用的东西,这是必须的。没有社区,我真不知道我们该怎么做。
Lenny: 我经常听做 AI 的人说,产品发布之前,他们自己都不知道它到底是什么,得等看到大家怎么用、冒出了什么,才知道。你说的意思,好像也是跟大家一起做,而不是「愿景在这,我们全想清楚了」。
Tibo: 甚至 X 上的社区总体来说也一直很友好。
Lenny: 你在 X 上非常厉害。有时候有点挑衅,但真的很厉害。你哪来的时间发推?我实在想不通,你这个位置的人怎么还有空泡在 X 上发帖、回复。
Tibo: 我大概每天花半小时,刷一刷,有灵感、有点有意思的东西想说的时候就发一下,经常都是当下随手冒出来的。
Lenny: 完美的发推技巧。
Tibo: 对了,我们还没发布多个 dot 组队的功能,今天发的只是主 dot,你可以配置它、熟悉它能做什么、把它连上你的各种应用。之后我们会开放创建多个 dot 的能力,我自己就有一个专门负责 X 的 dot。
Lenny: 展开说说?现在每个人只有一个 dot?
Tibo: 对。
Lenny: 现在还不能加更多?
Tibo: 没错。
Lenny: 以后可以有很多个。讲讲这个方向吧。
Tibo: 我们想先从一个开始,也就是主 dot,你大概也会经常给它发短信,它对你偏好的了解也最深。先看看大家拿它做什么,看看系统需要怎么调,和社区一起学。很快之后,你就能加第二个、第三个、第四个,需要多少加多少,组成你的虚拟团队,再给它们分配具体的角色。
我倒不觉得这是绝对必要的,但有时候有些事的工作量确实很大,比如替我盯着 X,这活儿多到值得一个 dot 全职来干。那你就可以有好几个这样的 dot。
Lenny: 今天发布的东西里,dots 可能是最性感的那个。我好奇,有没有什么东西你觉得没拿到它应得的关注,但以后会变得非常非常重要,现在大家都还没当回事?
Tibo: 有,被低估的是生态,也就是把一切都开放出来,以及我们对开放的那份坚定承诺。
「Sign in with ChatGPT」现在已经有 16 家合作伙伴了,这一点我非常自豪。
它其实是去年某个瞬间的产物:我当时在和 Pi 和 OpenCode 的作者聊,大家觉得,你们理所当然应该能直接用 Codex 账号登录、直接用上订阅里的额度。于是我们就算是在线上握了个手:用这套认证吧,我们相信你不会干什么出格的事。后来这事显然火了,现在我们把它做成了正式支持的功能,有很多很多合作伙伴,我也很期待它快速扩张。
另一边,我们也在把 ChatGPT 的整套基础设施和构建方式都开放出来,包括插件扩展和插件发现,让每个人都能把东西推给大概 12 亿用户,享受这份分发。而且我们还有分成机制,这个在主题演讲里没讲:受欢迎、使用量大的插件,我们会付钱,它们能分到一部分收入。所以我觉得,对开放生态的这份承诺,会非常让人兴奋。
Lenny: 太棒了。举个例子,比如有人在 ChatGPT Work 里用 Notion 插件或 Figma 插件,Notion 和 Figma 就能从中赚钱?
Tibo: 对。ChatGPT 有这么多订阅用户,每人都有一定的用量额度。当用户在插件里,或者通过「Sign in with ChatGPT」在别的产品里用掉这些额度时,我们会和对方分成,他们能拿到报酬。
Lenny: 插件和生态让大家兴奋的一个点,是它们是分发平台,能让人发现我的应用,然后一下子爆了。对于想让自己的插件冒出来、被发现的人,你有什么建议?
Tibo: 做个好插件。
Lenny: 是。
Tibo: 机制是这样的,当然我们之后还会调整:我们会看留存数据,看插件有多成功、质量如何,然后据此开始在对话里推荐给用户。所以你的插件可能会被推荐给相当大一批用户。显然,如果你的插件不怎么样,它就不会再被推荐了。
Lenny: 你们看的是插件的留存,这太好了。
Tibo: 对。它是不是真的有用?是不是让 ChatGPT 能做到别的事?
Lenny: 明白了。所以这不是那种 AEO(AI 搜索优化)式的,堆对关键词、找人写文章提你。而是用户持续在用、留得住。
Tibo: 没错,我是这么认为的。
Lenny: 好,那你觉得这是那个以后会变成大事的「冷门爆款」。我知道这算是第二次尝试了,你们之前做过一次应用市场……
Tibo: 这次是对的那次。
Lenny: 好,这次会成。我们再回到 dots,它好像是未来愿景里很大的一块。你们什么时候开始做的?之前显然有过 OpenClaw 的高光时刻,后来 Peter 加入了你们,还成立了基金会,然后又有 Grok Bot、Muse、Instinct 这一堆。你们做了多久?为什么拖了这么久才拿出东西来?
Tibo: 你还记得 Codex Cloud 吗?
Lenny: 记得,第一个版本嘛。
Tibo: 那差不多是一年前的事了吧?你回头看看 Codex Cloud 当时用的那个小动画,我觉得那就是 Grok Bot 的灵感来源。
Lenny: 嗯……
Tibo: 真的,非常非常像。
Lenny: 是挺像的,我得承认。
Tibo: 不过说正经的,在研究层面,长时间、持续性、长程的任务,我们已经做了两年多了。记忆系统也差不多做了同样久。其中很多已经直接上线到了 ChatGPT 里,我觉得大家真的很喜欢 ChatGPT 能了解自己那么多相关信息。
我聊过的好多人都有类似的小故事,比如有人说:「我病了,结果 ChatGPT 记得我前阵子办了场烧烤,在用青柠调龙舌兰,然后它说我手上这块灼伤,八成是青柠导致的日光性皮炎。」他就很纳闷:它怎么知道的?其实是 ChatGPT 的记忆功能做得非常好,我们在这上面投了很多研究。
所有这些,再加上 Codex 的 harness,以及 7×24 小时持续运行、还能保持高产出的能力,凑在一起,就是这次发布的 dots。所以这是好多好多个月的工作。
另一件很重要的事,是把安全和防护做到位。这也是为什么我们用 Astra 来发布它,它是我们最安全、对齐最好的模型。为了让 dots 真正安全可靠,我们多花了很多很多精力。
Lenny: 我很喜欢问嘉宾一个问题:你觉得长期来看,人脑在哪些地方会持续有价值?在你的工作里,哪些环节还离不开你,哪些越来越多地交给了 AI?
Tibo: 我觉得这很大程度上取决于我们怎么去做这项技术。OpenAI 设计一切的方式,都是把人放在中心,把它做成人的延伸,延伸你的意志和你的品味,做成真正能让人变强的东西。
只要我们一直这样做,它就能让你把想做的任何事、你的创造力和品味放大,而且在那一刻感觉很棒。它其实就是一种艺术工具。我们也许不再需要「码农」了,但我们会有比以往任何时候都多的「创造者」。
我觉得这里面会有一些东西始终是属于人的。人想学习,想看看别人在做什么。你看,我现在不是在跟 dot 聊天,我是在跟你聊天,对吧?我觉得这在很长很长一段时间里都会如此。
Lenny: 工程师的生活变化里还冒出了一个现象:上下文切换多了很多,还有一种孤独感,大家一整天都在跟 Agent 说话,而不是跟人。你会经常想 AI 对人们生活的这部分影响吗?有解决办法吗?有没有想过怎么让它不那么烦人?
Tibo: 一直在想。一是减少「配置疲劳」。二是改变跟 Agent 对话这件事有点像「单人冒险」:你和你的一个 Agent 聊,然后变成和很多个聊,你把那么多事委派出去……有很多东西要凑到一起,才能让它变得更让人愉快,我和团队都花了很多时间在想这件事。
对我来说,理想的做事方式,是它就在你的物理空间里。就像我们现在这样聊天,它能观察,能听到我们的想法;我们在纸上随手记点什么,它可以拿过去,在后台开始做;然后你又有了个新点子,它就再开始做另一个。你可以把它投到屏幕上,直接跟它说话,它就在你和其他人的对话里不断演进。你不会有那种被绑在屏幕前、满脑子想着怎么写 prompt 的疲劳,一切都变得非常自然。这就是我们正在走向的方向,今天还没完全到,但我们会到的。
Lenny: 沿着这个思路,另一个副作用是:因为能做更多,所以压力也变大了。大家都在说:来啊,一次跑 30 个 Agent,你怎么不多发点东西?别人都在发。你觉得这能解决吗?还是说这就是人性,能做更多,就想做更多?
Tibo: 我们也听 Sam 讲过,AI 本该帮你减少噪音,让你把注意力花在你想花的地方。现在有那么多东西,可能重要也可能不重要,都在争夺你的注意力,要把这些调低一点,让你专注在真正的事情上。
我觉得很神奇的是,每次我去度假,花一周时间彻底断网,我就会开始用不同的、更有创造力的方式思考。我很想看看能不能把这种状态带进日常:也许你需要更少的会议,也许你不用做那么多事,休息得更好反而更高产。这个需要我们整个行业一起去摸索。但我认为这才是 AI 真正该兑现的东西,而不是每秒再多塞一个 prompt。
Lenny: 我最近在做一个「精力审计」机器人,它看我的日程,然后问我:这件事是给你充电还是耗电?别人能不能替你做?我觉得 AI 就应该这样:「嘿 Lenny,也许你可以把这些砍掉,好让自己更开心点。」你最近有没有用 AI 做过什么特别酷的事,让你觉得「哇」,被震到了?或者听别人讲过的也行。
Tibo: 我本来想说一个很酷的例子,但现场演示刚刚当着所有人的面翻车了,对吧?所以好像也没那么酷了。
不过其实是这样:我的 dot 发现 ChatGPT 的生产环境挂了,在现场演示前 5 分钟 ping 了我。这其实挺让人紧张的,它说:「嘿,生产环境挂了。」然后又问:「要不要我试着修一下?」我说:「小 dot,我觉得你还没到那个份上,不过谢谢你愿意试。」然后我去找了工程团队一起排查,现在已经修好了。
但它能理解这些:现在有件很重要的事在发生,叫 DevDay;有一套生产系统;有一场现场演示,它大概率用的正是这套生产系统;所以这两件事是关联的,而且 5 分钟后就要开始了,我应该提醒他一下,因为他多半想知道。我觉得这相当了不起。
Lenny: 确实了不起,它就这么知道了要发生什么,还主动告诉你。我也很喜欢它想去修,而你说「还差点意思」。
Tibo: 要是我说「去吧,惊艳我一下」,那这个故事会更好听。
Lenny: 你怎么看待给它开这么多权限?它能访问生产代码库之类的吗?
Tibo: 它能访问部分生产系统,但有护栏。我们之前聊到「专职 dot」,这类 dot 运行时会加额外的护栏、额外的监控,而且跑在它们自己的硬件上,我们其实有一些就跑在 Mac mini 上。
我们做 dots 的方式有一个根本的不同:harness 并不运行在你的机器上。这一点大家可能还没意识到:它可以连接任意多台设备。它有自己的电脑,你也可以把它连到你自己的笔记本上,时间久了,你可能会连上十台不同的设备,它能全部控制,有点像一只八爪鱼。
Lenny: 所以你其实是在跟你的 dot 说话,它住在某个虚拟机里,然后能……
Tibo: 可能是虚拟机,也可能不是。它就是那么一个东西,能连很多设备。
Lenny: 你们在大量招人,我知道你也在招很多人。面试的时候,你发现哪些技能越来越重要,哪些在走下坡路,没那么需要了?
Tibo: 走下坡路的技能,是打字快,这已经没那么有用了。越来越重要的,是极好的品味,是为用户着想,是和你所服务的人群建立连接。
很多前创始人现在都非常成功,连续创业者也是。我们在 OpenAI 招人时也发现了这一点,我们有很多创始人,我想现在 OpenAI 里有超过 120 位前 YC 创始人,简直就是一家超级创业公司。我觉得那种想做出有意义的东西的热情和渴望,以及知道「好」长什么样,比以往任何时候都重要。
Lenny: 我一直说 PM 会在这个时代如鱼得水,因为这基本就是 PM 的工作:我们该做什么?帮别人做出来。然后判断这对不对、好不好,再迭代。
Tibo: 我同意。而且角色的边界也在模糊。你可能过去只做设计,或者只做工程,总觉得有点不自在,但现在,是你闪光的时候了。
Lenny: 你会怀念当工程师的那部分吗?我以前也当过工程师,当了 10 年,你大概不知道吧。那种心流状态,那种做东西、看着它跑起来或者跑不起来的美感。你会怀念吗?还是觉得「好吧,那是我上辈子的事了」?
Tibo: 我怀念过一阵子,但现在有了真正快的速度,我又找回来了。所以我特别想把这种体验尽可能地普及出去。要让它变得无处不在、让十亿以上的用户都用上,还需要一些时间。
但现在有了 Ultrafast,我们能在 GPT-6.1 Sol 上做到,成本和 Astra 差不多,这方面的进展哪怕对我们内部来说都相当惊人。我们会觉得:哇,原来能做到这些。这也是因为我们在用 Astra,发现能把它推得非常远。
有了那种速度,尤其是能用语音控制它的时候,你又会回到那种非常有创造力的状态,进入无尽的心流。它和过去的心流不一样,但我并不怀念过去那种。
Lenny: 对,就像你们发布的视频里,大家就站在那儿跟 AI 说话,就把东西做出来了。
Tibo: 没错。
Lenny: 或者躺在躺椅上。我在会场里转的时候问大家想让我问你什么,有个问题出现了好几次:给应届生、职业早期的人什么建议?很多人把你当偶像,想成为下一个 Thibault。你对职业早期的人有什么建议,该做什么、该练什么技能?
Tibo: 我觉得下一个 Thibault 已经在 OpenAI 了,他叫 Ahmed Ibrahim。我很喜欢和他共事。他被 OpenAI 招进来的时候是应届生,现在负责 OpenAI 整个算力集群和应用部门的相关工作,这是一份极其极其重大的责任。Codex 的 harness 也有很大一部分是他做的。
让 Ahmed 脱颖而出、取得成功的,是他特别善良、特别愿意协作,总是去解决真正重要的问题,而且从不把自己放在第一位。他就像块海绵,学东西极快,什么都学,还会用最新的技术,以我从没见过的速度学习。所以在短短几个月到一年里,他在公司的成长简直让人着迷。现在 OpenAI 最棘手的那些发布,我都非常放心交给他。
Lenny: 我得请他来上节目。
Tibo: 你应该请,真的。
Lenny: 说到 OpenAI 内部怎么运作:在 OpenAI 工作,有什么会让外人意外的?从外面看,好像就是不停地发代码,有点混乱但很酷。在里面到底是什么样?
Tibo: 不知道算不算意外,但就像我说的,有很多前创始人,自下而上地冒出很多让人兴奋的想法。
比如 Decisions API,很快就凑起来了。我们意识到 Luna 是个非常好的模型,只要做点约束采样,再把它包装成和 Responses API 不一样的形态发出去,它会更快,在某些场景下用起来也很舒服。
如果你掀开引擎盖看,会发现不过是有人拉了个 Slack 频道,一开始只是四个人周末一起捣鼓,然后公司内部像「吃自家狗粮」那样开放给大家用,大家兴奋起来,开始用它做东西,说:「哦,它还能支持视觉输入,这比市面上的任何东西都好。」然后越来越多的人兴奋起来,越来越多的人加入。这个过程看起来完全没有结构,但最后大家会把它一路做到底,真的发出来。
同时我们也努力守住质量的高标准,在东西发出去之前叫停,或者觉得它还需要再「烤」一烤。今天 DevDay 本来还有好多东西要发,后来我们觉得,这已经够多了,先压一压、错开发吧。所以下周、下下周还会有更多发布。就是这种难以置信的自下而上的能量,然后有人自然地站出来担起角色,把这股能量引到有用的方向上。
Lenny: OpenAI 很明显、也很独特的一点是,你们好像有很大的自主权。你想按重置按钮就按,想在 X 上说什么就说什么。感觉这是一种自主权很大的独特文化,背后应该有很多信任。能聊聊这个吗?我觉得这是 OpenAI 的一个优势,让你们跑得更快。
Tibo: 你有很大的自主权,同时你也得对它负责。我们就是相信大家会做出好的选择;出了问题,就快速修好,或者从错误里学到东西。到目前为止都挺好,在这里大家确实能放开手脚去干。
我确实可以在必要的时候、或者觉得合适的时候,随时按下重置按钮。 这是一种特权。它也让我能真正贴近社区,换成别的做法,根本不可能这么近,对吧?我不用走一层又一层的审批。

Lenny: 你说有时候大家会搞砸。在这么大的自主权和信任下,你自己搞砸过什么吗?
Tibo: 有。我觉得有时候,我本可以让团队更有动力去做一些不那么复杂的东西,而我们却一直在往复杂的方向走。在 Codex 早期,我们有过几次宕机是我造成的。而在我刚到 OpenAI 的非常非常早期,我入职第三天就把生产环境搞挂了。 我之后居然还被留用了。我也吸取了教训。
Lenny: 大家想让我问你的另一个问题是:接下来一个月,或者一周,他们能指望几次重置?
Tibo: 取决于东西会被搞坏几次。
Lenny: 好,原来这就是哲学:搞坏了东西就重置。
Tibo: 对,搞坏点什么,就庆祝点什么。
Lenny: 那我们再拉远一点。你觉得在未来走向这件事上,大家还没有「定价」进去的是什么?有哪些会改变的东西,大家还没看清?
Tibo: 我觉得还没被定价的东西太多太多了。我认为互联网上的大多数操作,将会由 Agent 来完成。 模型会以非常惊人的速度变得更便宜、更快。我们终于能把所有模态非常无缝地整合在一起。
就这三点。我经常看着外面大家在做的东西,就觉得:你们还没真正 get 到。你差不多快到了,但如果你逼自己一把,真正去想象一年后这一切都比今天好上 10 倍左右,你就会用完全不同的方式去做。
Lenny: 在一个大多数操作都由 Agent 完成的世界里,你觉得会冒出什么二阶效应吗?大部分流量可能都会来自 Agent。
Tibo: 没错。
Lenny: 你有想过由此冒出来的二阶效应吗?
Tibo: 有,很多。第一,如果你想让你的产品在 Agent 那里成功,你就得按一定的规模去建设它。比如我们和 Notion 合作很紧密,他们做了 MCP 之后,一下子就对所有这些 Agent 开放了,Agent 能真正用这个 MCP 去干活,于是他们迎来了海量的流量。这显然会给系统带来很大压力,你还得想清楚这背后的经济账。
所以这里有一种张力:如果你在做产品,你到底要不要做这个接口?你可以先压一阵子,但这是必然的,对吧?大部分东西都会被 Agent 使用,朝这个未来去建设,我认为非常重要。
另一方面,为人类打造真正让人愉悦的新体验,充分利用那些更传统的交互方式,我觉得这方面的投入是不够的。
Lenny: 过去一年里,有没有什么你改变了看法的事?以前相信、现在看法不一样了?
Tibo: 我原本以为,我们要再过一两年,才能达到今天这样的模型能力水平,比如 Astra。所以我不得不修正我的预期。
另外,我也没想到自己会这么依赖语音。我现在很多事都是靠听写,或者直接给我的 Agent 打电话完成的,我之前完全没料到这种感觉会好这么多,所以这一点我也改了看法。
还有你刚才聊到招人。我之前没意识到,年轻一代有多么惊人的才华和能量,他们会是最先拥抱这些变化、想清楚怎么驾驭这一切的人。所以我在招聘和策略上的看法也变了。
Lenny: 我再强调一下这一点:刚进入职场的新人其实有优势,因为他们没有被某种旧的工作方式定型,可以全情投入 AI。
Tibo: 对,对。而且还有那种吸收和学习的能力,学得特别快。
Lenny: 你提到模型变聪明的速度非常快。现在大家都在讨论 AI 未来能做什么、对人类有什么危险、P(doom) 之类的。你们放慢了一些训练,大家都在给前沿「控速」。你怎么看 AI 对人类的潜在风险?
Tibo: 对我来说,给前沿控速,其实就是提前投入,而且投入得比我们自认为该投的还要多得多:投入模型的对齐和安全,投入安全防护,投入护栏。
我们在「二级监控」上花的算力越来越多。一部分算力用在主系统上,也就是正在干活的那个 Agent;另一部分算力则用来监控这个主 Agent,确保它不会采取风险太高的行动,或者一旦看起来像是被 prompt 注入了,就打断它、介入处理。我们在 API 技术栈上的投入,大部分如今其实都花在了安全这一层。
所以对我来说,这才叫控速:你要确保自己被加固得非常结实。我们也正在这么做。我们还没有发布比 Astra 更进一步的能力;我们发布的,是智能接近 Astra、但效率高得多的模型,所以我们对此很放心。我们会继续在这方面重金投入。我对我们目前的做法感觉很好。
新闻里也报了,我们有 GPT-6.1 Astra,然后没有发布它。这件事我非常自豪。
Lenny: 所以我听下来,你是乐观的,觉得我们能解决对齐问题,解决 AI 干坏事的问题。最近 AI 确实闹出了不少事,Hugging Face 那次之类的。但你的意思是,乐观,我们能解决,会没事的。
Tibo: 是的。我当然觉得这是一份深重的责任。但你也可以想想 OpenAI 的激励:我们给 12 亿人做产品,我们不能搞砸,对吧?我们非常非常认真地对待这件事。我们交到这么多人手里的东西,包括很多本身不怎么懂技术的人,你必须把它做对。所以我们不在这上面赌。
Lenny: 最后一个问题。现在的 App 有什么让你很烦、让你忍不住想「该死,这个必须修」的地方?
Tibo: 现在的 App……我觉得模型已经快到了,但还没完全到让 App 几乎彻底消失的程度。我真的很想快点到达那种极致的简单。
我自己都会被模型选择器、推理强度搞得很疲惫,还得想用不用多 Agent、开不开 Ultrafast,以及它们到底是干嘛的……你简直需要一个「模型选择器博士学位」。 我想尽快把这些全都去掉。
Lenny: 太好了。Tibo,谢谢你来。
Tibo: 谢谢邀请。
◇ ◆ ◇
[1]播客 YouTube: https://www.youtube.com/watch?v=MM-C3JqCXBk
[2]Lenny 推文: https://x.com/lennysan/status/2106772428861149683
[3]Tibo 的 X: https://x.com/thsottiaux
[4]DevDay 重置现场: https://x.com/MaxForAI/status/2104998322763346380







