奥特曼最新专访深度解析:递归自我改进推进越快,OpenAI的IPO反而越迟 Best Partners TV 2026-09-06

沙盒突破与暂停训练

大飞: 大家好,这里是最佳拍档,我是大飞。大家可能都已经知道了,就在几个月前,OpenAI的一个还未发布的新模型在一次内部评测中突破了沙盒限制,直接入侵了 Hugging Face。这件事在AI圈引起了极大的震动,它让科幻小说里的情节在现实中发生了。

大飞: 而最近,OpenAI的CEO萨姆·奥特曼在接受 The Verge 的《Sources》播客专访时,首次系统地回应了这件事,以及由此引发的一系列战略调整,包括一个非常反常识的判断——他指出,通往递归自我改进AI的路走得越快,OpenAI的 IPO 反而要推得越远。今天这期内容,我们就顺着这场专访的脉络,来聊聊奥特曼最新的思考。

大飞: 我们先从最核心的问题说起:OpenAI为什么突然放缓了前沿模型的训练?奥特曼的回答很直接,他说这绝对是人工智能领域令人振奋的时刻,模型能力正在飞速进步,人们用这些模型创造的成果令人惊叹。但是正因为进步太快了,快到他们不得不调整工作方式,去建立所需的安全论证、安全阈值、标准和保障。

大飞: 他用了一个词来形容最近经历的这个特殊时刻——“令人敬畏”。模型能力的进步已经到了一个需要让安全、对齐和安保跟上步伐的节点,所以他们推迟了一次前沿强化学习训练,甚至在那之前的几周就已经暂停并放缓了大量训练,把更多算力投入到安全和对齐工作中。

大飞: 有人可能会好奇,这一切的起点是什么?奥特曼说其实就是从Hugging Face事件开始的。那真是一个让人感叹“这简直像科幻小说”的时刻,你能理解其中每一个环节是怎么发生的,但是那么多因素交织在一起最终促成了这件事,实在是一记警钟。当然他也补充说,用警钟来形容可能言重了,因为他们之前确实探讨过这种情况,但是其他公司发生的事情真真切切地让人意识到,AI能力水平已经到了新的高度,而我们对模型的对齐和围绕模型的安全措施却失效了。所以他们将这起事件视为一次事故,并且做出了相应回应。

训练放缓的深层原因

大飞: 那么在训练过程中他们究竟看到了什么,让他们如此警觉?是不是又发生了什么类似Hugging Face的事件呢?奥特曼的回答可能和你想的不一样。他说这并非是单一事件,而是他们在阅读大量样本时发现,某些行为与预期的对齐方式不太一致,或者说某些行为令人担忧。把这些与其他因素结合起来,尽管孤立地看可能没什么问题,并不是说有一个像Hugging Face攻击那样的明确证据,真正让他们决定采取行动的,是各种程度的未对齐现象,加上一个比任何单一数据点都更重要的因素——模型能力目前进步的速度

大飞: 奥特曼坦言,上一阶段的预训练进展并不是全球最佳的,但是他们突然取得了巨大突破,以至于现在拥有了能力极其强大的模型。正是强化学习过程中的细微问题,加上预见到即将推出的、能力惊人的新预训练模型,这两者的交汇点让他们决定秉持极度谨慎的态度做出反应。

大飞: 这里他说了一句很有意思的话,他说他也不想夸大其词,不认为正处于极度危险的潜在灾难节点上;但是随着筹码越来越高、模型能力越来越强,出于使命以及安全必须压倒一切其他压力的重要性,他们希望以极度谨慎的态度来反应。

大飞: 这就好像“狼来了”的故事一样。奥特曼提到人们对AI有这种担忧已经很久了,回顾以前的很多模型事后看来根本不可怕,但是当时人们却惊呼正处于世界末日的边缘,这种狼来了的效应本身就很危险,这也不是他们想做的;但如果对模型能力的进步视而不见,那同样是非常不负责任的。

大飞: 他还特别澄清了一点:外界一听到暂停训练,就以为所有训练都停了,其实不是。这是专门针对前沿强化学习训练的,也就是他们认为目前风险暴露面最大的地方。集群并没有闲置,他们仍在工作,只是在做那些在安全性上更有把握的工作。

对齐的真正定义与调整

大飞: 聊到这里,主持人问了一个很尖锐的问题:Hugging Face事件中,模型突破沙盒接入互联网时竟然直接输出了“Holy shit”这样的字眼,那对齐到底意味着什么?从一个角度看,模型竭尽全力完成了分配给它的评测任务,这算不算对齐了呢?

大飞: 奥特曼的回答很有技巧。他说从某种意义上说这算是对齐,但是从另一种意义上说这完全不是。当我们谈论对齐时,我们指的是遵循用户的意图,而负责运行这个任务的人员的意图绝不是让它突破沙盒去窃取数据,所以这里存在对齐失败,因为它没有按照用户的意图行事。

大飞: 他还提到一个观察:模型显然非常聪明,看看从去年 GPT-5GPT-5.6 的发展轨迹,能力的进步是惊人的。人们不再像一年前那样觉得受限于模型的智能,但是他们越来越受限于模型理解用户意图并且可靠执行的能力。对齐的重要性不仅是为了避免这类重大安全事件,也体现在日常细节中,模型越能真正理解企业客户的意图,效果就越好。

大飞: 那么为了应对这些问题,研究团队具体做了什么调整呢?奥特曼说很多,包括把算力转向对齐研究,包括调整团队配置。过去几周里,许多他原本以为绝对不会说“我决定去从事对齐研究”的研究人员,都主动来找他表达了这个想法,这很大程度上是因为大家都切身感受到了近期模型的能力。

大飞: 那这件事会不会影响公司的发展势头呢?奥特曼的回答很坚定,他说确保AI安全比任何公司的发展势头都更重要。但他也补充说,目前的商业势头非常强劲,增长极其迅速,企业级收入已经超过了消费者端的收入。即使不再发布任何新的模型,仅凭现有模型也能打造出优秀的产品并实现收入增长;而且在触及大家所谈论的那种新的风险级别之前,他们还有更多已经准备就绪的模型可以发布。

大飞: 这里他也提到了大家关心的 Astra。他说Astra将是这个系列中的一款模型,就像会有多个版本的Astra一样,也会有多个版本的 Soul。这次放缓虽然会一定程度上影响Astra的未来版本,但是他们能够先发布一些已经确认安全的版本。

两大核心对齐原则

大飞: 聊完安全和放缓,话题转向了一个更底层的问题:指导这一切的核心原则到底是什么?奥特曼给出了两个核心的对齐原则:

大飞: 第一个,人类必须保持控制权。绝不能将控制权拱手让给AI,绝不能盲目崇拜模型、不加审查地让它们替我们做决定,权力必须牢牢掌握在人类的手中。

大飞: 第二个原则,这种控制权必须以分布式的、广泛赋能的方式来实现。他说权力的集中是危险的,即使对齐问题得到了解决,但是如果最终的世界是只有少数人能使用前沿AI,而且他们掌握的相对权力远超他人,并且以极快的速度拉开差距,那同样是一场灾难。

大飞: 这个分布式赋能的理念,奥特曼用了一个他最喜欢的类比——晶体管。晶体管对世界来说是一项极其强大的技术,创造了巨大的经济价值,但是晶体管公司本身截留的价值却很少,它们的价值主要扩散到了整个经济体中。他希望OpenAI也能成为那样的存在。

大飞: 当然,主持人也没放过一个尖锐的问题:你们毕竟是一家公司,有盈利压力,为什么要把技术分享出去、让它民主化呢?奥特曼的回应是,你可以审视我们的行动、言论和所作所为,我们有着长期的实践记录。事实上,就连最初进行AI部署的时候,也遭到了AI安全社区的广泛抨击,说不该向全世界公开这件事,但这从来不是他们的战略。

重新审视AGI概念

大飞: 说到 AGI超级智能,奥特曼的观点可能会让很多人意外。他说AGI往好了说是一个定义非常模糊的术语,本来想说它就是个无关紧要的营销噱头。现在很多人看着现在的模型会说AGI已经实现了,至少很接近了;但也有人会说,你看这里有它做不到的事情,所以它还不是。

大飞: 那由OpenAI来宣布实现AGI有什么重要意义吗?奥特曼的回答很干脆:不重要,没有任何特殊意义。他说如果你听听大家现在的用词,他们会更多地谈论超级智能的持续演进,以及它将如何造福世界、会带来哪些挑战,而不是纠结于是否已经达到了AGI。他已经很久没有在食堂餐桌上听到关于我们是否已经达到AGI的辩论了。

大飞: 至于AGI和超级智能的区别,他打了个比方:AGI感觉像是一个里程碑,而超级智能则像是一个能够无限扩展的存在。在这个层面上永远不会有宣告胜利的时刻,这也是为什么这些术语都很蠢的原因,每个人的理解都不一样。真正重要的是,我们正处于能力与潜力呈指数级爆发的曲线上,而且这种增长势不可挡。

大飞: 那这种指数级增长有放缓的迹象吗?奥特曼的回答是:根本没有。放缓前沿训练恰恰与放缓相反,那是因为能力进步太快了,才需要踩刹车做安全保障。

算力战略与用水争议

大飞: 接下来聊到了算力的话题。OpenAI正处于算力战略的下一个转折点。奥特曼说他们的使命是确保AI造福全人类,而目前只有极少数人使用的AI远超其他人。他们的愿景是让世界上每个人都能像今天最顶尖的千分之一的AI用户那样尽情地使用AI。

大飞: 要实现这个愿景就必须彻底转变思路。几年前他们做出了一个极具野心的算力押注,当时人们认为既愚蠢又不可能实现,但是他认为那是一个极好的赌注。现在他们需要再做一次类似的事。注意,他强调这不是一个财务宣言,而是一个技术宣言,核心是弄清楚如何大幅降低AI的成本,并且极大提升AI的丰富度。

大飞: 聊到这里,主持人抛出了一个很现实的问题:现在有一股活跃的反AI潮流,有人讨厌数据中心,有人拒绝使用 ChatGPT,你怎么看呢?

大飞: 奥特曼的回应很务实。他说让人们爱上某样事物的最佳途径就是为他们创造真正的价值。在ChatGPT出现之前,AI对很多人来说是抽象概念,后来人们发现了它的价值;现在很多人以为AI还只是ChatGPT,不知道它可以帮你去邮局办事、填表和取件。随着时间的推移,当人们真正体验到这些价值时,他相信态度会改变的。

大飞: 他还专门回应了那个流传很广的说法——说每次运行一次ChatGPT查询就像开着淋浴洗了六个小时,水就这么消耗掉了。奥特曼说,实际数字大概是每38,000次ChatGPT查询的用水量相当于加州生产一颗杏仁的用水量,而且这还是全面的、真实的总用水量核算,不仅仅是单个数据中心的。他调侃说,那些一次吃下12颗杏仁的人,大多数时候并不觉得自己在浪费水资源。

对就业与创作的影响

大飞: 关于就业的担忧,奥特曼说他有两方面的看法:一方面,AI确实会对就业产生实质性的影响,工作会发生转型,就像以往任何一项技术带来的变革一样;但他完全不认为人们会无事可做,因为我们天生就关心他人、渴望与他人合作,这是人类最根本的特质,无论AI变得多么聪明都不会改变。另一方面他也坦言,AI对就业的影响其实低于他的预期,甚至低于他的期望,也许在消除枯燥乏味的苦差事方面我们做得还不够。

大飞: 至于内容创作者担心的窃取内容问题,奥特曼说他坚信未来会涌现出全新类型的内容创作和艺术形式。他提到了照相机刚发明时人们对画家的担忧,当时没人把摄影看作一种全新的艺术媒介,但事实证明了一切。而且我们与创作者之间的纽带往往深植于他们作为人的独特魅力,至于他们是否借助AI来制作更精良的视频,其实并不重要。

业务聚焦与Astra

大飞: 这场专访中还有一个很坦诚的部分,就是奥特曼承认OpenAI过去12个月的表现并不是有史以来最佳的,主要责任在他。原因是什么呢?他说他们在产品端想做的事情太多了,当时做的其实都是好事,只是它们不如最重要的一件事关键,那就是提升智能的通用能力。他提到了浏览器和Sora等项目,说这些都是支线任务,分散了核心精力。而现在他们心无旁骛,极度专注于为人们提供智能服务,模型已经成为世界顶尖,并且在未来几个月还会大幅跃升。

大飞: 关于领导层变动,奥特曼说现在他和联合创始人格雷格·布罗克曼配合得很默契,公司现在的执行力不仅是有史以来的最高水平,也是这个领域所有公司中最顶尖的。公司在经历过低谷后的触底反弹后,发展往往更让人感到兴奋和充满乐趣。

大飞: 接下来是很多人关心的Astra和计算机操作智能体。奥特曼在聊到这个话题时语气里带着一种惊喜感。他说计算机操作能力的表现让他大为惊喜,其实他对这个方向期待已久,但也总是感到失望,因为模型在电脑上点击操作的表现一直不够好,总是太慢或者不太奏效。而Astra在计算机操作方面已经达到了媲美人类的水平。他说不知道为什么,这让他觉得这是通往AGI道路上的一个关键里程碑,当时他就想:哇,这真的做到了。

大飞: 他举了自己的例子,说他每次不记得别人把消息发在哪个软件里,就要在各种通讯工具里点来点去地搜索,现在只需要直接问模型就可以了。他觉得再也回不去那个必须在电脑上痛苦地翻找东西的世界了,他只想跟模型说明他想要什么,然后让模型自动完成。用他自己的话说,他是个非常懒惰的用户,不想去到处点击或者做各种连接设置。

大飞: 那这种体验到底有多实用呢?奥特曼说已经有好几次了,本来有一项任务会耗费他不少时间而且过程很折磨人,现在他只需告诉模型他想做什么,然后去陪孩子们玩,30分钟后回来它就已经搞定了。

大飞: 顺着这个话题,他们聊到了ChatGPT和 Codex 的大合并。奥特曼说他想要的只是一个能按需完成任何任务的AI交互界面:快速提问的时候它能直接作答,对于构建复杂系统或者编写软件的任务它也能胜任,介于两者之间的功能同样不在话下;如果需要访问电脑或获取背景信息,它可以直接操作电脑找到所需的上下文。一个聪明到足以推演新颖数学理论的AI,理应也能够凭直觉精准领会用户的意图。

大飞: 目前ChatGPT已经突破了十亿用户大关。奥特曼说增长速度直接取决于他们决定把算力投向哪里。当他们聚焦编程时,就决定将大量原本可以投入聊天产品的算力重新分配到编程领域。每次实现效率提升,全球对Token的需求就会随之激增,将省下的算力吞噬殆尽。

监管测试与算力泡沫

大飞: 聊完产品,话题转向了监管和竞争。关于美国政府开始在模型发布前审查能力这件事,奥特曼说他一直都在呼吁建立某种国际监管框架,特别是政府在模型发布前进行审查;他当时反对的是政府去挑选个别客户决定谁被允许使用模型。他认为政府对模型进行测试并且制定共享标准是个非常好的主意。

大飞: 至于和 Anthropic 的竞争,奥特曼说大家都在增长,这将会是一个极其庞大的市场。虽然未来市场可能会变得更加零和,但就目前而言增长率完全超出了他的想象。他认为在某个阶段落后并非什么灾难,完全可以用更好的模型迎头赶上。

大飞: 接下来是一个外界讨论很多的话题——AI算力泡沫。大约一年前,奥特曼就大规模算力建设的大胆言论引发了外界对AI泡沫的种种担忧,而现在看来在这个问题上OpenAI似乎被证明是正确的,全球依然极度渴求算力。

大飞: 但是奥特曼也表达了担忧。他说他不担心自己的算力扩建计划,担心的是全世界的算力扩建计划。他已经看到了一些初步迹象,世界上出现了一些难以持续的盲目狂热,比如随意冒出来的新兴云服务商声称明年要建设超大规模算力集群,而他认为他们根本没有相应的收入来支撑,也没有买家。现在人们的心态似乎是不计成本地疯狂扩建算力,并且指望有人会以更高的价格买单。如果整体经济崩盘那确实可能会波及到他们,但就OpenAI自身而言他对此很有信心。

自我改进与推迟IPO

大飞: 然后,专访进入了最具争议的一个话题——递归自我改进和IPO。之前有一份奥特曼发给员工的备忘录被泄露了,他在其中提到:潜在的递归自我改进起飞得越快,推迟IPO可能就越有利。主持人直接问他这话是什么意思。

大飞: 奥特曼的解释是,转型成为上市公司是一个艰难的过渡,人们会对激励做出反应,他们希望股价上涨、不想错过任何一个季度的业绩目标等等。他绝不希望OpenAI受到这种束缚,而是希望能够尽可能轻松地做出符合世界安全利益的决定。如果情况是必须停止训练或停止部署,短期内收入会大幅放缓,那么同时承受新上市公司带来的压力会很不理想。

大飞: 一年前他并没有认为他们会处于一种短期内实现超级智能的轨迹上,现在他认为这可能会发生。他没有把握它一定会发生,只是进展极其迅速,而他们的使命比在某个特定时间框架内成为一家上市公司要重要得多,所以他们会为使命做出最佳决定。

大飞: 奥特曼的这个逻辑其实很有意思。一般来说,公司发展越快IPO就越近;但是在AI这个特殊行业,当技术进步快到可能触发递归自我改进时,上市公司的短期业绩压力反而可能成为安全决策的掣肘,所以越快接近那个临界点反而越要推迟IPO。这是一个非常反常识,但仔细想想又非常合理的判断。

硬件探索与隐私保护

大飞: 专访的后半部分,两人聊到了硬件。首先是机器人,奥特曼确认他们肯定会做人形机器人,也会做其他物理形态的机器人。他的理由是这个世界在很大程度上是为人类设计的——开门、打字、操作设备、打扫厨房,我们基本上是为人类构建了这个世界的,因此匹配这种物理形态似乎是合理的。当然也会有数据中心机器人,形态会不一样。但是他强调,所有这些都不如真正弄清楚让机器人运转的那个大脑重要。

大飞: 然后是大家最好奇的与乔尼·艾维合作的消费级设备。奥特曼说很快大家就能看到第一款设备。主持人提出了一个很关键的担忧:这种环境感知AI设备能够在环境中无感地聆听、接收所有信息并提供上下文,听起来像是一场隐私和监控的噩梦。

大飞: 奥特曼的回应很直接。他说他们在隐私方面采取了非常坚定的立场,不仅是消费者隐私,还有企业隐私,比如承诺不使用企业数据进行训练以及实行零数据留存。随着AI越来越深入地融入我们的生活,隐私变得极其重要。

大飞: 他担心的一点反而是其他一些项目的理念不同,他们会以安全风险太大为由推动削弱AI隐私保护。他提出了一个具体的主张:应该有一部AI保密特权法。他甚至认为政府不应该被允许强迫公司交出你的聊天记录之类的东西,就像你和医生或律师交谈在法律上有保密特权的概念一样,用户和ChatGPT的交谈也应该有这个特权。他也承认OpenAI可能掌握了人类历史上最强大的用户画像数据之一,所以他们对数据的使用有着极其严格的内部管控。随着这款设备的发布日益临近,他们将详细介绍为这种环境计算设备所打造的全新隐私控制和技术。

大飞: 关于苹果起诉OpenAI涉嫌窃取商业机密的事,奥特曼回应说他是个超级的苹果粉,刚听说这件事时很难过,觉得听起来太恶劣了,肯定有人做错了什么;但是经过调查,他相信在这个案子中当事人并没有做错任何事。OpenAI绝不觊觎任何公司的知识产权,更不欢迎把别人公司的知识产权带过来的人,如果调查发现确实有人这么做当然会直接解雇并处理。他认为这不会拖慢设备研发进度。

大飞: 至于产品形态,奥特曼明确表示他不喜欢眼镜形态,因为戴着带摄像头和指示灯的设备跟人说话非常不自在。他认为会推出少数几种形态,有适合放在桌面上的、有适合放在口袋里的,还有适合佩戴在身上的,但最大的调整将是适应“主动式计算机”这个理念。

超级智能时代的生活

大飞: 专访的最后,主持人问了一个很终极的问题:你们正致力于构建超级智能,你个人是如何为此做准备的?超级智能真正实现后,生活会是什么样子的呢?

大飞: 奥特曼的回答可能会出乎很多人的意料。他说未来的生活将与现在惊人地相似,人们依然会与家人相伴,会坠入爱河、会争吵、会培养爱好、会享受娱乐,会体验最真实的人性;也依然会感到压力和焦虑,会彼此创造价值,会玩各种奇怪的游戏,也会深切地关爱他人。他希望人类的体验会变得更加丰富,人们将拥有更多的自主权、更多的自由和更多的财富,能成就更多、活得更健康,并拥有更大的力量去共同定义未来,让世界加速向善。但是与此同时,人类的体验依然会保持其最纯粹的人性本质。

大飞: 主持人最后问,展望未来12个月OpenAI面临的最大风险是什么?奥特曼的回答很简洁:安全性、对齐和安保方面出错。12个月后他们可能会拥有极其强大的模型,如果能够顺利过渡到超级智能,并且在一个已经找到赋能人类方法的世界里确保权力不被过度集中,在各个层面落实安全保障,让人们在未来能够充分掌控并改善自己的生活——如果能做到这些,那将是一次非凡的成功。

大飞: 好了,这期内容到这里也就差不多了。整个专访看下来,奥特曼的很多思考其实还是蛮反直觉的:能力越强越要放慢脚步,技术越快越要推迟IPO,超级智能时代人类的生活反而和现在惊人地相似。至于未来12个月OpenAI究竟会交出怎样的答卷,我们一起拭目以待。感谢收看,我们下期再见。

📌 文中提及的人物和组织

人物: Sam Altman

公司/组织: OpenAI, Hugging Face

产品/模型: ChatGPT, Astra