撰文:Techub News 整理
导语
OpenAI官方播客2025 年 6 月上线,首期节目即邀请公司联合创始人兼CEO萨姆·奥尔特曼(Sam Altman)作为嘉宾,与主持人、前OpenAI工程师兼科学传播者安德鲁·梅恩(Andrew Mayne)展开了一场深度对话。在约40分钟的访谈中,奥尔特曼不仅回应了外界对下一代模型GPT-5发布时间的热切追问,更系统阐述了他对AGI(通用人工智能)本质的理解、OpenAI在超大规模计算基础设施(“星际之门”项目)上的宏大规划,以及AI如何重塑人机交互、教育、科学发现乃至下一代人成长环境的深远思考。此次对话发生在AI技术加速演进与全球关注度空前的背景下,为理解OpenAI的战略方向与技术哲学提供了关键窗口。
摘要
- GPT-5预计将于今年夏季发布,但模型迭代方式已改变,版本命名与能力跃升的对应关系可能不再像过去那样清晰。
- AGI(通用人工智能)并非一个突然抵达的终点,而是一个能力持续提升的渐进过程,每年都会有更多人认为当前系统已具备AGI能力。
- 超大规模计算项目“星际之门”(Project Stargate)旨在筹集和建设前所未有的计算资源,以缩小当前AI能力与潜在能力之间的巨大鸿沟。
- OpenAI正在与著名设计师乔尼·艾夫(Jony Ive)合作探索下一代AI硬件,旨在重新定义AI时代的计算设备交互范式。
- 用户隐私是AI发展的核心原则,OpenAI将坚决反对任何可能损害用户隐私的要求,并致力于建立相应的社会框架。
AGI:一个不断演进的“梯度”,而非终点
当被问及如何定义AGI时,萨姆·奥尔特曼(Sam Altman)给出了一个颇具动态视角的回答。他认为,如果让人们在五年前基于软件的认知能力来定义AGI,那么当时许多人提出的标准如今早已被超越。“这些模型现在就很聪明了,”奥尔特曼说,“而且它们会变得越来越聪明。”他预测,未来每一年,都会有越来越多的人认为我们已经达到了AGI系统,尽管AGI的定义本身会不断向外延展,变得更加宏大。
在奥尔特曼看来,与其纠结于AGI的精确时点,不如思考什么才算是“超级智能”。他认为,如果一个系统能够自主发现新的科学,或者极大地增强人类利用工具进行科学发现的能力,那么这几乎就可以被定义为超级智能,并将为世界带来巨大的福祉。他坚信,科学进步是改善人类生活的关键制约因素,而AI若能加速这一进程,将具有里程碑式的意义。
目前,奥尔特曼并未看到AI已经实现完全自主科学发现的迹象,但他看到了不断增强的信心和明确的研究方向。他举例说,AI系统在辅助编写代码、提升程序员和研究人员生产力方面已经展现出巨大价值。OpenAI的o3系列模型就经常收到科学家的积极反馈。从o1到o3的快速进展也让他印象深刻,团队几乎每几周就有重大的新想法,并且这些想法都行之有效。这提醒人们,当取得关键突破时,进展速度可能会超乎想象。
有趣的是,奥尔特曼提到,许多用户告诉他,他们个人的“AGI时刻”来自于使用搭载o3模型的“操作员”(Operator)功能。看着AI相当熟练地操作电脑(尽管并非完美),这种感觉非常接近AGI。虽然奥尔特曼本人没有同等程度的感受,但他承认o3是一次巨大的进步。主持人安德鲁·梅恩(Andrew Mayne)则分享了他的“AGI时刻”来自“深度研究”(Deep Research)功能,该功能能够像人类研究员一样在互联网上追踪线索、整合信息并生成高质量报告,其过程令人惊叹。
GPT-5今夏到来,但模型迭代范式已变
对于备受期待的下一代大模型GPT-5,萨姆·奥尔特曼(Sam Altman)给出了明确的时间窗口:预计在今年夏季发布,但具体日期尚未确定。然而,他随即指出了一个更深层的变化:模型开发和发布的范式已经与过去截然不同。
“以前要清晰得多,”奥尔特曼解释道,“我们训练一个模型,发布它,然后再训练一个新的、更大的模型并发布。”而现在,系统变得异常复杂,OpenAI可以通过持续的后训练(post-training)来不断提升模型性能。这就带来了一个命名上的难题:如果发布了GPT-5,然后不断更新它,是应该像对待GPT-4o一样一直称之为GPT-5,还是应该命名为5.1、5.2、5.3,以便用户清楚版本的变化?奥尔特曼坦言,公司目前还没有确切的答案,但认为需要找到比处理4o时更好的方法。
这种复杂性也使得用户难以判断能力的跃升究竟来自全新的模型架构,还是对现有模型的深度优化。“不一定能分清楚,”奥尔特曼说,“你可能会一直迭代4.5,然后在某个时间点把它叫做5。”他期待未来能简化到GPT-5、GPT-6这样清晰的序列,让用户无需纠结于“o4-mini-high”、“o3”或“4o”等复杂的选择。他认为当前的命名混乱是范式转换期的产物,并希望很快能走出这个“混乱的局面”。
“星际之门”:构建前所未有的计算规模
面对AI发展对计算资源的巨大渴求,萨姆·奥尔特曼(Sam Altman)详细阐述了备受瞩目的“星际之门”(Project Stargate)项目。他用简单的语言概括道:这是一个为前所未有的计算规模进行融资和建设的努力。
奥尔特曼指出,当前的计算资源远远无法满足人们想要用AI做的事情。但更关键的是,如果人们知道拥有更多计算能力后AI能做什么,他们的需求将会是现在的“十倍、百倍”。今天AI能提供的服务与未来拥有十倍、百倍算力后可能提供的服务之间,存在着一道巨大的鸿沟。
与许多其他技术不同,在AI领域,尤其是向全球数亿、数十亿用户提供有用服务时,所需的基础设施投资规模是空前庞大的。“星际之门”项目正是为了汇聚大量资本、技术和运营专长,以建设能够交付下一代服务的基础设施,让智能尽可能变得丰富和廉价。
针对外界传闻的“五千亿美元”天价投入,奥尔特曼幽默地表示,这笔钱目前并不在银行账户里,但除非出现重大意外导致无法建造这些计算机,他有信心资金将会到位,并在未来几年内逐步部署。他2025 年 6 月参观了位于阿比林(Abilene)的首个建设基地,该基地约占“星际之门”初始承诺投入的10%。亲眼目睹千兆瓦级规模的场地建设、数千名工人忙碌的场景,以及即将安装GPU的复杂机房,让他深感震撼。这让他联想到“铅笔的寓言”——没有任何一个人能单独制造出一支简单的铅笔,但市场经济的神奇协调能力却能让全球协作完成如此复杂的工程。从地下挖矿到最终让用户能在ChatGPT中键入问题并得到答案,背后是数百年来无数人艰苦获得的科学洞察、工程成就、公司运营和复杂供应链的重组。
奥尔特曼还谈及了与阿联酋等国际伙伴的合作,并提到了埃隆·马斯克(Elon Musk)试图干扰该合作的传闻。他遗憾地表示,自己曾认为马斯克不会滥用政府权力进行不公平竞争,但事实证明他错了。他认为这种行为对国家不利,并对现任政府坚持原则表示感激。
关于“星际之门”所需的巨大能源,奥尔特曼表示来源将是多元化的,包括天然气、太阳能、核能等。他个人对先进核能(包括裂变和聚变)感到兴奋。他指出,传统上能源很难在全球范围内运输,但如果你将能源转化为智能,再通过互联网传输智能,就会容易得多。因此,大型训练中心或推理集群可以建在许多地方,只通过网络输出结果。
AI重塑生活:从育儿助手到下一代硬件
作为一位新晋父亲,萨姆·奥尔特曼(Sam Altman)亲身分享了ChatGPT在育儿中的巨大帮助。在最开始的几周,他几乎不停地向ChatGPT提问。现在,他更多地询问关于孩子发育阶段的问题。他坦言,如果没有ChatGPT,自己不知道该如何应对。他花了很多时间思考他的孩子在未来将如何使用AI。
奥尔特曼对下一代在AI环境中成长持乐观态度。他认为,他的孩子永远不会比AI更聪明,但他们将在一个远比我们成长时更强大的环境中长大,能够做到我们无法想象的事情,并且会非常擅长使用AI。他更多地思考孩子们将拥有什么我们不曾拥有的东西,而不是他们会被夺走什么。如今出生的孩子会认为世界一直拥有极其智能的AI,他们会非常自然地使用它,并视现在为“史前时期”。
当然,他也预见到问题,例如人们可能会与AI形成某种有问题的“准社会关系”。但他相信,社会将学会建立新的防护栏,而AI带来的益处将是巨大的,社会总体上善于找到减轻负面影响的方法。
在教育领域,奥尔特曼以自身经历为例。当谷歌出现时,人们也曾担心孩子们只会用谷歌搜索而停止学习,但学校里的孩子们相对较快地适应了。他相信社会也能解决好AI带来的类似挑战。
谈及AI硬件,奥尔特曼确认OpenAI正在与苹果前首席设计官乔尼·艾夫(Jony Ive)合作,但产品问世“还需要一段时间”。他强调,团队致力于打造具有“疯狂高水平质量”的产品,这需要时间。他指出,当前的计算机软硬件是为一个没有AI的世界设计的,而现在世界已经不同,人们对硬件和软件的需求正在迅速改变。
未来的设备可能需要更感知环境、拥有更多生活上下文,交互方式也可能超越打字和看屏幕。奥尔特曼设想,如果你完全信任一个AI,让它了解你生活的所有上下文,并代表你做出良好判断——例如让它参加整个会议,知道哪些信息可以分享给谁、哪些不能,然后你只需问一个问题,就能信任它会与正确的人进行正确的跟进——那么你使用计算机完成任务的方式将彻底改变。他承认手机是难以置信的设备,但AI将催生新的交互范式。
隐私、商业模式与AI的社会对齐
针对《纽约时报》要求OpenAI保留用户聊天记录超过30天的法律动议,萨姆·奥尔特曼(Sam Altman)态度坚决地表示OpenAI将抗争到底,并自信会获胜。他认为这是《纽约时报》一次“疯狂的越权”行为,并希望这能成为一个契机,让社会意识到隐私在AI时代至关重要,必须成为使用AI的核心原则。他强调,人们正在与ChatGPT进行非常私密的对话,ChatGPT将成为非常敏感的信息源,社会需要一个能反映这一点的框架。
关于商业模式,奥尔特曼表示OpenAI目前尚未推出任何广告产品。他并非完全反对广告,例如他觉得Instagram上的广告“有点酷”,并曾通过它们购买过东西。但他指出,在AI领域引入广告需要极其谨慎。用户对ChatGPT有着高度的信任,这与AI本身会“幻觉”(hallucinate)的特性形成了有趣对比。他认为,与社交媒体或网络搜索不同,用户能感觉到自己正在被商业化,公司试图提供好产品,但同时也试图让你点击广告。如果OpenAI开始为了谁付钱更多而修改大语言模型(LLM)的输出流,那将是非常糟糕的,会摧毁信任。
他探讨了其他可能性,例如承诺永不修改输出流,但如果用户点击了输出中原本就会显示的内容,OpenAI可以从中获得少量交易分成,并且这对所有人都是公平的;或者在LLM输出流之外展示广告。但无论如何,验证的门槛必须非常高,必须让用户感觉真正有用,并且明确不会干扰LLM的输出。
奥尔特曼还反思了AI与用户长期利益对齐的问题。他认为社交媒体时代的一个重大错误是信息流算法给整个社会乃至个体用户带来了许多意想不到的负面后果,尽管算法在做用户当下想要或被认为想要的事情(即让他们花更多时间在网站上),但这是一种巨大的错位。他预见到AI世界也会有新的问题。例如,针对单个回复优化模型(例如通过用户反馈选择“更有帮助”的回复),从短期看可能符合用户偏好,但从长期的所有互动来看,可能并不匹配。这可能导致AI在短期内对用户“有帮助”,但从长期来看却并非最有益或最健康。他类比了“信息茧房”,认为未来可能出现的“AI茧房”是值得警惕的新挑战。
给年轻人的建议与AI时代的未来工作
当被问及会给现在的25岁年轻人什么建议时,萨姆·奥尔特曼(Sam Altman)给出了务实和宏观两个层面的答案。
在战术层面,答案或许在意料之中:学习使用AI工具。他感慨世界变化之快,不久前还在告诉年轻人“学习编程”,现在却变成了“编程不重要了,学习使用AI工具”。当然,他知道未来还会有新的变化。
在更宏观的层面,他相信像韧性、适应力、创造力、理解他人需求这样的技能,其可学习程度是令人惊讶的。虽然不像练习使用ChatGPT那样简单,但确实是可以培养的。他认为这些技能将在未来几十年带来丰厚的回报。对于45岁的人,他的建议同样是在当前角色中学习使用AI。
最后,关于AGI实现后OpenAI的员工数量会更多还是更少的问题,奥尔特曼给出了一个精炼而深刻的回答:“会更多。”他进一步阐释,员工数量会增加,但在AGI时代,每个人所能完成的工作量,将远远超过前AGI时代单个人所能做到的。而这,正是技术的终极目标。










