撰文:Techub News 整理
导语
在 ChatGPT 掀起全球浪潮之前,OpenAI 是一家怎样的公司?其内部的研究文化、技术路径探索以及关键决策是如何演变的?2025 年 7 月,播客节目《Before AGI》邀请到了 OpenAI 的首席科学家 Jakub Pachocki(雅库布·帕霍茨基)和公司仅有的几位技术研究员之一的 Szymon Sidor(西蒙·西多)进行了一场长达 65 分钟的深度对话。两人不仅是 OpenAI 的元老,更是自高中时期就相识的挚友与长期合作者,亲历并共同塑造了 OpenAI 乃至整个 AI 领域近十年的发展轨迹。这次对话罕见地揭开了这家全球最具影响力的 AI 实验室的幕后故事,从早期「冒名顶替综合症」弥漫的创业氛围,到 Dota 2、GPT 等关键项目的诞生内幕,再到对 AI 安全、治理与未来发展的最新思考,为我们理解 AI 前沿的真实图景提供了宝贵的第一手资料。
摘要
- 从波兰高中的编程竞赛到 OpenAI 核心团队,Jakub Pachocki 和 Szymon Sidor 分享了他们被 AlphaGo 等里程碑事件「点醒」,从而投身 AI 研发的心路历程。
- 回顾 OpenAI 早期岁月:弥漫着「冒名顶替综合症」的文化、探索性的技术方向,以及从 Dota 2 项目到 GPT 范式确立的关键转折。
- 深入探讨当前 AI 研发的日常:识别和修复「静默 Bug」、构建更可靠的数据管道,以及从「模仿人类思考」到「发展模型自身推理能力」的范式转变。
- 重新定义 AGI:从遥不可及的「情感目标」到一系列可实现的里程碑,特别是「自动化研究」能力被视为关键节点,但也伴随着前所未有的权力集中与治理挑战。
- 展望 AI 安全与治理:两位研究者认为,模型能力(Capability)与安全性(Safety)的激励正日趋一致,但构建强大 AI 所需的小型化、自动化团队可能带来深刻的权力结构变化,是全社会必须面对的难题。
从波兰到硅谷:两位 AI 先锋的启蒙之路
Jakub Pachocki(雅库布·帕霍茨基)和 Szymon Sidor(西蒙·西多)的缘分始于波兰格但斯克的一所高中,两人被同一位计算机科学老师吸引,沉浸在其鼓励自由探索、而非灌输知识的教学方法中。随后,他们通过波兰为编程竞赛尖子生组织的计算机科学夏令营加深了友谊。尽管本科分别前往剑桥/MIT 和卡内基梅隆大学深造,但这段共同的「跳出舒适圈」赴美求学的经历,让两人的联系更加紧密。
关于 AI 的「顿悟时刻」,两人各有不同。Jakub Pachocki(雅库布·帕霍茨基)最初专注于理论计算机科学,视真正具有推理能力的 AI 为需要强大算力和坚实数学基础的远期目标。是 AlphaGo 的胜利彻底改变了他的看法:「国际象棋曾是 AI 的重大里程碑……但在围棋中,搜索空间如此之大,我们的算法很难与人类顶尖选手竞争。」 AlphaGo 证明了无需复杂启发式规则,仅凭深度神经网络与搜索结合就能征服围棋,这迫使 Jakub Pachocki(雅库布·帕霍茨基)重新评估:我们是否真的需要那么多理论基石?还是应该将其视为一种需要理解的物理现象?这一认知转变促使他决定投身 AI。
Szymon Sidor(西蒙·西多)的起点则更具戏剧性:他因观看第一部《钢铁侠》电影而对机器人学产生兴趣,并以此为目标申请美国大学。尽管最初对传统机器人学感到失望,几乎考虑退学,但分布式深度学习激发了他的兴趣。随后 AlphaGo 的出现成为决定性瞬间,让他确信 AI 是未来的方向。在短暂效力于一家现已不存的 AI 初创公司后,他得知 OpenAI 聚集了多位波兰同胞,包括他敬仰的 Wojciech Zaremba 等人,便决心加入。
2017 年前后,两人先后加入 OpenAI。当时,深度学习革命虽已启动,但远未如今日这般炙手可热。OpenAI 也并非今天的巨头,而是一个充满不确定性的独立实验室。吸引他们的,除了认识的朋友,还有面试中接触到的 Ilya Sutskever、Alec Radford 等人展现出的才华与愿景。Szymon Sidor(西蒙·西多)坦言,当时 OpenAI 「构建 AGI」的使命宣言在他听来「有点扯」,他对超快时间线持怀疑态度,更多是被技术本身所吸引。
OpenAI 早期:探索、质疑与文化演变
初入 OpenAI,两人感受到的氛围与今天截然不同。Szymon Sidor(西蒙·西多)形容为「冒名顶替综合症有限公司」:公司里有一批非常知名的研究员,他们彼此之间都隐约感觉不如对方,午餐时常常很安静,大家都在心里打长长的腹稿,以期说些聪明的话。这种「尴尬」也反映在技术路径上:大家并不知道明确的方向,而是在多个不同方向上探索。
Jakub Pachocki(雅库布·帕霍茨基)补充道,他们作为「新皈依者」,带着一种基于实证的怀疑论视角,与像 Ilya Sutskever 这样对深度学习有长远信念的同事形成了有益的互补。他们合作的第一个大项目是让 AI 玩转复杂游戏《Dota 2》。他们原本预期,简单地扩展现有强化学习算法会遇到障碍,从而为他们提供深入研究「算法为何失败」的机会。然而结果令人「失望」:算法直接生效了。接下来的两年,他们主要的工作变成了持续扩展系统规模,并在此过程中解决各种工程瓶颈。这个项目是 OpenAI 早期少数几个长期、聚焦的项目之一。
那么,GPT 范式是如何确立的呢?Jakub Pachocki(雅库布·帕霍茨基)特别澄清,这并非 Alec Radford 偶然「撞见」的。关键转折点是 2017 年的「情感神经元」论文(早于 Transformer 发表)。该研究证明,仅在海量评论数据上训练一个 LSTM 模型,它就能无监督地捕捉到评论是正面还是负面这一语义概念。这揭示了纯粹从数据中能推断出深层含义,让团队意识到「这里面大有可为」。此后,Alec Radford 等人持续探索基于大规模数据的语言建模,最终汇聚成 GPT 这条道路。
构建 AI 的日常:与「静默 Bug」共舞
谈及当今 AI 研发的日常,Jakub Pachocki(雅库布·帕霍茨基)形容为「寻找 Bug」。这是一个独特的领域:一方面,研究者对神经网络架构、优化方式拥有完全的控制权;另一方面,我们并未完全理解网络优化的根本原理。这意味着研究者其实是在研究一种自然现象,必须精心设计实验以理解不同改动如何导致迥异的结果。
挑战在于,神经网络「非常想学习」。即使你的实验设置存在某些错配,它们依然会学习,只是可能学得不够好。这就导致了大量「静默 Bug」——错误发生了,但系统没有崩溃,只是性能未达预期,使得定位问题异常困难。Szymon Sidor(西蒙·西多)也分享了他早期一篇关于数据预处理中颜色处理导致图像中鱼消失的博客,以及他与 Jakub Pachocki(雅库布·帕霍茨基)合作,花费大量时间追踪神经网络中随机性能峰值的根源的经历。这些「修 Bug」的工作贯穿了他们的职业生涯。
作为长期合作的「强力二人组」,他们的协作模式也很有趣。Szymon Sidor(西蒙·西多)擅长乐观地快速获取数据、推进实施,而 Jakub Pachocki(雅库布·帕霍茨基)则善于深入思考现象本质、规划研究路径。Szymon Sidor(西蒙·西多)欣赏 Jakub Pachocki(雅库布·帕霍茨基)那种「坚信问题可以被解决」的信念感,而 Jakub Pachocki(雅库布·帕霍茨基)则钦佩 Szymon Sidor(西蒙·西多)的无畏与行动力。他们常常共同处理那些处于项目边缘、重要性难以向他人说明的问题,例如早期预训练中数据批次并非真正独立同分布(i.i.d.)这一工程难题,其解决虽未带来巨大性能飞跃,但让数据处理从「感觉导向」变得更可管理,为后续发展扫清障碍。
从「模仿思考」到「自主推理」:AGI 观的演变
对话转向了对未来发展的展望。Jakub Pachocki(雅库布·帕霍茨基)指出,过去两年的一大焦点是迈向「推理范式」。像 GPT-4 这样的模型知识渊博,但当被要求思考时,它们很大程度上是在模仿人类可能如何解决问题,因为训练数据就是人类的语言。这并非模型自身的思考方式。OpenAI 的目标是教会模型以自己的方式进行思考。经过大量调试和研究,他们看到了模型开始产生不同于初始训练的思考模式,这是一个重大时刻。他认为,接下来几年,这种「自主推理」的进步将会加速,类似于语言模型从早期发展到 GPT-4/ ChatGPT 所经历的轨迹。
Szymon Sidor(西蒙·西多)也认为,新的推理范式极其丰富,可以从许多方向进行研究。当前的一个根本性瓶颈是我们衡量模型智能水平的方式与实际能力之间存在差距。例如,模型可能在 10 道数学题上都得满分,但与之交互时仍能明显感觉缺失。他认为,设计更好的评估基准本身就是一个有价值的研究方向,甚至可以在没有海量 GPU 的实验室中进行。
关于 AGI 的定义,两人的看法都随时间发生了显著变化。Szymon Sidor(西蒙·西多)认为,AGI 这个概念正在变得「毫无意义」,而这可能正意味着我们接近了它。AI 已经在数学、编程等特定领域超越了绝大多数人类。Jakub Pachocki(雅库布·帕霍茨基)则回忆,2017 年时 AGI 更像一个遥远的情感目标,仿佛一个能解决所有问题、且所有对齐和安全问题都已解决的终极系统。如今看来,AGI 是一系列里程碑。OpenAI 章程中「能够完成大部分有经济价值的工作的 AI」的定义经受住了时间考验,并且变得可以衡量。
对 Jakub Pachocki(雅库布·帕霍茨基)而言,最接近他最初 AGI 想象的里程碑是「能够进行自动化研究、发现新知识的系统」。他预计,在未来几年内,我们将出现能够在许多领域以更少人类专项工作解决此类问题的通用系统。
责任、安全与治理:强大 AI 的双刃剑
随着 AI 能力快速增长,其责任与风险也成为焦点。Jakub Pachocki(雅库布·帕霍茨基)认为,OpenAI 的使命是确保 AGI 惠及全人类。这包括两方面:一是通过迭代式产品部署,思考强大 AI 如何与人交互、应采用何种形态、如何确保可及性;二是进行长期的科学研究,构建理解这项技术如何运作的「科学」,这最终将使我们能够思考如何将其与我们的价值观对齐并确保安全。
Szymon Sidor(西蒙·多)以新冠疫情初期为例,说明了团队感受到的深刻责任感。当时他们急切地想用 AI 帮助应对疫情,但技术尚未成熟,未能提供实质性帮助。他设想,如果发生在今天,医生或许能通过 ChatGPT 快速获取文献综述,节省时间。这让他认识到,履行责任的方式或许不是被动反应,而是扎实地构建基础,通过迭代部署逐步让世界变得更好。
AI 对齐(Alignment)不仅是技术问题,更是「对齐什么」的价值选择问题。Jakub Pachocki(雅库布·帕霍茨基)指出,即使拥有将模型与某些价值观对齐的技术能力,我们距离能够安心使用仍有很大差距。随着系统变得更智能、更微妙甚至有些「异类」,无法再依赖监督一切或设定清晰边界,必须依靠更高级的方法。他以社交媒体推荐算法为例:AI 优化用户参与度本身并非坏事,但可能导致回音室和观点极化,这说明了对齐的挑战性。
当被问及如何看待众多由前 OpenAI 员工创办的竞争对手(如 xAI、SSI、Thinking Machines Lab 等)时,Jakub Pachocki(雅库布·帕霍茨基)承认这是一个微妙的问题。开放与竞争能促进创新,尤其开源模型能培育大实验室之外的创造力;但另一方面,如此强大的技术显然需要在部署时投入一定程度的控制和思考,而随着技术扩散,控制将愈发困难。两者都有其道理,其影响深远复杂,难以简单抉择。
不可避免的话题是 2023 年 11 月的 OpenAI 董事会风波。两人当时都感到震惊和困惑。Szymon Sidor(西蒙·西多)坦言,早期的治理结构在当时看来像是「过度设计」,他作为 AGI 怀疑者甚至没有完全认同。但这场风波让他意识到,治理至关重要,早期看似无关紧要的决定可能会在未来带来巨大影响。Jakub Pachocki(雅库布·帕霍茨基)也强调了治理的极端重要性,以及他们倾注近十年心血构建的一切可能突然陷入危机的现实。
展望未来,Jakub Pachocki(雅库布·帕霍茨基)最期待的是 AI 能加速新知识发现、新技术开发和疾病新疗法的寻找。但他也最担忧,由少数人管理、完全自动化运行的强大 AI 研究团队可能带来前所未有的权力集中,这种根本性的权力结构变化是社会必须谨慎应对的全新挑战。
Szymon Sidor(西蒙·西多)则对 AI 安全的前景感到更乐观。过去他认为没有多少具体的安全问题可以攻克,但如今看到,随着模型能力增强,安全性正变得与能力本身紧密交织。例如,要让一个强大的 AI 安全地访问你的邮箱,就必须确保它能抵抗诱导指令。这种能力与安全的激励一致化,使得在安全性上取得进展成为可能,甚至是产品有用的前提。当然,这并不能保证完美的结果,但无疑增加了解决长期安全部署问题的可能性。










