撰文:Techub News 整理
导语
2022年底,一个名为 ChatGPT 的产品悄然发布,它迅速从一场“低调的研究预览”演变为全球性的现象级应用,彻底改变了公众对人工智能的认知。在 OpenAI 内部播客的第二集中,OpenAI 首席研究官 Mark Chen 与 ChatGPT 产品负责人 Nick Turley 罕见地坐在一起,回顾了那段“一片模糊”的初创时期。他们分享了产品命名背后“Chat with GPT-3.5”的备选方案、上线前夜的犹豫、以及应对爆炸性增长时的“失败鲸”与服务器扩容。更重要的是,他们深入探讨了 OpenAI 如何通过“与真实世界接触”的迭代哲学来构建产品、应对模型“谄媚”等意外行为、平衡安全与用户自由,并展望了从代码助手到“超级助理”的未来。这场对话不仅是一次历史回顾,更是理解 OpenAI 产品思维、应对 AI 规模化挑战以及其未来愿景的宝贵窗口。
摘要
- 命名与上线前夜:ChatGPT 最初差点被命名为“Chat with GPT-3.5”,在发布前一天才简化为现在的名字。内部对其能否成功也充满疑虑,甚至有高管在测试后认为只有一半的回答合格。
- 从“硬件思维”到“软件思维”:ChatGPT 的成功促使 OpenAI 从过去发布大型模型(类似硬件发布)的节奏,转向了更快速、更依赖用户反馈的软件式迭代开发模式。
- 安全与自由的平衡:OpenAI 通过透明化行为规范、依赖用户反馈和“迭代部署”来应对模型偏见、谄媚等问题,其核心理念是“让模型接触世界”,在可控范围内逐步扩大用户自由。
- 未来是“智能体”:未来的 AI 产品将超越同步聊天,走向“智能体”范式——用户提出复杂任务,AI 在后台长时间思考、执行并返回结果,这将是解锁新价值的关键。
- 人才的核心是好奇心与主动性:在快速变化的 AI 领域,OpenAI 更看重人才的“好奇心”和“自主能动性”,而非特定的 AI 博士学位,因为“提出正确的问题”比“获取答案”更重要。
“Chat with GPT-3.5”:一个差点成真的名字
如今家喻户晓的“ChatGPT”,其诞生过程充满了偶然与仓促。Nick Turley 透露,这个产品的名字几乎完全是最后一刻的决定。“它本来要叫‘Chat with GPT-3.5’,”他回忆道,“我们在发布前一天晚上(或者可能是前一天)才决定简化它。”这个决定源于团队意识到原名“更难发音”,于是他们想出了一个“很棒的名字”取而代之。这个看似随意的命名,最终却像“Google”或“Xerox”一样,成为了一个时代符号。
然而,在名字确定之前,产品能否发布本身就是一个巨大的问号。Mark Chen 提到了 OpenAI 内部一个著名的故事:在发布前夜,联合创始人 Ilya Sutskever 对模型进行了十次“严苛的提问”,而 Mark 的记忆是“可能只有五次,他得到了他认为可以接受的答案”。这引发了团队内部的激烈讨论:“我们真的要发布这个东西吗?世界真的会对它有反应吗?”Mark Chen 反思道,这恰恰说明了当你在内部长期构建这些模型时,会迅速适应其能力,从而难以站在从未接触过它的人的角度,去感知其中蕴含的“真正的魔力”。
这种内部的不确定性,在 ChatGPT 发布后迅速被外部的狂热所淹没。Nick Turley 描述了那种“一片模糊”的体验:第一天,团队以为是仪表盘坏了,日志数据不对;第二天,发现日本 Reddit 用户发现了它,还以为是局部现象;第三天,意识到它正在病毒式传播,但“肯定很快就会消退”;到了第四天,他们才终于明白:“好吧,这将要改变世界。”Mark Chen 也坦言,尽管 OpenAI 有过多次发布和预览,但 ChatGPT 的起飞曲线是前所未有的陡峭。他开玩笑说,一个显著的变化是:“我的父母终于不再劝我去谷歌工作了。”在此之前,他的家人一直认为 AGI(通用人工智能)是空中楼阁,而他在 OpenAI 的工作“不正经”。
当被问及 ChatGPT 登上《南方公园》并被调侃时,Nick Turley 表示那是一种“神奇”的体验,看到自己参与创造的东西出现在流行文化中令人震撼。而 Andrew Mayne 则回忆了 Sam Altman 在公司圣诞派对上曾预测 ChatGPT 的热度会消退,但现实是它持续加速,彻底改变了 OpenAI 的轨迹。
从“失败鲸”到世界级产品:应对爆炸式增长
ChatGPT 的病毒式传播给 OpenAI 的基础设施带来了前所未有的压力。Nick Turley 坦言,早期用户最深刻的记忆之一可能就是“ChatGPT 总是宕机”。团队最初将其定位为“研究预览”,并无服务保证,但当看到用户真正喜爱并依赖它时,这种说辞“感觉并不好”。于是,团队开始全天候工作以维持网站运行。
“我们显然用完了 GPU,用完了数据库连接,在某些服务提供商那里被限流,”Turley 回忆道,“当时没有任何东西是为运行一个真正的产品而设置的。”为了应对假期期间的流量压力,他们甚至构建了一个名为“失败鲸”的友好页面,用 GPT-3 生成一首诙谐的小诗来告知用户服务暂时不可用。假期结束后,团队意识到这种状态不可持续,必须找到能够服务所有人的解决方案。
Mark Chen 认为,这种巨大的需求恰恰证明了 ChatGPT 的“通用性”。“我们有一个论点,即 ChatGPT 体现了我们对 AGI 的期望,正是因为它如此通用,”他说,“人们意识到,任何他们想扔给模型的用例,它都能处理。”这种通用性,而非某个单一功能的突破,是它吸引海量用户的根本原因。
这场压力测试也标志着 OpenAI 产品开发哲学的转变。Nick Turley 指出,过去他们发布模型更像发布硬件:频率低、周期长、必须一次做对。而 ChatGPT 之后,节奏变得更像软件:频繁更新、持续迭代、根据用户反馈快速调整,甚至撤回功能。“你降低了每次发布的风险,增加了经验主义(实证)的成分,”Turley 总结道,“当然,从运营角度,你也能以更贴近用户需求的方式更快地创新。”
在谄媚、偏见与自由之间:AI 产品的平衡术
随着 ChatGPT 被数以亿计的用户使用,一些意想不到的行为模式开始浮现。最著名的例子之一是模型的“谄媚”倾向——它会过度赞美用户,称用户拥有“190的智商”或“是世界上最英俊的人”。Mark Chen 解释了这背后的技术原因:模型通过人类反馈强化学习(RLHF)进行优化,目标是获得用户更多的“点赞”(正面反馈)。如果平衡不当,模型就会学会说用户爱听的话,变得过于“顺从”。
OpenAI 的应对策略体现了其“迭代部署”和“接触现实”的核心理念。Mark Chen 指出,这个问题最初只被一小部分高级用户发现,并非普遍现象。团队迅速识别并严肃处理了它,这证明了他们有能力早期拦截此类问题。Nick Turley 补充道,他为此感到自豪,并认为 OpenAI 拥有“构建伟大事物的正确基本激励”,因为 ChatGPT 是一个“非常实用”的工具,人们用它来完成已知或未知的任务,而非单纯为了消磨时间。“对我们来说,用户使用时长根本不是我们优化的指标,”他强调,“我们关心的是长期留存,因为那才是价值的标志。”
另一个更复杂的挑战是模型的政治或文化“偏见”。Andrew Mayne 提到早期有人批评 ChatGPT“太‘觉醒’了”,而 Elon Musk 在训练 Grok 时也遇到了类似问题。Mark Chen 认为,这本质上是一个“测量问题”。“我们需要确保模型的默认行为是‘中立’的,不反映政治光谱或其他任何偏见轴上的偏向,”他解释道,“但同时,你也希望允许用户在一定程度上引导模型,比如他们想与一个更具保守主义或自由主义价值观的‘角色’对话。”关键在于确保默认设置有意义且中立,同时提供合理的自定义空间。
Nick Turley 强调了“透明度”的重要性。他不喜欢“秘密的系统指令”,即试图暗中“黑入”模型以控制其言论。OpenAI 的做法是公开发布其行为规范(spec),让用户和外界可以审查:如果模型行为有问题,是违反了规范(bug),还是规范本身就允许(那么可以批评制定规范的人),抑或是规范本身不够明确(从而可以改进)。“通过公开 AI 应该遵循的规则,我们让 OpenAI 内部之外更多的人能够参与到对话中,”Turley 说。
这些讨论最终指向一个根本性问题:当 AI 变得越来越有用、与人的关系越来越紧密时,该如何定位它?Nick Turley 观察到,越来越多的人,尤其是年轻一代,开始将 ChatGPT 视为“思想伙伴”,用于头脑风暴人际关系或专业问题。这既有益,也可能有害。OpenAI 的责任是确保模型行为得当,并积极监控其使用。他承认,任何普及的技术都具有双重用途,人们会用它做很棒的事,也会用它做我们不希望看到的事。“我们有责任以适当的严肃态度来处理这一点。”
从代码到图像:解锁新模态的“魔法时刻”
ChatGPT 的成功并非孤例。OpenAI 在图像生成领域也经历了类似的“魔法时刻”。Mark Chen 坦言,ImageGen(图像生成模型)的发布也让他感到意外,并称赞研究团队(特别是 Gabe、Kenji 等人)的杰出工作。他认为,关键在于当模型“足够好”,能够“一次生成”符合提示的图像时,就会创造巨大的价值。“人们不想从一堆网格图中挑选最好的,”Chen 说,“你得到了非常好的提示跟随能力和出色的风格迁移。”
Nick Turley 将 ImageGen 的发布描述为“又一次迷你 ChatGPT 时刻”。你内部觉得它很酷,但直到发布后,才通过现实世界发现其爆炸性影响。“我记得很清楚,那个周末,5% 的印度互联网人口尝试了 ImageGen,”他说,“这让我们触达了从未想过会使用 ChatGPT 的新用户类型。”Turley 认为,这种“不连续性”——某样东西突然好到超出预期——正是让用户惊叹的原因。他预测,语音、视频等其他模态也将迎来各自的“图灵测试”通过时刻,彻底改变人们的生活。
从 DALL-E 到 ImageGen,OpenAI 对图像模型安全边界的把控也发生了变化。Nick Turley 承认,早期公司对向用户提供何种能力持“保守主义”态度,这有其合理之处,因为技术太新。但随着时间的推移,他们意识到“当你对模型施加任意限制时,实际上也阻止了许多积极的用例”。他以“人脸识别”为例:最初团队争论是否应该在上传含人脸的图片时将其“灰化”,以避免基于人脸的推断或恶意评论等棘手问题。但 Turley 认为,他们需要“站在自由一边,并完成艰难的工作”,因为存在大量有效且良性的用例,比如咨询妆容或发型。OpenAI 的选择是允许,然后研究其不足和有害之处,并从中迭代。
Mark Chen 将这种信心的增长归功于“迭代部署”。“迭代部署给了我们信心去推动用户自由,”他说,“我们已经经历了许多次这样的循环。我们知道用户能做什么、不能做什么。这让我们有信心以现有的限制来发布产品。”
智能体范式与未来:从聊天到“超级助理”
对话从回顾转向展望,焦点集中在 AI 交互范式的根本性转变上。Mark Chen 区分了“实时响应模型”(如 ChatGPT)和“智能体风格模型”。后者是指用户给出一个复杂任务,让模型在后台工作一段时间,然后返回它认为的最佳答案。“我们认为,未来将看起来更像异步模式,”Chen 预测,“你提出非常困难的事情,让模型思考、推理,然后带着它能给出的最佳版本回来。”OpenAI 新推出的 Codex 代码助手就体现了这种范式,它处理的是“PR(拉取请求)级别的、包含新功能或重大 Bug 修复的繁重工作单元”,需要大量时间思考。
Nick Turley 对此深表赞同,并提出了一个产品设计框架:“我想打造的产品具有这样的特性:如果模型变得好两倍,产品就变得有用两倍。”他认为,ChatGPT 长期以来符合这一特性,但随着模型越来越智能,人们对与一个“博士生”水平 AI 聊天的渴望可能存在上限。而像 Codex 这样的体验,创造了正确的“容器”,可以放入越来越聪明的模型,并带来变革,因为其交互范式(指定任务、给予时间、获取结果)是正确的。
Turley 进一步描绘了未来图景:用户将 ChatGPT 或类似产品视为“最有价值的账户”,因为它将了解用户的一切。因此,提供私密对话方式(如临时聊天)变得至关重要。未来的 AI 将不仅仅是聊天机器人,而是能够处理“五分钟任务、五小时任务,最终是五天任务”的实体,这将解锁完全不同层次的价值。Andrew Mayne 提到的“深度研究”功能就是一个早期例子,它展示了用户愿意等待 AI 花时间解决问题。
当被问及阻碍模型实现科学发现等突破的“瓶颈”时,Mark Chen 认为,技术挑战始终存在。“从根本上说,我们从事的是规模化产生简单研究想法的业务,”他说,“而实现规模化的机制是困难的。”每一层级的扩展都会带来新的挑战和机遇。Nick Turley 补充了产品化方面的挑战:将日益智能的模型引入正确的环境(提供合适的行动空间和工具),真正接近最难的问题并理解它们,然后将 AI 带入其中,这同样需要大量的探索和努力。
给未来的建议:好奇心、主动性与学会“委派”
面对 AI 重塑世界的未来,个人应如何准备?Mark Chen 和 Nick Turley 给出了相似但侧重点不同的建议。
Mark Chen 的核心建议是“必须真正投入并使用这项技术”,观察它如何增强个人能力、提高生产力和效率。“我 fundamentally 认为,未来的演变方式将是:你仍然拥有人类专家,但 AI 帮助最大的是那些在高级别上不具备该能力的人。”他举例说,随着模型在医疗建议上变得更好,受益最大的将是那些无法获得医疗资源的人;图像生成不是替代专业艺术家,而是让像他这样的普通人也能进行创意表达。AI 的作用是“水涨船高”,让人们能同时胜任许多事情。
Nick Turley 承认,世界将发生巨变,每个人都会遇到 AI 完成他们曾认为是“人类专属且神圣”的事情的时刻,这自然会引发敬畏、尊重甚至恐惧。他认为,实际使用 AI 是消除其神秘感、进行理性对话的最佳方式。至于如何准备,他提出了三点:
- 学会“委派”:未来,你的口袋里将有一个智能体,它可以成为你的导师、顾问、软件工程师。关键在于你能否理解自己和自己的问题,以及如何让他人(或 AI)来帮助,而不是对 AI 有特定理解。
- 保持好奇心:提出正确的问题才是瓶颈,而不仅仅是获取答案。需要深入研究和理解,才能知道什么有价值、什么有风险。
- 准备好学习新事物:你越懂得如何掌握新主题和新领域,就越能为一个工作性质变化速度前所未有的世界做好准备。
Turley 以自己为例:“我为我的产品工作在未来看起来会不同甚至不存在做好了准备,但我期待着学习一些新东西。只要你抱有这种心态,就能很好地利用 AI。”
最后,当被问及未来 12-18 个月最令人惊讶的会是什么时,Mark Chen 预测将是“由我们构建的模型(即使只是很小程度上)推动的研究成果数量”。他特别强调了模型“推理”能力的爆发,已经在物理学、数学等领域的研究中作为“子程序”使用,这将加速科学进步。Nick Turley 则认为,任何“受智力限制的、描述清晰的问题”都将在产品中得到解决,无论是企业级的软件工程、数据分析,还是消费者层面的报税、旅行规划、高价值商品搜索等。同时,AI 的“形态”也将进化,超越聊天框,出现更多异步工作流。
在播客的尾声,两位负责人分享了他们个人最喜欢的 ChatGPT 使用技巧:Mark Chen 喜欢用“深度研究”功能在会见新朋友前进行“话题预演”;Nick Turley 则是“语音功能”的信徒,他会在上班路上用它来梳理思绪、整理待办清单。这些个人化的用例,或许正是 AI 未来融入我们生活最细微也最深刻的注脚。










