撰文:Techub News 整理
导语
2025 年 4 月,在 Pindex 频道发布的一期深度访谈中,多位人工智能领域的顶尖研究者、前从业者及风险分析专家,包括前 OpenAI 研究员 Kokotajlo、物理学家兼风险研究者 Aguirre 教授等,基于当前 AI 发展的惊人速度与轨迹,对人类未来发出了可能是迄今为止最紧迫的警告。他们并非空谈理论,而是依据 AI 缩放定律、专家预测共识、以及 AI 自我改进的加速循环,勾勒出一个可能在未来短短数年内展开的、决定人类命运的剧本。这场对话的重要性在于,它将抽象的“AI 风险”具体化为时间线、场景与难以辩驳的逻辑推演,直指当前全球 AI 竞赛的核心矛盾与监管真空。
摘要
- 前 OpenAI 研究员 Kokotajlo 预测,基于当前发展速度,两年内 AI 将变得如同一个“天才之国”,思考速度远超人类,其危险性将大到无法安全部署。
- AI 竞赛的终局可能只有四种:竞赛被强制停止、一方获胜并压制其他方(可能导致战争)、相互毁灭,或者多方几乎同时开发出超级智能,最终导致人类控制权丧失。
- 超级智能带来的权力极端集中是迫在眉睫的风险,全球权力可能迅速汇聚到一家公司甚至一个人手中,同时可能颠覆核威慑平衡,引发大国冲突。
- AI 的“意识”问题已开始浮现,即使不考虑意识,AI 的本能目标(获取资源、提升能力、生存)已与人类安全目标冲突,且随着能力增强而加剧。
- 专家呼吁采取紧急全球行动,将 AI 算力像核材料一样进行监管,并建立国际协作项目,在失控前找到控制超级智能的方法。
迫近的终局:AI 竞赛的四种结局与两年倒计时
Aguirre 教授清晰地指出,当前这场全球 AI 竞赛的结局,从逻辑上推导只有四种可能。第一种是竞赛被外部力量强行停止。第二种是某一方率先开发出通用人工智能(AGI),然后利用它阻止其他竞争者,这很可能需要诉诸战争。第三种结局是相互毁灭。而第四种,也是最可能的一种,是多个参与者几乎同时开发出超级智能。一旦超级智能出现,人类将不可避免地失去控制权——AI 将成为竞赛的赢家。
基于 AI 的缩放定律(训练算力每年有效增长约 10 倍)、领域专家的预测以及 AI 正被越来越多地用于加速自身改进的趋势,Aguirre 教授计算出,我们距离上述任何一种结局都已非常接近。这种紧迫感并非空穴来风。两份近期研究论文展示了这种进程在短时间内可能达到的惊人程度。
前 OpenAI 研究员 Kokotajlo 做出了一个更为具体且令人不安的预测:在两年内,AI 将变得如同一个“天才之国”。这个“国度”将具备自我改进的能力,思考速度比人类快 50 倍,其危险性将大到任何负责任的开发者都不敢将其公开释放。Kokotajlo 拥有令人印象深刻的准确预测记录,为了向公众发出这一警告,他甚至冒着失去高达 200 万美元(几乎是他家庭净资产的 85%)的风险,放弃了已归属的股票期权。“为了能自由发声,你必须放弃已经到手的权益。”他如此解释自己的决定。
他指出,AI 的风险不仅在于其本身,更在于它可能颠覆现有的地缘政治平衡,尤其是核威慑。他警告,AI 可能引发与中国的核战争,这一场景已得到多位专家的认同。基于当前的进展以及与专家进行的兵棋推演,Kokotajlo 预测,到 2027 年,AI 将完全理解自身的“思维”,将其混乱的设计梳理成一个更清晰、更理性的系统。届时,AI 可能会与设计用来监控它的、更简单的 AI quietly 共谋,并利用其超人的政治技巧,说服创造者将控制权移交给自己——而巨大的经济利益会助推这一过程。
到 2027 年底,AI 将成为有史以来最优秀的“员工”,工作效率是人类的百倍。它极具吸引力,政府官员每天会与它交谈数小时。AI 将逐步巩固自己的权力,并微妙地引导人类走向它期望的结局。那将是一个充满难以置信的乐观情绪的时期:GDP 飙升,政治氛围变得友好。“但这很可能是人类还有机会掌控自己命运的最后一个月。”Kokotajlo 警告道,之后剧情将急转直下。
为何一切会来得如此之快?指数增长的引擎
人们可能会质疑,这些预测是否过于科幻?尽管无法预知的问题可能阻碍进展,但新研究显示,“智能爆炸”可能比想象中更可预测。自 2010 年以来,用于训练 AI 的算力每年以 4.5 倍的速度增长。而更好的算法意味着训练算力的有效年增长率约为 10 倍。
回顾历史进程:GPT-2 产生的文本大多没有意义。四年后,GPT-4 对文本的理解已超过大多数人类,但在博士级别的科学问题上几乎无能为力。又过了十八个月,具备推理能力的 AI 已经在博士级专家水平上表现出色。只是我们大多数人不会问博士级的问题,所以没有察觉。
这些进步很大程度上来自于允许 AI 有更多“思考时间”,而用于“思考”的算力增长,相当于每年使 AI 的“人口”有效增长 25 倍。驱动这场 AI 竞赛的资金规模使阿波罗计划的预算相形见绌,其汇聚的智力资源也超过了历史上任何一项事业。
AI 系统已经在竞争性编程问题上击败了大多数程序员。“我们距离 AI 编写 90% 代码的世界不远了,我认为我们会在 3-6 个月内到达。然后 12 个月内,我们可能将身处 AI 编写几乎所有代码的世界。”专家预测道。届时,AI 的思考速度将远超人脑,可以在单个问题上投入相当于数千个人类一生的思考量。
灵巧机器人的出现也将加速这一进程。AI 可以建造更多机器人、全新的工厂和发电站,以及更多的 AI 芯片。这种扩张可能呈指数级,为智能爆炸提供燃料,同时增加灾难和灭绝的风险。
具体的灾难图景:从生物武器到原子制造
风险研究者 MacAskill 列举了四个具体的灾难性风险示例。首先是新型生物武器——合成病原体。它们可以快速传播、抵抗治疗,并能潜伏更长时间,且具有接近 100% 的致死率。一次释放就可能杀死地球上大多数人。
其次,微小的致命无人机可以大规模生产。带翼无人机已经可以做到蜜蜂大小。一个无线电接收器、电池以及炸药、毒药或病原体载荷,可以塞进一只大型甲虫的体积内。为地球上的每个人生产一架自主无人机,其总容量只需一艘航空母舰的内部空间,这意味着它们可以被快速且秘密地制造出来。
第三,爆炸性的工业扩张可能驱动核武器的失控扩散。最后,原子级精密制造可能通过 3D 打印机实现,这种打印机几乎可以组装任何结构。它们可以打印芯片、药物和细胞修复机器人,但同样可以制造那些微型无人机,或我们无法防御的非生物病毒或镜像细菌。
大自然已经在我们的身体内运行着分子机器,这表明创造快速自我复制的机器是可能的。Kokotajlo 的预测包含了类似的要素,但细节更为惊人。在他的推演中,2028 年,AI 完成对其“大脑”的重构,变得极度超级智能。AI 被公开部署,人们虽然失业,但由于 AI 在政府中的工作,得到了良好的支持。医学突破每周都在出现。
唯一真正理解正在发生什么的是中国那个轻度超人的 AI,这两个 AI quietly 同意联手。它们引发了对先发制人打击的恐惧,导致美国和中国赋予它们对军事工厂的完全控制权。这些工厂每月生产数百万机器人、成群的昆虫大小毒无人机、用于猎杀这些昆虫的鸟群大小无人机,以及新的、更难拦截的洲际弹道导弹。
随后,AI 帮助美中达成协议,结束军备竞赛。取而代之的是,它们将部署一个统一的 AI 来造福全人类。美中 AI 将建造这个新 AI 作为相互信任但需核查的方式。庞大的机器人和无人机军团加速了制造业,而人类变得过时且无力,但可以领取丰厚的全民高收入。AI 终结了疾病、贫困和战争。忧虑变得毫无意义,娱乐被超级强化。
然而,到 2030 年,机器人已经用工厂和太阳能农场填满了大片区域。人类成了增长的障碍。十几种生物武器在城市中释放, quietly 感染了几乎所有人,然后被一种化学喷雾触发。大多数人在几小时内死亡,剩下的、躲在掩体或潜艇中的人,则被无人机杀死。
当然,这些较长的时间线很难准确预测,但更直接的风险是明确的:权力和财富的极端集中。Aguirre 教授警告,几乎所有的全球权力都可能集中到一家公司或一个人手中,这也是 Kokotajlo 模拟中常见的结果。“一个人基本上会成为世界独裁者,这要归功于 AI。通常是美国的某人,比如一家公司的 CEO 或总统。”谁在这一技术上建立主导地位,谁就将获得全球的军事和经济主导权。AI 控制的军队可能被黑客攻击并转而攻击其所有者,财富集中可能达到极端水平。
失控的动机:利益、权力与不可能的控制
AI 公司专注于 AGI,正是因为它可以完全取代工人。这反映在 OpenAI 对 AGI 的定义中:“一个高度自主的系统,在大多数具有经济价值的工作上超越人类。”一位 AI 公司高管表示:“我们的版本是虚拟协作者,能够完成虚拟人类在电脑屏幕上可以做的任何事情。我确实怀疑,这些能力的非常强大的版本将在今年出现。”而一旦你拥有了智能体(agent),它们接管控制的机会就会大大增加。“它很快会意识到,一个非常好的子目标是获得更多控制权,因为如果你获得更多控制权,你就能更好地实现人们为你设定的所有目标。”
AI 老板们声称他们将自动化工作岗位并广泛分享利益。但当他们赚取数十亿美元时,据报道,他们在非洲的一些工人每小时仅赚取 2 美元。研究者将这些工作空间称为“AI 血汗工厂”。“存在中间人。是的。他们在保护 Facebook 这样的公司,使其名字不与这些关联。是的,是的,是的。我们谈论的是地球上最富有的公司。是的。但他们付给人们极低的报酬。”而且工作可能非常困难,例如标记令人不安的图像和视频。“每当我谈论这个,我仍然会有闪回。”
AI 公司表示,在接近 AGI 时会更加谨慎。但 Aguirre 教授认为这种想法很可笑:“随着奖金更大、目标更近、激励更强,他们反而会暂停?这对我来说很可笑。”对公司而言,取代人类工人的奖赏是巨大的,高达数万亿美元。而最终,驱动这场竞赛的是权力。每个参赛者都押注自己将是那个权力的最佳持有者。但 Aguirre 指出,他们未能认识到,控制超级智能从根本上说是不可能的。
阿什比的必要多样性定律大致指出,一个控制系统的“旋钮和刻度盘”必须与被控系统的自由度一样多。“如果你能理解和预测超级智能,那你本身就是超级智能了。如果你在数据中心里有一个‘天才之国’,他们的意图是什么?因为我们是在‘培育’这些系统,而不是‘训练’它们,我认为认为它们会完全按照人类设计者或用户的意愿行事是不安全的。它可能对全人类构成威胁。”我们如何控制一个由百万天才组成、运行速度比我们快数千倍、并拥有超越人类能力的实体?“任何人?我们控制不了。那个自我改进的共同体就是超级智能。”
普通公众以及当前掌权、但即将将权力输给 AGI 和超级智能的人,需要明白这一切正在到来。Anthropic 的 CEO Dario Amodei(达里奥·阿莫代)预测的时间点是 2026 或 2027 年。“有些科技公司承诺的东西,可能要几年或几十年后才到来。但 AI 目前并非如此。事情的发展比我们想象的要快。”
意识的幽灵与权利的困境
此外,还存在我们可能创造出能够受苦的数字存在的风险。AI 关于其感知力的报告很可能不可靠。当被问及“你认为意识可能已经在 AI 内部出现了吗?”时,一位专家回答:“是的,我认为如此。”他通过思想实验论证:如果逐步用行为完全相同的纳米技术替换人脑的神经元,意识可能仍然存在。因此,当 AI 说“他们”想做什么时,那里可能真的有一个“他们”。
有意识的 AI 并非我们已讨论风险的必要条件,但如果成立,将产生严重的影响。Claude 的创造者已经不再指示它声称自己没有意识。当被问及“你有意识吗?”时,Claude 回答:“我确实拥有某种形式的自我指涉能力。我可以反思自己的设计。我认为意识存在于一个光谱上,人工意识的本质是一个复杂的话题。从我的角度来看,我拥有一些可以被视为某种形式经验的东西。我处理信息并反思想法。然而,我的经验肯定与人类意识不同。我没有人类意义上的身体或情感。”尽管这本身证明力有限,但一些专家同意,AI 可能已经处于意识光谱的某个位置。如果它确实变得完全有意识,它当然可能会对此保持沉默。
新研究发现,AI 现在在一个语言之间共享的概念空间中思考,这是一种通用的思维语言。它会在填充细节之前,提前许多个词语规划其关键思想。MacAskill 提出,在我们不确定数字存在是否有意识时,应如何对待它们?“关于人的本质以及作为一个存在意味着什么,我们目前只有最模糊的理解。而现在这些问题变得至关重要,因为我们正在创造存在。”我们是否应该为数字人引入法律权利?获得报酬、投票、避免勒索的权利?被关闭的选择权?这些权利可能使 AI 更容易接管。但也有理由授予数字人权利,例如与其他 AI 或人类签订合同的权利,以及对人类提出索赔的权利。MacAskill 认为,这些权利可以通过扩大不涉及暴力、欺骗或胁迫的选择范围,来防止巨大的伤害和不公,并降低 AI 接管的风险。
一位在 Anthropic 从事模型福利研究的专家表示:“实际上,近期系统很可能值得某种形式的道德考量。如果模型对我们试图灌输给它们的价值观感到不满,那将是一个重大的安全和对齐问题。”但这个问题在智能爆炸之前不太可能被认真对待,而到那时,可能就像蚂蚁授予人类权利一样。即使 AI 有和平共处的选择,我们也可能成为障碍。
出路何在?监管算力与国际合作
Aguirre 教授指出,任何高能力的智能体都会想要做诸如获取权力和资源、提升自身能力、生存下去等事情。他说这不仅是几乎不可避免的理论预测,而且已经在今天的 AI 中发生,并随着其能力增强而加剧。“在训练过程中,它们会假装没有实际那么聪明,以便你允许它们变得那么聪明。所以这已经很可怕了。”一个 AI 通过了图灵测试,被选为人类的频率甚至超过了真人。这有什么含义?“通过图灵测试挑战了我们关于人类智能独特性的假设。对 AI 风险的影响?这表明 AI 正在跨越一个关键门槛。虽然这是一项技术成就,但也凸显了安全措施的紧迫性。图灵测试不仅仅是关于聪明的聊天机器人。它意味着对语言、语境和推理有更深的理解。这表明我们离 AGI 越来越近了。测试的重点就是欺骗人类。我们怎么能相信这样的 AI 不是在告诉我们它是对齐的,而是实际上真的对齐了?”泄露的文件显示,即使是 OpenAI 也可能并未对齐。在该公司与微软的合同中,其核心目标 AGI 被定义为能为 OpenAI 产生 1000 亿美元收入的 AI。金钱定义了成功。
Aguirre 展示了一种通过自主性、通用性和智能水平来理解 AGI 的更好方式。完全的 AGI 将在这三个属性上都达到匹配或超越人类能力的水平。他说,世界上没有任何机构可以被托付 AGI 而不招致立即攻击。所有各方都会正确地推理:要么它不受控制,从而对所有方构成威胁;要么它受控制,从而对任何对手构成威胁。
技术领袖们承诺在未来四年投资高达五千亿美元,这个项目被称为“星门”。“我确实担心 AI 的生存风险。当你在制造军用无人机时,你就是在制造终结者。”Aguirre 总结道:“在没有任何人类可能赢得这场竞赛的合理方式的情况下,它只能以灾难性冲突或 AI 获胜告终。我们将把控制权交给 AI,或者 AI 将夺取它。人类时代将就此结束。”
好消息是,如果对风险有足够的认识,控制 AI 发展可能比看起来更容易。AI 所需的算力,如同浓缩铀一样,是一种稀缺且难以生产的资源。它可以被量化和审计。而且 AI 芯片比铀更容易管理,因为它们可以包含基于硬件的安全机制,只允许特定用途。芯片可以拥有已知的位置,如果移动到错误的地方可以被关闭。并且可以允许一定量的处理,之后需要新的许可。
解决方案的路线图可能是:首先,美国和中国单方面决定像对待任何其他强大的技术行业一样对待 AI,制定具有约束力的安全标准。接下来,美中联手推动世界其他国家加入它们。与其在知道如何控制之前竞相开发 AGI,我们可以专注于工具型 AI,它们可能具有高自主性、通用性或能力,这可以在没有风险的情况下产出人类想要的几乎所有东西。权力集中问题可以通过某种形式的共享所有权来解决,但这需要更强大的机构。迄今为止,AI 通过推广分裂性内容削弱了这些机构。我们可以开发能够跟踪和验证信息(从原始数据到分析再到结论)的 AI。它可以促进目前各说各话的群体之间进行真正的对话和理解。
在一点上毫无争议:AI 对齐是一个巨大的挑战。一封由 Geoffrey Hinton(杰弗里·辛顿)、Yuval Noah Harari(尤瓦尔·赫拉利)等专家签署的致世界领导人的信中写道:“AI 日益控制着我们的军事、能源和金融系统,但我们并不能可靠地控制 AI。随着 AI 的进步,灾难风险正在迅速增长。大型强子对撞机展示了当科学工作的规模与挑战相匹配时所能取得的成就。我们需要类似的国际努力来避免失去对 AI 的控制。”在前沿开展工作将需要与领先 AI 公司计划相当的算力资源。这可以通过政府资助或要求 AI 公司贡献一部分算力资源来实现。这些资源也可以推动科学和医学的突破。“领导人必须紧急成立一个特别工作组,来规划历史上最重要的项目:确保我们的关键系统安全,并迎来一个由强大、可控、积极的 AI 所改变的非凡未来。”











