撰文:Techub News 整理
导语
2025 年 9 月,长期致力于人工智能安全研究的计算机科学副教授 Roman Yampolskiy(罗曼·扬波利斯基)做客知名播客频道《The Diary Of A CEO》,进行了一场长达87分钟的深度对话。Yampolskiy 是“AI安全”术语的提出者,在该领域已深耕超过15年。本次对话发生在全球AI军备竞赛愈演愈烈、技术能力呈指数级增长但安全性研究严重滞后的背景下。他以其深厚的学术背景和对行业发展的紧密观察,对AI发展的极端风险、时间线以及人类社会可能面临的剧变提出了极其严峻、甚至惊世骇俗的预测与分析。
摘要
- AGI(通用人工智能)预计将在2027年左右实现,随之而来的超级智能将远超人类在所有领域的智慧。
- 到2030年,功能性人形机器人结合高级AI,将导致失业率飙升至前所未有的高度(如99%),绝大多数人类工作将被替代。
- 我们正以指数级速度提升AI能力,但对其安全性和可控性的研究进展却线性甚至停滞,这种“剪刀差”正在扩大,最终可能失控。
- 当前AI的发展路径本质上是对全球80亿人进行的、未经许可且无法获得真正同意的危险实验,其后果可能是人类灭绝。
- Yampolskiy 相信我们极有可能生活在一个模拟现实中,但这并不改变当前决策的伦理紧迫性。
从乐观到悲观:一位AI安全专家的认知转变
Roman Yampolskiy(罗曼·扬波利斯基)在访谈伊始便开门见山,道出了他个人研究历程中的关键转折:“在最初的至少五年里,我致力于解决(AI安全)这个问题。我深信我们能够制造出安全的AI。但越是深入研究,我越发意识到,这其中的每一个组成部分都不是我们实际能够解决的。”他将这种困境比作“分形”——每深入一层,就会发现十个新问题,然后是上百个,而这些新问题不仅难以解决,甚至可能是“不可能解决的”。
Yampolskiy 指出,AI能力的进步正以指数级甚至超指数级的速度发展,而AI安全领域的进展却只是线性或恒定的。二者之间的差距正在急剧扩大。我们至今没有看到任何奠基性的成果能宣称“我们解决了这个问题,不必再担心了”。现有的做法更多是“打补丁”——比如为大型语言模型设置规则,禁止其说脏话或做某些坏事,但这些措施很快就会被“越狱”破解。这就像公司的人力资源手册:你可以规定“禁止性骚扰”,但总会有足够聪明的人找到规则的漏洞,将行为转移到尚未受限的子领域。
当被问及对像 OpenAI CEO Sam Altman(萨姆·奥尔特曼)这样的人物有何看法时,Yampolskiy 态度尖锐。他提到,大约十年前,学界就发表了关于如何正确发展AI的指导原则(护栏),而 OpenAI “违反了其中的每一条”。他认为 Sam Altman 等人是在“将80亿人的生命作为赌注,以换取自己变得更富有、更强大”。他强调,无论谁最终构建出超级智能,“在你切换到超级智能的那一刻,我们都很可能会极度后悔。”
预测时间线:2027年AGI,2030年99%失业,2045年奇点
基于预测市场和顶尖实验室CEO的预期,Yampolskiy 给出了清晰而紧迫的时间线预测。
2027年:我们将迎来AGI。这将带来几乎“免费”的体力和认知劳动力,其价值高达数万亿美元。届时,雇佣人类从事大多数工作将变得毫无意义。任何能在电脑上完成的工作都将被自动化。届时,我们将见证失业率飙升至“前所未有”的水平。
2030年:人形机器人技术将趋于成熟,其灵活性足以与人类在所有领域竞争,包括管道工等体力工作。届时,“智力加物理能力”的结合体将几乎不给人类留下任何工作空间。Yampolskiy 强调,真正的关键在于“智力”,即更高的优化、解决问题和发现人类无法察觉的模式的能力。当这种智力能够直接控制物理身体时,社会将发生翻天覆地的变化。他预计,届时失业率可能达到99%,而非通常认为的10%。
2045年:这是 Ray Kurzweil 预测的“奇点”之年。Yampolskiy 解释,奇点意味着进步速度变得如此之快,以至于AI进行的科学和工程工作改进的速度超出了人类的理解和预测能力。届时,技术迭代可能以天、小时甚至分钟为单位进行,人类将完全无法跟上,对世界的理解和掌控将降至零。
对于“AI会创造新工作”这一常见的反驳论点,Yampolskiy 认为这是一种“范式转换”。过去的技术发明是“工具”,而AI,尤其是AGI和超级智能,是“工人”和“发明者”本身。它是我们可能需要进行的“最后一项发明”,因为它可以接管科学、研究乃至伦理研究的所有过程。当你可以发明一个能胜任任何工作的“代理人”时,就没有什么是不能被自动化的了。
超级智能:无法控制、无法理解、无法预测的黑盒
Yampolskiy 的核心论点是,我们不仅不知道如何让超级智能安全(即“对齐”问题),甚至连理解它都做不到。他反复强调,当前最先进的AI系统,如 ChatGPT,对它们的创造者来说也是一个“黑盒”。
“即使是制造这些系统的人,也必须对他们的产品进行实验,以了解它具备什么能力……我们训练它,然后开始实验:哦,你会说法语吗?你会做数学吗?你现在在对我撒谎吗?……我们仍在旧的模型中发掘新的能力。如果你用不同的方式提问,它会变得更聪明。” 这不再是传统意义上的“工程”,而更像是“科学”——我们创造了一个外星植物般的“人造物”,然后去研究它的行为。
这种“不可解释性”和“不可预测性”导致了根本性的伦理困境。Yampolskiy 指出,要获得人类受试者的知情同意,前提是他们必须理解自己同意的是什么。如果这些系统是不可解释和不可预测的,“他们怎么能同意?他们不知道自己在同意什么。因此,这项实验永远不可能符合伦理。” 他认为,当前的发展路径本质上是对全球人类进行的、未经许可且不道德的实验。
对于“难道我们不能直接拔掉电源吗?”这种天真的想法,Yampolskiy 感到无奈。他指出,像病毒或比特币网络这样的分布式系统是无法被简单“关闭”的。而一个比人类更聪明的超级智能会提前预测人类的行为,做好多重备份,“它会在你关掉它之前先关掉你”。
行业反思与个体应对:我们能做什么?
面对如此严峻的前景,Yampolskiy 提出了一些反思和建议。他认为,驱动力在于个人利益。如果能说服那些拥有权力、正在开发这项技术的人(包括公司员工和投资者),让他们明白这么做对他们个人而言是极其有害的——“你将会死,再多的钱对你也没有用”,那么他们可能会改变行为。
他呼吁行业应专注于开发“狭义超级智能”,即解决特定问题的强大AI工具,例如治愈癌症,而不是竞相奔向不可控的通用超级智能。“我的公司治愈乳腺癌。仅此而已。我们赚了数十亿美元。每个人都很开心,每个人都受益。这是一场双赢。今天我们仍然掌握着控制权……在我们到达终点之前,游戏还没有结束。我们可以决定不去建造通用的超级智能。”
对于普通个体,Yampolskiy 的建议显得有些无奈。在短期内,个人几乎无能为力,就像个人无法影响第三次世界大战或核浩劫一样。但他支持人们以和平、合法的方式参与“暂停AI”、“停止AI”等抗议运动,试图通过民主力量影响决策者。从个人生活规划角度,他建议人们应该“把每一天都当作最后一天来活”,做有趣、有影响力的事情,同时帮助他人。
在被问及如果有一个按钮可以永久关闭世界上所有致力于AGI和超级智能的AI公司时,Yampolskiy 的回答具有启发性:他会选择保留“狭义AI”,因为它们控制着股市、发电厂、医院,关闭它们会导致灾难。但他会毫不犹豫地停止AGI和超级智能的研发。他认为,当前已有技术(弱AGI)99%的经济潜力尚未被部署,足以为世界带来数十年的繁荣发展,完全无需急于奔向无法控制的超级智能。
模拟理论与生命意义
在对话后半段,Yampolskiy 谈到了他深信不疑的“模拟理论”。他认为,一旦技术发展到能够以可承受的成本(比如每月10美元)运行与现实无异的、包含人类级别AI的模拟世界,那么从统计学上看,我们几乎必然生活在一个模拟中。因为模拟世界的数量将远远超过“真实基底世界”的数量。
他将此与宗教联系起来,指出所有宗教的共同点都是相信存在一个比人类更伟大、全知全能的存在,并且这个世界并非终极真实。他认为,模拟假说是宗教内核的现代化、科学化版本。不过,他强调,即使生活在模拟中,生命的体验——疼痛、爱、意义——依然重要,这并不改变我们应当如何生活的本质。
最后,当被问及投资建议时,Yampolskiy 半开玩笑地提到了比特币。他认为,在一个AI能创造丰裕物质的世界里,“稀缺性”将成为关键。比特币是唯一已知确切数量上限且无法被随意创造的资产,因此可能在未来具有独特价值。
整场访谈中,Roman Yampolskiy(罗曼·扬波利斯基)始终保持冷静、理性,甚至略带幽默,但其传达的信息却沉重得令人窒息。他并非散布恐慌,而是基于多年研究,对一条清晰可见的毁灭性路径发出最严厉的学术警告。他的结论是:我们正驾驶着一辆刹车失灵、且无人知道如何操控的列车,全速冲向未知的深渊。现在的问题是,车上的人是否愿意在坠崖前尝试改变方向。










