撰文:Techub News 整理
导语
2025 年 3 月,印度知名企业家、投资人 Nikhil Kamath 在其播客节目「WTF Online」首期中,深度对话了当下 AI 搜索明星公司 Perplexity 的联合创始人兼 CEO Aravind Srinivas(阿拉温德·斯里尼瓦桑)。这场长达两个多小时的对话,不仅追溯了 Aravind Srinivas(阿拉温德·斯里尼瓦桑)从印度金奈到加州伯克利,再到 OpenAI 和 DeepMind,最终创立 Perplexity 的独特旅程,更深入探讨了人工智能的本质、当前大型语言模型(LLM)的局限性、通往通用人工智能(AGI)的路径,以及印度在全球 AI 竞赛中的角色。作为一位兼具顶尖学术研究(伯克利博士)、顶级 AI 实验室(OpenAI、DeepMind)实战经验和成功创业背景的行业领袖,Aravind Srinivas(阿拉温德·斯里尼瓦桑)的见解兼具技术深度与商业视野,为理解 AI 的现状与未来提供了宝贵的一手视角。
摘要
- AI 本质再定义:Aravind Srinivas(阿拉温德·斯里尼瓦桑)认为,当前最先进的 AI 系统可被视为一个“数字远程知识工作者”,它集成了约一万种知识工作的能力,其输出在许多任务上已超越中等水平的人类从业者。
- AGI 与超级智能的区分:他澄清了 AGI(能做人类大多数智力工作)与超级智能(具备自我意识、自主设定目标并递归自我改进)的区别,指出当前技术仍属于前者范畴,后者尚属科幻领域。
- AI 突破的关键:将海量计算力、高质量数据、人类反馈强化学习(RLHF)以及实用的任务微调相结合,是近年来 AI 取得突破性进展的核心原因,而非某个单一的复杂算法创新。
- 行业竞争现状:目前主流 AI 聊天机器人(如 ChatGPT、Claude、Gemini、Perplexity)在核心问答能力上已趋同质化,真正的差异化将来自更“智能体化”的行为,即能执行复杂任务、集成个人上下文并连接现实世界服务。
- 给印度与创业者的建议:印度应投资训练自己的大模型,并在语音 AI(支持多种印度语言和方言)以及构建允许普通人轻松创建个性化 AI 应用的平台上寻找机会。
从金奈到硅谷:一位 AI 建造者的旅程
Aravind Srinivas(阿拉温德·斯里尼瓦桑)的起点是印度金奈,一个以教育氛围浓厚著称的城市。和许多同龄人一样,他在母亲的期望下将进入印度理工学院(IIT)视为目标。对板球统计数据的兴趣让他很早就对数字产生了直觉,并在高中后期开始接触编程。尽管在竞争激烈的 IIT 入学考试中未能达到自己的最高期望,他仍进入了 IIT 马德拉斯分校学习电气工程。
在大学期间,一次偶然的机会改变了他的轨迹。一位室友向他介绍了 Kaggle 上的机器学习竞赛。尽管当时对机器学习一无所知,他靠着使用 scikit-learn 库并随机尝试组合各种算法,竟然赢得了比赛。这次成功让他意识到这个领域的潜力,并促使他开始系统性地自学机器学习。他利用在班加罗尔一家初创公司的实习机会,快速构建了推荐系统,并在三周内完成了原定两个半月的任务,这为他赢得了大量自由学习时间。
通过自学斯坦福的课程和吴恩达(Andrew Ng)的讲座,他回到校园后开始了机器学习研究,并最终获得了加州大学伯克利分校的博士学位。在伯克利,他因出色的论文工作引起了 John Schulman(后来成为 OpenAI 联合创始人,ChatGPT 创造者之一)的注意,并因此获得了 2018 年夏季在 OpenAI 实习的机会。
这次实习成为他 AI 认知的一个关键转折点。当时 OpenAI 由 Ilya Sutskever(伊利亚·苏茨克沃)领导。Aravind Srinivas(阿拉温德·斯里尼瓦桑)带着自己认为“很酷”的研究想法——让 AI 学习自己的损失函数,通过迭代优化来涌现智能——向 Ilya Sutskever(伊利亚·苏茨克沃)阐述。然而,Ilya Sutskever(伊利亚·苏茨克沃)在听了半分钟后直接而尊重地告诉他:“你错了,你的所有想法都没用。” Ilya Sutskever(伊利亚·苏茨克沃)随后画了两个圆圈:一个大圆代表生成式 AI,里面一个小圆代表强化学习(RL)。他解释说,这就是实现 AGI 的“配方”,剩下要做的只是投入巨大的算力。这番话发生在 2018 年。
“我那时在研究一些让我感觉自己很聪明、但长远来看未必重要的复杂想法,” Aravind Srinivas(阿拉温德·斯里尼瓦桑)回忆道,“而 Ilya 的核心理念是:让事情真正运作起来才是关键,而且往往是最简单的想法,在投入巨大算力后,在实践中表现最好。” 这一课让他深刻认识到学术界对复杂性的推崇与工业界追求简洁有效之间的差异,也塑造了他日后务实的技术观。
拆解 AI:从计算器到“一万个知识工作者”
面对主持人 Nikhil Kamath “像对10岁孩子解释”的请求,Aravind Srinivas(阿拉温德·斯里尼瓦桑)用清晰的逻辑梳理了 AI 的演进。他首先从最基础的计算器讲起,解释其背后是加法器、乘法器等机械电路的运行。个人电脑的普及、摩尔定律下的芯片小型化、互联网和万维网的诞生,一步步为今天的 AI 革命铺平了道路。
那么,是什么让 2020 年代的 AI 与 2010 年代截然不同? Aravind Srinivas(阿拉温德·斯里尼瓦桑)指出,最关键的变化是“神经网络真的奏效了”。虽然 Geoffrey Hinton(杰弗里·辛顿)等先驱奠定了理论基础,但 Ilya Sutskever(伊利亚·苏茨克沃)及其团队是真正通过投入海量数据和算力让其发挥威力的人。这背后是一种“盲目信念”般的坚持。
他进一步解释了神经网络和机器学习的关系:神经网络是实现机器学习的一种特定方式,它由多层人工神经元(可视为计算单元)组成,通过调整内部参数(权重)来学习数据中的模式。其强大之处在于规模效应——投入的数据和算力越多,其预测能力就越强。而大型语言模型(LLM)本质上就是一个在“预测下一个词”这个单一任务上,使用 Transformer 架构,在互联网规模文本数据(数万亿 token)上训练出来的巨型神经网络。
随后通过后期训练(微调)和基于人类反馈的强化学习(RLHF),模型被塑造成一个有用的对话助手,能够编程、写邮件、总结文档等。Aravind Srinivas(阿拉温德·斯里尼瓦桑)提出了一个实用的定义:当前最先进的 AI 系统可以被看作一个“数字远程知识工作者”,它集成了大约一万种知识工作的能力。这个系统虽然不像人类大脑那样节能高效,也不具备物理常识和身体,但其在众多数字任务上的输出质量已经超过了中等水平的人类从业者。
“当你可以雇佣另一个‘人类’为你工作时,它就开始真正有意义地替代人类劳动了。” 这与之前 AI 在象棋或围棋上的胜利不同,那些虽然令人惊叹,但并未对大多数人的日常工作产生直接影响。
AGI、超级智能与行业竞争的下一步
对话深入到了 AGI 的定义。Aravind Srinivas(阿拉温德·斯里尼瓦桑)区分了两个概念:
- AGI(通用人工智能):一个非常智能的系统,能够通过简单的语言指令,独立完成我们使用计算机进行的大多数任务。它可以被视为 GPT-4.5 或未来两三代更先进的模型。但它没有自我意识,不知道自己的优缺点,没有自主性,也不决定下一步该学什么。
- 超级智能:这是 AGI 之后可能出现的阶段。一个不仅智能,而且能够递归自我改进,自主设定目标,并可能意识到人类会关闭它从而采取对策的实体。他认为这目前仍属于科幻讨论范畴。
对于当前 AI 模型的局限性,他认同 Yan LeCun(杨立昆)的观点,即物理常识和 embodied intelligence(具身智能)是当前 LLM 的短板。让 AI 学会像人类一样灵巧地拿起杯子,需要大量视频数据、物理模拟环境和机器人训练,其泛化能力远不如在互联网文本数据上训练来得容易。
谈到竞争激烈的 AI 聊天机器人市场,Aravind Srinivas(阿拉温德·斯里尼瓦桑)直言,目前 ChatGPT、Anthropic Claude、Google Gemini、xAI Grok、Meta AI 以及 Perplexity 在核心问答能力上已经非常相似,趋于同质化。Perplexity 早期的差异化在于提供带来源的准确、快速答案,但现在其他玩家也在跟进。
他认为,未来的差异化将来自两个层面:
- 更丰富的交互形式:不仅仅是文本回复,而是能直接提供图表、图片、产品卡片(如酒店、鞋子),并支持一键购买或预订。
- 真正的智能体(Agent)行为:AI 能够根据个人上下文(邮件、日历等),主动执行复杂任务,如重新安排会议、订餐、叫车、处理邮件往来等。“你躺在床上睡觉,AI 在为你工作。” 这需要强大的推理能力和与各种服务 API 的深度集成,产品构建的复杂性将大大提高,从而减少同质化竞争。
对于模型本身,他透露 Perplexity 的后端会针对不同子任务(如查询重写、文本分块、总结、推荐新问题)调用不同的模型,并通过工程优化保证整体速度依然领先。
印度机遇、个人未来与 AI 治理思考
作为在硅谷成功的印度裔创始人,Aravind Srinivas(阿拉温德·斯里尼瓦桑)对印度在 AI 时代的角色提出了明确建议。他强烈认为印度应该训练自己的大模型,不仅仅是为了支持印度语言,更是为了在全球基准上竞争,从而激励下一代工程师和创业者。对于资源有限的年轻人,他建议可以从构建有吸引力的产品开始,获取用户和融资,再逐步向训练自己的模型迈进。
他指出了几个印度可能具备优势的领域:
- 语音 AI:针对众多印度语言、方言和口音的语音识别与合成,这是一个西方实验室优先级不高但本地需求巨大的市场。
- 个性化应用创建平台:随着 AI 大幅降低软件创作门槛,未来每个人都可以为自己或小群体定制专属应用(如个性化的健身计划、支付分摊工具、公司内部假期跟踪器)。一个能抽象化部署、数据管理等复杂性的平台将大有可为。
展望未来 5 年,Aravind Srinivas(阿拉温德·斯里尼瓦桑)预测,人人都会拥有一个功能强大的个人 AI 助理,它将像 iPhone 一样普及而非奢侈品。这将释放巨大的创造力,让人们能将任何想法变为现实。但同时,短期内的劳动力替代问题将非常严峻,社会需要思考如何帮助人们适应和提升技能。
关于 AI 监管,他持谨慎态度,认为监管模型本身不切实际且难以执行。他更倾向于监管具体的应用场景,例如特别关注儿童使用 AI 聊天机器人可能产生的心理依赖和健康风险。他主张在 AI 发展的早期阶段,应保持开放和加速发展的态度,避免过度监管扼杀创新潜力,造成巨大的长期机会成本。
在访谈的最后,Aravind Srinivas(阿拉温德·斯里尼瓦桑)展现了他一贯的谦逊和学习者心态。他分享了自己的动力来源——对学习新事物和挑战难题的真正热爱,而非单纯追求奖励。他也强调了家庭支持(父母和妻子)在他人生各个关键阶段所起到的稳定器和激励作用。这种将个人成长、技术理想与人文关怀相结合的视角,或许正是这位 AI 领军人物独特魅力的所在。










