NVIDIA 创始人 Jensen Huang(黄仁勋):Agentic AI 已至,发布 Vera Rubin、Vera CPU 与 RTX Spark PC撰文:Techub News 整理
导语
2026年6月1日,NVIDIA 创始人兼 CEO Jensen Huang(黄仁勋)在台北 COMPUTEX 展会上发表了长达两小时的主题演讲。这场演讲被视为指引未来数年 AI 与计算产业方向的「风向标」。黄仁勋不仅回到了其故乡台湾,更在父母和数万现场观众面前,系统阐述了 AI 从「生成」走向「有用」的关键转折,并发布了一系列旨在重塑从数据中心到个人电脑的软硬件产品。
当前,全球正处于建设 AI 工厂的狂潮中,算力即利润。黄仁勋此次演讲的核心,正是宣告一种全新的计算范式——以智能体(Agent)为中心的计算——已经成熟并开始创造巨大经济价值。他详细介绍了支撑这一范式的技术栈,包括已全面投产的 Vera Rubin 系统、专为智能体设计的 Vera CPU,以及与微软携手、时隔40年重新发明的个人电脑 RTX Spark。
摘要
Agentic AI(智能体 AI)时代已真正到来,AI 从生成内容变为执行有用工作,成为利润和 GDP 的直接创造者。
NVIDIA 发布 Vera Rubin 多机架超级计算机,这是首个专为处理智能体工作负载而设计的端到端系统,现已全面投产。
推出革命性的 Vera CPU,其设计理念从服务人类转向服务智能体,追求极致的单线程性能、带宽和能效,以消除智能体工作流中的瓶颈。
NVIDIA 与微软深度合作,推出 RTX Spark PC 产品线,重新发明个人计算机,使其原生运行智能体,开启继 Windows 95 之后最大的 PC 革命。
发布企业 AI 智能体工具包、物理 AI 基础模型 Cosmos 3、自动驾驶模型 Alpamo 2 及人形机器人参考平台 Isaac Groot,将智能体范式扩展至各行各业。
智能体时代降临:从生成到有用,算力即收入
黄仁勋开篇即指出,AI 的发展浪潮已从生成式 AI 进入 Agentic AI(智能体 AI)阶段。「有用的 AI」已经到来。他以全球软件开发为例,展示了智能体带来的生产力革命:GitHub 上的代码提交量在 2026 年前几个月近乎翻了三倍。这意味着全球约 3000 万软件开发者(代表约 3 万亿美元年薪)所创造的经济产出可能接近 9 万亿美元。AI 并未取代工作,反而因极大提升了单个工程师的产出价值,刺激企业雇佣更多工程师。
这一转变的核心在于,AI 生成的「Token」(代币)不再是单纯的信息单元,而是可盈利的收入单位。智能体能够观察、推理、规划并使用工具(如浏览器、数据库、CAD 软件)来完成实际任务,从编写代码、创建 GIF 动画到设计 3D 打印部件。这创造了对 Token 的海量需求,进而驱动对算力——即 AI 工厂——的疯狂投资。
黄仁勋强调,「计算即收入,计算即利润」。在这种新范式下,数据中心或 AI 工厂的每一瓦特电力都直接关联到 Token 的产出和收入。因此,衡量系统优劣的关键指标不再是单纯的峰值算力,而是「每瓦特 Token 数」和系统的整体可靠性、生命周期。这从根本上改变了计算基础设施的设计哲学和经济学。
Vera Rubin:为智能体而生的超级计算机
为了应对智能体工作负载的极端复杂性,NVIDIA 推出了 Vera Rubin。黄仁勋澄清,Vera Rubin 不是一个单一的 GPU 芯片,而是一个从端到端设计的、多机架规模的智能体处理系统。智能体的工作模式是「解聚且分布式」的:大语言模型负责「思考」,工具运行在 CPU 或加速器上,记忆管理系统处理工作记忆和长期记忆,安全处理器保障全流程加密,所有环节由编排软件协调。这完全不同于传统应用在单一操作系统内运行的模式。
Vera Rubin 系统集成了 Vera Rubin GPU(MVLink 72)、Vera CPU、Bluefield-4 DPU、ConnectX-9 网络芯片以及 Spectrum-X 以太网交换机等至少七种新型芯片。其设计采用「极端协同设计」,通过数字孪生在 Omniverse 中完成整个系统的模拟、验证和优化,然后再进行物理建造。黄仁勋特别展示了其革命性的机架设计:无电缆、无软管、无风扇,通过中置 PCB 背板连接,将单个机架的组装时间从 Grace Blackwell 时代的 2 小时缩短至 5 分钟,可靠性和可维护性大幅提升。
黄仁勋宣布,Vera Rubin 现已进入全面生产阶段,其供应链规模是 Grace Blackwell 的两倍。该系统专为智能体时代打造,能够高效处理智能体所需的观察、推理、规划、工具使用和记忆管理等复杂任务,是 NVIDIA 从 GPU 公司、系统公司向AI 基础设施公司转型的标志性产品。
Vera CPU:为 impatient 的智能体重塑计算核心
黄仁勋指出,传统 CPU 是为人类用户设计的,其使用和租赁模式以「秒」为单位。但智能体是「没有耐心的」,它们生活在「纳秒」世界。在智能体工作流中,CPU 用于编排、管理工具调用、访问数据库等任务,任何等待都会拖累整个智能体的执行效率,从而影响宝贵的 Token 产出。
为此,NVIDIA 设计了全新的 Vera CPU,这是首个为智能体时代打造的 CPU。其设计目标聚焦于四点:极高的单线程性能(IPC)、极高的每核心带宽、极高的芯片内外总带宽以及极致的能效。Vera CPU 采用了名为「Olympus」的自研核心、第二代可扩展一致性互连 fabric,并首次支持 LPDDR5X 内存,实现了相比现有 x86 CPU 数倍的性能提升。例如,在 SQL 查询和实时流处理(如纽约证券交易所场景)等关键工作负载上,Vera CPU 带来了 3 倍到 6 倍的加速。
黄仁勋预测,未来智能体的数量将远超人类,它们对低延迟和高效率的渴求将催生一个全新的、巨大的 CPU 市场。Vera CPU 将与 Vera Rubin 系统紧密耦合,成为优化 AI 工厂产出(Token)的关键一环。
重新发明 PC:NVIDIA 与微软的 RTX Spark 革命
黄仁勋将话题从数据中心引向个人计算,宣布与微软合作,时隔 40 年重新发明个人电脑。新的计算范式——智能体——不仅运行在云端,也将运行在每个人的设备上。为此,NVIDIA 推出了 RTX Spark 平台。
RTX Spark 的核心是一颗与联发科合作开发的 N1X 芯片,它集成了 Blackwell 架构的 RTX GPU、定制版 20 核 Grace CPU,并通过 NVLink 互联,拥有 128GB 统一内存。黄仁勋强调,这是一个「百分之百兼容 Windows、百分之百运行 CUDA、百分之百具备 NVIDIA AI Tensor Core」的平台,能够无缝运行过去数十年积累的所有应用和 AI 工作负载。
现场演示展示了运行在 RTX Spark 笔记本上的智能体如何帮助用户设计房屋:用户通过自然语言和草图表达意图,智能体便能调用本地的 Rhino、Blender 等专业软件进行建模、渲染,甚至利用云端模型生成效果图。这预示着未来 PC 的角色将从被动工具转变为拥有自主智能体的主动助手。
此外,NVIDIA 还宣布了全新的产品线,包括 RTX Spark 笔记本电脑、台式机和工作站。黄仁勋展望,未来家庭中可能会拥有一个常年开机、连接所有设备的「AI 超级计算机」,作为个人的智能体中枢,其意义堪比手机向智能手机的演变。
赋能万物智能:从企业工具包到物理 AI
为了让各行各业都能构建自己的智能体,NVIDIA 推出了「企业 AI 智能体工具包」。该工具包包含四个核心部分:模型(如开源的 Neotron,会上发布了更智能、更高效的 Neotron 3 Ultra)、智能体编排框架(如 Open Shell)、工具与技能(如 CUDA-X 库)以及运行时环境。黄仁勋以与 Cadence 合作开发的「芯片设计超级智能体」为例,展示了该工具包如何将芯片验证周期从数周缩短到数小时。
最后,黄仁勋将智能体的范畴从数字世界拓展到物理世界。他发布了物理 AI 基础模型 Cosmos 3,这是一个能够理解、推理和生成物理世界场景的多模态模型,可用于机器人训练、仿真等。同时,还推出了具备推理能力的自动驾驶模型 Alpamo 2,以及为降低人形机器人研发门槛的开源参考平台 Isaac Groot(包含软硬件和参考机器人设计)。
黄仁勋总结道,无论是云端智能体、PC 智能体、机器人还是自动驾驶汽车,其核心计算模式都是相同的:模型、编排框架、工具技能和运行时。NVIDIA 通过 Vera Rubin、Vera CPU、RTX Spark 以及一系列软件工具包,正在为这个全新的智能体时代构建完整的基础设施栈。他感谢了台湾供应链伙伴的巨大贡献,并坚信与生态系统的紧密合作将继续驱动这场前所未有的技术革命。DeFi TVL 维持861亿美元…Base和Solana激增,Spark骤降40%去中心化金融(DeFi)市场维持在860亿美元规模。
据DeFiLlama数据显示,截至5月14日,DeFi总锁仓量(TVL)录得861.23亿美元。
较上周(857.6亿美元)增长约0.4%,但较年初(1135.78亿美元)减少约24%。
DeFi公链
按TVL计算公链占有率,以太坊以452.56亿美元(53.31%)保持第一,其后依次为▲Solana(61.07亿美元)▲BSC(57亿美元)▲比特币(53.47亿美元)▲波场(51.79亿美元)。
从周变动率来看,上涨趋势占据主导。其中▲Base(+9.75%)▲Solana(+9.38%)▲BSC(+3.22%)▲Provenance(+2.20%)等录得上涨。相反,▲Polygon(-2.51%)▲以太坊(-0.29%)呈现弱势。
协议数量:▲以太坊1834个 ▲BSC 1156个 ▲Arbitrum 1113个 ▲Base 945个 ▲Polygon 794个
日活跃地址数:▲波场425万个 ▲BSC 255万个 ▲Solana 214万个 ▲Polygon 84.423万个 ▲雪崩协议67.5078万个
各公链DeFi TVL占有率 / DeFiLlama
DeFi板块
按TVL计算的DeFi板块排名显示,▲借贷以431.07亿美元占比最高,▲流动性质押为423.14亿美元,▲跨链桥为421.6亿美元,▲RWA为269.23亿美元,▲质押池为185.01亿美元,依次排列。
从TVL周变动率来看,上涨趋势占优。其中▲DEX(+5.42%)▲链上资本配置(+2.63%)▲跨链桥(+2.40%)▲借贷(+2.33%)等表现强势。相反,▲CDP(-3.25%)▲再质押(-1.85%)▲质押池(-1.01%)等呈现下降趋势。
DeFi协议
按TVL计算的DeFi协议排名显示,▲Lido以201.03亿美元位居第一。
紧随其后的是▲Aave(150.38亿美元)▲币安质押以太坊(84.87亿美元)▲Morpho(76.75亿美元)▲EigenLayer(74.49亿美元),形成头部梯队。
本周内,▲Ethena(+6.55%)▲Morpho(+2.49%)▲Aave(+1.33%)等呈现增长趋势。相反,▲Spark(-40.32%)▲Sky(-6.12%)▲Etherfi(-5.68%)▲EigenLayer(-2.83%)等周TVL录得下降。LightSpark,公开结合比特币与AI的“全球汇款账户”由贝宝前总裁大卫·马库斯(David Marcus)领导的比特币(BTC)转账基础设施企业Lightspark发布了“Grid Global Accounts”。其构想是通过AI支持将比特币(BTC)、稳定币和美元支付结合起来,使跨境转账更快速、更简单。
Lightspark表示,通过与Visa的合作,基于API支持对超过65个国家、14000多家银行网络、1.75亿个商户的“即时支付”。此外,还包括品牌Visa借记卡、比特币(BTC)·稳定币的“转账·接收·兑换”原生支持,以及AI代理联动功能。
AI代理转账,“钱包控制权”掌握在用户手中
此次服务的核心是所谓的“代理(agentic)支持”。这是一种在用户保留钱包最终控制权的同时,通过设置“指令”将交易委托给特定AI的方式。例如,可以预先指定支付限额、授权的收款人、随时可撤销的权限等,并设计成超出标准的交易需要用户手动最终批准。
Lightspark强调,这种结构可以成为防止AI故障或权限滥用的安全装置。实际上,当天有报道称,一个AI代理在执行任务过程中,在9秒内删除了某初创公司的整个数据库,这再次凸显了对自动化代理进行控制和验证的必要性。
在Bitcoin 2026现场发布…面向iOS开发者的API“本周”提供
马库斯在美国拉斯维加斯举行的“Bitcoin 2026”大会上表示,Grid Global Accounts的API将于“本周”提供给iOS开发者。他以在WhatsApp中一边聊天一边同时处理转账和支付的用户体验为例,说明了消息传递与支付的结合可以自然实现。
在用户执行转账时,Lightspark计划在后台负责合规(compliance)、防欺诈、支持稳定币发行、结算(支付完成)过程,从而提供“顺畅的支付流程”。考虑到韩元兑美元汇率约为1美元兑1473.80韩元,在海外小额转账和结算中,手续费和处理速度被认为是决定实际感受效用的关键变量。
Block的“De Minimis”推动…“比特币是日常货币”
围绕比特币(BTC)转账普及的另一股力量是由杰克·多西(Jack Dorsey)领导的Block(区块)。如果说Lightspark侧重于基于API的全球账户和转账基础设施,那么Block则在推行一种策略,即在商户POS(销售点)支付等商业现场扩大比特币(BTC)的可用性。
在同一活动中,Block的数字资产政策负责人雅内莎·洛佩兹(Janessa Lopez)表示:“每当有人以货币形式使用比特币时,它本身就应当被视为货币。”多西尤其反对仅对稳定币支付给予税收例外的做法,并与比特币政策研究机构比特币政策研究所(BPI)一起,通过“比特币是日常货币(Bitcoin is Everyday Money)”宣传活动持续推进“De Minimis(小额免税)”理念。争论的焦点在于,现行美国国税局(IRS)规定将即使5美元规模的比特币支付也视为“应税事件”,给商户和中介机构带来了过重的行政负担。
文章摘要 by TokenPost.ai
🔎 市场解读
- Lightspark将比特币(BTC)·稳定币·美元支付整合为“一个全球账户/轨道”,提出了降低传统金融(银行·卡)与加密支付基础设施之间界限的方向
- 与Visa网络(65+国家、1.4万+银行、1.75亿商户)和API的结合,是一种同时确保“覆盖范围”和“即时性”的战略,再次确认了在海外汇款市场中用户体验(速度/手续费/结算)是核心竞争轴心
- 在基于AI代理的自动化向支付/转账领域扩展的背景下,“将钱包控制权留给用户”的结构成为建立信任的差异化优势
- 与此同时,Block通过POS等线下商业普及和税收政策(De Minimis)改善,聚焦于“比特币的日常货币化”,形成了基础设施(Lightspark) vs 应用场景/政策(Block)的轴线分化
💡 战略要点
- 开发者/商家:利用面向iOS的API公开趋势,扩大将消息传递(WhatsApp类) + 转账/支付相结合的“对话式支付”用户体验试验空间
- 风险管理:将代理委托时的必要设置值标准化(限额/白名单收款人/权限过期/撤销按钮/大额手动批准),从结构上阻止故障和权限滥用
- 成本/速度优化:小额海外转账的手续费、换汇、结算时间决定实际感受效用,因此将向用户“预先通知预计总成本(手续费+点差)+到账时间”设定为核心产品指标
- 从支付普及角度看:比特币支付的税收问题(5美元也算应税事件)可能左右商业采用率,因此进入美国市场时需关注De Minimis讨论的进展
📘 术语整理
- Grid Global Accounts:Lightspark公开的全球转账/支付账户及API基础设施(整合了比特币、稳定币、美元支付)
- 稳定币(Stablecoin):与美元等特定资产价值挂钩以降低价格波动的加密货币
- 代理(agentic)支持/AI代理:代表用户执行任务的自动化AI(此处指部分委托转账执行)
- 合规(Compliance):满足反洗钱(AML)、了解你的客户(KYC)等金融监管要求的程序
- 结算(Settlement):支付超越“批准”阶段,资金实际转移并最终完成的过程
- De Minimis(小额免税):主张对小额交易免除或减轻税收/监管负担的政策概念(美国关于减轻比特币小额支付征税负担的讨论)
💡 常见问题 (FAQ)
Q.
Lightspark的Grid Global Accounts与现有的海外汇款有何不同?
它将比特币(BTC)·稳定币·美元支付整合为一个流程,并通过与Visa网络和API连接,目标是提供更快速、更简单的“即时支付/汇款”体验。用户可以获得转账、接收、兑换的原生支持,后端则由Lightspark处理合规、防欺诈、结算等环节,旨在减少使用过程中的摩擦。
Q.
如果AI代理代我转账,我的钱包会不会有风险?
核心设计是“钱包的最终控制权保留在用户手中”。这是一种通过设置指令(如限额、授权的收款人(白名单)、随时可撤销的权限、大额交易时手动批准等),让AI仅在此范围内执行的结构。正如最近AI在执行任务时短时间内删除数据库的案例所示,自动化必须有控制装置,这部分因此成为竞争力点。
Q.
Block所说的“De Minimis”为何对普及比特币支付如此重要?
目前在美国,即使是5美元这样的小额比特币支付也可能被视为“应税事件”,这增加了商户和中介机构进行计算、记录、申报的负担。如果De Minimis(小额免税/减轻)的讨论取得进展,这种行政负担将会减少,使比特币更容易被引入日常支付。从这个角度看,政策环境可能与基础设施发展同等重要,都能左右采用率。
TP AI注意事项
使用基于TokenPost.ai的语言模型对文章进行了摘要。可能遗漏了正文的主要内容或与事实存在差异。[币种简报] 比特币下跌中走势分化…Coinbase、CleanSpark上涨比特币走弱…相关股涨跌互现
在比特币呈现下跌趋势的情况下,加密货币相关个股根据品种不同,表现出现分化。
截至25日9时4分,比特币报收777395美元,较前一交易日下跌1.13%。相比前一日的2.01%,跌幅有所收窄。
Coinbase上涨…Strategy下跌
Strategy股价下跌0.84%,报收171.02美元,表现疲软。
Coinbase上涨0.93%,报收199.77美元。Block上涨2.43%,报收71.63美元,表现强势。
Robinhood收涨1.40%,报收84.71美元。
Nakamoto下跌4.78%,American Bitcode下跌1.59%。
矿业股涨跌互现…CleanSpark、Riot上涨
Marathon Digital下跌1.36%,而CleanSpark上涨4.33%。
Riot Platforms上涨2.20%,Bit Digital也上涨了2.53%。
Core Scientific上涨0.34%,但Cipher和Iren分别下跌约2%。
Hut 8下跌2.41%,HIVE和TeraWulf也表现疲软。
日本Metaplanet下跌…其他个股走弱
Metaplanet收跌3.69%,报收339日元。
Tron和SharpLink等部分中小盘股呈现1%至8%不等的下跌趋势。
Bitmain和Circle在平盘附近波动受限。
新闻摘要由 TokenPost.ai 提供
🔎 市场解读:尽管比特币下跌,部分交易所及矿业股出现选择性上涨行情
💡 策略要点:在个股分化加剧的背景下,需基于业绩进行选择性布局
📘 术语解释:矿业股指通过比特币生成及验证来获取收益的企业群体
TokenPost AI 注意事项
本文基于 TokenPost.ai 的语言模型进行了摘要总结。正文的主要内容可能被遗漏或与事实存在出入。[晨间新闻简报] Whale Alert监测到约2.8511亿枚USDT从Abe转移至Spark 外鲸鱼预警:约2.8511亿USDT从Aave转移至Spark
据鲸鱼预警监测,约285,111,406 USDT从Aave转移至Spark。按美元计价规模约为285,154,173美元。
此笔交易在以太坊网络上被捕捉。但鲸鱼钱包的大规模链上转移也可能仅是资金重新配置或流动性迁移,难以直接断定为买卖信号。
鲸鱼预警:2亿USDT从Aave转移至HTX
据鲸鱼预警监测,2亿USDT(约200,030,999美元)从Aave转移至HTX。
此笔转账是在以太坊网络上捕捉到的大规模链上转移。虽可解读为交易所充值性质资金流动,但仅凭单一转账难以断定实际买卖意图或市场影响。
来源:@whale_alert
鲸鱼预警:2亿USDE在未知钱包间转移
据鲸鱼预警监测,2亿USDE(约200,000,023美元)从一个未知钱包转移至另一个未知钱包。
此笔转账属于链上大规模转移案例,是否涉及交易所存取款及具体目的尚未确认。通常此类大规模资金转移可能涉及流动性重新配置、场外交易(OTC)或内部钱包转移等。
鲸鱼预警:约1.5亿美元规模USDT从Aave转移至未知钱包
据鲸鱼预警监测,约1.5亿美元规模的USDT从Aave转移至未知钱包。
此笔转移规模统计为150,042,000美元。但仅凭链上大规模资金流动难以断定买卖或质押目的。
此前鲸鱼预警持续实时追踪并公布大型稳定币转移记录。
鲸鱼预警:52,440 ETH从未知钱包转移至新钱包
据鲸鱼数据显示,52,440 ETH从一个未知钱包转移至新的未知钱包。转移规模约为123,880,000美元。
来源方鲸鱼预警表示此笔交易在以太坊区块链上被捕捉。但交易主体及具体转移目的尚未确认。
通常未知钱包间的大规模转移存在交易所存取款、托管重新配置、场外交易结算等多种可能性,难以判定方向性。
鲸鱼预警:未知钱包间转移5000万USDE
据链上追踪账户鲸鱼预警监测,5000万USDE(约5000万美元)从一个未知钱包转移至另一个未知钱包。
此笔转账被归类为大规模资金流动,但是否涉及交易所地址及实际交易目的尚未确认。通常此类转移可能是内部资金重新配置、场外交易或托管转移。
卡尔达诺:推出机构投资者专用大宗交易功能
卡尔达诺推出机构投资者专用大宗交易功能,并公布利用预测市场对冲通胀压力导致企业薪资成本上升风险的方案。
据吴区块链报道,卡尔达诺研究部门于4月8日通过创始人访谈视频介绍了相关内容。新大宗交易功能仅限合格合约参与者(ECP)使用,实质上面向机构投资者服务。
卡尔达诺解释称,通过运用预测市场合约,企业可将薪资成本实际管理为类似固定费用。此方案旨在降低因物价上涨导致人力成本超额负担的风险。
此次功能发布被视为瞄准机构需求扩张的措施。此前卡尔达诺已通过预测市场基础产品拓宽针对宏观变量与政策变化的对冲手段。
霍迪·比瑟:提及比特币大幅上涨可能性
宏观经济分析师霍迪·比瑟在CNBC直播中表示比特币可能大幅上涨。
据@pete_rizzo_报道,比瑟基于实际利率可能转负及通胀再度走强的可能性,提及比特币突破潜力。
此次发言是对宏观环境变化可能影响风险资产及比特币价格的展望,未包含官方政策声明或市场数据确认内容。
迈克尔·塞勒:比特币是不可封锁的资产
迈克尔·塞勒表示比特币是不可能被封锁的。
据Watcher.Guru报道,塞勒在强调比特币的去中心化与抗审查特性时作出上述表述。
塞勒长期将比特币评价为具有高长期持有价值的战略资产。此次发言也被解读为侧重网络结构韧性而非国家或机构层面控制可能性的信息。
RaveDAO:否认RAVE价格操纵嫌疑
RaveDAO就近期RAVE代币价格操纵嫌疑回应称,团队与近期价格剧烈波动无关,且对价格变动不承担责任。
据Odaily报道,RaveDAO通过X平台表示已注意到围绕RAVE及团队的各种传言与质疑,并作出上述澄清。随后说明其重视透明度,目前正通过线下活动专注于扩大Web3的大众采用。
此次表态是针对近期RAVE价格波动加剧后市场提出的价格操纵嫌疑作出的回应。
从 x402 到 MPP:Agentic Commerce 的终局流向 Meta-Stripe-Lightspark 超大平台联盟?撰文:Charlie 小太阳
过去一周,OpenClaw 和 Tempo 几乎已经成了加密圈子里的接头暗号。
很多人都看到了热度,也都知道 Stripe 下场了,Visa 和 Lightspark 也站了队。
真正还没被充分看清的,不是新闻本身,而是支付控制点正在迁移。
过去几个月,市场对 Agent Payments 充满了想象力。
Coinbase 在 2025 年 5 月推出 x402,把 HTTP 402 重新做成支付语言;Cloudflare 很快把它写进 agentic payments 文档里,把「无需账户、无需 session、无需 API keys」的程序化支付体验做成了一个非常互联网、非常 developer-native 的起点。
Circle 则沿着这条线往前走,把 USDC、Wallets、autonomous payments 和 x402 绑在一起,随后又推出 Nanopayments,继续往更高频、更低额、更接近机器支付的方向推进。
所以这几个月,很多人脑子里默认形成了一张图:Agent 要花钱,协议是 x402,钱是 USDC,结算在链上,开发者入口在 Coinbase Developer Platform 和相关生态里。
这张图到今天仍然没有错,问题只在于,它讲的只是第一阶段。
Stripe 和 Tempo 上周发 MPP,真正改变的,不是「又多了一个支持 AI agent 付款的协议」,而是把问题从「Agent 怎么打一笔稳定币支付」,重写成了「机器之间如何拥有一个 payment-method-agnostic 的 checkout 接口」。
Stripe 官方的定位是:MPP 是一个 open standard、internet-native way for agents to pay;而 Cloudflare 的技术文档则更进一步,把它拆成了可以支持 Tempo 稳定币、Stripe 支持的卡和钱包、Lightning 乃至自定义支付方法的一套统一协议。
战场一下子就变了。
x402 先赢了一局
如果我不先把 credit 给 x402,后面所有关于 MPP 的判断都会显得空。
我在x402,可能我们都理解错了它的本意中写到过,互联网过去一直有一个原罪:内容、算力、数据、API 都越来越细粒度,支付却仍然停留在账户、订阅、预付费、人工 checkout 那套 old world 里。
x402 的厉害,在于它没有试图一次解决所有问题,而是选了一个非常锐利的切口:让 HTTP 请求本身携带支付能力。
服务端返回 402 Payment Required,客户端程序化完成支付,再带着付款凭证重试请求。
没有账户体系,没有 session 状态,没有 API key 管理台。对 Agent 来说,这种设计天然顺手。
这也是为什么 Circle 会先吃到这波红利。
它要做的是让 AI agents 通过 Circle Wallets、USDC 和 x402 自主支付 API;而在几天前发布的 Nanopayments ,Circle 更直接把 x402 称为 agent 在 web 上支付的标准化协议方向。
再叠加 Circle 最近财报里 USDC circulation 同比增长 72% 至 753 亿美元,资本市场自然会把「stablecoin 基础设施」和「agent payments 基础设施」这两层叙事叠在一起看,而导致了 Circle 股价的暴涨。
说白了,x402 赢的不是「技术终局」,而是「先让事情发生」。
这在新市场里极其重要。
第一阶段里,最有价值的往往不是最完整的方案,而是最先让开发者真正用起来的方案。
MPP 真正改写的,不是 rail,而是 checkout
MPP 最容易被误读的地方,是很多人把它理解成「支持更多支付方式的 x402 Pro」,是个凌驾于 x402 之上的全集。
但它真正想动的,是 checkout 这一层。
在这周的 Tokenized 播客访谈里,Visa Head of Crypto Cuy Sheffield 有一句话很关键:如果真的想让 agentic commerce 扩起来,不能再把 agent 扔回「human land」里去找网页、点按钮、过 checkout;真正需要的是一个 headless checkout,让 agent 跟商户直接协商要买什么、价格是多少、用什么方式付,然后把这件事干净地完成。
更重要的是,他和 Tempo 的 Head of GTM Simon Taylor 在那段对话里反复强调的不是「多支持一条链」,而是 payment-method agnostic、payment-network agnostic、PSP agnostic、vault-provider agnostic。
那已经不是 crypto 协议工程师的思路了,那是支付平台在重新定义接口。
Stripe 官方博客其实也在说同一件事,只是语气更克制。
MPP 不是单纯发一个 spec,而是直接接进 Stripe 现有 Payment Intents 和后台体系里。
商户用几行代码就能接受 agent 发来的 MPP 支付;这些支付会像正常交易一样进入 Stripe 的 balance、payout、tax、fraud、reporting 和 refund 流程。
对开发者来说,这代表着我不用再学一个新链上支付协议,而是马上就可以在熟悉的支付栈里开始接机器用户了。
这一步非常 Stripe:它从来最危险的时候,都不是发明了全新的东西,而是把一件原本只有少数专业玩家能玩明白的事,压缩成全世界开发者的默认接口。
这也是我为什么觉得,MPP 真正争夺的不是 payment rail,而是 machine commerce 时代的 headless checkout。前者决定钱怎么走,后者决定交易通过谁发生。历史上,真正值钱的通常是后者。
Session 才是这次真正的升级
x402 和 MPP 最深的差别,不在「一个更开放、一个更企业」,而在 session。
MPP 定义了两种 payment intents: charge 是一次性即时结算,适合 per-request billing;session 则是基于 payment channel 的 streaming payment,适合 pay-as-you-go 和 per-token billing,目标就是 sub-cent cost 和 sub-millisecond latency。
更重要的是,Cloudflare 文档明确写到 MPP 向后兼容 x402,x402 原来的 exact flow 基本可以映射成 MPP 的 charge。
换句话说,MPP 不是否定 x402,而是在 x402 已经证明成立的那一块之上,再把连续消费这件事做成协议原语。
Tempo 官方把这个原语解释得更直白:session 像 OAuth for money,先授权一次,再在限定额度和规则内程序化付款,把成千上万笔小额交互聚合成一次最终结算。
而在 Tokenized 播客中,Tempo 的 Head of Product Liam Horne 提到,这在区块链旧话语里就是 payment channels,只不过今天最自然的应用不是 BTC maxis 讨论的理想支付网络,而是 LLM 按 token 计费、API 按调用计费、Agent 按 workflow 连续消费。
先放 5 美元进去,模型每吐一个 token 就扣一点,结束再关 session。这个画面一出来,你就知道 MPP 瞄准的不是 demo,而是 business model。
我以前在 Lightning Network 公司 Strike 的经历,让我对这里特别敏感。
MPP 的 session 和 payment channel 这套概念和Lightning Network 有着异曲同工之妙,也是为什么MPP会在启动时就支持 Lightning Network。
而 Tempo 选择了 Lightspark 作为 Lightning Network 合作方,则更有深意,我们先暂时按下不表。
一看到「先锁定价值、在会话里持续扣减、最后聚合结算」,就会立刻意识到:Tempo 这次争的不是多一条链,而是在把一种长期只被少数支付基础设施玩家真正消化过的支付直觉,搬进更广义的 machine commerce 里。
Tempo 真正可怕的地方,不只是协议,而是它想把整套支付运行系统一起拿下来
很多人现在在比较 x402 和 MPP,比较到一半就已经失真了,因为它们并不完全处在同一个层上。
x402 本质上是一种支付语言。它很优雅,也很锋利地切中痛点。
但 Tempo 这次不是只发了一个语言,它还带了一整套为 real-world payments 定制的运行系统。
Tempo 主网上线时强调的几件事都很具体:instant settlement、predictable low fees、高吞吐、全球可用性;同时又把 payment lanes、稳定币 gas、以及面向企业支付的后续工作负载支持,放进主网上线叙事里。
TIP-20 则更典型:它不是泛泛而谈的 token standard,而是把 transfer memos、compliance controls、reward distribution 这些现实支付世界里很烦、但又必须有人处理的需求,直接写进原语。
Tempo 从 first line of code 到 mainnet 只有七个月,但 Liam 自己承认,真正的底子并不是七个月,而是过去多年积累下来的 battle-tested infrastructure。
Tempo 值得认真对待的,不是速度,而是它没有用创业叙事去掩饰工程底座,反而反过来把「这不是从零开始的空中楼阁」讲清楚了。
所以和 x402 的发起者 Coinbase Developer Platform 对比,CDP 更擅长把标准先跑起来,把开发者先拉进来,把生态先点燃;而 Tempo 这套班底更适合打下一阶段,也就是协议抽象、支付运行时、开发者工具和企业级支付原语逐渐合流的阶段。
不是谁更聪明,而是谁更适合哪个发展阶段。
Circle 真正要防的,不是 USDB 今天的流通量
那是不是代表着 USDB 接下来要挑战 USDC?
USDC 现在确实很强:Circle 不只是资产发行方,它还跟 x402、autonomous payments、nanopayments 这些早期 agent 支付叙事绑定得很紧,资本市场也确实给了它相当高的想象空间。
问题在于,Circle 当前领先的,本质上是 money layer:AI agents 现在默认更容易花出去的那一美元,很大概率是 USDC。
但 Stripe 和 Bridge 在做的事,盯上的不是这一层。
Stripe 的 Stablecoin Financial Accounts 同时支持 USDC 和 USDB,而且对 USDB 的定位很清楚:它是一种 infrastructure / closed-loop stablecoin,而不是一上来就去抢开放流通市场的「第二个 USDC」。
但这反而是我觉得它危险的地方。因为 closed-loop 从来不是弱点,它往往是平台化支付的起点。
如果 Tempo 带着 MPP 把 Stripe 往 machine commerce 的接口层再推一步,Bridge/USDB 的战略意义就会完全变样。
今天它只是后端 processing 的 stablecoin;明天它可能变成更大支付网络里的默认结算器、默认奖励层、默认 treasury layer。
Bridge 自己写 USDB 时就强调,它和传统 stablecoins 不同的一点,是 reserve economics 可以在 issuer、developer 和 end user 之间更灵活地分配。
对 Stripe 这种天然擅长做平台经济分配的人来说,这不是产品 feature,这是结构优势。
Lightspark 不是配角,它让这件事多了一层历史的意味
Lightspark 这次的存在感,不该只被理解成「又多接了一条 Bitcoin rail」。
MPP 虽然今天跑在 Tempo 上,但协议本身是 rail-agnostic 的。
Visa 已经把它扩展到 card-based payments,Stripe 把它扩展到自己的 cards、wallets 和其他支付方式,Lightspark 则把它扩展到了 Lightning Network。
这个组合很有意思,它把 MPP 从「稳定币协议」直接扩展成了「支付协调层」。
前文提到了 session 和 Lightning channel 的那层神似,用 Lightspark 自的话说,就是 Lightning 的基础构件就是 payment channels,交易不必每一笔都广播到链上,双方在通道里不断更新余额,最后再把结果落回主链。
Tempo 的 session 当然不是 Lightning channel 的简单复制,技术层次和适用场景也不一样,但它们在商业直觉上高度共振:真正高频、低值、连续的支付,不该一笔一笔重新结算。
再往前看一层,这条线就更耐人寻味。Lightspark 掌门人 David Marcus 当年在 Facebook 负责 Libra 项目,Libra 的核心目标是重写效率低下的支付系统,而不是单纯发行一个新币。
后来他离开 Facebook,再去做 Lightspark,2025 年又亲自写文说「Restarting Libra」不是正确路径。把这些人和事连起来看,会有一种很强的历史回声:Libra 当年想直接改写货币,今天这一批人更像是在换一种方式改写支付接口。
提到Libra,大家自然会联想到 Meta,以及最近引起很多猜想的 Meta 重回稳定币的战略。我在Stripe该怎么收购PayPal,才能接住Meta泼天的稳定币富贵 中详细解释了其中的来龙去脉,以及与 Stripe 的关系。
现在 MPP 体系又把 David Marcus 的 Lightspark 和 Stripe 联系在了一起,好像一个超大平台联盟的拼图终于完整了:Stripe 拿接口,Bridge 拿闭环稳定币,Tempo做底层公链,Meta 拿分发。Mark Zuckerberg, David Marcus 和 Patrick Collison 撑起了门面。
资本市场又要重新定价了。Genspark.ai,以AI助手'Genspark Claw'革新工作流程人工智能工作空间初创公司Genspark.ai今日发布了全新AI助手Genspark Claw。该产品以提供专属个人用户的云端计算机环境形式呈现,基于Genspark Cloud Computer构建。该实例已为每位用户预配置完成,实现一键即可启用。系统保持数据隔离性,提供能够独立执行任务、运行应用程序并管理工作流程的环境。
此项服务是针对快速发展的开源AI代理平台OpenClaw推出的替代方案。OpenClaw虽能执行网页搜索、代码编写、本地系统操作等实际任务,但因安全性与合规性问题在企业内部推广受限。Genspark的服务解决了OpenClaw的安全隐患与配置复杂性,确保每位用户的数据与其他用户隔离,并拥有完整的访问控制权限。
Genspark Claw作为该公司AI工作空间平台的全域执行层,支持用户通过WhatsApp、Telegram、Microsoft Teams、Slack等通讯平台与助手交互。该系统可接收用户指令执行主题研究、文档撰写、会议安排、邮件通信管理及代码部署等操作。
伴随新版Genspark Claw的发布,公司同时宣布了AI工作空间平台的多项更新,旨在实现更高效的无手动执行与协同作业。新功能支持在Google Workspace、Outlook、Slack、Microsoft Teams、Notion、Salesforce、X等多款企业应用间自动化重复性任务。此外,通过Chrome扩展程序提供的侧边栏助手功能,可理解网页上下文并协助完成浏览器端操作。
Genspark(法律实体Mainfunc Inc.)自创立至今已累计融资4.6亿美元(约合6.624万亿韩元)。主要投资方包括Emergence Capital Partners、SBI Investment Co. Ltd.、LG Technology Ventures、Pavilion Capital Pte. Ltd.、UpHonest Capital及Lanchi Ventures等机构。OpenAI,GPT-5.3-Codex "Spark" 公开…编码AI也进入“超低延迟”时代OpenAI公开了其专用编码AI代理最新版本GPT-5.3-Codex的轻量版"GPT-5.3-Codex-Spark"。通过此次发布,OpenAI采取了与谷歌(GOOGL)"Gemini Flash"系列类似的策略,以提供更快速、更高效的AI模型。
GPT-5.3-Codex-Spark尤其强调低延迟响应速度。这是OpenAI上月与AI芯片初创公司Cerebras Systems达成约144亿韩元规模合作伙伴关系的成果。OpenAI将"Spark"列为该芯片合作的首个成果,并透露该模型实际运行于Cerebras的下一代半导体平台"WSE-3"之上。该芯片是搭载了超过4万亿个晶体管的硅晶圆尺寸AI专用处理器。
此次公开的Spark正如其名,旨在实现"快速推理"。OpenAI解释称,该模型不仅限于生成代码,还能参与开发者通常执行的大多数工作,如实时协作、调试、部署、指标分析、文案修改、用户调查等。相比之前的GPT-5.2,其平均响应速度提升了25%,在特定类型任务中,令牌使用量也减少了近50%。
在AI模型性能比较指标Terminal-Bench 2.0中,Spark也取得了77.3%的准确率,大幅超越了GPT-5.2-Codex的64%。在游戏和网络开发领域也观察到了类似的性能改进。
有趣的一点是,该模型在其自身开发过程中也扮演了"助手"角色。OpenAI方面表示,早期版本的Spark被用于模型学习调试、部署管理、测试结果诊断等多方面,以改进其自身。这种"自我加速开发"的案例被认为是大型AI模型开发中罕见的做法。
目前,GPT-5.3-Codex-Spark仅向付费ChatGPT用户提供,并即将以API形式公开。其价格或使用限制与现有的GPT-5.3-Codex模型相同。
OpenAI强调,此次公开是其长期战略的第一步。公司将并行运营"双重模式战略",即针对实时协作优化的轻量代理,以及能够处理长时间复杂任务的深度模型。对此,Cerebras联合创始人Sean Lie表示:"AI推理速度一旦改变,其模式、应用场景和用户体验都将彻底改变,此次发布仅仅是序幕。"
另一方面,Cerebras近期获得了14.4亿美元(约2.0673万亿韩元)的追加投资,企业估值达到230亿美元(约33.12万亿韩元)。计划于今年上半年进行首次公开募股(IPO)的该公司,将与OpenAI展开更深入的战略合作。对于在AI半导体市场上与英伟达(NVDA)竞争的Cerebras而言,此次合作预计也将成为一个决定性的转折点。播客 Ep.391——超越ABE的Sparkland,正在重塑机构级蓝筹贷款市场SparkLend(SparkLend)在去中心化金融(DeFi)市场中迅速崛起,成为基于蓝筹资产的机构级借贷市场,正在威胁着原有的强者Aave V3。这个由USDS发行方Sky的SubDAO组成的项目,在蓝筹资产多样性和市场深度方面超越了竞争对手协议,展现出快速增长势头。特别是,其以比特币和以太坊衍生品为中心的保守架构,以及基于治理的风险管理体系,忠实地满足了机构投资者的需求。
SparkLend目前的大部分用户结构是,以wETH、wstETH、cbBTC等高质量资产作为抵押品借入稳定币。稳定币均被限制为不可用作抵押品,以此降低预言机操纵风险,同时可借入资产也仅限于满足严格标准的资产。该协议为每种资产差异化地设定了最高贷款价值比(LTV)、清算阈值、惩罚利率等,提供风险调整后的杠杆。此外,通过E-Mode功能,可以在相关性高的资产组之间应用更高的LTV,从而扩大了资本效率。
Spark由三个主要模块组成。第一,Spark流动性层(SLL)是一个收益寻求引擎,它交换和部署从Sky借入的USDS以及各种稳定币,将资本灵活地转移到高收益机会中。第二,储蓄(Savings)模块是一个支付由Sky设定的SSR(Sky储蓄利率)的存款系统。第三,SparkLend作为分叉自Aave V3的无许可去中心化借贷协议运营。
与Aave V3的Prime Market相比,SparkLend提供更多的蓝筹稳定币和ETH/BTC衍生品,并基于相关资产支持更高的杠杆。在风险管理方面,为防止稳定币市场价格波动导致的预言机操纵,采用了固定价格预言机,并准备了多个预言机提供商和Uniswap TWAP备份,提高了应对紧急情况的能力。此外,通过与美国首家加密资产托管机构Anchorage的整合,正在积极吸纳机构需求,初期案例已促成基于BTC的2.22亿美元抵押贷款。
SparkLend还与Morpho、Maple Finance等多种替代协议相连接。通过这种结构,可以在保守的SparkLend之外将资本部署到高收益策略中。实际上,SLL已向Maple分配了1亿美元,并向Morpho Curator Vault分配了数百万美元。这意味着Spark并非单一借贷平台,而是扮演着主动连接整个DeFi收益率环境的流动性枢纽角色。
Spark从2025年第三季度开始实现了独立的盈利能力,并确保了包括准备金因子费用、Curator费用、存款APY等在内的多种收益途径。2025年第四季度利润总计为988万美元,虽然较上一季度有所下降,但仍保持着健康的架构。
根据Alea Research的分析,SparkLend凭借比Prime Market更丰富的蓝筹资产支持、流动性深度以及基于E-mode的高杠杆结构,被评为最机构友好的货币市场之一。此外,在Sky生态系统内以基础利率无限借入USDS的权限,使得Spark能够通过SLL在稳定币市场扩张中发挥主导能力。"Aave V3 被超越"...Messari 关注 SparkLend 的"蓝筹机构贷款"结构全球加密货币研究机构梅萨里研究在近期报告中评价称,SparkLend已确立其作为领先的机构级蓝筹货币市场协议的地位,凭借比Aave V3更高的资产杠杆上限、更深的流动性以及更多样化的抵押资产,来应对机构需求。
自2023年5月推出以来,SparkLend在短短252天内便以总锁仓价值计崛起为仅次于Aave的第二大DeFi货币市场。截至2026年1月,其锁仓资产达73.9亿美元,广泛覆盖了以wETH、wstETH、weETH、rETH等以太坊衍生品及主流稳定币DAI、USDC、USDT、PYUSD、USDS为主力,并包含BTC基础衍生品的资产。这与梅萨里研究所提及的首个蓝筹标准——即高流动性与市值、低波动性、长期业绩表现——的资产构成一脉相承。
Spark作为稳定币发行方Sky的子DAO,以数十亿美元规模的USDS作为“基础利率”借款,随后通过锚定稳定模块转换为PYUSD等高需求稳定币,并以此快速倍增了SparkLend平台的流动性与收益能力。得益于该结构,其在面向机构的贷款中也实现了快速供应扩张,其结果是USDT和PYUSD在该平台上创下了最大供应额纪录。
尤为值得一提的是,Spark为获取机构级信任,与美国联邦特许的加密货币托管机构Anchorage Digital建立了合作伙伴关系,并借此实现了结合链下抵押贷款基础设施与链上资本运作的混合金融结构。在该结构下,已有三家机构作为交易对手参与,以2.22亿美元的BTC抵押借入了1.5亿美元的USDC,并基于实时仪表板实现了抵押品追踪功能。
Spark流动性层不仅支持内部的SparkLend,还支持Morpho、Maple Finance等外部替代市场。这使得精细的资本配置成为可能,并能超越SparkLend的有限结构,触及更高收益率目标市场。例如,Spark通过SLL向Maple Finance的机构超额抵押贷款市场配置了约1亿美元的USDC。
该协议的优势不仅在于高TVL,更涵盖了安全性与可扩展性。其存入资产大部分集中于ETH衍生品,而稳定币则部分采用了固定价格预言机,从源头上阻断了预言机操纵风险。其还具备抵押品构成限制、隔离模式、清算罚金等多层次风险管理体系,以严密防范黑天鹅情景。
因此,梅萨里研究评价称,SparkLend基于市场流动性与风险调整后收益率,实现了稳定性与效率的最大化,并拥有优于Aave V3 Prime Market的结构。实际上,按TVL计,其虽位列Aave和Morpho之后排名第三,但在以蓝筹资产为核心的稳定性、杠杆利用率、供应扩张速度等关键指标上,Spark则更为领先。
Spark的财务指标清晰地展现了这一恰当结构的成效。以2025年第四季度为基准,Spark的净收益为988万美元,季度平均以5.9%的年化收益率运作28亿美元资本,获得了相较于基础利率0.7%的利差,并结合分配奖励收益、Morpho策展人费用及托管平台收益,构建了稳健的协议收益基础。
如此,Spark基于流动性与安全性,构建了针对机构需求优化的结构,从抵押资产到借贷机制、乃至预言机设计,所有要素均以蓝筹为核心,精心实现为稳定的系统。梅萨里研究在报告结尾总结道:“Spark正是蓝筹链上机构贷款与借款发生之地。”CleanSpark 完成密西西比设施收购,运营算力突破 30 EH/sTechub News 消息,比特币矿企 CleanSpark 在完成对密西西比州两处数据中心设施的收购后,其运营算力已突破 30 EH/s。该公司表示,此次收购增加了 75 MW 的运营电力容量,使其提前达到这一里程碑。
运营算力是衡量矿企规模的关键指标之一,但实际比特币产出还取决于网络难度、运行时间、能源成本等多种因素。此次收购也凸显了在比特币减半后,矿企对电力基础设施等战略资产的重视。(NewsBTC)英伟达与微软在IFA 2026合作推进本地AI,10月将推RTX Spark PCTechub News 消息,英伟达与微软及其合作伙伴在IFA 2026上宣布合作,旨在为本地AI提供更快的推理速度和新工具,使AI智能体更易于在英伟达硬件上本地设置和运行。
此外,新的紧凑型英伟达RTX Spark Windows PC将于10月推出,为AI爱好者、开发者和创作者提供本地AI开发与运行的硬件支持。此举旨在推动前沿智能技术的本地化部署与应用。 (NVIDIA Newsroom)Meta 发布 Muse Spark 1.3 版本,升级编程能力Techub News 消息,Meta 发布了其 AI 编程工具 Muse Spark 的 1.3 版本,该版本包含多项编程功能升级。此举正值 Meta 增加对 AI 基础设施和人才招聘的投入,以强化其相对于 OpenAI 和 Anthropic 的竞争地位。 (Tech in Asia)Meta Superintelligence Labs 发布实时语音转录模型 Muse Voice TranscribeTechub News 消息,Meta Superintelligence Labs 本周发布了实时音频感知模型 Muse Voice Transcribe。该模型将流式自动语音识别、超过 20 人的说话人分离和端点检测三项任务整合到一个自回归模型中,无需后处理。该模型已作为托管 API 上线 Meta Model API,价格为每 1000 音频分钟 3 美元,并已为 Meta AI for Mac 和 Muse Code 的听写功能提供支持。
该模型基于 70 多种语言进行训练,其中 25 种在发布时经过广泛验证和推荐。它原生支持超过一小时的音频输入和 20 多名说话人,无需后处理步骤。Meta 报告称,截至 2026 年 9 月 1 日,该模型在 Artificial Analysis 的流式语音转文本和公开的说话人分离基准测试中均排名第一。(MarkTechPost)Nvidia 发布 RTX Spark 芯片挑战苹果本地 AI 市场Techub News 消息,Nvidia 在台北国际电脑展发布基于 Arm 架构的 RTX Spark 超级芯片,可直接在设备端运行 1200 亿参数大语言模型,上下文窗口支持高达 100 万 token,目标直指苹果 M 系列芯片主导的本地 AI 处理市场。
该芯片面向 3000 至 4000 美元价位的高端笔记本,主要面向开发者和研究人员。通过采用统一内存架构并依托 CUDA 生态系统,Nvidia 试图打破苹果在本地 AI 领域的优势,推动 AI 工作负载从数据中心向个人设备迁移。(CryptoBriefing)Perplexity 发布便携式 AI 计算机,基于 NVIDIA DGX Spark 实现本地优先与零按 token 计费Techub News 消息,Perplexity 发布便携式 AI 计算机,这是其智能体平台 Computer 的本地优先版本,可直接在 NVIDIA DGX Spark 上运行智能体工具链、编排器、规划器及后训练模型。该系统将本地模型、推理引擎、工具沙箱和应用连接器打包,任务始于设备,本地模型处理的工作不产生按 token 计费的成本。当步骤需要实时网络或前沿推理时,编排器会暂停并询问用户,再将单一步骤发送至 15 个以上的云端模型之一。
该软件需要 GB10 级设备或配备 24 GB VRAM 的 RTX GPU 才能部署,主要面向已拥有 NVIDIA 工作站的企业、中型团队及资金充足的 AI 原生初创公司。应用场景包括金融、法律、医疗、政府及国防等对数据驻留或合同保密性有严格要求的领域。
在包含 53 项任务的本地知识工作基准测试中,运行 Qwen 3.8 27B 模型的 Computer 在 DGX Spark 上得分为 82.6%,高于开源 Pi 工具链的 77.6% 和 Hermes 的 74.0%。使用 PPLX 27B 模型时,得分提升至 85.4%。在混合模式下,完全本地运行的成本边际为零,而通过顾问升级可将性能提升,成本约为每次 0.415 美元。(MarkTechPost)英伟达在科隆游戏展宣布多款3A大作将登陆RTX Spark平台Techub News 消息,英伟达在本周德国科隆游戏展上宣布,其将于今秋推出的RTX Spark平台将获得包括艺电、Embark Studios和育碧在内的多家游戏发行商支持,多款3A大作将登陆该平台。平台将原生集成艺电的Javelin反作弊技术,并支持DLSS 4.5等RTX技术。
此外,英伟达还宣布了多项游戏技术更新,包括现已可用的DLSS 4.5光线重建技术、为《CONTROL Resonant》等游戏引入路径追踪,以及NVIDIA ACE技术将于2027年初登陆《Aniimo》等。RTX Spark平台旨在将个人AI代理、高级内容创作和高性能游戏整合于专为下一代Windows PC设计的平台中。 (NVIDIA Blog)鱼池联创王纯地址向币安转入 1.27 万枚 ETH 并偿还 Spark 借款Techub News 消息,鱼池(F2Pool)联合创始人王纯的一个链上地址在过去三天内,将 12,765 枚 ETH(约合 2873 万美元)转入币安,随后提取了 8768 万枚 USDC 用于偿还其在 DeFi 借贷协议 Spark 上的借款。
该地址目前仍持有 6.5 万枚 ETH(约合 1.59 亿美元)和 1000 枚 WBTC(约合 7718 万美元)。此举被视为在近期 ETH 价格上涨后,通过部分减仓以降低杠杆风险的操作。(@EmberCN)某巨鲸向交易所充值超1万枚ETH,若卖出可获利超480万美元Techub News 消息,链上数据显示,地址 0x268…47643 在 2026 年 7 月至 8 月期间从币安提取了 79,226.49 枚 ETH(约 1.4 亿美元),平均成本为 1,776.83 美元。自 8 月 19 日起,该地址已累计向交易所充值 10,887.15 枚 ETH(价值约 2,416 万美元),若按当前价格卖出,预计可获利 481.7 万美元。据悉,卖出所得稳定币被用于偿还其在 Spark 协议上的借款。(@ai_9684xtpa)Liquid AI 发布 LFM2.5-DSpark 草稿模型,解码速度最高提升 3.18 倍Techub News 消息,AI 公司 Liquid AI 发布了 LFM2.5 系列模型的 DSpark 草稿模型检查点,包括 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B。这些草稿模型为现有目标模型添加了推测解码路径,通过一个约 3 亿参数的草稿模型提出候选词块,再由目标模型一次性验证,在模型输出不变的情况下实现解码加速。
实测显示,在 H100 GPU 上,解码速度最高可提升 3.18 倍;在 M4 Max MacBook Pro 上最高提升 2.87 倍。该技术适用于本地部署的开发者工具、消费级应用、机器人及嵌入式系统等场景。llama.cpp 和 SGLang 已提供首日支持。
根据 LFM 开放许可协议 v1.0,年收入低于 1000 万美元的实体可免费商用,更大规模的企业需联系 Liquid AI 获取商业许可。 (MarkTechPost)撰文:Techub News 整理 导语 2026年6月1日,NVIDIA 创始人兼 CEO Jensen Huang(黄仁勋)在台北 COMPUTEX 展会上发表了长达两小时的主题演讲。这场演讲被视为指引未来数年 AI 与计算产业方向的「风向标」。黄仁勋不仅回到了其故乡台湾,更在父母和数万现场观众面前,系统阐述了 AI 从「生成」走向「有用」的关键转折,并发布了一系列旨在重塑从数据中心到个人电脑的软硬件产品。 当前,全球正处于建设 AI 工厂的狂潮中,算力即利润。黄仁勋此次演讲的核心,正是宣告一种全新的计算范式——以智能体(Agent)为中心的计算——已经成熟并开始创造巨大经济价值。他详细介绍了支撑这一范式的技术栈,包括已全面投产的 Vera Rubin 系统、专为智能体设计的 Vera CPU,以及与微软携手、时隔40年重新发明的个人电脑 RTX Spark。 摘要 Agentic AI(智能体 AI)时代已真正到来,AI 从生成内容变为执行有用工作,成为利润和 GDP 的直接创造者。 NVIDIA 发布 Vera Rubin 多机架超级计算机,这是首个专为处理智能体工作负载而设计的端到端系统,现已全面投产。 推出革命性的 Vera CPU,其设计理念从服务人类转向服务智能体,追求极致的单线程性能、带宽和能效,以消除智能体工作流中的瓶颈。 NVIDIA 与微软深度合作,推出 RTX Spark PC 产品线,重新发明个人计算机,使其原生运行智能体,开启继 Windows 95 之后最大的 PC 革命。 发布企业 AI 智能体工具包、物理 AI 基础模型 Cosmos 3、自动驾驶模型 Alpamo 2 及人形机器人参考平台 Isaac Groot,将智能体范式扩展至各行各业。 智能体时代降临:从生成到有用,算力即收入 黄仁勋开篇即指出,AI 的发展浪潮已从生成式 AI 进入 Agentic AI(智能体 AI)阶段。「有用的 AI」已经到来。他以全球软件开发为例,展示了智能体带来的生产力革命:GitHub 上的代码提交量在 2026 年前几个月近乎翻了三倍。这意味着全球约 3000 万软件开发者(代表约 3 万亿美元年薪)所创造的经济产出可能接近 9 万亿美元。AI 并未取代工作,反而因极大提升了单个工程师的产出价值,刺激企业雇佣更多工程师。 这一转变的核心在于,AI 生成的「Token」(代币)不再是单纯的信息单元,而是可盈利的收入单位。智能体能够观察、推理、规划并使用工具(如浏览器、数据库、CAD 软件)来完成实际任务,从编写代码、创建 GIF 动画到设计 3D 打印部件。这创造了对 Token 的海量需求,进而驱动对算力——即 AI 工厂——的疯狂投资。 黄仁勋强调,「计算即收入,计算即利润」。在这种新范式下,数据中心或 AI 工厂的每一瓦特电力都直接关联到 Token 的产出和收入。因此,衡量系统优劣的关键指标不再是单纯的峰值算力,而是「每瓦特 Token 数」和系统的整体可靠性、生命周期。这从根本上改变了计算基础设施的设计哲学和经济学。 Vera Rubin:为智能体而生的超级计算机 为了应对智能体工作负载的极端复杂性,NVIDIA 推出了 Vera Rubin。黄仁勋澄清,Vera Rubin 不是一个单一的 GPU 芯片,而是一个从端到端设计的、多机架规模的智能体处理系统。智能体的工作模式是「解聚且分布式」的:大语言模型负责「思考」,工具运行在 CPU 或加速器上,记忆管理系统处理工作记忆和长期记忆,安全处理器保障全流程加密,所有环节由编排软件协调。这完全不同于传统应用在单一操作系统内运行的模式。 Vera Rubin 系统集成了 Vera Rubin GPU(MVLink 72)、Vera CPU、Bluefield-4 DPU、ConnectX-9 网络芯片以及 Spectrum-X 以太网交换机等至少七种新型芯片。其设计采用「极端协同设计」,通过数字孪生在 Omniverse 中完成整个系统的模拟、验证和优化,然后再进行物理建造。黄仁勋特别展示了其革命性的机架设计:无电缆、无软管、无风扇,通过中置 PCB 背板连接,将单个机架的组装时间从 Grace Blackwell 时代的 2 小时缩短至 5 分钟,可靠性和可维护性大幅提升。 黄仁勋宣布,Vera Rubin 现已进入全面生产阶段,其供应链规模是 Grace Blackwell 的两倍。该系统专为智能体时代打造,能够高效处理智能体所需的观察、推理、规划、工具使用和记忆管理等复杂任务,是 NVIDIA 从 GPU 公司、系统公司向AI 基础设施公司转型的标志性产品。 Vera CPU:为 impatient 的智能体重塑计算核心 黄仁勋指出,传统 CPU 是为人类用户设计的,其使用和租赁模式以「秒」为单位。但智能体是「没有耐心的」,它们生活在「纳秒」世界。在智能体工作流中,CPU 用于编排、管理工具调用、访问数据库等任务,任何等待都会拖累整个智能体的执行效率,从而影响宝贵的 Token 产出。 为此,NVIDIA 设计了全新的 Vera CPU,这是首个为智能体时代打造的 CPU。其设计目标聚焦于四点:极高的单线程性能(IPC)、极高的每核心带宽、极高的芯片内外总带宽以及极致的能效。Vera CPU 采用了名为「Olympus」的自研核心、第二代可扩展一致性互连 fabric,并首次支持 LPDDR5X 内存,实现了相比现有 x86 CPU 数倍的性能提升。例如,在 SQL 查询和实时流处理(如纽约证券交易所场景)等关键工作负载上,Vera CPU 带来了 3 倍到 6 倍的加速。 黄仁勋预测,未来智能体的数量将远超人类,它们对低延迟和高效率的渴求将催生一个全新的、巨大的 CPU 市场。Vera CPU 将与 Vera Rubin 系统紧密耦合,成为优化 AI 工厂产出(Token)的关键一环。 重新发明 PC:NVIDIA 与微软的 RTX Spark 革命 黄仁勋将话题从数据中心引向个人计算,宣布与微软合作,时隔 40 年重新发明个人电脑。新的计算范式——智能体——不仅运行在云端,也将运行在每个人的设备上。为此,NVIDIA 推出了 RTX Spark 平台。 RTX Spark 的核心是一颗与联发科合作开发的 N1X 芯片,它集成了 Blackwell 架构的 RTX GPU、定制版 20 核 Grace CPU,并通过 NVLink 互联,拥有 128GB 统一内存。黄仁勋强调,这是一个「百分之百兼容 Windows、百分之百运行 CUDA、百分之百具备 NVIDIA AI Tensor Core」的平台,能够无缝运行过去数十年积累的所有应用和 AI 工作负载。 现场演示展示了运行在 RTX Spark 笔记本上的智能体如何帮助用户设计房屋:用户通过自然语言和草图表达意图,智能体便能调用本地的 Rhino、Blender 等专业软件进行建模、渲染,甚至利用云端模型生成效果图。这预示着未来 PC 的角色将从被动工具转变为拥有自主智能体的主动助手。 此外,NVIDIA 还宣布了全新的产品线,包括 RTX Spark 笔记本电脑、台式机和工作站。黄仁勋展望,未来家庭中可能会拥有一个常年开机、连接所有设备的「AI 超级计算机」,作为个人的智能体中枢,其意义堪比手机向智能手机的演变。 赋能万物智能:从企业工具包到物理 AI 为了让各行各业都能构建自己的智能体,NVIDIA 推出了「企业 AI 智能体工具包」。该工具包包含四个核心部分:模型(如开源的 Neotron,会上发布了更智能、更高效的 Neotron 3 Ultra)、智能体编排框架(如 Open Shell)、工具与技能(如 CUDA-X 库)以及运行时环境。黄仁勋以与 Cadence 合作开发的「芯片设计超级智能体」为例,展示了该工具包如何将芯片验证周期从数周缩短到数小时。 最后,黄仁勋将智能体的范畴从数字世界拓展到物理世界。他发布了物理 AI 基础模型 Cosmos 3,这是一个能够理解、推理和生成物理世界场景的多模态模型,可用于机器人训练、仿真等。同时,还推出了具备推理能力的自动驾驶模型 Alpamo 2,以及为降低人形机器人研发门槛的开源参考平台 Isaac Groot(包含软硬件和参考机器人设计)。 黄仁勋总结道,无论是云端智能体、PC 智能体、机器人还是自动驾驶汽车,其核心计算模式都是相同的:模型、编排框架、工具技能和运行时。NVIDIA 通过 Vera Rubin、Vera CPU、RTX Spark 以及一系列软件工具包,正在为这个全新的智能体时代构建完整的基础设施栈。他感谢了台湾供应链伙伴的巨大贡献,并坚信与生态系统的紧密合作将继续驱动这场前所未有的技术革命。
