扫码下载
搜索“Nvidia Vera Rubin”共有8条相关结果
Techub News 消息,AI 云服务提供商 CoreWeave 已部署多机架 Nvidia Vera Rubin NVL72 集群。受此消息影响,CoreWeave 股价上涨 14%。该集群的快速部署可能重塑云服务领域的竞争格局,推动创新和需求增长。 (Crypto Briefing)
Techub News 消息,戴尔科技已向 AI 云服务商 CoreWeave 交付全球首批英伟达 Vera Rubin NVL72 AI 服务器机架。该部署标志着 AI 效率的重大飞跃,有望降低大规模 AI 应用的成本与能耗。 (Crypto Briefing)
Techub News 消息,AI 云服务提供商 Nscale 承诺向人形机器人初创公司 Figure 提供至少 35 亿美元的 AI 云容量支持。该计划包括在德克萨斯州部署 10 万台英伟达 Vera Rubin GPU。 此次合作旨在为 Figure 的机器人研发提供大规模计算基础设施,以加速其人工智能模型的训练与部署。(Crypto Briefing)
Techub News 消息,NVIDIA 发布 Vera Rubin NVL72 系统的早期性能数据。数据显示,在运行 AI 代理工作负载时,该系统每兆瓦的吞吐量比 NVIDIA GB300 NVL72 系统高出高达 30 倍,同时每百万个令牌的成本降低高达 35 倍。 性能测试基于 SemiAnalysis AgentX 工作负载进行,该负载模拟了现实世界的代理编码会话,保留了实际上下文增长、工具调用和子代理生成。对于受电力限制的 AI 工厂而言,这意味着在相同能耗下可完成多达 30 倍的代理工作。 NVIDIA 表示,其 DSX MaxLPS 技术可在 GPU、机架和工作负载级别管理功耗,从而在相同的兆瓦预算内调配多达 40% 的 GPU,进一步提升了 AI 工厂规模的每兆瓦吞吐量。 (NVIDIA Blog)
Techub News 消息,NVIDIA 宣布其 Vera Rubin 机架级系统 NVIDIA Groq 3 LPX 已投入全面生产。该系统在运行开源智能体模型 Gemma 4 31B 的基准测试中,针对 10 万令牌的长上下文用例,每秒可生成 3400 个输出令牌,速度比最接近的替代平台快 4 倍。 全球行业合作伙伴正在采用 Vera Rubin 平台解决方案。SpaceXAI 宣布将使用 NVIDIA Vera CPU 为其下一代智能体 AI 提供动力。CoreWeave 已部署 Spectrum-X Multiplane 进入生产环境,该技术通过多个并行交换机连接 NVIDIA Vera Rubin 机架,提供高带宽、扁平且无损的 AI 网络。Nebius 成为首个采用 NVIDIA Groq 3 LPX 的 AI 云。 NVIDIA 表示,随着 AI 从训练转向推理和智能体化,推理已成为新前沿。智能体 AI 系统正在生成更多令牌,处理更大的上下文窗口,并越来越多地与其他 AI 系统协作以解决复杂问题。这些工作负载需要一类新型基础设施,不仅针对性能,还需在空前规模下优化吞吐量、响应能力和经济性。(NVIDIA Blog)
Techub News 消息,Nvidia Vera Rubin 平台已进入全面生产阶段,并开始向全球大型云运营商出货。新的 NVL72 机架级系统每个集成 72 颗 Rubin GPU 与 36 颗 Vera CPU,代表了 AI 推理效率的代际跨越。 该架构在智能体 AI 工作负载上的每能耗吞吐量最高可达上一代 Blackwell 的 10 倍,推理成本同步下降九成。系统可从基础的 NVL72 配置扩展至超过 1000 颗芯片的集群。Supermicro 已于 2026 年 6 月起交付端到端 Rubin 解决方案,CoreWeave、微软、亚马逊及甲骨文等已成为首批接收订单的客户。(CryptoBriefing)
Techub News 消息,百时美施贵宝(Bristol Myers Squibb)宣布购入基于 Nvidia Vera Rubin 架构的 DGX SuperPOD 超算系统,成为首家部署该系统的生命科学公司,用于加速新药发现流程。 该系统由 8 台 DGX Vera Rubin NVL72 组成,相较 2023 年部署的 AI 基础设施计算能力提升超 10 倍。BMS 将利用 Nvidia BioNeMo 平台和 Agent Toolkit 训练专有基础模型,构建自主 AI 代理执行复杂药物发现任务,此前双方合作已将 AI 靶点识别时间从数周缩短,并使特定工作负载计算成本降低 55%。(Cryptobriefing)
Techub News 消息,该去中心化 GPU 云项目已集成 NVIDIA Vera Rubin 架构,通过 2,304 块 GPU 集群提供企业级算力,可将 AI 推理成本降低至 Blackwell 架构的十分之一,并支持长上下文代理管道和机密计算工作负载。 Vera Rubin 于 2026 年 1 月发布,单 rack 提供 3.6 exaFLOPS 算力。Aethir 此前已为 Axe Compute 部署大规模 GPU 集群,现通过 Aethir Claw 提供模型即服务,使开发者无需等待超大规模云服务商即可使用前沿算力。(Aethir)