Techub News 消息,NVIDIA 宣布其 Vera Rubin 机架级系统 NVIDIA Groq 3 LPX 已投入全面生产。该系统在运行开源智能体模型 Gemma 4 31B 的基准测试中,针对 10 万令牌的长上下文用例,每秒可生成 3400 个输出令牌,速度比最接近的替代平台快 4 倍。 全球行业合作伙伴正在采用 Vera Rubin 平台解决方案。SpaceXAI 宣布将使用 NVIDIA Vera CPU 为其下一代智能体 AI 提供动力。CoreWeave 已部署 Spectrum-X Multiplane 进入生产环境,该技术通过多个并行交换机连接 NVIDIA Vera Rubin 机架,提供高带宽、扁平且无损的 AI 网络。Nebius 成为首个采用 NVIDIA Groq 3 LPX 的 AI 云。 NVIDIA 表示,随着 AI 从训练转向推理和智能体化,推理已成为新前沿。智能体 AI 系统正在生成更多令牌,处理更大的上下文窗口,并越来越多地与其他 AI 系统协作以解决复杂问题。这些工作负载需要一类新型基础设施,不仅针对性能,还需在空前规模下优化吞吐量、响应能力和经济性。(NVIDIA Blog)