英伟达(NVDA)发布全新人工智能(AI)模型系列"Nemotron 3",正加速进军智能体AI市场。该模型系列以开源形式提供,基于融合高速推理能力与轻量内存需求的混合架构设计。模型规模分为纳米(Nano)、超级(Super)、至尊(Ultra)三种,各自的性能和应用领域划分明确。
英伟达针对此次模型发布强调:"开放平台是AI创新的核心","通过Nemotron 3将能够构建具备透明度与可扩展性的智能体系统"。实际上,最小的Nemotron 3纳米模型可提供较前代高出4倍的处理量。该模型在3000亿参数中仅激活30亿参数,从而最小化内存与计算资源占用。
Nemotron超级模型采用1000亿参数与100亿激活参数,适用于需要多AI智能体的中等级别应用领域。最大的Nemotron至尊模型由5000亿参数与500亿激活参数构成,专为需要复杂推理与战略规划的高阶AI应用程序设计。模型将按序发布,纳米版已可用,超级版计划于2026年第一季度推出,至尊版将于上半年内公开。
本系列模型基于英伟达最新的4位NVPF4训练格式,可在Blackwell架构兼容GPU上高效运行。此类优化使得即使在有限GPU环境下也能实现高性能,并能在无知识损失的前提下转换为轻量化模型。预计这将显著提升企业与开发者的成本效益。
初期合作伙伴包括埃森哲、CrowdStrike、甲骨文、Palantir、Perplexity、ServiceNow、西门子、Zoom等跨行业领军企业。Perplexity首席执行官阿拉温德·斯里尼瓦斯表示:"我们正在构建可选择性调用优化开源模型的智能体路由系统,Nemotron 3至尊版将成为其核心支柱。"
此次发布的核心议题在于确保整个AI生态系统的可靠性与可扩展性。为此英伟达公开了规模高达3万亿token的预训练、后训练及强化学习数据集。此外还同步发布了可增强实时运营安全性的"Nemotron智能体安全数据集",以及支持开发环境的开源工具包"NeMo Gym"与"NeMo RL"。
英伟达表示将提出长期路线图,以确保未来模型发布的可靠性与可持续性。在模型发布接连不断的市场趋势中,该公司旨在通过保障稳定性与兼容性的方式构建开发者社区的信任。
此次Nemotron 3的发布不仅是单纯的模型推出,更是英伟达在下一代AI平台竞争中夺取开源模型领导权的又一战略布局。这些宣告智能体AI时代来临的模型,预示着将在需要复杂推理与自动化技术的各产业领域引发重大变革。


