英伟达正式发布了其最先进的人工智能模型Nemotron Super 3。该模型旨在支持大规模运行复合式人工智能系统,它将高级推理能力与快速处理速度相结合,能够高效执行对准确性要求极高的任务。Nemotron Super 3基于包含1200亿参数的混合专家架构。英伟达表示,其吞吐量最高可达前代Nemotron Super模型的五倍,且准确性提升了一倍。
最新的Nemotron 3 Super在英伟达的Blackwell GPU上以NVFP4精度运行,可减少内存需求,并将推理速度较前代Hopper平台提升高达四倍。该模型专门为解决自动化大规模AI工作流所需的两大限制而设计。其一是内容的爆炸式增长,其二是被称为"思考税"的复杂推理过程所涉及的成本问题。
Nemotron Super 3可通过build.nvidia.com、OpenRouter和Hugging Face下载,并将集成到AI搜索引擎公司Perplexity Inc.以及用于代码生成的应用程序中。多家企业正利用该模型自动化电信、网络安全、半导体设计与制造等多个领域的工作流,戴尔科技和慧与等公司也计划通过其各自的代理中心提供对该模型的访问。
Nemotron 3 Super的发布正值英伟达年度GTC大会前夕,预计此次大会将揭晓其下一代GPU平台。


