QR コードでダウンロード
「Nemotron」の検索結果:全23件
英伟达投资了一个叫 Reflection 的模型公司,发布了第一个开源模型 Beam,对标智谱的 GLM-5.2 官方说两者在高级推理测试上分数相当,Beam 的推理算力只要 5.2 的三分之一到四分之一 彭博和金融时报都表示:它是美国在开源模型领域,对中国的反击 但是呢,作为新选手...从目前成绩上来看,与国内头部的其他开源模型比如 qwen3.8/gl…
撰文:Techub News 整理 导语 2026 年 7 月,NVIDIA 创始人兼 CEO Jensen Huang(黄仁勋)与 AI 应用框架 LangChain 的创始人进行了一场深度对话。这场对话发生在 AI 智能体技术迅猛发展的关键节点。过去半年,随着 Claude Code、OpenClaw 等突破性进展,智能体系统正从概念走向大规模企业应用…
英伟达($NVDA)发布了能够同时处理文本、图像和语音的全新推理人工智能模型"Nemotron 3 Nano Omni"。该模型采用无需单独识别模块即可整合并解析多种输入的结构,旨在成为更快速、更智能的"代理型AI"的核心大脑。 此次发布的模型参数规模约为300亿,其特点是采用了"专家混合"结构,同时实现了低延迟和高灵活性。英伟达表示,该模型通过结合视觉与…
随着LG AI研究所与英伟达扩大人工智能合作的消息传出,Yuracl公司股价呈现强势上涨。由于LG超大型AI模型EXAONE与英伟达Nemotron的结合计划备受关注,基于EXAONE开展业务合作的Yuracl公司有望受益的预期正反映在股价走势中。 22日科斯达克市场上,Yuracl以14960韩元成交。较前一交易日上涨1860韩元(涨幅14.20%)。盘…
英伟达正式发布了其最先进的人工智能模型Nemotron Super 3。该模型旨在支持大规模运行复合式人工智能系统,它将高级推理能力与快速处理速度相结合,能够高效执行对准确性要求极高的任务。Nemotron Super 3基于包含1200亿参数的混合专家架构。英伟达表示,其吞吐量最高可达前代Nemotron Super模型的五倍,且准确性提升了一倍。 最新…
英伟达为强化人工智能领域地位,宣布推出全新AI模型与战略投资计划。英伟达公开了名为"Nemotron3 Super"的开放式AI模型,该模型基于最新Blackwell芯片,推理速度最高可达现有模型的4倍。此次发布的AI模型专为具备自主判断与复杂任务执行能力的AI智能体优化,采用能高效处理复杂任务的混合专家架构。 英伟达此举被解读为提升其在GPU市场份额的战…
英伟达(NVDA)发布新一代人工智能模型群"Nemotron-3",着力强化开源生态系统。此次发布作为奠定未来智能体AI基础的核心战略,其意义重大在于该模型是兼顾高性能、效率与透明度而设计的。 以首席执行官黄仁勋为首的管理层一贯强调开源技术是AI普及的关键。此次Nemotron-3的发布也延续了这一理念。这是为了降低全球各类开发者和企业参与AI开发的门槛,…
全球最大人工智能(AI)芯片制造商英伟达(NVIDIA)发布了其自主研发的开源大型语言模型(LLM)“NemoTron3”,正式着手扩展开放式人工智能生态系统。同时,公司通过收购能够管理大规模AI服务器作业的代表性开源工具,正从软件到硬件全面强化其整合竞争力。 NemoTron3是于2025年12月15日(当地时间)发布的模型,根据参数数量推出了“纳米版”…
英伟达(NVDA)发布全新人工智能(AI)模型系列"Nemotron 3",正加速进军智能体AI市场。该模型系列以开源形式提供,基于融合高速推理能力与轻量内存需求的混合架构设计。模型规模分为纳米(Nano)、超级(Super)、至尊(Ultra)三种,各自的性能和应用领域划分明确。 英伟达针对此次模型发布强调:"开放平台是AI创新的核心","通过Nemot…
Techub News 消息,英伟达发布 Nemotron 3 Diarization 模型,该模型旨在帮助开发者构建能够实时识别并区分不同说话人的 AI 应用。该技术可应用于会议转录、客服对话分析等场景,提升语音处理的准确性与效率。(Hugging Face)
Techub News 消息,据 huggingface.co 报道,Nemotron 开发了一种任务引导的合成问答生成工作流程,旨在提升 Ultra 和 Super 训练的效果。该流程利用广泛的公共任务数据集作为能力种子,生成与任务对齐的新示例,并通过推理和相关知识进行丰富,最终过滤成策划的合成数据集。 该流程包括收集种子任务、标准化记录、生成相似示例、丰富答案和过滤打包等五个阶段。在对 Nemotron-3 Nano 模型进行的 100B-token 续写实验中,任务引导的合成问答生成在多个评估指标上均有所提升,显示出该流程在知识密集型和推理密集型任务中的有效性。
Techub News 消息,据 Cointelegraph 报道,Nvidia CEO 黄仁勋在 Computex 2026 上宣布推出新款 AI 模型 Nemotron 3 Ultra。 此次发布标志着 Nvidia 在 AI 模型领域的最新进展,进一步完善其生成式 AI 软件生态。
Techub News 消息,NVIDIA 联合普林斯顿大学和马里兰大学的研究人员推出 PivotOPD,这是一种用于多轮大语言模型智能体的策略蒸馏方法。该方法训练智能体避免最具破坏性的早期错误,并在错误发生时进行恢复。在针对 13 个基线的测试中,该方法在 ALFWorld、WebShop 和基于搜索的 QA 任务上,为 Qwen3-1.7B 和 Qwen3-8B 学生模型取得了最佳平均成绩。研究结论是,恢复能力是可学习的,而标准策略蒸馏很少教授这一点。 该方法在 Qwen3-8B 学生模型上,能从 72.7% 的重放关键错误中恢复,而标准策略蒸馏的恢复率仅为 20.3%。该方法不增加推理成本,训练后的智能体可在其基础模型运行的任何地方运行。(MarkTechPost)
Techub News 消息,英伟达创始人兼CEO黄仁勋周二出席Salesforce Dreamforce大会,与Salesforce CEO马克·贝尼奥夫同台。此次亮相正值Salesforce发布其首个CRM推理模型Koa,该模型基于英伟达Nemotron 3 Super构建。黄仁勋在会上强调了AI“无所不知、无所不能”的潜力。 (NVIDIA Newsroom)
Techub News 消息,Salesforce 与英伟达合作推出名为 Koa 的新型 AI 推理模型。该模型基于英伟达的开源权重模型 Nemotron 构建,专门训练用于执行销售、营销和客户支持任务。此举标志着企业软件巨头与芯片制造商在垂直领域 AI 应用上的深度整合。(TechCrunch)
Techub News 消息,英伟达正在使用 Palantir Foundry 平台和其开源优化库 cuOpt 来自动化其全球制造基地的硬件供应链分配决策。该公司构建了“数字供应链智能”指挥中心,通过混合整数线性编程来最小化物料所有权时间,并协调零部件供应、产能限制与客户交付计划之间的依赖关系。 为处理非结构化运营变量(如供应商通话记录、天气预测和地缘政治事件),英伟达对 Nemotron 3.5 Lightning 模型进行了领域微调。该模型在历史分配记录上实现了 86.7% 的决策准确率,优于未调优的基础模型和更大的 Nemotron 3 Ultra 模型。微调过程在两块 B200 GPU 上仅耗时数分钟。 英伟达即将为 Vera Rubin 架构构建的供应链网络规模将是支持 Grace Blackwell 网络的两倍。运营选择、计划修订和实际工厂产出数据将持续写回 Palantir 的本体模型中。 (AI News)
Techub News 消息,OpenBMB 发布 MiniCPM5-2B 模型,这是 MiniCPM5 系列的第二代检查点。该模型为密集因果语言模型,参数量约 25.2 亿,采用标准 Llama 架构,上下文窗口为 131,072 个 token,并采用 Apache 2.0 开源许可。 在 34 项基准测试中,MiniCPM5-2B 平均得分 53.9,优于同规模基准模型 Qwen3.5-4B(51.1)。该模型在工具使用、代码推理和长上下文检索任务上表现突出,但在通用知识任务上稍弱于更大规模的模型。 OpenBMB 同时开源了训练数据集,包括 Ultra-FineWeb、UltraData-Code、UltraData-Math 等,以及多个中间检查点,以便社区验证其强化学习与策略蒸馏训练流程的效果。 (MarkTechPost)
Techub News 消息,英伟达(Nvidia)应用深度学习研究副总裁 Bryan Catanzaro 透露,公司已将开源权重 AI 模型 Nemotron 的发布周期从原来的 6-8 个月缩短至每 4-6 周一次。这一加速得益于合成数据生成、多教师蒸馏(MOPD)及强化学习环境等内部工具链的完善。 该公司最新发布的 Nemotron 3.5 Lightning 于 8 月 11 日上线,采用混合架构结合 Mamba 与 Transformer 设计。所有 Nemotron 模型均以开放权重形式发布,附带完整训练配方和数据集,开发者可免费下载修改。该策略旨在通过降低模型使用门槛来带动其推理优化芯片及相关软件平台的需求。(CryptoBriefing)
Techub News 消息,据 CryptoBriefing 报道,Cadence Design Systems 发布与英伟达合作的 ChipStack AI Super Agent,将芯片验证周期从五周缩短至一天以内,效率提升超 40 倍。 该系统基于英伟达 Nemotron 基础模型构建,具备 Level-5 自主能力,可独立执行复杂芯片设计和验证流程。该公司曾于 2 月推出初版,预计下半年开放新功能的早期访问。