Techub News 消息,知名软件开发工具商 JetBrains 发布了 Mellum2.1,这是一个专为编程智能体和快速子智能体设计的开源模型。Mellum2.1 是一个 120 亿参数的混合专家思维模型,每令牌激活 25 亿参数,在 17 项基准测试中的 15 项上超越了其前代 Mellum2,并在 LiveCodeBench v6 等多项编程基准上领先于 Qwen3.5-9B。 该模型在 Apache 2.0 许可下发布于 Hugging Face,架构与 Mellum2 保持一致,主要升级来自在真实软件环境中进行的强化学习训练。这使得它成为一个可自托管的小型模型,能够探索代码仓库、编辑文件并检查自己的修改。 JetBrains 表示,该模型可在用户自己的 GPU 上通过 vLLM 或 SGLang 运行,速度测试基于 1 块 NVIDIA H200。其上下文长度为 131,072 个令牌,主要面向智能体工作、通用推理助手和私有自托管部署三种用途。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Semua maklumat di laman web ini adalah untuk rujukan sahaja.
Laman web ini tidak menjamin ketepatan, kesahan, ketepatan masa atau kelengkapan maklumat.
Pengguna menanggung sendiri risiko bagi tindakan berdasarkan maklumat di laman web ini.
Techub News 消息,知名软件开发工具商 JetBrains 发布了 Mellum2.1,这是一个专为编程智能体和快速子智能体设计的开源模型。Mellum2.1 是一个 120 亿参数的混合专家思维模型,每令牌激活 25 亿参数,在 17 项基准测试中的 15 项上超越了其前代 Mellum2,并在 LiveCodeBench v6 等多项编程基准上领先于 Qwen3.5-9B。 该模型在 Apache 2.0 许可下发布于 Hugging Face,架构与 Mellum2 保持一致,主要升级来自在真实软件环境中进行的强化学习训练。这使得它成为一个可自托管的小型模型,能够探索代码仓库、编辑文件并检查自己的修改。 JetBrains 表示,该模型可在用户自己的 GPU 上通过 vLLM 或 SGLang 运行,速度测试基于 1 块 NVIDIA H200。其上下文长度为 131,072 个令牌,主要面向智能体工作、通用推理助手和私有自托管部署三种用途。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Semua maklumat di laman web ini adalah untuk rujukan sahaja. Laman web ini tidak menjamin ketepatan, kesahan, ketepatan masa atau kelengkapan maklumat. Pengguna menanggung sendiri risiko bagi sebarang tindakan berdasarkan maklumat ini.