Techub News 消息,知名软件开发工具商 JetBrains 发布了 Mellum2.1,这是一个专为编程智能体和快速子智能体设计的开源模型。Mellum2.1 是一个 120 亿参数的混合专家思维模型,每令牌激活 25 亿参数,在 17 项基准测试中的 15 项上超越了其前代 Mellum2,并在 LiveCodeBench v6 等多项编程基准上领先于 Qwen3.5-9B。 该模型在 Apache 2.0 许可下发布于 Hugging Face,架构与 Mellum2 保持一致,主要升级来自在真实软件环境中进行的强化学习训练。这使得它成为一个可自托管的小型模型,能够探索代码仓库、编辑文件并检查自己的修改。 JetBrains 表示,该模型可在用户自己的 GPU 上通过 vLLM 或 SGLang 运行,速度测试基于 1 块 NVIDIA H200。其上下文长度为 131,072 个令牌,主要面向智能体工作、通用推理助手和私有自托管部署三种用途。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,知名软件开发工具商 JetBrains 发布了 Mellum2.1,这是一个专为编程智能体和快速子智能体设计的开源模型。Mellum2.1 是一个 120 亿参数的混合专家思维模型,每令牌激活 25 亿参数,在 17 项基准测试中的 15 项上超越了其前代 Mellum2,并在 LiveCodeBench v6 等多项编程基准上领先于 Qwen3.5-9B。 该模型在 Apache 2.0 许可下发布于 Hugging Face,架构与 Mellum2 保持一致,主要升级来自在真实软件环境中进行的强化学习训练。这使得它成为一个可自托管的小型模型,能够探索代码仓库、编辑文件并检查自己的修改。 JetBrains 表示,该模型可在用户自己的 GPU 上通过 vLLM 或 SGLang 运行,速度测试基于 1 块 NVIDIA H200。其上下文长度为 131,072 个令牌,主要面向智能体工作、通用推理助手和私有自托管部署三种用途。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。