Techub News 消息,OpenBMB 发布 MiniCPM5-2B 模型,这是 MiniCPM5 系列的第二代检查点。该模型为密集因果语言模型,参数量约 25.2 亿,采用标准 Llama 架构,上下文窗口为 131,072 个 token,并采用 Apache 2.0 开源许可。 在 34 项基准测试中,MiniCPM5-2B 平均得分 53.9,优于同规模基准模型 Qwen3.5-4B(51.1)。该模型在工具使用、代码推理和长上下文检索任务上表现突出,但在通用知识任务上稍弱于更大规模的模型。 OpenBMB 同时开源了训练数据集,包括 Ultra-FineWeb、UltraData-Code、UltraData-Math 等,以及多个中间检查点,以便社区验证其强化学习与策略蒸馏训练流程的效果。 (MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,OpenBMB 发布 MiniCPM5-2B 模型,这是 MiniCPM5 系列的第二代检查点。该模型为密集因果语言模型,参数量约 25.2 亿,采用标准 Llama 架构,上下文窗口为 131,072 个 token,并采用 Apache 2.0 开源许可。 在 34 项基准测试中,MiniCPM5-2B 平均得分 53.9,优于同规模基准模型 Qwen3.5-4B(51.1)。该模型在工具使用、代码推理和长上下文检索任务上表现突出,但在通用知识任务上稍弱于更大规模的模型。 OpenBMB 同时开源了训练数据集,包括 Ultra-FineWeb、UltraData-Code、UltraData-Math 等,以及多个中间检查点,以便社区验证其强化学习与策略蒸馏训练流程的效果。 (MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)


本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。