Techub News 消息,AI 模型公司 PrismML 发布 Ternary Bonsai 2 27B 模型。该模型是 Qwen3.8 27B 的三元权重版本,体积仅 5.93 GB(FP16 版本为 53.80 GB),在 20 项基准测试中平均性能保留率达 98.2%。模型支持文本与图像输入,上下文长度达 262K token,并可在 RTX 5090 等消费级硬件上运行。 模型采用 Apache 2.0 许可,权重已开源。其架构与 Qwen3.8 27B 保持一致,参数总量 27.36B,其中语言主干 24.35B,嵌入层与语言模型头 2.54B,视觉模块 0.47B。模型使用三元量化技术,绝大多数权重仅取 -1、0、+1 三个值,配合共享的 FP16 缩放因子,实现高压缩比。 性能评估显示,模型在数学与代码任务上保留率超 99%,但在长程智能体任务(如 Terminal-Bench 2.1)上性能下降较明显。实测中,RTX 5090 解码速度达每秒 142.5 token,RTX 4090 为 96.7 token/s,苹果 M5 Max 笔记本为 46.8 token/s。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Mọi thông tin trên trang web này chỉ mang tính tham khảo.
Trang web không bảo đảm tính chính xác, hiệu lực, kịp thời hay đầy đủ của thông tin.
Người dùng tự chịu rủi ro khi hành động dựa trên thông tin của trang web này.
Techub News 消息,AI 模型公司 PrismML 发布 Ternary Bonsai 2 27B 模型。该模型是 Qwen3.8 27B 的三元权重版本,体积仅 5.93 GB(FP16 版本为 53.80 GB),在 20 项基准测试中平均性能保留率达 98.2%。模型支持文本与图像输入,上下文长度达 262K token,并可在 RTX 5090 等消费级硬件上运行。 模型采用 Apache 2.0 许可,权重已开源。其架构与 Qwen3.8 27B 保持一致,参数总量 27.36B,其中语言主干 24.35B,嵌入层与语言模型头 2.54B,视觉模块 0.47B。模型使用三元量化技术,绝大多数权重仅取 -1、0、+1 三个值,配合共享的 FP16 缩放因子,实现高压缩比。 性能评估显示,模型在数学与代码任务上保留率超 99%,但在长程智能体任务(如 Terminal-Bench 2.1)上性能下降较明显。实测中,RTX 5090 解码速度达每秒 142.5 token,RTX 4090 为 96.7 token/s,苹果 M5 Max 笔记本为 46.8 token/s。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Mọi thông tin trên trang web này chỉ mang tính tham khảo. Trang web không bảo đảm tính chính xác, hiệu lực, kịp thời hay đầy đủ của thông tin. Người dùng tự chịu rủi ro khi hành động dựa trên thông tin của trang web này.