Techub News 消息,Z.ai 发布了 GLM-5.3-Flash,这是 GLM-5 系列中首个原生多模态模型,也是该实验室推出的最具性价比的编程模型。它是一个混合专家模型,总参数量为 3200 亿,每个令牌激活 180 亿参数,上下文窗口达 1,048,576 个令牌,并支持图像和视频输入。该模型以 MIT 许可证发布,权重已上传至 Hugging Face。 Z.ai 报告称,该模型在基准测试和实际工作负载中均优于 GLM-5.2,价格约为其十分之一,并在其内部编程基准测试中与 Claude Opus 4.8 的差距在半个百分点以内。模型的首周预览以“Ox Alpha”匿名身份在 OpenCode 和 OpenRouter 上运行,完全基于国产中国 AI 芯片提供服务。 该模型可在 Hugging Face 上获取权重,并已提供托管 API 服务。默认 FP8 检查点权重约为 306 GiB,当前 vLLM 路径仅支持 NVIDIA Hopper 及更新架构,这意味着中型和大型组织或租用 GPU 容量的 AI 原生初创公司可自行托管。 (MarkTechPost)