GLM-5.3-FlashX 上线:200 tokens/s智谱今天上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型 提速 5 倍、提价 2.5 倍,API 同步开放,模型名称:GLM-5.3-FlashX
在这背后,是在 10万 张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化
GLM 的 Infra,由 GLM 构建
跑…
从 Token-Maxxing,到 Token-Minimizing最近,各家都掏出了 flash 版的口粮模型:又快又好又便宜,干啥都不心疼无论国内的 DeepSeek V4.1-Flash、GLM-5.3-Flash,抑或是海外的 Gemini 3.8 Flash,都被各家作为便宜大碗的主力模型进行推广,让那些需要做,但投入产出评估上不值得 Fable 一类模型出马的事情,变得值得落地了
这个的背后,其实有个小小的时代…
从 Token-Maxxing,到 Token-Minimizing最近,各家都掏出了 flash 版的口粮模型:又快又好又便宜,干啥都不心疼无论国内的 DeepSeek V4.1-Flash、GLM-5.3-Flash,抑或是海外的 Gemini 3.8 Flash,都被各家作为便宜大碗的主力模型进行推广,让那些需要做,但投入产出评估上不值得 Fable 一类模型出马的事情,变得值得落地了
这个的背后,其实有个小小的时代…AI 平台 B.AI 免费开放顶级模型,日处理量突破 1.33 万亿 tokenTechub News 消息,下一代 AI 基础设施平台 B.AI 近期通过免费开放顶级模型引发开发者热潮,平台日 token 处理量在数日内突破 1.33 万亿,创下历史里程碑。在 15 天窗口期内,累计处理量达 8.19 万亿 token,吸引了超过 22 万新 API 用户。截至 9 月 3 日,B.AI 总用户数已正式超过 230 万。
该平台免费提供了包括 DeepSeek-V4-Flash、腾讯 Hy3、小米 MiMo-V2.5、GLM-5.3-Flash (Ox Alpha) 及 Qwen3.8-Flash 在内的六款前沿模型。9 月 3 日,B.AI 对 DeepSeek-V4-Flash 及其视觉扩展版推出了新的分层定价结构,高峰时段提供 50% 折扣,非高峰时段价格降至标准峰值的 25%,同时保持其他几款模型的零成本访问。
B.AI 旨在超越传统的计算分发管道,构建智能的全球结算层,成为一个核心基础设施枢纽,为复杂业务流程中的 AI 代理提供跨节点协作、编排和价值分配支持。(NewsBTC)币安合约将下架 IDEXUSDT、SLPUSDT、GLMRUSDT、MDTUSDT 和 AUDIOUSDT U 本位永续合约Techub News 消息,币安合约将分别于香港时间 5 月 15 日 17:00 和 5 月 16 日 17:00 对 IDEXUSDT、SLPUSDT、GLMRUSDT U 本位永续合约及 MDTUSDT、AUDIOUSDT U 本位永续合约进行自动清算,并将在清算结束后下架上述 U 本位永续合约交易对。此外,币安合约将于香港时间 5 月 8 日 18:30 更新 IDEXUSDT、SLPUSDT、MDTUSDT 和 AUDIOUSDT U 本位永续合约杠杆和保证金阶梯。本周包括 IMX、HFT 在内的 7 个代币将迎来大额解锁Techub News 消息,Token Unlocks 数据显示,7 个项目的代币将于本周一次性解锁,其中仅 IMX 和 HFT 解锁金额超百万美元。其中: 9 月 4 日 11:06,Tornado Cash 将解锁 2.28 万枚 TORN(价值约合 6.1 万美元),约占流通量 1.51%; 9 月 5 日 8 时,Liquity 将解锁 65.7 万枚 LQTY(价值约合 54.1 万美元),约占流通量 0.7%; 9 月 5 日 20 时,Galxe 将解锁 41.6 万枚 GAL(价值约合 46.6 万美元),约占流通量 0.9%; 9 月 6 日 3:54,LooksRare 将解锁 1250 万枚 LOOKS(价值约合 67.4 万美元),约占流通量 2.29%; 9 月 7 日 8 时,Hashflow 将解锁 323 万枚 HFT(价值约合 107 万美元),约占流通量 1.84%; 9 月 8 日 8 时,Moonbeam 将解锁 304 万枚 GLMR(价值约合 56.3 万美元),约占流通量 0.42%; 9 月 9 日 6 时,ImmutableX 将解锁 1808 万枚 IMX(价值约合 981 万美元),约占流通量 1.61%。智谱今天上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型 提速 5 倍、提价 2.5 倍,API 同步开放,模型名称:GLM-5.3-FlashX 在这背后,是在 10万 张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化 GLM 的 Infra,由 GLM 构建 跑…
