Loading...
GLM-5.3-FlashX 上线:200 tokens/s智谱今天上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型 提速 5 倍、提价 2.5 倍,API 同步开放,模型名称:GLM-5.3-FlashX
在这背后,是在 10万 张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化
GLM 的 Infra,由 GLM 构建
跑…AI优化创新,Zymtrace获1,220万美元投资开发人工智能(AI)基础设施优化平台的'Zymtrace'宣布已筹集1,220万美元(约合1,756.8亿韩元)规模的投资。本轮投资包括近期完成的850万美元(约合122.4亿韩元)种子轮融资,其主要目的是拓展美国市场及扩大企业部署。
Zymtrace提供一个能够分析和优化在GPU基础设施上运行的AI工作负载性能的平台。该平台侧重于持续运行时性能分析,旨在…dynatrace将追踪AI行为……宣布开启“可观测性2.0”时代在AI重构企业内部系统的浪潮中,戴纳追踪(Dynatrace)正大幅强化其可观测性战略。在接受流媒体频道theCUBE专访时,戴纳追踪首席技术策略官阿洛伊斯·莱特鲍尔(Alois Reitbauer)阐释了代理型AI(agentic AI)的崛起与AI模型实验规模的扩大,正如何推动传统观测方式发生变革。
他指出当前应用开发模式已不同往昔:早期仅是直接调用O…智谱今天上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型 提速 5 倍、提价 2.5 倍,API 同步开放,模型名称:GLM-5.3-FlashX 在这背后,是在 10万 张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化 GLM 的 Infra,由 GLM 构建 跑…
