GLM-5.3-FlashX 上线:200 tokens/s智谱今天上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型 提速 5 倍、提价 2.5 倍,API 同步开放,模型名称:GLM-5.3-FlashX
在这背后,是在 10万 张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化
GLM 的 Infra,由 GLM 构建
跑…Lambda, 通过Python代码帮助部署AI推理的‘Flash’公开AI云企业Runpod推出了软件开发工具包(SDK)兼平台“Flash”,让开发者无需复杂的 infrastructure 设置即可直接部署 AI 推理服务。其核心特点是从本地 Python 代码直接连接到云端 AI 推理,大幅减轻了容器设置、镜像管理和基础设施配置的负担。
Runpod 在此次发布中表示,其重点在于解决开发者对“无服务器虽强大,但初始设置…OpenAI,收购Python工具企业Astral...加速整合CodexOpenAI集团今日宣布已决定收购Astral Software Inc.。Astral是一家拥有广受欢迎的Python开发工具的初创公司,此次收购的具体条款未予披露。
Astral的开发工具采用Rust语言编写,该语言比Python更复杂,同时也以速度更快著称。凭借这一性能优势,Astral赢得了数百万开发者客户。该公司的主要工具"uv"充当Python…AI 编程工具推动 JavaScript 语言家族在 GitHub 使用率快速增长Techub News 消息,GitHub 2025 年 10 月 Octoverse 报告显示,TypeScript 月度贡献者达 264 万,同比增长 66%。2025 年有超百万开发者在 GitHub 上首次编写 TypeScript 代码。报告指出,JavaScript 语言家族(含 TypeScript)已成为 GitHub 上使用最广泛且增长最快的语言。
分析认为,AI 编程工具的广泛采用(约两年时间)正改变技术栈选择逻辑。由于模型主要从已公开的大量 JavaScript/TypeScript(尤其是 React)代码中学习,其为这些语言生成的代码质量更高、更易用,导致团队更倾向于选择与 AI 工具兼容的框架,进而形成数据反馈循环,加剧了语言集中趋势。
尽管 AI 模型开发本身仍主要使用 Python,但最终面向用户的产品前端多采用 JavaScript 实现。市场奖励了模型已熟悉的语言选择,而非纯粹的技术性能优劣。(AI News)Prime Intellect 推出自进化编程框架 Prime AgentTechub News 消息,分布式 AI 基础设施公司 Prime Intellect 发布开源编程框架 Prime Agent,该工具基于递归语言模型(RLM)架构,可在持续运行的 Python 环境中自主编写、测试并优化代码,在 ARC-AGI-3 基准测试中获得 95.5% 的分数,超过人类专家水平。
该公司上月估值达 10 亿美元,此前已完成 1.3 亿美元 A 轮融资,投资方包括 Radical Ventures、NVIDIA Ventures 和 Intel Capital。该框架允许开发者免费使用,无需授权费用或供应商锁定。(CryptoBriefing)Starlette 曝严重漏洞,数百万 AI 代理面临风险Techub News 消息,据 CryptoBriefing 报道,Python 框架 Starlette 被发现存在严重漏洞 CVE-2026-48710(代号 BadHost)。攻击者可通过操纵 HTTP Host 头绕过身份验证,无需凭证即可访问受保护端点。该框架每周下载量达 3.25 亿次,为 FastAPI、vLLM 和 LiteLLM 等 AI 基础设施的基础依赖。
漏洞影响 Starlette 1.0.1 之前所有版本,项目方已发布补丁修复。攻击者利用 Host 头注入特殊字符篡改 URL 路径边界,导致认证中间件失效。开发者可通过 badhost.org 提供的免费扫描器检测受影响应用,建议立即升级至 1.0.1 或更高版本以修复此漏洞。Anthropic 收购 Stainless 扩展 AI 代理能力Techub News 消息,据 Anthropic 官方报道,Anthropic 宣布收购 Stainless,一家专注于 SDK 和 MCP 服务器工具的开发基础设施公司。
Stainless 成立于 2022 年,支持将 API 规范转换为 TypeScript、Python、Go 等多种语言的 SDK。此次收购将增强 Claude 平台的开发者体验,提升 AI 代理与外部系统连接的能力。智谱今天上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s,较 GLM-5.3-Flash 模型 提速 5 倍、提价 2.5 倍,API 同步开放,模型名称:GLM-5.3-FlashX 在这背后,是在 10万 张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化 GLM 的 Infra,由 GLM 构建 跑…
