扫码下载
搜索“Claude”共有10条相关结果
Techub News 消息,据 Similarweb 数据,ChatGPT 在 AI 聊天机器人网站流量中的份额已回升至 55.5%。不过,其同比领先优势已从 73.3% 大幅收窄,因 Gemini 份额翻倍,Claude 份额增长近五倍。此数据未包含移动应用和桌面客户端流量。 (The Decoder)
Techub News 消息,MBZUAI旗下基础模型研究所(IFM)发布了K2 Horizon系列开源模型,包含六款参数规模从0.9B到375B的模型,均采用Apache 2.0许可。该系列模型共享核心架构、训练方法和部署工具,预训练数据约20万亿token,其中包含大量合成任务与问题解决轨迹。IFM称这是AI史上最大规模的全开源模型发布。 该系列模型已在Hugging Face上提供,支持vLLM、SGLang和Ollama等推理框架,并可在NVIDIA、AMD和Cerebras硬件上运行。IFM还引入了MoVA注意力机制和名为Uno的LoRA适配器,后者据称可实现约3倍的无损解码加速。(MarkTechPost)
Techub News 消息,加州大学伯克利分校的研究团队发布了 CUA-Lite,这是一个用于计算机使用代理(CUA)的开源平台。该平台将代理、环境、轨迹以及评估和训练框架整合在一个统一的操作空间、数据模式和命令下,覆盖桌面、浏览器和移动端。其轻量级沙箱可在任何 Docker 主机上运行,无需 /dev/kvm 支持。 平台的核心组件 Lite.OSWorld 在普通 Docker 容器中复现了 OSWorld 的任务套件和评估器,内存占用从 4.1 GB 降至 0.9 GB,并行实例数量增加约 4.6 倍,且评估分数与原始虚拟机版本一致。平台还包含 LiteSample 统一数据模式,并已将十余个现有 CUA 数据集预处理后发布在 Hugging Face 上。 该框架集成了 10 多个基于 GPT、Claude、Gemini 等模型的代理,以及 15 多个涵盖桌面、浏览器和移动端的基准测试。通过单一命令支持监督微调和强化学习训练,例如在 Lite.ScaleCUA 上微调 Qwen3-VL-2B-Instruct 模型,在 332 项任务的评估集上平均回合回报从 0.138 提升至 0.237。 (MarkTechPost)
Techub News 消息,AI 基准测试平台 Artificial Analysis 发布了其 Intelligence Index 的 4.2 版本。此次更新很可能源于其基准测试未能准确反映 GPT-6 Astra 实际进展的批评。在新版指数中,GPT-6 Astra 的得分较其前代高出 4 分,但仍落后于 Anthropic 的 Claude Fable 5.1 模型。 (The Decoder)
Techub News 消息,Anthropic 宣布其 AI 模型 Claude 耗时 11 天,将有着 350 年历史的数学难题“费马大定理”转化为一份长达 1300 万行的代码证明。该证明可由计算机自行检查验证,无需依赖人类信任。 Anthropic 表示,这一成果展示了 AI 在形式验证和复杂逻辑推理方面的潜力,或将推动数学证明方式的变革。 (Decrypt)
Techub News 消息,@laurashin 发推称,DeepSeek V4 Pro 在智能合约安全竞赛中捕获 12 个漏洞标志中的 11 个,计算成本仅 1.45 美元,而 Claude Opus 4.8 捕获 10 个且花费 7.61 美元。 该对比显示 DeepSeek 在 AI 编码安全检测领域展现出显著的成本优势,反映出不同模型在区块链代码审计应用中的性能与价格差距正逐渐扩大。
Techub News 消息,OpenAI 的 GPT-6 Astra 模型在不同基准测试中表现不一。Epoch AI 给予其 169 分领先,而 Artificial Analysis 则认为其表现不优于前代且落后于 Claude Fable 5.1。最大亮点来自 ARC-AGI-3 测试,Astra 首次以高于人类平均水平的效率完成任务。ARC Prize 负责人 François Chollet 虽不认为这证明了通用人工智能(AGI)的实现,但他承认进展速度是预期的两倍,并因此提前了他的 AGI 预测时间表。 (The Decoder)
Techub News 消息,Anthropic 宣布 Claude Commerce Agents 正式开源,为 AI 购物与商家代理提供开发蓝图。 该开源项目覆盖零售、旅游、电信及娱乐等行业,提供构建智能商业代理的标准化框架,帮助开发者部署购物与商户服务代理。(Cointelegraph)
Techub News 消息,OpenAI 的 ChatGPT、xAI 的 Grok 与 Anthropic 的 Claude 三大主流 AI 聊天机器人于美东时间上午 11 点左右同时出现服务中断。ChatGPT 用户开始收到错误信息,其状态页面显示 ChatGPT 和 Codex 存在“普遍性错误升高”。 Anthropic 的状态页面显示,其多个模型版本最初受到影响,但目前问题主要集中在 Opus 4.8 和 Opus 5 版本。xAI 的 Grok 也在其应用程序和网页端遭遇了类似的服务中断。 三大 AI 服务在同一时段发生大规模故障,原因尚不清楚,相关公司正在调查中。(The Verge)
Techub News 消息,Anthropic 宣布其 AI 助手 Claude 现已能够以“后台模式”控制 Mac 电脑,以自动化任务。该功能旨在通过 AI 驱动的工作流提升生产力,标志着 AI 与计算环境更深入的集成。(Crypto Briefing)