扫码下载
搜索“Claude Sonnet”共有8条相关结果
Techub News 消息,Anthropic 发布了 Claude Sonnet 5.5,这是其 Claude 5.5 系列中的第二个模型。该模型输出速度快 30% 以上,每项任务成本降低高达 30%,在知识工作基准测试中性能接近 Opus 5.5。在编码基准测试 Terminal-Bench 上,其得分从 10.3% 跃升至 70.6%。随着 Haiku 5.5 将于未来几周内发布,Anthropic 将很快拥有与 OpenAI 三款 GPT-6 模型一一对应的产品。(The Decoder)
Techub News 消息,模型聚合平台 OpenRouter 已上架 Anthropic 最新模型 Claude Sonnet 5.5。该模型定位为 Sonnet 级,适用于日常工作任务,作为 Claude Sonnet 5 的直接升级版本,据称在构建功能、修复错误等方面表现突出。 虽然 Anthropic 尚未正式官宣,但 OpenRouter 平台上架模型常早于官方发布。(OpenRouter 新模型)
Techub News 消息,Anthropic 发布 Claude Sonnet 5 模型,主打低成本 Agent 能力。该模型支持自主规划、调用浏览器和终端工具运行,即日起成为 Claude 免费版和 Pro 版的默认模型。 该模型输入定价为每百万 tokens 2 美元(8 月 31 日前),性能接近旗舰模型 Opus 4.8,在知识工作基准测试中甚至实现超越。Anthropic 表示,开发者可根据任务复杂度在 Sonnet 5 和 Opus 4.8 之间选择,以平衡成本与准确性。(TechCrunch)
Techub News 消息,Sakana AI 发布研究论文《Beyond Imitation》,介绍其围绕错误检测构建的大模型辅助同行评审系统。该系统采用多层评审(MLR)架构,使用 Claude Sonnet 4 与 Claude Haiku 3.5 等现成 API 模型,无需 GPU 或微调,每次评审成本约 0.47 美元。 在一个包含 1,164 个植入矛盾的基准测试中,MLR 系统在 4 次评审下捕获了 73.43% 的核心主张错误,而最佳基线模型仅捕获 14.81%。但在真实撤稿论文测试中,其精确匹配率仅为 16.11%。 该系统包含三个智能体:附录智能体总结实验细节、文献综述智能体进行网络搜索定位研究背景、评审智能体执行三阶段提示链进行评审。论文还指出,MLR 的评审重点与人类存在差异,更强调有效性和实验,而人类更看重清晰度和新颖性。(MarkTechPost)
Techub News 消息,MBZUAI旗下基础模型研究所(IFM)发布了K2 Horizon系列开源模型,包含六款参数规模从0.9B到375B的模型,均采用Apache 2.0许可。该系列模型共享核心架构、训练方法和部署工具,预训练数据约20万亿token,其中包含大量合成任务与问题解决轨迹。IFM称这是AI史上最大规模的全开源模型发布。 该系列模型已在Hugging Face上提供,支持vLLM、SGLang和Ollama等推理框架,并可在NVIDIA、AMD和Cerebras硬件上运行。IFM还引入了MoVA注意力机制和名为Uno的LoRA适配器,后者据称可实现约3倍的无损解码加速。(MarkTechPost)
Techub News 消息,Anthropic 近期密集调整 Claude 模型产品线,推出三档差异化定价策略。Claude Sonnet 5 于 6 月 30 日发布,输入 token 价格降至 2 美元/百万,成为免费及 Pro 版默认模型;Claude Fable 5 于 6 月 9 日上线,定位超高端「神话级」,定价 10 美元/百万输入 token;Claude Opus 4.8 则维持 5 美元/百万输入 token 的中端价位。 此次调整形成从 2 美元到 10 美元的五倍价差体系,显示出 Anthropic 针对企业市场的激进成本竞争策略。值得注意的是,Fable 5 曾因美国出口管制短暂全球下架,于 7 月初恢复服务。该定价重构可能对企业 AI 支出产生深远影响,并波及 AI 概念加密代币市场。(cryptobriefing.com)
Techub News 消息,美团于 6 月 30 日正式发布开源 AI 模型 LongCat-2.0,确认该模型此前以「Owl Alpha」为代号在 OpenRouter 平台匿名运行两个月。该模型采用 1.6 万亿参数混合专家架构,单次推理激活约 480 亿参数,标准 API 定价为每百万输入 token 0.75 美元、输出 token 2.95 美元,低于 GPT-5.5 和 Claude Sonnet 5 的定价水平。 这是首个完全基于国产 ASIC 芯片完成端到端训练部署的万亿参数模型,预训练过程使用超过 5 万块国产加速器,处理超 35 万亿 token 且未出现回滚或不可恢复的损失峰值。该模型在 Hermes Agent 工作区调用量排名第一,目前推出促销价降至每百万输入 token 0.30 美元、输出 token 1.20 美元。(Decrypt)
Techub News 消息,Anthropic 正式发布 Claude Opus 4 与 Claude Sonnet 4 两款新模型。Claude Opus 4 是领先的编码模型,在复杂、长时间运行的任务和代理工作流中拥有持续的性能,Claude Sonnet 4 是 Claude Sonnet 3.7 的重大升级,提供优秀的编码和推理能力,同时可以更精确地响应指令。
当前搜索结果已加载完毕