扫码下载
搜索“Qwen”共有10条相关结果
Techub News 消息,AllSpark团队发布了Iris-mini和Iris-pro两款开源搜索智能体,其基于Qwen模型开发,在同等规模的开源权重模型中基准测试表现领先。论文显示,其训练数据与模型即使在未经专门训练的任务上,如通用工具使用和办公工作,性能也有所提升。(The Decoder)
Techub News 消息,阿里巴巴研究机构发布了 Qwen-Drive 1.0 AI 模型,该系统集成了环境感知、交通问答和路线规划功能。研究表明,文本-图像模型无法自动理解三维空间,空间感知能力需要专门训练。其目标是打造一个能同时运行座舱和驾驶系统的单一模型。(The Decoder)
Techub News 消息,阿里更新其旗舰模型 Qwen3.8-Max,据称其前端编程能力已跃居全球第一。该更新进一步提升了模型在代码生成与理解方面的性能。(量子位)
Techub News 消息,英伟达正在为 DeepSeek 和 Qwen 等中国开源 AI 模型优化硬件支持。该公司同时警告,美国可能出台针对源自中国的 AI 模型的限制措施,这或将损害其业务。(CNBC)
Techub News 消息,8月26日晚,阿里旗下千问办公首发上线刚刚发布的Qwen3.8-Flash模型,并同时推出标准模式。该模型生成速度提升100%,Token消耗减少75%。 (量子位)
Techub News 消息,阿里巴巴通义千问团队发布 Qwen3.8-Flash-Next 模型,该模型采用混合专家架构,每令牌仅激活 1250 亿参数中的 60 亿。其训练成本仅为竞争对手的九分之一,但在编码和办公基准测试中超越了 DeepSeek-V4-Flash 和 Claude Opus 4.6 等更大模型,为 OpenAI 和 Anthropic 带来更多定价压力。 该模型预览了 Qwen4 架构,旨在实现“终极成本效益”。(The Decoder)
Techub News 消息,阿里巴巴通义千问团队提前一天预告其下一代模型架构 Qwen 3.8-Flash-Next,并称其规格显示该模型能以极低功耗运行接近前沿规模。 Qwen 3.8-Flash-Next 将作为 Qwen 4 的预览版发布,展示了阿里在 AI 模型效率与性能方面的进展。(Decrypt)
Techub News 消息,Perplexity 发布便携式 AI 计算机,这是其智能体平台 Computer 的本地优先版本,可直接在 NVIDIA DGX Spark 上运行智能体工具链、编排器、规划器及后训练模型。该系统将本地模型、推理引擎、工具沙箱和应用连接器打包,任务始于设备,本地模型处理的工作不产生按 token 计费的成本。当步骤需要实时网络或前沿推理时,编排器会暂停并询问用户,再将单一步骤发送至 15 个以上的云端模型之一。 该软件需要 GB10 级设备或配备 24 GB VRAM 的 RTX GPU 才能部署,主要面向已拥有 NVIDIA 工作站的企业、中型团队及资金充足的 AI 原生初创公司。应用场景包括金融、法律、医疗、政府及国防等对数据驻留或合同保密性有严格要求的领域。 在包含 53 项任务的本地知识工作基准测试中,运行 Qwen 3.8 27B 模型的 Computer 在 DGX Spark 上得分为 82.6%,高于开源 Pi 工具链的 77.6% 和 Hermes 的 74.0%。使用 PPLX 27B 模型时,得分提升至 85.4%。在混合模式下,完全本地运行的成本边际为零,而通过顾问升级可将性能提升,成本约为每次 0.415 美元。(MarkTechPost)
Techub News 消息,汤森路透宣布推出自研语言模型“Thomson”,该模型基于阿里巴巴的通义千问(Qwen)构建,预计两年内投入约4000万美元。公司首席技术官Joel Hron表示,关键不在于智能本身,而在于明确哪些智能需要自主拥有。 据悉,该模型在接入公司自有内容(如Westlaw法律数据库)时表现最佳。此举旨在减少对OpenAI或Anthropic等外部AI服务的依赖,转而拥有并控制核心AI能力。(The Decoder)
Techub News 消息,AI 初创公司 Superwhisper 发布了 S1 系列模型,包括云端语音转文本模型 S1-Voice、云端指令遵循模型 S1-Language 以及开源权重的文本规范化模型 S1-mini。S1-mini 是一个 0.6B 参数的模型,并非转录或聊天模型,其作用是在自动语音识别之后,将原始转录文本转换为干净的书面文本,包括移除填充词、修正自我纠正、添加标点符号和大小写,并将口语化的数字、日期、货币和电子邮件地址转换为书面形式。该模型基于 Qwen/Qwen3-0.6B 微调,目前仅支持英语,其量化版本 GGUF 文件大小为 462 MB,可在笔记本电脑 CPU 上运行。 S1-mini 的接口是一个三轴控制线,用户可分别设置文本的「风格」(如随意、正式)、「结构」(如散文、列表)和「上下文」(如通用、电子邮件)。模型在 7,519 个测试案例上实现了 94.8% 的词元准确率。Superwhisper 表示,该模型适用于医疗临床记录、法律、金融服务、客户支持及实时字幕等多个行业。 S1-mini 已以 Apache 2.0 许可证(附加命名条款)在 Hugging Face 上开源,供开发者或企业集成使用。而 S1-Voice 和 S1-Language 则为 Superwhisper 托管的云服务,不可自托管。(MarkTechPost)