Techub News 消息,阿里云旗下通义千问团队发布多模态模型 Qwen3.8-Omni-Flash。该模型是其首个围绕智能体能力构建的“全模态”模型,可同时理解文本、图像、音频和视频输入,并输出文本,集音视频理解、推理与工具调用于一体。模型现已通过 QwenCloud、阿里云 Model Studio 和 Qwen Studio 提供 API 服务,但未开源权重。 Qwen3.8-Omni-Flash 基于 Qwen3.8-Flash-Next 架构构建,上下文窗口为 100 万令牌。在处理长视频时,模型采用基于问题的代理感知方法,动态选择关键片段进行分析,据称在 OmniVideoBench 基准上准确率提升至 67.8,同时令牌使用量减少约 45.7%。 官方数据显示,在 29 项评测中,其平均得分较 Qwen3.5-Omni-Plus 提升超 25%。团队称其音视频性能接近 Gemini 3.8 Flash,整体音频性能优于后者。API 定价为每百万输入令牌 0.15 美元,每百万输出令牌 0.47 美元,音视频输入成本较前代降低超 90%。(@Alibaba_Qwen)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Semua maklumat di laman web ini adalah untuk rujukan sahaja.
Laman web ini tidak menjamin ketepatan, kesahan, ketepatan masa atau kelengkapan maklumat.
Pengguna menanggung sendiri risiko bagi tindakan berdasarkan maklumat di laman web ini.
Techub News 消息,阿里云旗下通义千问团队发布多模态模型 Qwen3.8-Omni-Flash。该模型是其首个围绕智能体能力构建的“全模态”模型,可同时理解文本、图像、音频和视频输入,并输出文本,集音视频理解、推理与工具调用于一体。模型现已通过 QwenCloud、阿里云 Model Studio 和 Qwen Studio 提供 API 服务,但未开源权重。 Qwen3.8-Omni-Flash 基于 Qwen3.8-Flash-Next 架构构建,上下文窗口为 100 万令牌。在处理长视频时,模型采用基于问题的代理感知方法,动态选择关键片段进行分析,据称在 OmniVideoBench 基准上准确率提升至 67.8,同时令牌使用量减少约 45.7%。 官方数据显示,在 29 项评测中,其平均得分较 Qwen3.5-Omni-Plus 提升超 25%。团队称其音视频性能接近 Gemini 3.8 Flash,整体音频性能优于后者。API 定价为每百万输入令牌 0.15 美元,每百万输出令牌 0.47 美元,音视频输入成本较前代降低超 90%。(@Alibaba_Qwen)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Semua maklumat di laman web ini adalah untuk rujukan sahaja. Laman web ini tidak menjamin ketepatan, kesahan, ketepatan masa atau kelengkapan maklumat. Pengguna menanggung sendiri risiko bagi sebarang tindakan berdasarkan maklumat ini.