Techub News 消息,Nunchux AI 发布 VC-Attention,一种无需训练的低比特注意力内核,专为视频扩散 Transformer 设计。它同时解决值量化误差和 softmax 阶段缓慢两个问题,通过 V-Smooth 处理值异常值和 ExpCast-FP8 优化 softmax 瓶颈。 在 B200、H200、RTX 5090 等 GPU 上的测试显示,该内核能实现 1.13 倍至 1.70 倍的端到端加速,注意力计算速度提升最高达 3.58 倍。在 Wan2.2 等开源视频生成模型上,其保真度优于 SageAttention2 等先前方法。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,Nunchux AI 发布 VC-Attention,一种无需训练的低比特注意力内核,专为视频扩散 Transformer 设计。它同时解决值量化误差和 softmax 阶段缓慢两个问题,通过 V-Smooth 处理值异常值和 ExpCast-FP8 优化 softmax 瓶颈。 在 B200、H200、RTX 5090 等 GPU 上的测试显示,该内核能实现 1.13 倍至 1.70 倍的端到端加速,注意力计算速度提升最高达 3.58 倍。在 Wan2.2 等开源视频生成模型上,其保真度优于 SageAttention2 等先前方法。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。