Techub News 消息,Google Research 推出了一套名为 AI 视频联合导演的智能体框架,旨在解决长视频生成中的身份漂移和级联错误问题。该套件包含 Co-Director、CANVAS、A²RD 和 VQQA 四个框架,可将短片段拼接成数分钟长的连贯故事视频,并支持语音和配乐。 其中,Co-Director 框架在 GenAD-Bench 基准测试中获得平均 81.4 分,人类评分为 3.96(满分 5)。CANVAS 在背景连续性、角色一致性和道具一致性上分别提升 21.6%、9.6% 和 7.6%。A²RD 框架在 1 到 10 分钟视频上的一致性提升高达 30%,叙事连贯性提升 20%。 该系统构建于 Gemini 和 Veo 模型之上,但设计为模型无关,可驱动其他生成器。输出继承了基础模型的 SynthID 水印技术。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,Google Research 推出了一套名为 AI 视频联合导演的智能体框架,旨在解决长视频生成中的身份漂移和级联错误问题。该套件包含 Co-Director、CANVAS、A²RD 和 VQQA 四个框架,可将短片段拼接成数分钟长的连贯故事视频,并支持语音和配乐。 其中,Co-Director 框架在 GenAD-Bench 基准测试中获得平均 81.4 分,人类评分为 3.96(满分 5)。CANVAS 在背景连续性、角色一致性和道具一致性上分别提升 21.6%、9.6% 和 7.6%。A²RD 框架在 1 到 10 分钟视频上的一致性提升高达 30%,叙事连贯性提升 20%。 该系统构建于 Gemini 和 Veo 模型之上,但设计为模型无关,可驱动其他生成器。输出继承了基础模型的 SynthID 水印技术。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。