Techub News 消息,谷歌发布原生多模态视频生成与编辑模型 Gemini Omni 1.1 Flash。该版本支持基于最长10秒上下文进行场景扩展,总扩展时长可达40秒,并能通过固定首尾帧控制摄像机运动。用户可提供视频片段作为参考以保持角色一致性,并支持以360p分辨率快速生成草稿,再升级至4K输出。 模型通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 提供,Adobe、Figma Weave、GMI Cloud 和 Runway 已作为生产用户接入。输入视频代币成本为每百万1.5美元,视频输出代币成本为每百万17.5美元,720p视频生成成本约为每秒0.1美元。所有生成视频均带有 SynthID 水印。(MarkTechPost)