谷歌宣布推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高可输出 4K 分辨率视频。相较 Omni 1.1 的标准 720p,新模型在速度与成本上做了明显取舍,并向专业成片场景延伸。
从分镜预览到 4K 成片的全流程
亮点之一是场景扩展:用户可基于已有视频从结尾无缝续生成后续画面,按每次 10 秒步长逐步扩展,单条累计最长 40 秒。指定首尾帧功能则只需给定起止画面,即可实现平滑转场与运镜;视频参考支持引入最长 3 秒片段,精准维持上下文与角色一致性。
成本结构分层清晰:360p 预览每秒 0.03 美元、速度较标准提升最高 60% 且成本仅三分之一,适合分镜迭代;720p、1080p、4K 分别为每秒 0.1、0.15、0.3 美元。谷歌正把视频生成从"能跑预览"推向"可交付成片",让 AI 视频在原型与终稿之间有了连续的生产链路。
via AI新闻资讯 (author: AI Base)