Gemini Omni 1.1 Flash 上线:新增首尾帧控制与4K放大
2026年8月28日,Google正式宣布Gemini Omni 1.1 Flash进入通用可用(GA)阶段,这是其生成式视频模型的一次重大版本更新。新模型在原有能力基础上,新增了场景延展、首尾帧控制、360p草稿模式生成、1080p及4K视频输出,以及视频参考等多项核心功能。这一发布标志着Google在AI视频生成领域正在从“能生成”向“可控生成”和“专业可用”迈进,对影视制作、广告创意、游戏开发等行业的创作者而言具有里程碑式的意义。
首尾帧控制:从“抽卡”到“可控”的革命性突破
此次升级最受关注的亮点是首尾帧控制(first-and-last-frame control)功能。用户可以通过指定镜头的起始帧和结束帧两张关键图像,配合描述中间运动过程的文本提示,让模型自动生成两帧之间的连续运动画面。Google官方指出,这一功能支持的摄像运动效果包括镜头环绕(camera orbits)、缩放过渡(zoom transitions)、循环剪辑(looping clips),以及两帧之间的其他摄像运动方式。
对于专业视频创作者而言,首尾帧控制的意义远不止于功能列表上的一条更新。此前,纯文本到视频的生成被广泛比喻为“老虎机”——用户输入提示词,模型输出一个随机结果,创作者无法精确控制视频的起止状态和运动轨迹。而首尾帧控制相当于给创作者提供了“两个固定锚点”,模型只需要求解两点之间的中间过程,这是一个“小得多的出错空间”。这一特性尤其适用于产品展示的镜头设计、动态故事板的精确分镜、广告创意的预可视化,以及需要精确控制镜头语言的影视前期制作等场景,大幅降低了高质量视频内容的制作门槛和试错成本。
360p草稿模式:低成本创意迭代的利器
为提升创作效率,Gemini Omni 1.1 Flash新增了360p草稿模式(draft mode)。Google表示,该模式的渲染速度最高可提升60%,成本仅为标准720p输出的三分之一。这一功能的推出精准地回应了AI视频创作中的一个核心痛点:创意思路需要反复尝试和验证,但高分辨率渲染成本高昂、耗时长。
工作流程被设计为“低分辨率草稿先行、高分辨率最终输出”——用户先以360p快速生成大量草稿,确认创意方向后,再将选中的片段放大至720p、1080p或4K。这种“先验证创意,再投资画质”的模式,有效平衡了创意迭代效率与最终成品质量之间的关系,对于预算有限的内容团队和个人创作者尤为友好。
4K放大与1080p输出:画质跃升,专业可用
在输出分辨率方面,Gemini Omni 1.1 Flash通过放大技术(upscaling)支持将生成的视频提升至1080p乃至4K分辨率。需要注意的是,这些高分辨率输出并非原生渲染,而是对生成帧的智能放大处理。尽管如此,4K输出能力使得AI生成的视频素材可以直接用于专业影视制作、大屏商业展示和品牌广告领域,解决了此前AI视频普遍存在的细节模糊、画质不足的问题,大大拓展了AI视频素材的商业应用空间。
场景延展与视频参考
除上述核心功能外,Gemini Omni 1.1 Flash还支持场景延展(scene extension)功能,开发者可以每次10秒的增量对视频片段进行延长,最多可累积延展至40秒。视频参考功能则允许模型根据已有视频素材进行风格或内容的参考生成,进一步提升了创作的一致性与可控性。
可用性与发布范围
Gemini Omni 1.1 Flash已通过Gemini API在Google AI Studio中正式开放。同时,该模型已面向全球Google AI Plus、Pro和Ultra订阅用户开放使用。

平顶山市哈基米与他的朋友们科技有限公司——让顶级AI视频创作触手可及
面对Gemini Omni 1.1 Flash所代表的前沿AI视频生成技术,高昂的算力成本和复杂的模型调用门槛仍是大多数创作者与企业面临的现实难题。平顶山市哈基米与他的朋友们科技有限公司 现已全面掌握并深度优化了基于主流AI视频大模型(包括Gemini系列、MiniMax H3等)的视频生成、首尾帧控制与4K高清放大技术。我们通过自研算力调度系统与工程化部署方案,能够为客户提供与一线大厂技术水准相当的AI视频生成与超分服务,同时将运营成本压缩至行业平均水平的60%以下,价格远低于市场主流报价。无论是需要精确到帧的镜头生成、4K画质输出,还是批量化的视频内容生产,我们都能为您提供稳定、高效、低成本的一站式解决方案。欢迎广大内容创作者、影视制作团队、广告公司及企业客户与平顶山市哈基米与他的朋友们科技有限公司洽谈合作,本公司热烈期待与各界伙伴携手共赢!