Gemini Omni 1.1 Flash加入视频续写、插值与4K增强能力
Google发布Gemini Omni 1.1 Flash预览模型,支持视频续写、首尾帧插值、低分辨率草稿及1080p/4K增强,并提供短视频参考输入。
一套面向可控生成的更新
Google发布Gemini Omni 1.1 Flash预览版本,模型标识为gemini-omni-1.1-flash-preview。根据Google开发者博客,新版本支持每次续写约10秒、累计扩展至约40秒,还可以根据首帧和尾帧生成过渡片段。
从草稿到高分辨率输出
模型允许先生成360p草稿,再增强至1080p或4K,以便团队在较低成本下快速确认构图和运动方向。它也支持最长约3秒的视频参考,用于传递人物、动作或视觉风格。Google Cloud的模型文档将其列为预览能力,因此接口、配额和行为仍可能调整。
工作流比单次生成更重要
视频续写和首尾帧插值适合广告分镜、产品演示、转场和短片预演,但连续生成容易出现人物细节漂移、物体位置跳变或镜头逻辑断裂。更稳妥的流程是先锁定角色设定与关键帧,再分段生成,并在每段之间检查身份、光线、动作方向和音画关系。
4K增强也不等于凭空恢复真实细节。团队应把高分辨率输出视为后期环节,仍需人工检查文字、品牌元素、手部与快速运动区域。对于生产系统,还要记录模型版本和提示参数,避免预览模型更新后无法复现既有素材。
文章回复
0 条公开回复