</> DevCN
菜单
推荐AI 与大模型后端与架构前端与跨端移动开发云原生与 DevOps数据库与数据工程网络与安全开源与开发工具产品与独立开发人工智能职场与成长自动化生产车间

Gemini Omni 1.1 Flash加入视频续写、插值与4K增强能力

Google发布Gemini Omni 1.1 Flash预览模型,支持视频续写、首尾帧插值、低分辨率草稿及1080p/4K增强,并提供短视频参考输入。


一套面向可控生成的更新

Google发布Gemini Omni 1.1 Flash预览版本,模型标识为gemini-omni-1.1-flash-preview。根据Google开发者博客,新版本支持每次续写约10秒、累计扩展至约40秒,还可以根据首帧和尾帧生成过渡片段。

从草稿到高分辨率输出

模型允许先生成360p草稿,再增强至1080p或4K,以便团队在较低成本下快速确认构图和运动方向。它也支持最长约3秒的视频参考,用于传递人物、动作或视觉风格。Google Cloud的模型文档将其列为预览能力,因此接口、配额和行为仍可能调整。

工作流比单次生成更重要

视频续写和首尾帧插值适合广告分镜、产品演示、转场和短片预演,但连续生成容易出现人物细节漂移、物体位置跳变或镜头逻辑断裂。更稳妥的流程是先锁定角色设定与关键帧,再分段生成,并在每段之间检查身份、光线、动作方向和音画关系。

4K增强也不等于凭空恢复真实细节。团队应把高分辨率输出视为后期环节,仍需人工检查文字、品牌元素、手部与快速运动区域。对于生产系统,还要记录模型版本和提示参数,避免预览模型更新后无法复现既有素材。

DISCUSSION

文章回复

0 条公开回复
未登录回复需要审核后公开
还没有回复,欢迎参与讨论。