【太平洋科技快讯】据 IT 之家报道,当地时间 8 月 27 日,谷歌正式发布 Gemini Omni 1.1 Flash 视频生成 AI 模型。

支持视频场景扩展功能,用户可以在现有视频末尾无缝接续生成新画面,每次可扩充 10 秒内容,单条视频累计最长能够达到 40 秒;
支持自定义首尾帧,用户输入起始与结束画面,模型便可生成过渡自然的转场以及镜头运镜效果;
为适配快速迭代需求,模型可以输出 360p 预览版本。对比 Gemini Omni 1.1 标准 720p 模式,预览模式生成速度最高提升 60%,使用成本仅为原先三分之一,适合原型快速验证、分镜脚本反复调试等工作场景;
最高支持 4K 画质,可输出细节完整的 1080p、4K 成品视频;
提供视频参考能力,允许导入最长 3 秒的参考片段,在生成过程中保持背景环境、角色形象前后统一。
在调用定价上,Gemini Omni 1.1 Flash 生成 360p 视频每秒 0.03 美元,720p 每秒 0.1 美元,1080p 每秒 0.15 美元,4K 每秒 0.3 美元。