8月28日消息,据startuphub报道,谷歌正式推出gemini omni 1.1 flash版本,对其生成式视频模型进行了全面增强,显著提升了开发者在视频生成与精细化编辑方面的掌控力。该更新现已通过gemini api向开发者开放,支持在google ai studio及gemini enterprise agent platform中直接调用。
此次升级新增“场景扩展”能力,系统可自动解析输入视频前10秒的内容逻辑,并以此为基础延续生成新片段,单次扩展时长为10秒,最多可连续扩展至40秒。此外,开发者还可通过设定起始帧与结束帧来生成连贯视频,并精准控制专业级镜头运动轨迹。谷歌还引入了360p轻量级预览模式,使生成速度提升60%,同时推理成本仅为720p版本的三分之一。最终输出支持4K超高清分辨率,并允许在提示词中嵌入最长3秒的参考视频片段,以确保画面风格与视觉元素的高度一致性。目前,Adobe已将该模型集成进Firefly创意平台;Figma Weave、GMI Cloud、Runway等主流AI工具也已启动兼容性整合工作。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜












