Aioga
AI资讯 / 行业动态
返回 AI资讯

Gemini Omni 1.1 Flash 发布,为开发者提供更强生成式视频控制

Google DeepMind:Blog(RSS)Aioga 编辑团队2026-08-27T16:11:32.000Z热度 70

Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。新模型支持场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量累计...

模型更新Google DeepMind:Blog(RSS)

今日 AI 情报摘要

Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。

新模型支持场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量累计延长至 40 秒)、指定首尾帧生成平滑过渡,以及 4K 高清输出。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtbq1hfq156croamzzo9gno2

中文正文 · AI 翻译

今天,我们推出了 Gemini Omni 1.1 Flash,这是一个新的创意控制和生成性视频功能套件,旨在支持开发者。Gemini Omni:https://deepmind.google/models/gemini-omni/ 为生成创作引入了现实世界的推理,今天的更新让 Omni 1.1 通过 Google AI Studio 的 Gemini API 准备好用于专业生产。无论您是在构建生成性视频工作流、创意工具,还是媒体编辑软件,这些更新都使生成性视频更易控制、迭代更快,并为现实世界的部署提供了更完善的支持。以下是新增功能的介绍:

场景扩展允许您对现有视频进行续拍,从中断处无缝生成后续画面。

使用 Omni 1.1,模型现在可以分析最多 10 秒的前置上下文——相比之前模型仅参考最后一秒,这是一个飞跃。结果是视觉一致性和叙事连贯性得到改善,让您能够构建更长的故事或探索新的创意方向。视频可以以 10 秒为增量延长,总累计长度可达 40 秒。

提示 1:摄像机微微平移,我们现在看到她正在与一位卷发男子交谈,我们看到男子的背影,他说“我也看到了”,配有戏剧音乐。

提示 2:摄像机缓慢拉远,遗忘的尘封地下墓穴,配有戏剧音乐。提示 3:摄像机缓慢拉远,一个宽广的图书馆,书架和书籍在尘封的虚空中悬浮,配有戏剧音乐。

提示 1:继续视频。执行电影级光学推镜缩放镜头。摄像机前移的同时同时拉远镜头,使角色惊讶凝固的表情保持在完全相同的大小。背景中长长的石柱走廊在强烈的光学透视扭曲下戏剧性延伸和加深。整洁的建筑,连续不断的镜头。

提示 2:继续视频。摄像机快速机械式猛拉镜头,直接对准角色的圆睁双眼。风格化电影摄像机控制。

提示 3:继续视频。时间完全静止在一个静态瞬间:角色,随风摆动的外套。摄像机在静止的角色周围进行平滑的高速 360 度环绕旋转,展示柱廊上戏剧性的 3D 深度和视差。完美的连贯性。

提示 1:穿蓝色毛衣的男人回答:“你父亲也去船上了吗?”

提示 2:当他继续讲述时,摄像机连续拉开:“他常说这个港口有灵魂,船是我们的一部分。”音乐渐起。

提示 1:他直接看向摄像机,讲述最终一章将如何结束!

提示 2:然后他站起来绕到桌子旁走向摄像机说:“你会选择什么?”

以下是如何使用 Gemini API 扩展你的场景:

通过指定镜头的起始帧和结束帧,实现平滑的过渡和摄像机运动。Omni 1.1 在两个关键帧之间生成连续视频,非常适合复杂的摄像机环绕、缩放过渡或无缝循环片段。

提示 1:在宏伟大厅中,一名穿米色西装的时尚鼓手低角度特写演奏红色鼓组,摄像机快速横扫到一旁,展示一位较年长的萨克斯演奏家与穿白色服装旋转的芭蕾舞者在柔和的紫色舞台灯光下共演。一镜到底,无切换。

提示 2:摄像机拉近电视屏幕,我们看到相同的女人和起始场景。无缝视频。一镜到底,无切换。

生成 360p 分辨率的轻量预览,比 Omni 1.1 的标准 720p 分辨率快最多 60%*,成本仅为三分之一。这对于快速原型制作、分镜迭代和开发者平台上的快速渲染非常有用。

*根据 360p 与 720p 分辨率的系统吞吐量,生成速度最多可提高 60%

提示:显微镜下观赏彩虹色的海洋硅藻,展示精致如玻璃的硅壳,具有令人叹为观止的自然对称性。颜色从深火山琥珀和温暖的铜色到鲜艳的绿松石和紫罗兰色,模仿地球和海洋的丰富调色板。微小的精细结构在干净的深色背景下柔和发光。高保真科学成像,细节清晰,有机纹理,微距摄影。整个视频保持显微镜镜头效果。

生成经过精修的高分辨率 1080p 或 4K 输出,以便使用 Omni 1.1 进行专业制作。

提示 1:鱼在游动,跟拍镜头

提示 2:一只小花栗鼠从屏幕左侧的树林中快速蹿出,好奇地嗅闻空气,然后从右侧蹿出画面。

提示 3:电影感微距特写,展示生动的金橙色日本枫叶挂在纤细的树枝上,在柔和有节奏的秋风中轻轻摇曳。阳光透过半透明的叶片,营造温暖发光的效果。景深浅,背景呈梦幻散景,纹理超细致,真实感摄影,4K。

在构建场景时参考最多三秒的视频,这样可以基于视频参考保持视觉连续性和角色一致性。

提示:使用三段上传的舞蹈视频,将其替换为提供的角色。让他们在提供的图像所示的大开阔空间中,分别表演参考视频中的舞蹈动作。

狗角色 dog.png 应表演 dance3.mp4 中的古典舞。章鱼角色 octo.png 应表演 dance1.mp4 中的嘻哈舞,而熊角色 bear.png 应表演 dance2.mp4 中的街舞。最终效果应为一镜到底,无剪辑。

这里有一些想法,展示开发者如何在自定义工具和创意工作流程中应用这些新功能。

在此应用中,你可以放入第一帧和最后一帧,通过预设或提示框生成它们之间的过渡,因为 Omni 的全上下文推理功能可以让你获得真实感的镜头移动。

这个应用可以让相机在房间中移动。它可以弧形移动、推进,也可以后拉。它展示了家的理想状态,在完美的时间。它不会添加不存在的家具或细节。

创作者通常会生成多个视频,才能找到合适的那个。Draft Room 让这种探索变得廉价且有结构:生成 3-4 个 360p 草稿版本,每次只改变一个元素,然后并排比较它们。

我们的客户已经通过 Agent Platform API 使用 Gemini Omni Flash 推动现实世界的制作。探索他们创建的视频,并了解他们如何使用该模型。

Adobe 将 Gemini Omni Flash 集成到了 Adobe Firefly 中。观看此视频,了解其视频编辑功能。

“Gemini Omni Flash 是 Figma Weave 中最强大的视频模型之一,在这里,画布帮助创意团队在每一次生成基础上进行扩展——附加参考资料、分支不同版本、并塑造独特成果。通过扩展、更丰富的参考资料以及 4K 分辨率,Gemini Omni Flash 不仅是生成视频,更是让团队真正进行导演创作。” - Itay Schiff,Figma Weave 创意总监。

“在 GMI Cloud,我们为创作者提供对世界上最强大模型的集中访问权限。Gemini Omni Flash 的突出之处在于其准确性:细节经得起推敲。对于制作教育和说明内容的客户来说,准确性比任何单一功能都更重要。Omni 已使 AI 视频在此前无法依赖的领域成为可能。” - Louisa Guo,GMI Cloud 营销副总裁。

“Omni Flash 自然地融入了人们使用 Runway 的方式:从提示、图片或视频开始,然后生成或编辑。这是我们用户在创意想法之间快速切换的另一种方式。” – Jamie Umpherson,Runway 首席创意官。

Gemini Omni 1.1 闪光灯的定价表。

Omni 1.1 正在 Google 开发者生态系统中推广:

检查你的收件箱以确认订阅。

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。 Aioga 将其归入「模型更新」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: deepmind.google

来源: Google DeepMind:Blog(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-27T16:11:32.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Google 推出 Gemini Omni 1.1 Flash,为开发者提供更强的生成式视频控制能力。新模型支持场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量累计...

Google DeepMind:Blog(RSS)2026-08-27T16:11:32.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。