中文翻译

摘要: ## 新闻摘要

谷歌在2026年I/O大会上发布全新AI视频编辑模型Gemini Omni,用户可通过自然对话直接编辑视频片段,无需传统时间线操作。该模型支持文本、图片、音频及现有视频等多模态输入,每条指令会在前一条基础上继续执行,保持角色、服装、光线等元素的一致性。

首个版本Omni Flash于5月19日上线,应用范围覆盖Gemini应用、谷歌Flow及YouTube Shorts,视频片

正文

首页

新闻

谷歌全新 Gemini Omni:只需对话即可编辑视频

采编记者

2026年5月24日

5分钟阅读

添加至谷歌


Gemini Omni 视频编辑是谷歌迄今为止最具创意的 AI 举措——它就在昨天(2026年I/O大会上)刚刚发布。首个模型 Omni Flash 让你只需描述想要的更改,就能重塑视频片段。以下是你现在就能用它做什么,以及谁将率先获得访问权限。

目录

最受欢迎

谷歌 AI 智能眼镜 2026:Gemini、iPhone 支持、Meta 竞品

中国 Claude API 灰市以五折出售 AI 访问权限——而你的数据买单

Apple Watch Ultra 4 将全面重新设计:新增血压监测和翻倍传感器

iPad Fold 泄露:苹果更大的折叠屏战略

索尼 Xperia 1 VIII:规格、价格、发布日期及其 AI 相机为何走红

赞助内容

LinkedIn

Facebook

复制链接## 概要

Gemini Omni 是谷歌推出的新 AI 模型,可通过任意组合的文本、图片、音频或现有素材生成和编辑视频——全部通过自然对话完成。

首个版本 Gemini Flash 于 2026 年 5 月 19 日在 Gemini 应用、谷歌 Flow 和 YouTube Shorts 上线——视频片段限制在 10 秒是设计如此,而非技术限制。

每个 Omni 生成的视频都带有不可见的 SynthID 水印——这是谷歌推动 AI 内容可识别规模化的一部分。

个人虚拟形象功能让你可以创建自己的视频克隆,但需要先录制自己朗读数字的影像——这是谷歌为防止深度伪造而内置的防护措施。

YouTube Shorts 用户本周可免费访问;Gemini 应用和 Flow 的完整体验需要 AI Plus、Pro 或 Ultra 订阅。


谷歌刚刚推出一款视频 AI,让你可以通过对话来编辑片段——无需时间线、无需软件、无需经验。5 月 19 日在谷歌 I/O 2026 上发布的全新 Gemini Omni 模型,标志着谷歌迄今为止在 AI 视频创作领域最激进的举措,与 OpenAI 的 Sora 和 Adobe Firefly 正面竞争。以下是它的实际功能,以及它是否真的如宣传般出色。

什么是谷歌 Gemini Omni AI 视频编辑器?

大多数 AI 视频工具的工作方式只有一个方向:你写出提示词,AI 生成一段视频。Gemini Omni 改变了这一模式。它接受任意组合的输入——文本、图片、音频和现有视频——让你通过来回对话来构建或修改场景。你给出的每条指令都会在前一条的基础上继续进行,保持角色、光线和物体在编辑过程中的一致性。

你可以把它想象成一个创意副驾驶,而不是一个视频生成器。你拍摄一段 15 秒的片段,然后告诉 Omni 更换背景、换掉角色的服装,或者让整个画面看起来像是在某个地方拍摄的。


来源: Brave/memeburn.com

采集时间: 2026-05-24 20:30:29

AIGoogleMetaClaudeAPI人工智能