Skip to main content

所有付费套餐与积分包均享 2× 积分

Gemini Omni 在线多模态 AI 视频生成器

Gemini Omni

使用 Gemini Omni生成多模态 AI 视频

Gemini Omni 是一款多模态 AI 视频模型,可在一次生成中组合文本提示词、参考图片、参考视频、可复用角色和可复用音色。先建立角色库和音色库,再将它们复用到最高 4K 的电影感视频中。

开始使用 Gemini Omni
参考图片0 / 7
参考视频占用 2 个槽位
角色0 / 3

还没有角色,请先在“我的角色”中创建。

音色0 / 1

还没有音色,请先在“我的音色”中创建。

已用参考槽位,图片 + 2 × 视频 + 角色0 / 7
100积分
查看全部套餐

Gemini Omni 基于 Kie.ai 多模态 API 运行。角色和音色可在你的所有视频中复用。

背景介绍

什么是 Gemini Omni

Gemini Omni 是一款多模态 AI 视频模型,可在一次生成中接收文本、图片、参考视频、可复用角色和可复用音色。每个视频最多可使用 7 个参考槽位,其中每张图片占 1 个槽位,每个视频占 2 个槽位,每个角色占 1 个槽位。

多数视频模型要求你在文生视频或图生视频之间二选一,而 Gemini Omni 能同时处理这些输入。你可以描述镜头运动,加入产品参考图,上传视频作为动作参考,再绑定固定角色和克隆音色,全部通过一次请求完成。

Tryonr 将 Gemini Omni 拆成三个工作区,分别是生成视频、我的角色和我的音色。角色和音色可创建一次、多次复用,并可生成最高 4K 视频,也支持适合短视频的 9:16 竖屏比例。

Gemini Omni 多模态模型结构图,图片、音频、文本、视频、角色和音色输入汇入同一个 Omni 节点
为什么选择 Gemini Omni

为什么创作者选择 Gemini Omni

在 Tryonr 的 Gemini Omni 工作室构建视频工作流的六个理由。

一次调用完成真正多模态生成

文本提示词、参考图片、1 个参考视频、最多 3 个可复用角色和 1 个克隆音色会一起提交。无需串联多个流程,也不会在步骤之间损失质量。

可复用角色库

用一张照片和一段描述定义角色,获取可复用的 character_id,之后可放入任意视频。角色身份在不同镜头中保持一致。

自定义音色克隆

从 Kie 预设音色克隆声音,为它命名,并可用示例台词进行引导。生成的 voice_id 可在所有角色和视频中复用。

最高 4K 电影级分辨率

支持 720p、1080p 或 4K。可选择 4、6、8 或 10 秒视频。16:9 适合电影感画面,9:16 适合 TikTok、Reels 和 YouTube Shorts。

视频转视频动作参考

上传参考视频并指定开始与结束时间,精准引导你想要的动作。Gemini Omni 会读取节奏并应用到新场景中。

透明积分定价

每次提交前都会显示所需积分。生成失败会自动退还积分,流程幂等,无需提交客服工单。

如何使用 Gemini Omni

三步生成 Gemini Omni 视频

从空白输入到多模态电影感短片,通常两分钟内即可完成。

1
第 1 步,为 Gemini Omni 填写提示词并添加参考素材

填写提示词并添加参考素材

输入你想要的场景。可选添加参考图片、1 个带开始和结束时间的参考视频、最多 3 个可复用角色和 1 个克隆音色。槽位计数器会实时显示 7 个槽位的使用情况。

2
第 2 步,选择 Gemini Omni 的时长、画面比例和分辨率

选择时长、比例和分辨率

选择 4、6、8 或 10 秒。选择 16:9 电影画幅或 9:16 竖屏。支持 720p、1080p 或 4K。每种组合都会提前显示积分成本。

3
第 3 步,生成、预览并下载 Gemini Omni 视频

生成、预览并下载

点击生成,查看 Gemini Omni 渲染进度。可在浏览器中预览视频,然后下载 MP4。生成失败会自动退还积分。

使用场景

你可以用 Gemini Omni 创作什么

Gemini Omni 的多模态调用适合叙事、营销和保持一致性的创意实验。

Gemini Omni 时装试穿穿搭短片,粉色风衣模特旋转展示

时装试穿与穿搭短片

上传静态商品图,绑定常用模特角色,生成适合 Shopify、TikTok 广告和 Instagram 目录的行走转身短片。

Gemini Omni 产品营销演示,悬浮护肤瓶与金色花瓣

营销和产品演示视频

绑定品牌代言角色和自定义音色,并在每次新品发布视频中复用。不同镜头之间不会出现身份漂移。

Gemini Omni 音乐视频和短片场景,霓虹雨夜城市街道

音乐视频与短片

使用相同的 character_id 和 voice_id 串联多个 10 秒片段,组合成长叙事作品。素材库确保连续性。

Gemini Omni 9:16 竖屏视频,适合 TikTok、Reels 和 YouTube Shorts

TikTok、Reels 和 Shorts

生成 9:16 竖屏短片,并复用音色制作 TikTok、Instagram Reels 和 YouTube Shorts。构图会自动适配画面比例。

对比

Gemini Omni 对比 Veo 3、Kling 3 和 Sora

看看 Gemini Omni 的多模态调用与当前主流 AI 视频模型有何不同。

Gemini Omni 对比 Veo 3 视频质量,秋叶步行场景
适合 · 01

Gemini Omni 对比 Veo 3

Veo 3 可从提示词或单张图片生成视频。Gemini Omni 则可在一次调用中接收提示词、最多 7 个参考槽位、参考视频、可复用角色和克隆音色,并在后续生成中持续复用角色与音色。

  • 一次 POST 调用原生支持多模态输入
  • 角色和音色库可跨视频复用
  • 参考视频支持开始和结束时间的动作引导
Gemini Omni 对比 Kling 3,风格化与写实市场场景对照
适合 · 02

Gemini Omni 对比 Kling 3

Kling 3 适合快速生成风格化社交内容。Gemini Omni 的优势在于多模态参考和基于 character_id 的身份一致性。Kling 3 更适合快速 B-roll 迭代,Gemini Omni 更适合品牌内容和系列角色。

  • 可复用 character_id 让角色身份跨镜头保持一致
  • 音色克隆库可在每次生成中共享
  • 同一模型支持最高 4K 和 9:16 竖屏
Gemini Omni 对比 Sora 2 和 Seedance 2,绘画、动漫和写实画面面板
适合 · 03

Gemini Omni 对比 Sora 2 与 Seedance 2

Sora 2 擅长风格范围,Seedance 2 擅长速度。Gemini Omni 则是多模态全能型方案,可接收其他模型分散处理的输入,并通过可复用素材库统一绑定。

  • 文本、图片、视频、角色与音色一次多模态调用
  • 基于素材库保持连续剧式身份一致性
  • 同一 API 支持画面比例和分辨率灵活选择
案例

Gemini Omni 作品集

通过本工作室生成的 Gemini Omni 真实输出。

Gemini Omni 风景视频,雾气山脉日出和金色光束
Gemini Omni 时尚肖像,模特穿雕塑感粉色礼服,带洋红色灯光
Gemini Omni 产品视频,粉色大理石上的水晶香水瓶
Gemini Omni 动漫视频,吉卜力风英雄眺望日落中的幻想城市
Gemini Omni 演唱会视频,歌手站在洋红和蓝色灯光下
Gemini Omni 自然视频,红狐穿过白桦雪林
价格

Gemini Omni 积分价格

每次生成按积分透明计费。720p 与 1080p 价格相同,4K 更高。加入参考视频后按固定费率计费。

Kie.ai API · auto-refund on failures
免费试用
$0/ 新手积分

注册即可用新手积分试用 Gemini Omni。720p、4 到 10 秒,开放全部多模态输入。

标准
60 起积分 / 720p 短片

720P / 1080P,4 到 10 秒,支持全部多模态输入,包含可复用角色和音色。

4K 电影级
140 起积分 / 4K 短片

4K,4 到 10 秒,Gemini Omni 工作室级输出。适合追求 4K 多模态 AI 视频的最佳单秒成本。

时长720P / 1080P4K
4 秒60 积分140 积分
6 秒80 积分160 积分
8 秒100 积分180 积分
10 秒120 积分200 积分
含参考视频,任意时长160 积分240 积分

年度 Pro 方案的实际价格约为每积分 0.0094 美元。所有失败生成都会自动退款。

常见问题

Gemini Omni 常见问题解答

关于 Gemini Omni 和本工作室你想了解的内容。

开始使用

今天就开始使用 Gemini Omni

建立角色库和音色库,然后通过一次调用生成多模态视频。注册即含新手积分。

打开 Gemini Omni 工作室