Skip to main content

所有付费套餐与积分包均享 2× 积分

Gemini Omni 在线多模态 AI 视频生成器

✦ Gemini Omni

使用 Gemini Omni生成多模态 AI 视频

Gemini Omni 是一款多模态 AI 视频模型,可在一次生成中组合文本提示词、参考图片、参考视频、可复用角色和可复用音色。先建立角色库和音色库,再将它们复用到最高 4K 的电影感视频中。

开始使用 Gemini Omni
参考图片0 / 7
参考视频占用 2 个槽位
角色0 / 3

还没有角色,请先在“我的角色”中创建。

音色0 / 1

还没有音色,请先在“我的音色”中创建。

已用参考槽位,图片 + 2 × 视频 + 角色0 / 7
100积分
查看全部套餐

Gemini Omni 基于 Kie.ai 多模态 API 运行。角色和音色可在你的所有视频中复用。

✦ 背景介绍

什么是 Gemini Omni

Gemini Omni 是一款多模态 AI 视频模型,可在一次生成中接收文本、图片、参考视频、可复用角色和可复用音色。每个视频最多可使用 7 个参考槽位,其中每张图片占 1 个槽位,每个视频占 2 个槽位,每个角色占 1 个槽位。

多数视频模型要求你在文生视频或图生视频之间二选一,而 Gemini Omni 能同时处理这些输入。你可以描述镜头运动,加入产品参考图,上传视频作为动作参考,再绑定固定角色和克隆音色,全部通过一次请求完成。

Tryonr 将 Gemini Omni 拆成三个工作区,分别是生成视频、我的角色和我的音色。角色和音色可创建一次、多次复用,并可生成最高 4K 视频,也支持适合短视频的 9:16 竖屏比例。

Gemini Omni 多模态模型结构图,图片、音频、文本、视频、角色和音色输入汇入同一个 Omni 节点
✦ 为什么选择 Gemini Omni

为什么创作者选择 Gemini Omni

在 Tryonr 的 Gemini Omni 工作室构建视频工作流的六个理由。

一次调用完成真正多模态生成

文本提示词、参考图片、1 个参考视频、最多 3 个可复用角色和 1 个克隆音色会一起提交。无需串联多个流程,也不会在步骤之间损失质量。

可复用角色库

用一张照片和一段描述定义角色,获取可复用的 character_id,之后可放入任意视频。角色身份在不同镜头中保持一致。

自定义音色克隆

从 Kie 预设音色克隆声音,为它命名,并可用示例台词进行引导。生成的 voice_id 可在所有角色和视频中复用。

最高 4K 电影级分辨率

支持 720p、1080p 或 4K。可选择 4、6、8 或 10 秒视频。16:9 适合电影感画面,9:16 适合 TikTok、Reels 和 YouTube Shorts。

视频转视频动作参考

上传参考视频并指定开始与结束时间,精准引导你想要的动作。Gemini Omni 会读取节奏并应用到新场景中。

透明积分定价

每次提交前都会显示所需积分。生成失败会自动退还积分,流程幂等,无需提交客服工单。

✦ 如何使用 Gemini Omni

三步生成 Gemini Omni 视频

从空白输入到多模态电影感短片,通常两分钟内即可完成。

1
第 1 步,为 Gemini Omni 填写提示词并添加参考素材

填写提示词并添加参考素材

输入你想要的场景。可选添加参考图片、1 个带开始和结束时间的参考视频、最多 3 个可复用角色和 1 个克隆音色。槽位计数器会实时显示 7 个槽位的使用情况。

2
第 2 步,选择 Gemini Omni 的时长、画面比例和分辨率

选择时长、比例和分辨率

选择 4、6、8 或 10 秒。选择 16:9 电影画幅或 9:16 竖屏。支持 720p、1080p 或 4K。每种组合都会提前显示积分成本。

3
第 3 步,生成、预览并下载 Gemini Omni 视频

生成、预览并下载

点击生成,查看 Gemini Omni 渲染进度。可在浏览器中预览视频,然后下载 MP4。生成失败会自动退还积分。

✦ 使用场景

你可以用 Gemini Omni 创作什么

Gemini Omni 的多模态调用适合叙事、营销和保持一致性的创意实验。

Gemini Omni 时装试穿穿搭短片,粉色风衣模特旋转展示

时装试穿与穿搭短片

上传静态商品图,绑定常用模特角色,生成适合 Shopify、TikTok 广告和 Instagram 目录的行走转身短片。

Gemini Omni 产品营销演示,悬浮护肤瓶与金色花瓣

营销和产品演示视频

绑定品牌代言角色和自定义音色,并在每次新品发布视频中复用。不同镜头之间不会出现身份漂移。

Gemini Omni 音乐视频和短片场景,霓虹雨夜城市街道

音乐视频与短片

使用相同的 character_id 和 voice_id 串联多个 10 秒片段,组合成长叙事作品。素材库确保连续性。

Gemini Omni 9:16 竖屏视频,适合 TikTok、Reels 和 YouTube Shorts

TikTok、Reels 和 Shorts

生成 9:16 竖屏短片,并复用音色制作 TikTok、Instagram Reels 和 YouTube Shorts。构图会自动适配画面比例。

✦ 对比

Gemini Omni 对比 Veo 3、Kling 3 和 Sora

看看 Gemini Omni 的多模态调用与当前主流 AI 视频模型有何不同。

Gemini Omni 对比 Veo 3 视频质量,秋叶步行场景
适合 · 01

Gemini Omni 对比 Veo 3

Veo 3 可从提示词或单张图片生成视频。Gemini Omni 则可在一次调用中接收提示词、最多 7 个参考槽位、参考视频、可复用角色和克隆音色,并在后续生成中持续复用角色与音色。

  • 一次 POST 调用原生支持多模态输入
  • 角色和音色库可跨视频复用
  • 参考视频支持开始和结束时间的动作引导
Gemini Omni 对比 Kling 3,风格化与写实市场场景对照
适合 · 02

Gemini Omni 对比 Kling 3

Kling 3 适合快速生成风格化社交内容。Gemini Omni 的优势在于多模态参考和基于 character_id 的身份一致性。Kling 3 更适合快速 B-roll 迭代,Gemini Omni 更适合品牌内容和系列角色。

  • 可复用 character_id 让角色身份跨镜头保持一致
  • 音色克隆库可在每次生成中共享
  • 同一模型支持最高 4K 和 9:16 竖屏
Gemini Omni 对比 Sora 2 和 Seedance 2,绘画、动漫和写实画面面板
适合 · 03

Gemini Omni 对比 Sora 2 与 Seedance 2

Sora 2 擅长风格范围,Seedance 2 擅长速度。Gemini Omni 则是多模态全能型方案,可接收其他模型分散处理的输入,并通过可复用素材库统一绑定。

  • 文本、图片、视频、角色与音色一次多模态调用
  • 基于素材库保持连续剧式身份一致性
  • 同一 API 支持画面比例和分辨率灵活选择
✦ 案例

Gemini Omni 作品集

通过本工作室生成的 Gemini Omni 真实输出。

Gemini Omni 风景视频,雾气山脉日出和金色光束
Gemini Omni 时尚肖像,模特穿雕塑感粉色礼服,带洋红色灯光
Gemini Omni 产品视频,粉色大理石上的水晶香水瓶
Gemini Omni 动漫视频,吉卜力风英雄眺望日落中的幻想城市
Gemini Omni 演唱会视频,歌手站在洋红和蓝色灯光下
Gemini Omni 自然视频,红狐穿过白桦雪林
✦ 价格

Gemini Omni 积分价格

每次生成按积分透明计费。720p 与 1080p 价格相同,4K 更高。加入参考视频后按固定费率计费。

Kie.ai API · auto-refund on failures
免费试用
$0/ 新手积分

注册即可用新手积分试用 Gemini Omni。720p、4 到 10 秒,开放全部多模态输入。

标准
60 起积分 / 720p 短片

720P / 1080P,4 到 10 秒,支持全部多模态输入,包含可复用角色和音色。

4K 电影级
140 起积分 / 4K 短片

4K,4 到 10 秒,Gemini Omni 工作室级输出。适合追求 4K 多模态 AI 视频的最佳单秒成本。

时长720P / 1080P4K
4 秒60 积分140 积分
6 秒80 积分160 积分
8 秒100 积分180 积分
10 秒120 积分200 积分
含参考视频,任意时长160 积分240 积分

年度 Pro 方案的实际价格约为每积分 0.0094 美元。所有失败生成都会自动退款。

✦ 常见问题

Gemini Omni 常见问题解答

关于 Gemini Omni 和本工作室你想了解的内容。

✦ 开始使用

今天就开始使用 Gemini Omni

建立角色库和音色库,然后通过一次调用生成多模态视频。注册即含新手积分。

打开 Gemini Omni 工作室