Gemini Omni Flash API 定价、限制及访问指南

gemini-omni-flash-api-定价-限制

Gemini Omni Flash 是谷歌推出的一款用于多模态视频生成和对话式视频编辑的新预览模型。对于 API 用户而言,需要了解的模型 ID 是 gemini-omni-flash-preview. 简单的定价情况如下: Gemini API 定价 列出了视频输出位于 每100万个视频输出代币为$17.50, ,谷歌将其描述为大约 720p 视频为每秒 $0.10.

令人困惑的是,“Gemini Omni Flash 定价”可能有三种不同的含义。开发者可能关注的是 Gemini API 令牌的定价;创作者可能关注的是 Google AI 订阅和 Flow 积分。 普通用户可能不太关心 SDK,而更在意能否直接打开一个工作区,并开始使用该模型进行生成。.

这就是 GlobalGPT 完美适配。GlobalGPT Pro 现已支持 Gemini Omni Flash 访问,并涵盖该平台上的更广泛机型阵容(Google Veo 3.1 除外)。当前的 GlobalGPT Pro 价格 是 按年计费时,每月费用为 $10.8, 或 根据当前的月度促销活动,每月$15. 对于希望在不配置 API 密钥、计费项目或 SDK 调用情况下试用 Omni 的用户而言,这可能是一种更简洁的方式。.

以下是具体说明:Omni通过API的费用、Google AI套餐包含的内容、预览版适用的限制,以及如何在API访问、Google Flow和GlobalGPT Pro之间做出选择。.

Gemini Omni Flash 定价:简要版

如果您只需要数据,Gemini Omni Flash 是 Gemini API 中的付费模型。 Omni Flash 没有免费 API 层级。Google AI 付费订阅还通过 Flow 积分提供 Omni 访问权限,而 GlobalGPT Pro 则为用户提供了一条更简便的多模型路径,适合那些不想管理 API 配置的用户。.

前往路线已确认价格最合适主要注意事项
双子座应用程序接口$1.50 / 100万个输入令牌;$9 / 100万个文本输出令牌;$17.50 / 100万个视频输出令牌;720p视频每秒约$0.10开发人员、产品团队、自动化、批量测试无免费 API 套餐;需要进行 API 配置和使用监控
谷歌人工智能加$4.99 每月,200 流量积分谷歌消费级创意工具中的基础测试在发布每条视频的积分对照表之前,每代的精确Omni积分成本仍需通过Flow进行实时验证。
谷歌人工智能专业版$,每月19.99,1,000个流量积分已经在 Google Flow 中工作的创作者积分虽然有用,但与 API 计费并不相同
谷歌超级人工智能每月 $99.99,附带 10,000 个 Flow 积分;或每月 $199.99,附带 25,000 个 Flow 积分简体中文(大陆)Google Flow的重度用户和高强度创意工作流程只有当 Flow 已经是工作流的核心时,增加月度支出才有意义
GlobalGPT Pro按年计费时,每月费用为 $10.8;根据当前的月度促销活动,每月费用为 $15希望在单一订阅中同时使用Omni和多个AI模型的用户不能替代开发者 API 控制台或 Google 所有官方应用的功能
谷歌的API定价表将Gemini Omni Flash列为付费级别的型号,其中720p视频的视频输出价格约为每秒$0.10。.

什么是 Gemini Omni Flash?

Gemini Omni Flash 是 Gemini API 中的一个预览视频模型。谷歌的 Omni API 文档 其设计围绕原生多模态、对话式编辑和世界知识展开。具体而言,该系统旨在根据文本生成短视频、使用参考图像,并在工作流程支持的情况下保留足够的上下文信息以便后续编辑。.

API 模型 ID 是 gemini-omni-flash-preview. .“预览版”一词至关重要。这意味着该模型可用于测试和早期生产探索,但其定价、限制、功能覆盖范围和行为仍可能发生变化,且变化速度可能快于稳定版模型系列。.

谷歌将 Gemini Omni Flash 列在型号 ID gemini-omni-flash-preview 下。.

其最适合的应用场景包括短产品展示视频、社交视频创意、动画创意测试,以及需要进行具体修改的视频剪辑。它并非一款功能齐全的长视频编辑器。当前的预览功能更应被视为用于生成短视频片段的快速生成层,而非一套完整的后期制作套件。.

如何访问 Gemini Omni Flash

目前有三种实用的使用途径:Gemini API、包含 Flow 积分的 Google AI 套餐,以及 GlobalGPT Pro。虽然它们功能有所重叠,但各自解决的问题不同。.

选项 1:Gemini API

Gemini API 方案面向开发人员和技术团队。当您需要将 Omni 集成到产品中、运行可重复的测试、根据结构化提示生成片段,或按请求级别跟踪成本时,该方案最为合适。 相应的权衡在于配置工作:您需要配置计费、API 访问权限、请求处理、存储,以及围绕重试和媒体文件构建自己的工作流。.

对于已经开始比较视频生成成本的团队而言,API 途径是计算每段视频成本最简洁的方式。 一段10秒的720p视频输出,在不考虑输入代币和相关基础设施成本的情况下,视频输出成本约为$1.00。时长更短的3秒和8秒视频片段,成本则相应更低。.

选项 2:Google AI 套餐和 Flow 积分

对于希望通过谷歌的创作界面使用Omni的创作者而言,谷歌AI订阅服务更为便捷。在美国,付费 谷歌人工智能计划 显示 Omni 访问权限和每月 Flow 积分:Plus 套餐为 $4.99,含 200 积分, Pro 套餐价格为 $19.99,附赠 1,000 个积分;Ultra 套餐价格为 $99.99,附赠 10,000 个积分,或 $199.99,附赠 25,000 个积分。.

Google AI Plus、Pro 和 Ultra 套餐明确包含 Flow 积分,并提供 Gemini Omni Flash 访问权限。.

请勿将流量积分与 Gemini API 令牌计费混淆。 信用额度是面向消费者的配额。API 令牌则是面向开发者的计费单位。如果您主要关心的是“我的应用每生成一秒会花费多少?”,请参考 API 价格。如果您主要关心的是“我在 Flow 中能获得多少次创意生成尝试?”,请参考 Google AI 套餐和信用额度。.

选项 3:GlobalGPT Pro

对于希望尝试 Gemini Omni Flash 又不想将此任务变成 API 配置项目的用户而言,GlobalGPT Pro 是最实用的选择。 目前按年付费的年费为每月 $10.8,而当前的月度促销活动将 Pro 版的价格定为每月 $15。GlobalGPT Pro 还提供该平台更广泛的模型阵容,但 Google Veo 3.1 除外。.

GlobalGPT Pro 的适用场景

其价值并不在于 GlobalGPT 取代了 Gemini API——它并没有做到这一点。其价值在于,许多用户在日常测试中并不需要 API 控制台。他们需要一个可以在不同模型之间切换、比较输出结果并进行创作的平台,而无需为每个服务提供商分别保持付费订阅。.

Gemini Omni Flash API 定价详解

谷歌的价目表虽然简洁,但仅凭标价还无法判断Omni Flash是否物有所值。有意义的比较应是“每次成功剪辑的成本”:即在考虑了指令遵循情况、重试次数、问题解决情况以及工作流可靠性等因素后,该模型在视频输出费用方面能带来多少价值。.

  • 输入: 每100万个代币为$1.50。.
  • 文本输出: 每100万个代币为$9.00。.
  • 视频输出: 每100万个代币为$17.50,谷歌将其描述为播放720p视频时每秒约$0.10。.
  • 免费 API 配额: 不适用于 Gemini Omni Flash。.

按时长估算的视频输出成本

申请时长API视频输出的近似成本说明
3秒关于 $0.30适用于快速动作测试和过渡效果
8 秒钟关于 $0.80产品演示和社交媒体短视频的理想时长
10 秒钟关于 $1.00当前 API 持续时间范围的上限

这些估算值基于谷歌提供的 720p 视频输出指导标准。输入令牌、存储、重试以及任何相关应用成本均另计。.

Omni Flash 的性能是否足以证明其 API 价格的合理性?

目前尚无单一的公开基准测试分数能将视频质量直接转化为清晰的性价比数值,因此我们的 实操测试套件 在此情况下,它比综合评分更有参考价值。它衡量的是模型是否返回了要求的格式、是否保留了关键的视觉细节、是否遵循了定时操作,以及是否可靠地完成了工作流。.

实用的性价比基准测试

被测量项观测结果这对价值意味着什么
已完成的基础或生成请求第 5 页,共 5 页“文字转视频”、竖屏输出、图片转视频、基础片段以及定时序列均生成了可播放的视频。.
成功拍摄的素材及预计视频制作成本42秒,约$4.27即使测试预算有限,该产品也能按标价提供多个可用的短视频片段。.
受控完成时间完成8-10秒的任务需耗时25.7-39.2秒速度足以满足迭代概念设计的需求;这些时序数据并非基于GlobalGPT接口速度的测量结果。.
格式与一致性原生 9:16 及参考图像测试均通过当首次输出结果已经具备所需的朝向并保留了拍摄对象时,这个价格就更容易让人接受了。.
带状态的后续编辑0/1;HTTP 502如果制作工作流程依赖于重试,那么编辑可靠性可能会提高实际成本。.

根据这些证据,API 的定价与快速构思、产品镜头、社交媒体创意以及基于参考素材的动态测试非常匹配。一段 8 秒或 10 秒的 720p 视频输出成本不到 1 美元或约为 1 美元,且成功生成的视频渲染速度足够快,能够支持快速迭代。.

对于最终交付或长篇作品而言,其价值较低。 输出分辨率上限为720p,时长上限为10秒;在我们的测试中,精确计时结果仅为近似值,且状态化编辑曾出现一次失败。对于需要多次重试、片段拼接、画质提升或可靠后续编辑的项目,实际成本可能远高于标称的每秒费率所示。.

Google AI 套餐与 GlobalGPT:哪种价格更合理?

应根据使用情况来评估这些选项,而非单纯依据其月费价格。谷歌在其自有创意环境中销售容量逐级递增的套餐。GlobalGPT将订阅费用分摊到Omni及其他模式中。无论采用哪种方式,仅因用户选择了更昂贵的套餐,并不会使底层的Omni模式产生更好的收益。.

如何解读谷歌的定价阶梯

这张表格比另一份价格汇总表更有参考价值。每提升一个档位,Flow 配额的增长速度都会超过月费的增长速度,因此随着使用承诺的增加,每包含信用点的名义成本会随之降低。这使得“Pro”档位成为进行常规 Flow 迭代时更均衡的选择,而“Ultra”档位则适合那些能够实际消耗更大配额,并能从 Google 其他高级功能中获益的用户——他们需要购买的是容量。.

谷歌人工智能计划美国月度价格流量积分每学分的名义费用最合适
AI Plus$4.99200约2.50美分对于偶尔使用 Flow 的用户而言,这是成本最低的官方入口
人工智能专业$19.991,000约2.00美分希望每月在 Flow 中进行迭代的常规创作者
超级人工智能$99.9910,000约1.00美分大流量应用以及同样重视Ultra功能的用户
AI Ultra,更高限额选项$199.9925,000约0.80美分官方工具的使用频率极高,此时较高的配额实际上会被用完

从Plus到Pro,包含的学分额度增加了五倍,而费用则增长了约四倍,导致每包含学分的名义成本降低了约20%。 首个“Ultra”级别与“Pro”相比,该效率再次翻倍。这在理论上看起来很强劲,但单位成本的降低并不等同于总支出的减少:即使“Ultra”拥有最佳的性价比,未使用的容量也可能使“Plus”或“Pro”成为更划算的选择。.

通过实际测试,API 返回的结果显示,约 $4.27 可生成 42 秒成功视频,这一数据虽可作为有用的性能参考,但无法据此计算出一个 Flow 计划将生成多少个 Omni 片段。Flow 积分和 API 视频代币是不同的计费单位,且每次 Omni 操作的实时积分消耗仍需单独验证。.

GlobalGPT Pro 的适用场景

GlobalGPT 的价值体现在横向扩展上,而非基于处理量。如果您仅打算使用 Omni 模型,那么 Gemini API 或 Google AI 套餐会更容易评估,因为其计费单位直接与请求量或 Flow 容量挂钩。 如果同一订阅还用于写作、研究、图像处理以及跨多个模型的比较,其实际价值会更高,因为成本分摊到了更多工作流中。不过,它仍然无法替代原生的 Flow 功能或开发者级别的 API 控制。.

哪种方案实际上更划算?

如果你是……选择……为什么
将Omni集成到应用程序中双子座应用程序接口您需要请求控制、可预测的每秒成本以及技术集成。.
在官方 Google Flow 中以最低月费试用 Omni谷歌人工智能加这既限制了总投入,又提供了足够的容量来判断 Flow 是否适合该工作流程。.
每月在 Flow 中进行创作和迭代谷歌人工智能专业版与Plus套餐相比,该套餐的流量配额增长速度快于资费增长速度,因此成为最均衡的常规使用档位。.
在谷歌官方创意工具中运行大批量任务谷歌超级人工智能只有在真正利用了高流量处理能力以及谷歌的附加功能时,其单位经济效益才能发挥最大作用。.
将Omni与几款AI模型结合使用,用于内容创作GlobalGPT Pro其价值取决于所使用的模型数量和非视频工作流的数量,而非仅取决于Omni的生成量。.

如果您的 AI 视频研究范围超出了 Omni 的范畴,请从与您下一步决策相匹配的对比分析开始。该 索拉 2 API 的定价 在比较开发成本时,本指南非常有用,而 索拉视频生成 本指南旨在协助创作者优化工作流程。对于模型间的选择,该 Veo 3.1 vs Sora 2 “详细分析”是接下来最相关的阅读内容。.

您应该了解的 Gemini Omni Flash 限制

Omni Flash 功能强大,但其预览功能存在明显的局限。在消耗积分之前了解这些局限,比死记硬背某款机型的公告更为重要。.

谷歌的发布说明中指出,通过 Interactions API 生成 720p 分辨率的视频需要 3 至 10 秒。.

持续时间与分辨率

当前的 API 预览版支持来自 3 至 10 秒 于 720p, ,正如谷歌的 Gemini API 发布说明. 这使得Omni Flash成为一款短视频生成工具。它非常适合用于产品展示、社交媒体创意、画面过渡以及快速视觉测试,但并非设计用于通过单次请求生成完整的、长达数分钟的视频。.

长宽比

景观 16:9 是默认设置。纵向 9:16 还可以提出此类请求,这对 TikTok、Reels、Shorts 以及以移动端为先的广告测试非常有用。.

图片转视频

Omni 支持参考图像工作流。这对产品拍摄尤为重要,因为你可以从一个视觉锚点入手,而不是要求模型仅凭文字描述来构想物体。参考图像仍需配有清晰的动作指令。一个好的提示语应说明哪些部分应发生变化、哪些部分应保持一致,以及相机应如何运作。.

谷歌演示了如何将参考图像和动作提示转化为逼真的视频画面。.

带状态的视频编辑

Interactions API 能够通过之前的交互保留视频上下文,以便进行后续编辑。对用户而言,这意味着您可以要求进行诸如更换产品颜色或调整场景细节之类的修改,而无需重写整个原始提示词。最佳的编辑仍应具有针对性且具体明确。.

Interactions API 在进行后续编辑时能够保留视频上下文。.

预览限制

该预览版还存在一些重要的技术限制。谷歌的文档中列出了有关地区可用性、参考媒体、语音编辑、插值、高级参数以及部分指令控制方面的限制。生成的视频中还包含SynthID,且安全过滤器可能会影响输出结果。.

预览 API 对上传的媒体、地区、语音编辑和高级参数设有特定的限制。.

简单来说,Omni Flash 应该像预览工具一样进行测试:它足够强大,可以围绕其构建工作流,但不应将其视为无需监控变更的、完全稳定的生产环境。.

Gemini Omni Flash 实测结果

我们也进行了相同的测试 gemini-omni-flash-preview 该模型可通过受控的 API 工作流在 GlobalGPT Pro 上使用。.

在测试中,我们验证了五种实际工作流程:基准文本转视频、原生 9:16 输出、参考图像一致性、带状态的后续编辑,以及时长为 10 秒的序列。.

如何解读结果: 每个输出视频都配有相应的测量数据和审查说明。运行时间是指在受控工作流中测得的端到端时间,而非 GlobalGPT 接口速度。.

T1 · 文字转视频

拿铁拉花动作测试

基本通过
8.0秒实际持续时间
1280×720决议
16:9实际比例
28.6秒受控运行时间
有音频检测到 128 kbps 的音轨
~$0.81API 费用估算

在采样帧中,罗塞塔图案依然清晰可辨,蒸汽依然可见,且手部动作流畅自然。杯子在中点附近被微微抬起,而非仅原地旋转,因此操作虽基本符合指导要求,但并非完全准确。.

启示 这是一个可用的成果,视觉真实感很强,但动作细节仍需逐帧检查。.

查看确切的提示语

制作一段8秒钟、16:9比例、具有照片级真实感的单镜头连续视频。 一杯陶瓷拿铁静静地放在阳光洒落的窗边,置于胡桃木咖啡桌上。咖啡师的手轻轻将杯子旋转约30度,展现出清晰的罗塞塔拿铁拉花图案。细腻逼真的蒸汽自然升腾,在晨光中袅袅盘旋;液面波动与手部动作应遵循现实世界的物理规律。 采用缓慢而细腻的镜头推入手法,搭配浅景深、温暖的自然光以及真实的咖啡馆氛围。无对话、无音乐、无剪辑、无字幕、无可见品牌名称、无标志,且无水印。.

T2 · 竖屏视频

9:16 产品开箱测试

通过
8.0秒实际持续时间
720×1280决议
9:16实际比例
25.7秒受控运行时间
有音频检测到 128 kbps 的音轨
~$0.81API 费用估算

输出画面符合要求的竖版格式。充电盒保持居中,盒盖打开,两只耳机均清晰可见。盒盖打开后,手部仍处于画面中,但产品构图稳定,且采样帧中未出现任何徽标或文字。.

启示 Gemini Omni Flash 可以输出真正竖屏格式的产品片段,而不是裁剪后的横屏输出。.

查看确切的提示语

制作一段8秒钟、9:16竖屏比例、写实风格的产品视频,采用一镜到底的拍摄方式。将一个哑光钴蓝色的无线耳机充电盒置于干净的浅灰色摄影棚底座中央。一只手从画面下边缘伸入,流畅地打开盒盖,露出两只配套的蓝色耳机。 与此同时,摄像机从画面左前方向右前方进行半圈受控旋转,期间始终将充电盒置于画面中央并确保其完全可见。采用柔和的商业摄影棚灯光、逼真的材质、稳定的几何结构以及精准的手部与物体交互。不得出现任何标志、文字、剪辑、多余物体、变形的手指以及水印。.

T3 · 图片转视频

参考图像一致性测试

通过
8.0秒实际持续时间
1280×720决议
16:9实际比例
29.0秒受控视频播放时长
有音频检测到 128 kbps 的音轨
~$0.82视频播放时长估算*

蓝色杯身、黄色手柄、短壶嘴、石质台面以及阳光洒满的厨房场景均保持一致。开场画面之后出现了蒸汽。视频的构图比源图像稍宽一些,因此画面还原度较高,但并非像素级完全一致。.

启示 参考图像在提供有用的身份识别参考的同时,又避免了将场景凝固成一帧静止画面。.

查看确切的动画提示

将这张参考图制作成一段8秒、16:9比例的逼真视频。需完全保留茶壶的钴蓝色壶身、亮黄色壶柄、比例、壶嘴形状、置于桌面的位置、光线方向以及整体构图。 在摄像机以约20度的角度缓慢、平滑地向右环绕移动时,需在壶嘴处添加一缕逼真的蒸汽。茶壶必须保持刚性,且视觉效果与参考图完全一致;不得添加、移除、更改颜色或改变任何物体的形状。不得出现文字、徽标、剪辑、人物及水印。.

T4 · 带状态编辑

关于“蓝转红”自行车的后续报道

编辑失败
8.0秒基准期限
1280×720基本分辨率
16:9基数比
29.6秒基于基数的运行时间
52.0秒编辑响应时间超时
HTTP 502编辑回复

基础视频片段正确地展示了一位身穿黄色雨衣的成年女性,她站在一条湿漉漉的街道上,身旁停着一辆稳固的蓝色自行车。后续操作使用了同一拍摄 session,并针对基础视频中持续存在的信息进行了处理,但编辑操作返回了非流媒体的 502 响应,未获取到任何媒体内容,也未触发任何使用事件。.

启示 此次运行并不能证明带状态编辑能够可靠地工作。这是一次真正的失败尝试,因此无法评估其连续性。.

查看基础提示和后续提示

基本要求:制作一段8秒钟、16:9比例、写实风格的电影级视频,采用一镜到底的拍摄方式。雨刚停,一位身穿亮黄色雨衣的成年女性站在湿漉漉的城市街道上,身旁停着一辆蓝色的城市自行车。她轻轻握着车把,路面上的倒影闪烁不定,几滴雨水从遮阳篷上滴落。 采用缓慢的横向镜头移动,阴天自然光,真实的人体解剖结构,稳定的自行车几何形态以及统一的色彩。无对话、无文字、无标志、无剪辑、无水印。 后续任务:将自行车颜色从蓝色改为红色。其余所有内容保持不变。.

T5 · 时间与限制

10秒时间轴控制测试

基本通过
10.0秒实际持续时间
1280×720决议
16:9实际比例
39.2秒受控运行时间
有音频检测到 128 kbps 的音轨
~$1.02API 费用估算
0–3秒框已关闭
3–6秒盖子打开
6–10秒群星冉冉升起

观测到的边界样本: 4.0秒时箱子仍处于关闭状态,4.5秒时箱盖已打开,6.5秒时已能看到星星。整个过程顺序正确,但第一次状态转换开始的时间比要求的要晚。.

启示 该模型遵循了事件顺序,并返回了完整的10秒最大值,但二级计时结果仅为近似值,而非帧级精确。.

查看确切的提示语

制作一段10秒钟、16:9比例的逼真摄影棚视频,采用单个连续的固定机位镜头。一个系着金色丝带的哑光红色小礼盒置于深色中性色调的桌面上,位于画面中央。 请严格遵循以下时间线:[0-3秒] 礼盒完全闭合且静止不动;[3-6秒] 盒盖自行缓慢平稳地打开,而礼盒保持原位不动;[6-10秒] 几颗金属金色的纸质小星星从打开的礼盒内轻轻升起,并向上飘浮。 整个镜头中,摄像机、背景、礼盒的位置、比例、灯光以及物体特征均保持不变。不得出现人物、文字、标志、剪辑、额外物体、突然的动作以及水印。.

避免浪费积分的实用技巧

Omni Flash 的定价足够低,足以让人放心尝试,但浪费的提示词费用仍会逐渐累积。最好的提示词应当具体明确,同时又不过于繁琐。.

想要画面稳定时,请使用一个连续镜头

如果希望视频片段看起来连贯,请说明“单个连续镜头”或“一次不间断的摄像机运动”。这样可以减少模特在拍摄过程中擅自加入突兀的剪辑或中途改变拍摄主题的可能性。.

描述相机,而不仅仅是拍摄对象

产品描述不应仅止于“一个蓝色的耳机收纳盒”。应加入动态描写:“镜头缓慢进行半圈移动”、“手打开收纳盒”、“柔和的棚内反光”或“镜头略微推近”。与单纯给物体添加更多形容词相比,运用镜头语言通常能产生更具实用价值的描述效果。.

尽早说明宽高比

对于移动端内容,请直接采用9:16的画面比例。对于网站或YouTube风格的视频片段,请使用16:9。画面比例不仅仅是一种格式选择;它还会影响模特展示双手、产品以及背景动态所需的空间大小。.

进行编辑时,请将修改范围控制在较小范围内

当后续操作很简单时,带状态的编辑效果最佳,例如:“将自行车的颜色从蓝色改为红色,其他所有内容保持不变。”除非你愿意承担重试的成本,否则应避免同时要求进行多项互不相关的更改。.

对于定时操作,请使用时间括号

如果该片段包含一个序列,请使用如下所示的方括号: [0-3秒][3-6秒], 和 [6-10秒]. 这为模型提供了可视化的节奏结构。虽然无法保证帧级精确控制,但比将时间安排写成一段松散的文字要清晰得多。.

谁应该使用 API、Google Flow 或 GlobalGPT?

使用 双子座应用程序接口 无论您是在构建、自动化还是进行数据监测。当您需要程序化控制、按请求计费以及可重复的提示时,该 API 都是理想之选。.

使用 通过谷歌人工智能计划了解谷歌Flow 如果你已经想要使用谷歌的原生创意环境。此外,当积分系统符合你的创作习惯,且你想使用官方的消费者工具时,Pro 和 Ultra 版本就值得考虑了。.

使用 GlobalGPT Pro 如果您主要希望将 Gemini Omni Flash 与其他主流型号配合使用,且无需管理单独的订阅和 API 控制台,那么 Pro 版是您的理想选择。目前,Pro 版按年付费的月费为 $10.8,若参与月度促销活动,月费则为 $15。 对许多用户而言,这正是其实际价值所在:Omni 可在更广泛的工作空间中使用,您还可以在其中对比其他模型,用于写作、规划、研究和创意工作。.

选择 GlobalGPT Unlimited 如果您的套餐使用量足够大,选择更高阶的套餐会更划算。目前“无限量”套餐的年付价格为每月 $25,而当前的月付促销价为每月 $37。.

最终结论

Gemini Omni Flash 是一款值得关注的短视频模型,因为它将视频生成、参考媒体和对话式编辑功能整合到一个相对实惠的方案中。以 720p API 视频输出为例,每秒成本约为 $0.10,这一价格很容易理解。 其局限性也很明确:时长3-10秒、720p分辨率、目前处于预览阶段,以及在高级编辑和参数设置方面存在若干技术限制。.

如果您是开发者,请从 Gemini API 开始,并跟踪每生成一秒的成本。如果您已经在 Google 的创意工具中,请根据 Flow 积分比较 Google AI 套餐的等级。如果您只想使用 Gemini Omni Flash 而无需构建 API 工作流,, GlobalGPT 的视频工作区 这是更直接的日常选择,特别是当你希望在同一工作区中访问其他模型的 Pro 版权限时。.

常见问题

Gemini Omni Flash 是免费的吗?

不,不能通过 Gemini API 实现。谷歌将 Gemini Omni Flash 列为付费级 API 模型,不提供免费 API 配额。谷歌 AI 订阅中可能包含 Flow 积分,但这些积分属于消费者计划的配额,与免费 API 访问权限并非同一回事。.

Gemini Omni Flash API 的价格是多少?

Gemini Omni Flash API 的定价为:每 100 万个输入令牌 $1.50,每 100 万个文本输出令牌 $9,每 100 万个视频输出令牌 $17.50。 谷歌表示,720p 视频的视频输出价格约为每秒 $0.10。.

Gemini Omni Flash API 的型号 ID 是多少?

API 模型 ID 是 gemini-omni-flash-preview.

Google AI Pro 中是否包含 Gemini Omni Flash?

是的。Google AI Pro 套餐的月费为 $19.99,包含 1,000 个 Flow 积分以及 Omni 访问权限。.

GlobalGPT 是否包含 Gemini Omni Flash?

是的。GlobalGPT Pro 包含 Gemini Omni Flash 访问权限。目前,Pro 版按年付费的月费为 $10.8,若参与当前的月度促销活动,月费则为 $15。.

Gemini Omni Flash 的视频限制有哪些?

当前的 API 预览版支持生成 720p 分辨率的 3 至 10 秒视频。默认采用 16:9 横屏模式,也可请求 9:16 竖屏模式。.

Gemini Omni Flash 支持将图像转换为视频吗?

是的。Gemini Omni Flash 支持参考图像工作流,因此用户可以提供一张图像,并提示模型根据该视觉参考生成动作。.

Gemini Omni Flash 能编辑现有视频吗?

谷歌的文档支持通过 Interactions API 对生成的视频进行带状态的后续编辑。在我们的一次实际操作中,基础视频生成成功,但后续编辑返回了 HTTP 502 错误,且未生成编辑后的媒体文件。因此,应根据您实际所需的工作流程对该功能进行测试,尤其是在模型仍处于预览阶段时。.

分享帖子:

相关帖子