Gemini Omni Flash es el nuevo modelo de vista previa de Google para la generación de vídeo multimodal y la edición conversacional de vídeo. Para los usuarios de la API, el ID del modelo que deben tener en cuenta es gemini-omni-flash-preview. El panorama general de los precios es el siguiente: Precios de la API de Gemini muestra la salida de vídeo en 1 TP 40 T 17,50 por cada millón de tokens de salida de vídeo, que Google describe como algo así como $0,10 por segundo para vídeo de 720p.
Lo que resulta confuso es que la expresión “precios de Omni Flash Gemini” puede referirse a tres cosas diferentes. A los desarrolladores les puede interesar el precio de los tokens de API Gemini. A los creadores les pueden interesar las suscripciones a Google AI y los créditos de Flow. A los usuarios habituales quizá les importen menos los SDK y más si pueden abrir un espacio de trabajo y empezar a generar contenido con el modelo.
Ahí es donde GlobalGPT encaja a la perfección. GlobalGPT Pro incluye ahora acceso a Gemini Omni Flash, junto con la gama más amplia de modelos de la plataforma, excepto Google Veo 3.1. La actual Precio del GlobalGPT Pro es $10,8 al mes con facturación anual, o $15 al mes con la promoción mensual actual. Para los usuarios que quieran probar Omni sin tener que configurar claves de API, proyectos de facturación ni llamadas al SDK, esa puede ser la opción más sencilla.
A continuación se ofrece un desglose práctico: cuánto cuesta Omni a través de la API, qué incluyen los planes de Google AI, qué límites se aplican en la versión preliminar y cómo decidir entre el acceso a la API, Google Flow y GlobalGPT Pro.

Índice
- Precios del Omni Flash Gemini: la versión resumida
- ¿Qué es el Omni Flash Gemini?
- Cómo acceder a Gemini Omni Flash
- Explicación de los precios de la API de Omni Flash Gemini
- Planes de IA de Google frente a GlobalGPT
- Límites de Omni Flash Gemini
- Resultados de las pruebas prácticas del Omni Flash Gemini
- Consejos rápidos para no malgastar créditos
- ¿Quién debería utilizar la API, Flow o GlobalGPT?
- PREGUNTAS FRECUENTES
Precios del Omni Flash Gemini: la versión resumida
Si solo necesitas las cifras, Gemini Omni Flash es un modelo de pago de la API de Gemini. No existe un nivel gratuito de la API para Omni Flash. Las suscripciones de pago a Google AI también incluyen acceso a Omni a través de créditos Flow, mientras que GlobalGPT Pro ofrece a los usuarios una vía multimodelo más sencilla cuando no desean gestionar la configuración de la API.
| Ruta de acceso | Precio confirmado | Mejor ajuste | Advertencia principal |
|---|---|---|---|
| API Géminis | $1,50 / 1 millón de tokens de entrada; $9 / 1 millón de tokens de salida de texto; $17,50 / 1 millón de tokens de salida de vídeo; aproximadamente $0,10 por segundo para vídeo de 720p | Desarrolladores, equipos de producto, automatización, pruebas por lotes | No hay un nivel gratuito de la API; requiere la configuración de la API y la supervisión de su uso |
| Google AI Plus | $4,99 al mes, 200 créditos de Flow | Pruebas preliminares de las herramientas creativas para consumidores de Google | El coste exacto en créditos Omni por generación aún debe verificarse en Flow antes de publicar una tabla de créditos por vídeo. |
| Google IA Pro | $19,99 al mes, 1.000 créditos de Flow | Creadores que ya trabajan en Google Flow | Los créditos son útiles, pero no son lo mismo que la facturación de la API |
| Google IA Ultra | $99,99 al mes con 10 000 créditos de Flow, o $199,99 al mes con 25 000 créditos de Flow | Usuarios habituales de Google Flow y flujos de trabajo creativos de gran volumen | Un gasto mensual más elevado solo tiene sentido si Flow ya es un elemento fundamental del flujo de trabajo |
| GlobalGPT Pro | $10,8 al mes con facturación anual; $15 al mes con la promoción mensual actual | Usuarios que desean disponer de Omni y varios modelos de IA en una sola suscripción | No sustituye a la consola de la API para desarrolladores ni a todas las funciones oficiales de las aplicaciones de Google. |

¿Qué es Gemini Omni Flash?
Gemini Omni Flash es un modelo de vídeo de vista previa de la API Gemini. El de Google Documentación de la API de Omni se centra en la multimodalidad nativa, la edición conversacional y el conocimiento del mundo. En la práctica, está diseñado para generar vídeos cortos a partir de texto, utilizar imágenes de referencia y conservar suficiente contexto para realizar ediciones posteriores cuando el flujo de trabajo lo permita.
El ID del modelo de la API es gemini-omni-flash-preview. La palabra “vista previa” es importante. Significa que el modelo está disponible para realizar pruebas y explorar las primeras fases de producción, pero que los precios, las limitaciones, las funciones incluidas y el comportamiento aún pueden cambiar más rápidamente que en una línea de modelos estable.

Los casos de uso más destacados son las tomas breves de productos, los conceptos de vídeo para redes sociales, las pruebas creativas animadas y las ediciones de vídeo en las que el cambio solicitado es específico. No se trata de un editor de vídeo completo para formatos largos. Es mejor entender los límites actuales de la vista previa como una herramienta de generación rápida de clips cortos, y no como un paquete completo de posproducción.
Cómo acceder a Gemini Omni Flash
Existen tres vías de acceso prácticas: la API Gemini, los planes de Google AI con créditos Flow y GlobalGPT Pro. Aunque se solapan, resuelven problemas distintos.
Opción 1: API Gemini
La ruta de la API Gemini está dirigida a desarrolladores y equipos técnicos. Resulta más adecuada cuando necesitas integrar Omni en un producto, ejecutar pruebas repetibles, generar clips a partir de indicaciones estructuradas o realizar un seguimiento de los costes a nivel de solicitud. La contrapartida es la configuración: necesitas un sistema de facturación, acceso a la API, gestión de solicitudes, almacenamiento y tu propio flujo de trabajo en torno a los reintentos y los archivos multimedia.
Para los equipos que ya están comparando los costes de generación de vídeo, la vía de la API es la forma más sencilla de calcular el coste por clip. Un vídeo de 10 segundos a 720p supone aproximadamente $1,00 en costes de salida de vídeo, sin tener en cuenta los tokens de entrada ni la infraestructura asociada. Los clips más cortos, de 3 y 8 segundos, son proporcionalmente más baratos.
Opción 2: Planes de IA de Google y créditos de Flow
Las suscripciones a Google AI resultan más sencillas para los creadores que deseen utilizar Omni a través de las interfaces creativas de Google. En Estados Unidos, el servicio de pago Planes de IA de Google Mostrar Omni Access y créditos mensuales de Flow: Plus a $4,99 con 200 créditos, Pro a $19,99 con 1.000 créditos, y Ultra a $99,99 con 10.000 créditos o a $199,99 con 25.000 créditos.

Los créditos de flujo no deben confundirse con la facturación de tokens de la API Gemini. Los créditos son una asignación para productos de consumo. Los tokens de la API son una unidad de facturación para desarrolladores. Si tu pregunta principal es “¿cuánto gastará mi aplicación por cada segundo generado?”, utiliza el precio de la API. Si tu pregunta principal es “¿cuántos intentos creativos tengo en Flow?”, utiliza el plan de IA de Google y la asignación de créditos.
Opción 3: GlobalGPT Pro
GlobalGPT Pro es la opción más práctica para los usuarios que quieran probar Gemini Omni Flash sin convertir la tarea en un proyecto de configuración de API. El precio anual actual es de $10,8 al mes si se factura anualmente, mientras que la promoción mensual actual ofrece la versión Pro a $15 al mes. GlobalGPT Pro también da acceso a la gama más amplia de modelos de la plataforma, excepto Google Veo 3.1.

El valor no radica en que GlobalGPT sustituya a la API Gemini. No es así. El valor radica en que muchos usuarios no necesitan una consola de API para realizar pruebas cotidianas. Necesitan un lugar en el que puedan alternar entre modelos, comparar resultados y crear sin tener que mantener abiertas suscripciones de pago independientes para cada proveedor.
Explicación de los precios de la API de Omni Flash Gemini
La tarifa de Google es concisa, pero la tarifa nominal por sí sola no permite determinar si Omni Flash ofrece una buena relación calidad-precio. La comparación más útil es el coste por clip correcto: lo que ofrece el modelo por el coste de la producción de vídeo una vez que se tienen en cuenta el cumplimiento de las instrucciones, los reintentos, la resolución y la fiabilidad del flujo de trabajo.
- Entrada: $1,50 por cada millón de tokens.
- Salida de texto: $9,00 por cada millón de tokens.
- Salida de vídeo: $17,50 por cada millón de tokens, lo que Google describe como aproximadamente $0,10 por segundo para un vídeo de 720p.
- Nivel gratuito de la API: No disponible para Omni Flash Gemini.
Coste estimado de la producción de vídeo en función de la duración
| Duración solicitada | Coste aproximado de la salida de vídeo API | Notas |
|---|---|---|
| 3 segundos | Acerca de $0.30 | Útil para pruebas rápidas de movimiento y transiciones |
| 8 segundos | Acerca de $0.80 | Una duración práctica para demostraciones de productos y vídeos para redes sociales |
| 10 segundos | Acerca de $1.00 | El límite superior del intervalo actual de duración de la API |
Estas estimaciones se basan en las recomendaciones de Google para la salida de vídeo en 720p. Los tokens de entrada, el almacenamiento, los reintentos y cualquier otro coste relacionado con la aplicación se calculan por separado.
¿El rendimiento de Omni Flash justifica el precio de la API?
No existe una puntuación de referencia pública única que traduzca la calidad del vídeo en una cifra clara de relación calidad-precio, por lo que nuestro conjunto de pruebas prácticas En este caso, resulta más útil que una puntuación sintética. Mide si el modelo ha devuelto el formato solicitado, ha conservado los detalles visuales clave, ha respetado los plazos de las acciones y ha completado el flujo de trabajo de forma fiable.
Comparativa práctica de relación calidad-precio
| Elemento medido | Resultado observado | Qué significa esto en términos de valor |
|---|---|---|
| Solicitudes básicas o de generación completadas | 5 de 5 | Tanto la conversión de texto a vídeo, la salida en formato vertical, la conversión de imagen a vídeo, un clip base como una secuencia temporizada generaron vídeos que se podían reproducir. |
| Material de vídeo válido y coste estimado de la producción del vídeo | 42 segundos para aproximadamente $4,27 | El precio de catálogo permitió obtener varios clips cortos útiles sin necesidad de un gran presupuesto para pruebas. |
| Tiempo de finalización controlado | Entre 25,7 y 39,2 segundos para tareas de entre 8 y 10 segundos de duración | Lo suficientemente rápido para el trabajo conceptual iterativo; estos tiempos no son mediciones de la velocidad de la interfaz GlobalGPT. |
| Formato y coherencia | Se han superado las pruebas en formato nativo 9:16 y con imagen de referencia | El precio resulta más fácil de justificar cuando la primera impresión ya tiene la orientación necesaria y conserva el motivo. |
| Edición de seguimiento con estado | 0 de 1; HTTP 502 | La fiabilidad de la edición puede aumentar el coste efectivo si el flujo de trabajo de producción depende de repeticiones. |
A la vista de estos datos, el precio de la API se adapta perfectamente a la ideación rápida, las tomas de producto, los conceptos para redes sociales y las pruebas de movimiento basadas en referencias. Un resultado de 8 o 10 segundos en 720p cuesta menos de un dólar o alrededor de un dólar en salida de vídeo, y las ejecuciones correctas se completan con la rapidez suficiente como para permitir una iteración inmediata.
El resultado es menos satisfactorio en el caso de trabajos de entrega final o de larga duración. La resolución máxima es de 720p y la duración, de 10 segundos; en nuestra prueba, la sincronización no fue exacta y la edición con estado falló en una ocasión. Un proyecto que requiera muchos reintentos, clips ensamblados, aumento de resolución o ediciones posteriores fiables puede resultar considerablemente más caro de lo que sugiere la tarifa por segundo anunciada.
Planes de IA de Google frente a GlobalGPT: ¿qué precio es el más razonable?
Estas opciones deben evaluarse en función del uso, más que repitiendo sus precios mensuales. Google vende capacidades cada vez mayores dentro de su propio entorno creativo. GlobalGPT distribuye el valor de la suscripción entre Omni y otros modelos. Ninguno de los dos enfoques consigue que el modelo Omni subyacente genere un mejor rendimiento simplemente porque el usuario elija un plan más caro.
Cómo interpretar la escala de precios de Google
La tabla es más importante que otro resumen de precios. Cada paso aumenta la asignación de Flow más rápido que la cuota mensual, por lo que el coste nominal por crédito incluido disminuye a medida que aumenta el compromiso de uso. Eso convierte a Pro en el nivel más equilibrado para el uso habitual de Flow, mientras que Ultra es una compra de capacidad para aquellos usuarios que realmente pueden consumir una asignación mucho mayor y beneficiarse de otras funciones premium de Google.
| Plan de IA de Google | Precio mensual en EE. UU. | Créditos de flujo | Coste nominal por crédito incluido | Mejor ajuste |
|---|---|---|---|---|
| IA Plus | $4.99 | 200 | Unos 2,50 céntimos | La opción oficial más económica para utilizar Flow de forma ocasional |
| AI Pro | $19.99 | 1,000 | Unos 2,00 céntimos | Creadores habituales que tienen previsto trabajar en Flow cada mes |
| AI Ultra | $99.99 | 10,000 | Aproximadamente 1,00 céntimo | Trabajos que requieren un gran volumen de flujo y usuarios que también valoran las funciones de Ultra |
| AI Ultra, opción de límite superior | $199.99 | 25,000 | Aproximadamente 0,80 céntimos | Un uso muy intensivo de las herramientas oficiales, en el que realmente se aprovechará al máximo la mayor asignación |
De Plus a Pro, la asignación se multiplica por cinco, mientras que la cuota se multiplica aproximadamente por cuatro, lo que reduce el coste nominal por crédito incluido en unos 20%. El primer nivel «Ultra» vuelve a duplicar esa eficiencia en comparación con el «Pro». Sobre el papel parece muy atractivo, pero un menor coste unitario no equivale a un menor gasto total: la capacidad no utilizada puede hacer que los planes «Plus» o «Pro» resulten más rentables, incluso cuando el «Ultra» ofrezca la mejor relación.
El resultado obtenido mediante la API, de 42 segundos de vídeo con éxito por aproximadamente $4,27, constituye una referencia útil en cuanto al rendimiento, pero no puede utilizarse para calcular cuántos clips de Omni generará un plan de Flow. Los créditos de Flow y los tokens de vídeo de la API son unidades de facturación diferentes, y el consumo de créditos en tiempo real de cada operación de Omni aún debe verificarse por separado.
Dónde encaja el GlobalGPT Pro
El valor de GlobalGPT es horizontal, en lugar de basarse en el volumen. Si Omni es el único modelo que tienes intención de utilizar, la API Gemini o un plan de Google AI resultan más fáciles de evaluar, ya que la unidad de facturación se corresponde directamente con las solicitudes o la capacidad de Flow. Si la misma suscripción se utiliza también para la redacción, la investigación, el trabajo con imágenes y las comparaciones entre varios modelos, su valor efectivo aumenta, ya que el coste se reparte entre más flujos de trabajo. No obstante, sigue sin sustituir a las funciones nativas de Flow ni al control de la API a nivel de desarrollador.

¿Qué opción resulta realmente rentable?
| Si eres… | Elige… | Por qué |
|---|---|---|
| Integrar Omni en una aplicación | API Géminis | Necesitas control sobre las solicitudes, costes predecibles por segundo e integración técnica. |
| Probar Omni en el proceso oficial de Google con la cuota mensual más baja | Google AI Plus | Limita el compromiso total, al tiempo que ofrece capacidad suficiente para evaluar si Flow se adapta al flujo de trabajo. |
| Crear y perfeccionar en Flow cada mes | Google IA Pro | En comparación con el plan Plus, la asignación crece más rápido que la cuota, lo que lo convierte en el nivel más equilibrado para un uso habitual. |
| Ejecución de trabajos de gran volumen en las herramientas creativas oficiales de Google | Google IA Ultra | Su rentabilidad por unidad solo alcanza su máximo nivel cuando se aprovechan realmente la elevada capacidad de Flow y las funciones adicionales de Google. |
| Probamos Omni junto con varios modelos de IA para el trabajo con contenidos | GlobalGPT Pro | Su valor aumenta en función del número de modelos y flujos de trabajo no relacionados con el vídeo que se utilicen, y no solo en función del volumen de producción de Omni. |
Si tu investigación sobre vídeos generados por IA va más allá de Omni, empieza por la comparación que mejor se adapte a tu próxima decisión. La Precios de la API de Sora 2 Esta guía resulta útil a la hora de comparar los costes de los desarrolladores, mientras que la Generación de vídeo Sora Esta guía facilita los flujos de trabajo de los creadores. En cuanto a las opciones de «modelo a modelo», la Veo 3.1 vs Sora 2 El desglose es la siguiente lectura más cercana.
Límites de Omni Flash en el Gemini que debes conocer
Omni Flash es muy potente, pero la vista previa tiene unas limitaciones claras. Es más importante conocerlas antes de gastar créditos que memorizar el anuncio de un modelo.

Duración y resolución
La versión preliminar actual de la API admite vídeos de De 3 a 10 segundos en 720p, tal y como se indica en el Notas de la versión de la API Gemini. Esto convierte a Omni Flash en un generador de clips cortos. Puede resultar excelente para momentos de producto, conceptos para redes sociales, transiciones y pruebas visuales rápidas, pero no está diseñado para generar un vídeo completo de varios minutos en una sola solicitud.
Relación de aspecto
Paisaje 16:9 es la configuración predeterminada. Vertical 9:16 También se puede solicitar, lo cual resulta útil para TikTok, Reels, Shorts y las pruebas publicitarias orientadas principalmente a dispositivos móviles.

De imagen a vídeo
Omni admite flujos de trabajo con imágenes de referencia. Esto es importante para las fotografías de productos, ya que permite partir de un punto de referencia visual en lugar de pedir al modelo que invente el objeto basándose únicamente en el texto. La imagen de referencia sigue necesitando una instrucción clara sobre el movimiento. Una buena indicación describe qué debe moverse, qué debe permanecer constante y cómo debe comportarse la cámara.

Edición de vídeo con estado
La API de Interacciones puede conservar el contexto del vídeo para ediciones posteriores a partir de una interacción previa. Para los usuarios, esto significa que pueden solicitar un cambio, como cambiar el color de un producto o ajustar un detalle de la escena, sin tener que reescribir toda la indicación original. Las mejores ediciones siguen siendo específicas y concretas.

Restricciones de la vista previa
La versión preliminar también presenta importantes restricciones técnicas. La documentación de Google enumera limitaciones relacionadas con la disponibilidad por regiones, los medios de referencia, la edición de voz, la interpolación, los parámetros avanzados y algunos controles de instrucciones. Los vídeos generados también incluyen SynthID, y los filtros de seguridad pueden afectar a los resultados.

La cuestión es sencilla: Omni Flash debería probarse como una herramienta en fase de avance: lo suficientemente sólida como para crear flujos de trabajo en torno a ella, pero no como una plataforma de producción totalmente consolidada sin supervisar los cambios.
Resultados de las pruebas prácticas del Omni Flash Gemini
Lo hemos probado igual gemini-omni-flash-preview modelo disponible en GlobalGPT Pro a través de un flujo de trabajo controlado por API.
En nuestras pruebas, hemos analizado cinco flujos de trabajo prácticos: conversión básica de texto a vídeo, salida nativa en formato 9:16, coherencia con la imagen de referencia, una edición de seguimiento con estado y una secuencia cronometrada de 10 segundos.
Cómo interpretar los resultados: Cada vídeo de salida va acompañado de sus datos de medición y notas de revisión. El tiempo de ejecución es el tiempo total medido en el flujo de trabajo controlado, no la velocidad de la interfaz GlobalGPT.
T1 · De texto a vídeo
Prueba de movimiento del latte art en un café
El patrón de roseta sigue siendo reconocible, el vapor sigue siendo visible y el movimiento de la mano es fluido en los fotogramas muestreados. La taza se levanta ligeramente por la parte central en lugar de girar únicamente sobre sí misma, por lo que el cumplimiento de las instrucciones fue bueno, aunque no exacto.
Para llevar: Un resultado aceptable con un gran realismo visual, pero los pequeños detalles de la acción física aún deben revisarse fotograma a fotograma.
Ver el mensaje exacto
Crea un vídeo fotorrealista de 8 segundos, en formato 16:9, en una sola toma continua. Una taza de cerámica con café con leche descansa sobre una mesa de café de nogal junto a una ventana iluminada por el sol. La mano de un barista gira suavemente la taza unos 30 grados, revelando un nítido dibujo de latte art en forma de roseta. Un vapor fino y realista se eleva de forma natural y se enrosca a la luz de la mañana; la superficie del líquido y el movimiento de la mano deben obedecer a las leyes de la física del mundo real. Utiliza un acercamiento lento y sutil de la cámara, poca profundidad de campo, luz natural cálida y un ambiente auténtico de cafetería. Sin diálogos, sin música, sin cortes, sin subtítulos, sin nombres de marcas visibles, sin logotipos y sin marcas de agua.
T2 · Vídeo vertical
9:16: prueba de apertura del producto
El resultado respeta el formato vertical solicitado. El estuche permanece centrado, la tapa se abre y ambos auriculares siguen siendo visibles. La mano permanece en el encuadre tras la apertura, pero la geometría del producto se mantiene estable y no aparece ningún logotipo ni texto en los fotogramas muestreados.
Para llevar: El Omni Flash Gemini puede generar un clip del producto en formato vertical auténtico, en lugar de una imagen recortada en formato apaisado.
Ver el mensaje exacto
Crea un vídeo fotorrealista del producto, de 8 segundos de duración, en formato vertical 9:16 y en una sola toma continua. Centra un estuche de carga sin cables para auriculares, de color azul cobalto mate, sobre un pedestal de estudio limpio de color gris claro. Una mano humana entra desde el borde inferior, abre la tapa con suavidad y muestra dos auriculares azules a juego. Al mismo tiempo, la cámara realiza una media órbita controlada desde la parte delantera izquierda hacia la derecha, manteniendo el estuche centrado y totalmente visible. Utiliza iluminación suave de estudio comercial, materiales realistas, geometría estable y una interacción precisa entre la mano y el objeto. Sin logotipos, sin texto, sin cortes, sin objetos adicionales, sin dedos distorsionados y sin marcas de agua.
T3 · De imagen a vídeo
Prueba de coherencia de la imagen de referencia
El cuerpo azul, el mango amarillo, el pico corto, la superficie de piedra y el contexto de la cocina iluminada por el sol se mantienen iguales. El vapor aparece tras el primer fotograma. El vídeo utiliza un encuadre ligeramente más amplio que la imagen original, por lo que la conservación es buena, aunque no se trata de una reproducción píxel a píxel.
Para llevar: La imagen de referencia sirvió para controlar la identidad de forma útil sin convertir la escena en un fotograma estático.
Ver las instrucciones exactas de la animación
Anima esta imagen de referencia para crear un vídeo fotorrealista de 8 segundos en formato 16:9. Mantén exactamente el cuerpo azul cobalto de la tetera, el asa de color amarillo brillante, las proporciones, la forma del pico, la posición sobre la mesa, la dirección de la iluminación y la composición general. Añade una fina columna de vapor realista que se eleve desde el pico, mientras la cámara realiza una órbita lenta y suave hacia la derecha de unos 20 grados. Mantén la tetera rígida y visualmente coherente con la imagen de referencia; no añadas, elimines, cambies el color ni modifiques la forma de ningún objeto. Sin texto, sin logotipos, sin cortes, sin personas y sin marcas de agua.
T4 · Edición con estado
Seguimiento de la bicicleta «de azul a rojo»
El vídeo base muestra correctamente a una mujer adulta con un impermeable amarillo junto a una bicicleta azul en buen estado en una calle mojada. El vídeo de seguimiento utilizó la misma sesión y se centró en el mensaje del vídeo base, pero la edición devolvió una respuesta 502 de «no streaming», sin contenido multimedia y sin evento de uso.
Para llevar: Esta ejecución no demuestra que la edición con estado funcione de forma fiable. Se trata de un intento fallido real, y no se ha podido evaluar la continuidad.
Ver indicaciones básicas y de seguimiento
Base: Crea un vídeo cinematográfico fotorrealista de 8 segundos, en formato 16:9, en un plano secuencia continuo. Una mujer adulta con un chubasquero amarillo brillante está de pie junto a una bicicleta urbana azul en una calle mojada, justo después de llover. Sujeta ligeramente el manillar mientras los reflejos brillan en el pavimento y caen algunas gotas de lluvia desde un toldo. Utiliza un movimiento lateral lento de la cámara, luz natural con cielo nublado, anatomía humana realista, geometría estable de la bicicleta y colores coherentes. Sin diálogos, sin texto, sin logotipo, sin cortes y sin marca de agua. Seguimiento: Cambia el color de la bicicleta de azul a rojo. Mantén todo lo demás igual.
T5 · Plazos y límites
Prueba de control de la línea temporal de 10 segundos
Muestras de límites observadas: La caja seguía cerrada a los 4,0 s, la tapa se abrió a los 4,5 s y las estrellas se hicieron visibles a los 6,5 s. La secuencia fue correcta, pero la primera transición comenzó más tarde de lo previsto.
Para llevar: El modelo siguió el orden de los eventos y devolvió el máximo completo de 10 segundos, pero la cronometría de segundo nivel era aproximada, en lugar de ser exacta al fotograma.
Ver el mensaje exacto
Crea un vídeo fotorrealista de estudio de 10 segundos, en formato 16:9, en un único plano continuo sin movimientos de cámara. Una pequeña caja de regalo de color rojo mate con un lazo dorado aparece colocada en el centro de una mesa de color neutro oscuro. Sigue exactamente esta secuencia temporal: [0-3 s] la caja permanece completamente cerrada e inmóvil; [3-6 s] la tapa se abre sola, de forma lenta y suave, mientras la caja se mantiene en su sitio; [6-10 s] varias estrellitas de papel dorado metalizado se elevan suavemente desde el interior de la caja abierta y flotan hacia arriba. Mantén la cámara, el fondo, la posición de la caja, la escala, la iluminación y la identidad del objeto sin cambios durante toda la toma. Sin personas, sin texto, sin logotipo, sin cortes, sin objetos adicionales, sin movimientos bruscos y sin marca de agua.
Consejos rápidos para evitar malgastar créditos
El precio de Omni Flash es lo suficientemente bajo como para animar a experimentar, pero las indicaciones mal utilizadas acaban sumando. Las mejores indicaciones son específicas sin llegar a ser excesivas.
Utiliza un plano secuencia cuando quieras estabilidad
Si quieres que el vídeo resulte coherente, di “toma única y continua” o “un movimiento de cámara ininterrumpido”. Así se reduce la probabilidad de que el modelo introduzca cortes bruscos o cambie de tema a mitad del vídeo.
Describe la cámara, no solo el sujeto
La descripción de un producto no debe limitarse a “una funda azul para auriculares”. Añade movimiento: “movimiento de cámara lento en media órbita”, “una mano abre la funda”, “suaves reflejos de estudio” o “la cámara se acerca ligeramente”. El lenguaje cinematográfico suele dar lugar a resultados más útiles que añadir más adjetivos al objeto.
Indica la relación de aspecto desde el principio
Para contenidos móviles, solicita directamente el formato 9:16. Para la página web o vídeos al estilo de YouTube, utiliza el formato 16:9. La relación de aspecto no es solo una cuestión de formato; influye en el espacio del que dispone la modelo para las manos, los productos y el movimiento del fondo.
En las modificaciones, limita el alcance del cambio
La edición con estado funciona mejor cuando la instrucción posterior es sencilla: “Cambia el color de la bicicleta de azul a rojo. Mantén todo lo demás igual”. Evita solicitar varios cambios no relacionados entre sí a la vez, a menos que no te suponga ningún problema pagar por los reintentos.
Para las acciones con duración determinada, utiliza intervalos de tiempo
Si el vídeo tiene una secuencia, utiliza corchetes como [0-3 s], [3-6 s], y [6-10 s]. Esto proporciona al modelo una estructura clara para el ritmo. No garantiza un control milimétrico, pero resulta mucho más claro que escribir la sincronización en un párrafo sin estructura.
¿Quién debería utilizar la API, Google Flow o GlobalGPT?
Utilice el API Géminis tanto si estás desarrollando, automatizando o realizando mediciones. La API es la opción adecuada cuando necesitas control programático, seguimiento del coste por solicitud y solicitudes repetibles.
Utilice Google Flow a través de un plan de IA de Google si ya te interesa el entorno creativo nativo de Google. Además, las versiones Pro y Ultra son una buena opción cuando el sistema de créditos se adapta a tu forma de crear y quieres tener acceso a las herramientas oficiales para usuarios finales.
Utilice GlobalGPT Pro si tu objetivo principal es utilizar Omni Flash Gemini junto con otros modelos líderes sin tener que gestionar suscripciones y consolas de API por separado. Actualmente, el plan Pro cuesta $10,8 al mes con facturación anual, o $15 al mes con la promoción mensual. Para muchos usuarios, ese es el valor práctico: Omni está disponible dentro de un espacio de trabajo más amplio en el que también puedes comparar otros modelos para la redacción, la planificación, la investigación y el trabajo creativo.

Elija GlobalGPT Ilimitado si utilizas tanto el modelo que te resulte más conveniente optar por un plan superior. El precio anual actual del plan «Ilimitado» es de $25 al mes, mientras que la promoción mensual actual ofrece el plan «Ilimitado» por $37 al mes.
Veredicto final
Gemini Omni Flash es uno de los modelos de vídeos cortos más interesantes a tener en cuenta, ya que combina la generación de vídeo, los medios de referencia y la edición conversacional en un paquete relativamente asequible. Con un coste aproximado de $0,10 por segundo para una salida de vídeo API a 720p, el coste resulta fácil de justificar. Las limitaciones también son claras: entre 3 y 10 segundos, 720p, estado de vista previa y varias restricciones técnicas en torno a la edición avanzada y los parámetros.
Si eres desarrollador, empieza por la API de Gemini y realiza un seguimiento del coste por segundo generado. Si ya utilizas las herramientas creativas de Google, compara los niveles del plan de IA de Google en función de los créditos Flow. Si simplemente quieres utilizar Gemini Omni Flash sin crear un flujo de trabajo de API, El espacio de trabajo de vídeo de GlobalGPT es la opción más directa para el día a día, sobre todo cuando quieres tener acceso Pro a otros modelos del mismo espacio de trabajo.
PREGUNTAS FRECUENTES
¿Es gratuito el Gemini Omni Flash?
No, no a través de la API de Gemini. Google clasifica Gemini Omni Flash como un modelo de API de pago sin nivel gratuito. Las suscripciones a Google AI pueden incluir créditos de Flow, pero esos créditos forman parte de la asignación de un plan para consumidores y no equivalen al acceso gratuito a la API.
¿Cuánto cuesta la API Omni Flash Gemini?
El precio de la API Omni Flash Gemini es de $1,50 por cada millón de tokens de entrada, $9 por cada millón de tokens de texto de salida y $17,50 por cada millón de tokens de vídeo de salida. Google describe el precio de la salida de vídeo como de aproximadamente $0,10 por segundo para vídeo de 720p.
¿Cuál es el ID del modelo de la API Omni Flash Gemini?
El ID del modelo de la API es gemini-omni-flash-preview.
¿Se incluye Omni Flash Gemini en Google AI Pro?
Sí. El plan Google AI Pro tiene un precio de $19,99 al mes e incluye 1.000 créditos de Flow con acceso a Omni.
¿El modelo GlobalGPT incluye el Gemini Omni Flash?
Sí. El plan GlobalGPT Pro incluye acceso a Gemini Omni Flash. El precio actual del plan Pro es de $10,8 al mes con facturación anual, o de $15 al mes con la promoción mensual vigente.
¿Cuáles son los límites de vídeo de Omni Flash Gemini?
La versión preliminar actual de la API permite generar vídeos de entre 3 y 10 segundos a 720p. El formato horizontal 16:9 es el predeterminado, aunque se puede solicitar el formato vertical 9:16.
¿El Omni Flash Gemini permite convertir imágenes en vídeo?
Sí. Gemini Omni Flash es compatible con flujos de trabajo basados en imágenes de referencia, por lo que los usuarios pueden proporcionar una imagen y pedir al modelo que genere movimiento a partir de esa referencia visual.
¿Se pueden editar vídeos ya grabados con el Omni Flash Gemini?
La documentación de Google admite la edición posterior con estado para los vídeos generados a través de la API de Interacciones. En nuestra única prueba práctica, el vídeo base se generó correctamente, pero la edición posterior devolvió un error HTTP 502 y no se obtuvo ningún archivo multimedia editado. Por lo tanto, conviene probar esta función con el flujo de trabajo exacto que necesites, sobre todo mientras el modelo se encuentre en fase de vista previa.

