O Gemini Omni Flash é o novo modelo em pré-lançamento do Google para geração de vídeo multimodal e edição conversacional de vídeo. Para usuários da API, o ID do modelo que você precisa saber é gemini-omni-flash-pré-visualização. O panorama geral dos preços é o seguinte: Preços da API do Gemini lista as saídas de vídeo em $17,50 por 1 milhão de tokens de saída de vídeo, que o Google descreve como sendo sobre $0,10 por segundo para vídeo em 720p.
O que causa confusão é que a expressão “preços do Gemini Omni Flash” pode ter três significados diferentes. Os desenvolvedores podem estar interessados nos preços dos tokens da API do Gemini. Já os criadores podem estar interessados nas assinaturas do Google AI e nos créditos do Flow. Os usuários comuns podem se preocupar menos com SDKs e mais com a possibilidade de abrir um espaço de trabalho e começar a gerar conteúdo com o modelo.
É nesse ponto que GlobalGPT se encaixa naturalmente. O GlobalGPT Pro agora inclui acesso ao Gemini Omni Flash, juntamente com a linha mais ampla de modelos da plataforma, com exceção do Google Veo 3.1. O atual Preço do GlobalGPT Pro é $10,8 por mês, quando cobrado anualmente, ou $15 por mês na promoção mensal atual. Para usuários que desejam experimentar o Omni sem precisar configurar chaves de API, projetos de cobrança ou chamadas de SDK, essa pode ser a opção mais simples.
A seguir, apresentamos um resumo prático: quanto custa o Omni por meio da API, o que os planos do Google AI incluem, quais limites se aplicam na versão de pré-lançamento e como escolher entre o acesso à API, o Google Flow e o GlobalGPT Pro.
Índice
- Preços do Omni Flash Gemini: a versão resumida
- O que é o Gemini Omni Flash?
- Como acessar o Gemini Omni Flash
- Explicação sobre os preços da API do Omni Flash Gemini
- Planos de IA do Google vs GlobalGPT
- Limites do Omni Flash Gemini
- Resultados dos testes práticos do Gemini Omni Flash
- Dicas rápidas para evitar o desperdício de créditos
- Quem deve usar a API, o Flow ou o GlobalGPT?
- PERGUNTAS FREQUENTES
Preços do Omni Flash Gemini: a versão resumida
Se você precisar apenas dos números, o Gemini Omni Flash é um modelo pago na API do Gemini. Não há um plano gratuito da API para o Omni Flash. As assinaturas pagas do Google AI também incluem acesso ao Omni por meio de créditos do Flow, enquanto o GlobalGPT Pro oferece aos usuários uma opção multimodelo mais simples quando eles não querem se preocupar com a configuração da API.
| Rota de acesso | Preço confirmado | Melhor ajuste | Atenção especial |
|---|---|---|---|
| API Gemini | $1,50 / 1 milhão de tokens de entrada; $9 / 1 milhão de tokens de saída de texto; $17,50 / 1 milhão de tokens de saída de vídeo; cerca de $0,10 por segundo para vídeo em 720p | Desenvolvedores, equipes de produto, automação, testes em lote | Não há plano gratuito para a API; requer configuração da API e monitoramento do uso |
| Google AI Plus | $4,99 por mês, 200 créditos de tráfego | Testes preliminares nas ferramentas criativas do Google para o consumidor | O custo exato dos créditos Omni por geração ainda precisa ser verificado no Flow em tempo real antes da publicação de uma tabela de créditos por vídeo |
| Google AI Pro | $19,99 por mês, 1.000 créditos de tráfego | Criadores que já trabalham no Google Flow | Os créditos são úteis, mas não são a mesma coisa que o faturamento por API |
| Google AI Ultra | $99,99 por mês com 10.000 créditos do Flow, ou $199,99 por mês com 25.000 créditos do Flow | Usuários assíduos do Google Flow e fluxos de trabalho criativos de grande volume | Um aumento nos gastos mensais só faz sentido se o Flow já for fundamental para o fluxo de trabalho |
| GlobalGPT Pro | $10,8 por mês no caso de cobrança anual; $15 por mês na promoção mensal atual | Usuários que desejam o Omni e vários modelos de IA em uma única assinatura | Não substitui o console da API para desenvolvedores nem todos os recursos oficiais dos aplicativos do Google |

O que é o Gemini Omni Flash?
O Gemini Omni Flash é um modelo de vídeo de pré-visualização na API Gemini. O Google’s Documentação da API Omni baseia-se na multimodalidade nativa, na edição conversacional e no conhecimento do mundo. Na prática, foi projetado para gerar vídeos curtos a partir de texto, utilizar imagens de referência e manter contexto suficiente para edições posteriores, quando o fluxo de trabalho permitir.
O ID do modelo da API é gemini-omni-flash-pré-visualização. A palavra “pré-visualização” é importante. Significa que o modelo está disponível para testes e exploração inicial de produção, mas os preços, limites, cobertura de recursos e comportamento ainda podem mudar mais rapidamente do que em uma linha de modelos estáveis.

Os principais casos de uso são imagens curtas de produtos, conceitos de vídeo para redes sociais, testes criativos animados e edições de vídeo em que a alteração solicitada é específica. Não se trata de um editor completo de vídeos de longa duração. Os limites atuais da visualização devem ser entendidos como uma camada de geração rápida para clipes curtos, e não como um pacote completo de pós-produção.
Como acessar o Gemini Omni Flash
Existem três formas práticas de acesso: a API Gemini, os planos de IA do Google com créditos Flow e o GlobalGPT Pro. Elas se sobrepõem, mas resolvem problemas diferentes.
Opção 1: API Gemini
A rota da API Gemini é destinada a desenvolvedores e equipes técnicas. Ela faz mais sentido quando você precisa integrar o Omni a um produto, executar testes repetíveis, gerar clipes a partir de prompts estruturados ou acompanhar os custos no nível das solicitações. A desvantagem está na configuração: você precisa de faturamento, acesso à API, gerenciamento de solicitações, armazenamento e seu próprio fluxo de trabalho para novas tentativas e arquivos de mídia.
Para equipes que já estão comparando os custos de geração de vídeo, a abordagem via API é a maneira mais simples de calcular o custo por clipe. Uma saída de 10 segundos em 720p custa aproximadamente $1,00 em custos de saída de vídeo, sem considerar os tokens de entrada e a infraestrutura associada. Clipes mais curtos, de 3 e 8 segundos, são proporcionalmente mais baratos.
Opção 2: Planos de IA do Google e créditos do Flow
As assinaturas do Google AI facilitam a vida dos criadores que desejam usar o Omni por meio das interfaces criativas do Google. Nos Estados Unidos, o serviço pago Planos de IA do Google Mostrar o Omni Access e os créditos mensais do Flow: Plus por $4,99 com 200 créditos, Pro por $19,99 com 1.000 créditos e Ultra por $99,99 com 10.000 créditos ou $199,99 com 25.000 créditos.

Os créditos de fluxo não devem ser confundidos com o faturamento por tokens da API Gemini. Os créditos são uma cota destinada ao consumidor final. Os tokens da API são uma unidade de cobrança para desenvolvedores. Se sua dúvida principal for “quanto meu aplicativo gastará por segundo gerado?”, use o preço da API. Se sua dúvida principal for “quantas tentativas criativas eu tenho no Flow?”, use o plano de IA do Google e a cota de créditos.
Opção 3: GlobalGPT Pro
O GlobalGPT Pro é a opção mais prática para usuários que desejam experimentar o Gemini Omni Flash sem transformar a tarefa em um projeto de configuração de API. O preço anual atual é de $10,8 por mês, quando cobrado anualmente, enquanto a promoção mensal atual oferece o Pro por $15 por mês. O GlobalGPT Pro também dá acesso à linha mais ampla de modelos da plataforma, com exceção do Google Veo 3.1.

O valor não está no fato de a GlobalGPT substituir a API Gemini. Isso não acontece. O valor está no fato de que muitos usuários não precisam de um console de API para os testes do dia a dia. Eles precisam de um lugar onde possam alternar entre modelos, comparar resultados e criar, sem precisar manter assinaturas pagas separadas para cada provedor.
Explicação sobre os preços da API do Omni Flash Gemini
A tabela de preços do Google é concisa, mas a tarifa nominal, por si só, não indica se o Omni Flash oferece um bom custo-benefício. A comparação mais útil é o custo por clipe bem-sucedido: o que o modelo oferece em termos de custo de produção de vídeo, levando em conta o cumprimento das instruções, as tentativas de repetição, a resolução e a confiabilidade do fluxo de trabalho.
- Entrada: $1,50 por 1 milhão de tokens.
- Saída de texto: $9,00 por 1 milhão de tokens.
- Saída de vídeo: $17,50 por 1 milhão de tokens, o que o Google descreve como cerca de $0,10 por segundo para um vídeo em 720p.
- Nível gratuito da API: Não disponível para o Gemini Omni Flash.
Custo estimado da produção de vídeo por duração
| Duração solicitada | Custo aproximado da saída de vídeo API | Notas |
|---|---|---|
| 3 segundos | Sobre o $0.30 | Útil para testes rápidos de movimento e transições |
| 8 segundos | Sobre o $0.80 | Uma duração prática para demonstrações de produtos e vídeos para redes sociais |
| 10 segundos | Sobre o $1.00 | O limite superior do intervalo atual de duração da API |
Essas estimativas utilizam as orientações do Google para saída de vídeo em 720p. Os tokens de entrada, o armazenamento, as tentativas de repetição e quaisquer custos relacionados ao aplicativo são cobrados separadamente.
O desempenho do Omni Flash justifica o preço da API?
Não existe um único índice de referência público que transforme a qualidade do vídeo em um valor claro de custo-benefício; portanto, nossa conjunto de testes práticos É mais útil do que uma pontuação sintética neste caso. Ela avalia se o modelo retornou o formato solicitado, preservou os principais detalhes visuais, seguiu as ações cronometradas e concluiu o fluxo de trabalho de maneira confiável.
Teste prático de relação custo-benefício
| Item medido | Resultado observado | O que isso significa em termos de valor |
|---|---|---|
| Solicitações de base ou de geração concluídas | 5 de 5 | A conversão de texto em vídeo, a saída no formato retrato, a conversão de imagem em vídeo, um clipe base e uma sequência cronometrada geraram vídeos que puderam ser reproduzidos. |
| Material filmado com sucesso e custo estimado da produção do vídeo | 42 segundos para cerca de $4,27 | O preço de tabela permitiu a produção de vários clipes curtos úteis sem a necessidade de um orçamento elevado para testes. |
| Tempo de conclusão controlado | 25,7 a 39,2 segundos para tarefas concluídas em 8 a 10 segundos | Rápido o suficiente para o trabalho iterativo de concepção; esses tempos não são medições da velocidade da interface GlobalGPT. |
| Formato e consistência | Testes no formato nativo 9:16 e com imagem de referência foram aprovados | O preço é mais fácil de justificar quando a primeira impressão já apresenta a orientação necessária e mantém o objeto em foco. |
| Edição de acompanhamento com estado | 0 de 1; HTTP 502 | A confiabilidade da edição pode aumentar o custo efetivo se o fluxo de trabalho de produção depender de novas tentativas. |
Com base nessas evidências, o preço da API é bastante adequado para ideias rápidas, imagens de produtos, conceitos para redes sociais e testes de movimento baseados em referência. Um resultado em 720p de 8 ou 10 segundos custa menos de um dólar ou cerca de um dólar em saída de vídeo, e as execuções bem-sucedidas são concluídas com rapidez suficiente para permitir iterações imediatas.
O desempenho é inferior em trabalhos de entrega final ou de longa duração. A saída é limitada a 720p e 10 segundos; a duração exata foi aproximada em nosso teste, e a edição com estado falhou uma vez. Um projeto que exija muitas tentativas, clipes unificados, aumento de resolução ou edições subsequentes confiáveis pode custar significativamente mais do que a tarifa por segundo anunciada sugere.
Planos de IA do Google x GlobalGPT: qual preço faz sentido?
Essas opções devem ser avaliadas com base na utilização, e não pela repetição de seus preços mensais. O Google vende capacidades cada vez maiores dentro de seu próprio ambiente criativo. O GlobalGPT distribui o valor da assinatura entre o Omni e outros modelos. Nenhuma das duas abordagens faz com que o modelo Omni subjacente gere um melhor desempenho simplesmente porque o usuário escolhe um plano mais caro.
Como interpretar a tabela de preços do Google
A tabela é mais importante do que mais um resumo de preços. Cada nível aumenta a cota do Flow mais rapidamente do que a cobrança mensal; assim, o custo nominal por crédito incluído diminui à medida que o compromisso de uso aumenta. Isso torna o plano Pro a opção mais equilibrada para o uso regular do Flow, enquanto o plano Ultra é uma aquisição de capacidade para usuários que realmente podem consumir uma cota muito maior e se beneficiar de outros recursos premium do Google.
| Plano de IA do Google | Preço mensal nos EUA | Créditos de fluxo | Custo nominal por crédito incluído | Melhor ajuste |
|---|---|---|---|---|
| AI Plus | $4.99 | 200 | Cerca de 2,50 centavos | A opção oficial mais econômica para o uso ocasional do Flow |
| AI Pro | $19.99 | 1,000 | Cerca de 2,00 centavos | Criadores regulares que pretendem realizar iterações no Flow a cada mês |
| AI Ultra | $99.99 | 10,000 | Cerca de 1,00 centavo | Trabalhos que envolvem fluxos de alto volume e usuários que também valorizam os recursos do Ultra |
| AI Ultra, opção com limite mais alto | $199.99 | 25,000 | Cerca de 0,80 centavo | Uso muito intenso de ferramentas oficiais, em que a cota maior será efetivamente utilizada |
Do plano Plus ao Pro, o limite de uso aumenta cinco vezes, enquanto a mensalidade cresce cerca de quatro vezes, reduzindo o custo nominal por crédito incluído em aproximadamente 20%. O primeiro nível Ultra dobra essa eficiência novamente em comparação com o Pro. Isso parece excelente no papel, mas um custo unitário mais baixo não significa necessariamente um gasto total menor: a capacidade não utilizada pode tornar o Plus ou o Pro a opção mais vantajosa, mesmo quando o Ultra apresenta a melhor relação custo-benefício.
O resultado prático da API, de 42 segundos de vídeo bem-sucedidos para cerca de $4,27, é uma referência útil de desempenho, mas não pode ser usado para calcular quantos clipes Omni um plano Flow irá produzir. Os créditos do Flow e os tokens de vídeo da API são unidades de cobrança diferentes, e o consumo de créditos em tempo real para cada operação do Omni ainda precisa ser verificado separadamente.
Onde o GlobalGPT Pro se encaixa
O valor do GlobalGPT é horizontal, e não baseado em volume. Se o Omni for o único modelo que você pretende usar, a API Gemini ou um plano do Google AI são mais fáceis de avaliar, pois a unidade de cobrança se corresponde diretamente às solicitações ou à capacidade do Flow. Se a mesma assinatura também for usada para redação, pesquisa, trabalho com imagens e comparações entre vários modelos, seu valor efetivo aumenta, pois o custo é dividido entre mais fluxos de trabalho. No entanto, isso ainda não substitui os recursos nativos do Flow nem o controle da API no nível do desenvolvedor.
Qual opção é, de fato, mais econômica?
| Se você é… | Escolha… | Por que |
|---|---|---|
| Incorporando o Omni a um aplicativo | API Gemini | Você precisa de controle de solicitações, custos previsíveis por segundo e integração técnica. |
| Experimentando o Omni no Google Flow oficial com o menor valor mensal mínimo | Google AI Plus | Isso limita o compromisso total, ao mesmo tempo em que oferece capacidade suficiente para avaliar se o Flow se adapta ao fluxo de trabalho. |
| Criando e aprimorando no Flow todos os meses | Google AI Pro | A franquia cresce mais rapidamente do que a mensalidade em comparação com o plano Plus, tornando-o o plano de uso regular mais equilibrado. |
| Execução de trabalhos de grande volume nas ferramentas criativas oficiais do Google | Google AI Ultra | Sua rentabilidade por unidade só é máxima quando a alta capacidade do Flow e os recursos adicionais do Google são realmente utilizados. |
| Testando o Omni em conjunto com vários modelos de IA para trabalhos de conteúdo | GlobalGPT Pro | Seu valor aumenta com o número de modelos e fluxos de trabalho que não envolvem vídeo utilizados, e não apenas com o volume de produção do Omni. |
Se sua pesquisa sobre vídeos com IA for além do Omni, comece com a comparação que melhor se adequa à sua próxima decisão. A Preços da API Sora 2 esse guia é útil quando você está comparando custos de desenvolvedores, enquanto o Geração de vídeo Sora Este guia auxilia nos fluxos de trabalho dos criadores. Para escolhas entre modelos, o Veo 3.1 vs Sora 2 A análise detalhada é a próxima leitura mais relevante.
Limites do Omni Flash Gemini que você deve conhecer
O Omni Flash é poderoso, mas a visualização prévia tem limites bem definidos. Entender esses limites antes de gastar créditos é mais importante do que memorizar o anúncio de um modelo.

Duração e resolução
A versão prévia atual da API oferece suporte a vídeos de 3 a 10 segundos em 720p, conforme observado no site do Google Notas de lançamento da API Gemini. Isso faz do Omni Flash um gerador de clipes curtos. Ele pode ser excelente para momentos de produto, conceitos para redes sociais, transições e testes visuais rápidos, mas não foi projetado para gerar um vídeo completo de vários minutos em uma única solicitação.
Proporção da imagem
Paisagem 16:9 é a configuração padrão. Retrato 9:16 também pode ser solicitado, o que é útil para o TikTok, Reels, Shorts e testes de anúncios voltados para dispositivos móveis.

Imagem para vídeo
O Omni oferece suporte a fluxos de trabalho com imagens de referência. Isso é importante para fotos de produtos, pois permite começar com um ponto de referência visual, em vez de pedir ao modelo que crie o objeto apenas a partir do texto. A imagem de referência ainda precisa de uma instrução clara sobre o movimento. Um bom prompt descreve o que deve se mover, o que deve permanecer constante e como a câmera deve se comportar.

Edição de vídeo com estado
A API de Interações pode preservar o contexto do vídeo para edições posteriores com base em uma interação anterior. Para os usuários, isso significa que é possível solicitar uma alteração, como trocar a cor de um produto ou ajustar um detalhe da cena, sem precisar reescrever todo o prompt original. As melhores edições continuam sendo específicas e concretas.

Restrições à visualização
A versão de pré-visualização também apresenta restrições técnicas importantes. A documentação do Google lista limitações relacionadas à disponibilidade por região, mídia de referência, edição de voz, interpolação, parâmetros avançados e alguns controles de instruções. Os vídeos gerados também incluem o SynthID, e os filtros de segurança podem afetar os resultados.

A questão, em resumo, é que o Omni Flash deve ser testado como uma ferramenta em fase de pré-lançamento: robusta o suficiente para que se criem fluxos de trabalho em torno dela, mas não algo que deva ser tratado como um ambiente de produção totalmente consolidado, sem o acompanhamento das alterações.
Resultados do teste prático do Omni Flash Gemini
Testamos o mesmo gemini-omni-flash-pré-visualização modelo disponível no GlobalGPT Pro por meio de um fluxo de trabalho controlado por API.
Em nossos testes, analisamos cinco fluxos de trabalho práticos: conversão básica de texto para vídeo, saída nativa no formato 9:16, consistência com a imagem de referência, uma edição de acompanhamento com estado e uma sequência cronometrada de 10 segundos.
Como interpretar os resultados: Cada vídeo de saída é associado aos seus dados de medição e notas de revisão. O tempo de execução é o tempo total medido no fluxo de trabalho controlado, e não a velocidade da interface GlobalGPT.
T1 · De texto para vídeo
Teste de movimento na arte do café latte
O padrão em forma de roseta permanece reconhecível, o vapor continua visível e a interação com as mãos é precisa nos quadros capturados. A xícara é levantada levemente na região do ponto médio, em vez de apenas girar no lugar; portanto, o cumprimento das instruções foi bom, mas não exato.
Conclusão: Um resultado satisfatório com forte realismo visual, mas os pequenos detalhes da ação física ainda precisam ser revisados quadro a quadro.
Ver o prompt exato
Crie um vídeo fotorrealista de 8 segundos, no formato 16:9, em uma única tomada contínua. Uma xícara de cerâmica com café com leite está sobre uma mesinha de café de nogueira ao lado de uma janela iluminada pelo sol. A mão de um barista gira suavemente a xícara cerca de 30 graus, revelando um padrão nítido de latte art em forma de roseta. Um vapor fino e realista sobe naturalmente e se enrola à luz da manhã; a superfície do líquido e o movimento da mão devem obedecer às leis da física do mundo real. Use um movimento lento e sutil de aproximação da câmera, profundidade de campo rasa, luz natural quente e um ambiente autêntico de café. Sem diálogos, sem música, sem cortes, sem legendas, sem nomes de marcas visíveis, sem logotipos e sem marca d’água.
T2 · Vídeo na vertical
9h16: teste de abertura do produto
A imagem final respeitou o formato retrato solicitado. O estojo permanece centralizado, a tampa se abre e os dois fones de ouvido continuam visíveis. A mão permanece no enquadramento após a abertura, mas a geometria do produto se mantém estável e nenhum logotipo ou texto aparece nos quadros capturados.
Conclusão: O Gemini Omni Flash pode gerar um clipe do produto em formato vertical genuíno, em vez de uma imagem final recortada no formato paisagem.
Ver o prompt exato
Crie um vídeo fotorrealista do produto, com duração de 8 segundos, no formato vertical 9:16, em uma única tomada contínua. Centralize um estojo de recarga sem fio para fones de ouvido, na cor azul cobalto fosco, sobre um pedestal de estúdio cinza-claro e limpo. Uma mão humana entra pela borda inferior, abre a tampa suavemente e revela dois fones de ouvido azuis combinando. Ao mesmo tempo, a câmera realiza uma meia órbita controlada da frente esquerda para a frente direita, mantendo o estojo centralizado e totalmente visível. Use iluminação suave de estúdio comercial, materiais realistas, geometria estável e interação precisa entre a mão e o objeto. Sem logotipo, sem texto, sem cortes, sem objetos extras, sem dedos distorcidos e sem marca d’água.
T3 · Imagem para vídeo
Teste de consistência da imagem de referência
O corpo azul, a alça amarela, o bico curto, a superfície de pedra e o ambiente da cozinha iluminada pelo sol permanecem inalterados. O vapor aparece após o primeiro quadro. O vídeo utiliza um enquadramento ligeiramente mais amplo do que a imagem original; portanto, a preservação é fiel, embora não seja idêntica em nível de pixel.
Conclusão: A imagem de referência proporcionou um controle útil da identidade sem transformar a cena em um quadro estático.
Ver a instrução exata da animação
Transforme esta imagem de referência em um vídeo fotorrealista de 8 segundos, no formato 16:9. Preserve exatamente o corpo azul-cobalto do bule, a alça amarela brilhante, as proporções, o formato do bico, a posição sobre a mesa, a direção da iluminação e a composição geral. Adicione um fino jato de vapor realista saindo do bico, enquanto a câmera faz uma órbita lenta e suave para a direita de cerca de 20 graus. Mantenha o bule rígido e visualmente consistente com a referência; não adicione, remova, altere a cor ou modifique a forma de nenhum objeto. Sem texto, sem logotipo, sem cortes, sem pessoas e sem marca d’água.
T4 · Edição com estado
Acompanhamento da bicicleta “azul para vermelho”
O clipe base mostra corretamente uma mulher adulta vestindo uma capa de chuva amarela ao lado de uma bicicleta azul em bom estado, em uma rua molhada. A continuação utilizou a mesma sessão e teve como alvo a mensagem do vídeo base que persistia, mas a edição retornou uma resposta 502 (sem streaming), sem mídia e sem evento de uso.
Conclusão: Essa execução não comprova que a edição com estado funcione de maneira confiável. Trata-se de uma tentativa fracassada de fato, e não foi possível avaliar a continuidade.
Visualizar instruções básicas e de acompanhamento
Base: Crie um vídeo cinematográfico fotorrealista de 8 segundos, no formato 16:9, em uma única tomada contínua. Uma mulher adulta vestindo uma capa de chuva amarela brilhante está ao lado de uma bicicleta urbana azul em uma rua molhada da cidade, logo após a chuva. Ela segura levemente o guidão enquanto reflexos cintilam no asfalto e algumas gotas de chuva caem de um toldo. Use um movimento lateral lento da câmera, luz natural de dia nublado, anatomia humana realista, geometria estável da bicicleta e cores consistentes. Sem diálogo, sem texto, sem logotipo, sem cortes e sem marca d’água. Seguimento: Mude a cor da bicicleta de azul para vermelho. Mantenha todo o resto igual.
T5 · Tempos e limites
Teste de controle de linha do tempo de 10 segundos
Amostras de fronteira observadas: A caixa ainda estava fechada aos 4,0 s, a tampa estava aberta aos 4,5 s e as estrelas ficaram visíveis aos 6,5 s. A sequência estava correta, mas a primeira transição começou mais tarde do que o solicitado.
Conclusão: O modelo seguiu a ordem dos eventos e retornou o tempo máximo total de 10 segundos, mas a medição de tempo de segundo nível foi aproximada, em vez de exata ao quadro.
Ver o prompt exato
Crie um vídeo fotorrealista de estúdio com duração de 10 segundos, no formato 16:9, em uma única tomada contínua com a câmera fixa. Uma pequena caixa de presente vermelha fosca com uma fita dourada está posicionada no centro de uma mesa de cor neutra escura. Siga exatamente esta linha do tempo: [0-3s] a caixa permanece completamente fechada e imóvel; [3-6s] a tampa se abre devagar e suavemente por conta própria, enquanto a caixa permanece no lugar; [6-10s] várias pequenas estrelas de papel dourado metálico surgem suavemente de dentro da caixa aberta e flutuam para cima. Mantenha a câmera, o fundo, a posição da caixa, a escala, a iluminação e a identidade do objeto inalterados durante toda a tomada. Sem pessoas, sem texto, sem logotipo, sem cortes, sem objetos extras, sem movimentos bruscos e sem marca d’água.
Dicas rápidas para evitar o desperdício de créditos
O preço do Omni Flash é baixo o suficiente para incentivar a experimentação, mas as instruções desperdiçadas acabam pesando no bolso. As melhores instruções são específicas, sem serem excessivamente detalhadas.
Use uma tomada contínua quando quiser estabilidade
Se o vídeo precisar parecer coerente, diga “tomada única e contínua” ou “um movimento de câmera ininterrupto”. Isso reduz a chance de o modelo inventar cortes abruptos ou mudar de assunto no meio do vídeo.
Descreva a câmera, não apenas o objeto
Uma descrição de produto não deve se limitar a “um estojo azul para fones de ouvido”. Acrescente movimento: “movimento lento da câmera em meia órbita”, “a mão abre o estojo”, “reflexos suaves de estúdio” ou “a câmera se aproxima levemente”. A linguagem cinematográfica geralmente produz resultados mais úteis do que simplesmente adicionar mais adjetivos ao objeto.
Defina a proporção da imagem logo no início
Para conteúdo móvel, solicite diretamente a proporção 9:16. Para sites ou vídeos no estilo do YouTube, use a proporção 16:9. A proporção da imagem não é apenas uma escolha de formatação; ela determina quanto espaço a modelo tem para as mãos, os produtos e o movimento do fundo.
Ao fazer edições, mantenha a alteração específica
A edição com estado funciona melhor quando a instrução seguinte é simples: “Mude a cor da bicicleta de azul para vermelho. Mantenha todo o resto igual.” Evite solicitar várias alterações não relacionadas de uma só vez, a menos que você esteja disposto a arcar com os custos de novas tentativas.
Para ações com duração determinada, use intervalos de tempo
Se o clipe tiver uma sequência, use colchetes como [0-3s], [3-6 s], e [6 a 10 s]. Isso confere ao modelo uma estrutura visível para o ritmo. Não garante um controle perfeito em cada quadro, mas é muito mais claro do que descrever o ritmo em um parágrafo vago.
Quem deve usar a API, o Google Flow ou o GlobalGPT?
Use o API Gemini se você estiver desenvolvendo, automatizando ou realizando medições. A API é a escolha certa quando você precisa de controle programático, acompanhamento de custos por solicitação e solicitações repetíveis.
Uso O Google Flow como parte de um plano de IA do Google Se você já deseja utilizar o ambiente criativo nativo do Google. Além disso, as versões Pro e Ultra fazem sentido quando o sistema de créditos se adapta à sua forma de criar e você deseja ter acesso oficial às ferramentas para consumidores.
Uso GlobalGPT Pro se o seu objetivo principal for usar o Gemini Omni Flash junto com outros modelos líderes sem precisar gerenciar assinaturas e consoles de API separados. Atualmente, o plano Pro custa $10,8 por mês no faturamento anual, ou $15 por mês na promoção mensal. Para muitos usuários, esse é o valor prático: o Omni está disponível dentro de um espaço de trabalho mais amplo, onde você também pode comparar outros modelos para redação, planejamento, pesquisa e trabalho criativo.

Escolha GlobalGPT Ilimitado se o uso do seu plano for alto o suficiente para que um plano maior seja mais vantajoso. O preço anual atual do plano Ilimitado é de $25 por mês, enquanto a promoção mensal atual oferece o plano Ilimitado por $37 por mês.
Veredicto final
O Gemini Omni Flash é um dos modelos de vídeos curtos mais interessantes de se acompanhar, pois combina geração de vídeo, mídia de referência e edição conversacional em um pacote relativamente acessível. A cerca de $0,10 por segundo para saída de vídeo em 720p via API, o custo é fácil de avaliar. Os limites também são claros: 3 a 10 segundos, 720p, status de pré-visualização e várias restrições técnicas relacionadas à edição avançada e aos parâmetros.
Se você é desenvolvedor, comece com a API Gemini e acompanhe o custo por segundo gerado. Se você já utiliza as ferramentas criativas do Google, compare os níveis do plano de IA do Google com base nos créditos do Flow. Se você simplesmente deseja usar o Gemini Omni Flash sem criar um fluxo de trabalho de API, Espaço de trabalho de vídeo do GlobalGPT é a opção mais prática para o dia a dia, especialmente quando você deseja acesso Pro a outros modelos no mesmo espaço de trabalho.
PERGUNTAS FREQUENTES
O Gemini Omni Flash é gratuito?
Não, não por meio da API Gemini. O Google classifica a Gemini Omni Flash como um modelo de API de plano pago, sem nível gratuito. As assinaturas do Google AI podem incluir créditos do Flow, mas esses créditos são uma cota do plano para consumidores, o que não é a mesma coisa que acesso gratuito à API.
Quanto custa a API Omni Flash Gemini?
O preço da API Omni Flash Gemini é de $1,50 por 1 milhão de tokens de entrada, $9 por 1 milhão de tokens de saída de texto e $17,50 por 1 milhão de tokens de saída de vídeo. O Google descreve o preço da saída de vídeo como cerca de $0,10 por segundo para vídeos em 720p.
Qual é o ID do modelo da API do Omni Flash Gemini?
O ID do modelo da API é gemini-omni-flash-pré-visualização.
O Omni Flash Gemini está incluído no Google AI Pro?
Sim. O plano Google AI Pro custa $19,99 por mês e inclui 1.000 créditos do Flow com acesso ao Omni.
O GlobalGPT inclui o Gemini Omni Flash?
Sim. O GlobalGPT Pro inclui acesso ao Gemini Omni Flash. O preço atual do plano Pro é de $10,8 por mês, com cobrança anual, ou $15 por mês, de acordo com a promoção mensal atual.
Quais são os limites de vídeo do Gemini Omni Flash?
A versão prévia atual da API oferece suporte à geração de vídeos de 3 a 10 segundos em 720p. O formato paisagem 16:9 é o padrão, e o formato retrato 9:16 pode ser solicitado.
O Gemini Omni Flash é capaz de converter imagens em vídeo?
Sim. O Gemini Omni Flash é compatível com fluxos de trabalho com imagens de referência, de modo que os usuários podem fornecer uma imagem e solicitar que o modelo gere movimento a partir dessa referência visual.
O Omni Flash Gemini consegue editar vídeos já gravados?
A documentação do Google oferece suporte à edição posterior com manutenção de estado para vídeos gerados por meio da API Interactions. Em nossa única tentativa prática, o vídeo original foi gerado com sucesso, mas a edição posterior retornou um código de erro HTTP 502 e não gerou nenhuma mídia editada. Portanto, o recurso deve ser testado de acordo com o fluxo de trabalho exato de que você precisa, especialmente enquanto o modelo ainda estiver em fase de pré-visualização.




