Gemini Omni Flash는 다중 모달 영상 생성 및 대화형 영상 편집을 위한 구글의 새로운 프리뷰 모델입니다. API 사용자의 경우, 알아두어야 할 모델 ID는 다음과 같습니다. gemini-omni-flash-preview. 가격 구조는 간단히 말해 다음과 같습니다: Gemini API 요금 다음 위치에 비디오 출력을 나열합니다. 동영상 출력 토큰 100만 개당 $17.50, 구글은 이를 다음과 같이 설명하고 있습니다. 720p 동영상의 경우 초당 $0.10.
혼란스러운 점은 “Gemini Omni Flash 가격”이 세 가지 서로 다른 의미를 가질 수 있다는 것입니다. 개발자들은 Gemini API 토큰 가격에 관심을 가질 수 있고, 크리에이터들은 Google AI 구독 및 Flow 크레딧에 관심을 가질 수 있습니다. 일반 사용자들은 SDK보다는 하나의 워크스페이스를 열고 모델을 이용해 바로 콘텐츠를 생성할 수 있는지 여부에 더 관심을 가질 수 있습니다.
여기에서 GlobalGPT 자연스럽게 어울립니다. GlobalGPT Pro는 이제 Gemini Omni Flash 액세스 기능을 포함하며, Google Veo 3.1을 제외한 플랫폼의 더 폭넓은 모델 라인업을 지원합니다. 현재 GlobalGPT Pro 가격 는 연간 청구 시 월 $10.8, 또는 현재 진행 중인 월간 프로모션에 따라 매월 $15. API 키 설정, 청구 프로젝트 설정, SDK 호출 없이 Omni를 사용해 보고 싶은 사용자에게는 이 방법이 더 간편한 선택지가 될 수 있습니다.
다음은 구체적인 내용입니다. API를 통해 Omni를 이용할 때의 비용, Google AI 요금제에 포함된 내용, 프리뷰 버전에서 적용되는 제한 사항, 그리고 API 액세스, Google Flow, GlobalGPT Pro 중 어떤 것을 선택할지 결정하는 방법입니다.

Gemini Omni Flash 가격: 요약
단순히 숫자 정보만 필요하신 경우, Gemini Omni Flash는 Gemini API의 유료 모델입니다. Omni Flash에는 무료 API 티어가 없습니다. Google AI 유료 구독에는 Flow 크레딧을 통한 Omni 액세스 권한도 포함되어 있으며, GlobalGPT Pro는 사용자가 API 설정을 직접 관리하고 싶지 않을 때 더 간편한 멀티 모델 사용 경로를 제공합니다.
| 접근 경로 | 확정된 가격 | 가장 적합 | 주요 주의사항 |
|---|---|---|---|
| Gemini API | $1.50 / 입력 토큰 100만 개; $9 / 텍스트 출력 토큰 100만 개; $17.50 / 비디오 출력 토큰 100만 개; 720p 비디오의 경우 초당 약 $0.10 | 개발자, 제품 팀, 자동화, 일괄 테스트 | 무료 API 이용 등급이 없으며, API 설정 및 사용량 모니터링이 필요합니다. |
| Google AI 플러스 | $, 월 4.99, 200 플로우 크레딧 | 구글의 소비자용 창작 도구 내부의 간단한 테스트 | 영상별 크레딧 표를 게시하기 전에, 세대별 정확한 Omni 크레딧 비용은 실제 Flow를 통해 검증되어야 합니다. |
| 구글 AI 프로 | $ 월 19.99, 1,000 플로우 크레딧 | 이미 Google Flow 내에서 작업 중인 크리에이터들 | 크레딧은 유용하지만, API 과금과는 별개의 개념입니다. |
| 구글 AI 울트라 | 월 $99.99에 Flow 크레딧 10,000점, 또는 월 $199.99에 Flow 크레딧 25,000점 | 구글 플로우를 집중적으로 사용하는 사용자 및 대량의 크리에이티브 작업 흐름 | 월간 지출이 늘어나는 것은 Flow가 이미 워크플로우의 핵심 역할을 하고 있는 경우에만 타당합니다. |
| 글로벌GPT 프로 | 연간 결제 시 월 $10.8; 현재 진행 중인 월간 프로모션 적용 시 월 $15 | 단일 구독으로 Omni와 여러 AI 모델을 모두 이용하고자 하는 사용자 | 개발자 API 콘솔이나 모든 공식 Google 앱 기능을 대체하는 것은 아닙니다. |

Gemini Omni Flash란 무엇인가요?
Gemini Omni Flash는 Gemini API의 미리보기 비디오 모델입니다. Google의 Omni API 문서 이 시스템은 원어민 수준의 다중 모달성, 대화형 편집, 세계 지식을 핵심으로 삼고 있습니다. 실질적으로 이 시스템은 텍스트를 바탕으로 짧은 동영상을 생성하고, 참조 이미지를 활용하며, 워크플로우가 허용할 경우 후속 편집을 위해 충분한 맥락을 유지하도록 설계되었습니다.
API 모델 ID는 gemini-omni-flash-preview. “프리뷰”라는 단어는 중요합니다. 이는 해당 모델이 테스트 및 초기 생산 검토를 위해 이용 가능함을 의미하지만, 가격, 제한 사항, 지원 기능 범위 및 동작 방식은 안정화된 모델 라인보다 더 빠르게 변경될 수 있습니다.

가장 적합한 사용 사례는 짧은 제품 촬영 영상, 소셜 미디어용 영상 콘셉트, 애니메이션 크리에이티브 테스트, 그리고 구체적인 수정 요청이 있는 영상 편집 등입니다. 이 도구는 본격적인 장편 영상 편집기가 아닙니다. 현재의 미리보기 기능은 완전한 후반 작업 스위트라기보다는 짧은 클립을 빠르게 생성하는 단계로 이해하는 것이 더 적절합니다.
Gemini Omni Flash에 접속하는 방법
실제로 이용할 수 있는 경로는 세 가지가 있습니다. Gemini API, Flow 크레딧이 포함된 Google AI 요금제, 그리고 GlobalGPT Pro입니다. 이 세 가지 경로는 일부 기능이 겹치기도 하지만, 각각 해결하는 과제는 다릅니다.
옵션 1: Gemini API
Gemini API 경로는 개발자 및 기술 팀을 위한 것입니다. 이 경로는 Omni를 제품에 통합해야 하거나, 반복 가능한 테스트를 실행해야 하거나, 구조화된 프롬프트로부터 클립을 생성해야 하거나, 요청 단위로 비용을 추적해야 할 때 가장 적합합니다. 단, 설정 과정이 다소 번거롭다는 점이 단점입니다. 청구 시스템, API 액세스, 요청 처리, 저장 공간은 물론, 재시도 및 미디어 파일 처리를 위한 자체 워크플로우도 마련해야 합니다.
이미 영상 생성 비용을 비교하고 있는 팀의 경우, API를 활용하는 것이 클립당 비용을 계산하는 가장 깔끔한 방법입니다. 입력 토큰 및 관련 인프라 비용을 고려하기 전, 10초 분량의 720p 출력 영상의 비용은 대략 $1.00입니다. 3초 및 8초와 같이 더 짧은 클립일수록 비용은 비례적으로 더 저렴합니다.
옵션 2: Google AI 요금제 및 Flow 크레딧
구글 AI 구독 서비스는 구글의 콘텐츠 제작 인터페이스를 통해 Omni를 사용하고자 하는 크리에이터들에게 더 편리합니다. 미국에서는 유료 구글 AI 계획 Omni 액세스 및 월간 Flow 크레딧 표시: Plus 요금제는 $4.99에 200 크레딧, Pro 요금제는 $19.99에 크레딧 1,000개, Ultra 요금제는 $99.99에 크레딧 10,000개 또는 $199.99에 크레딧 25,000개를 제공합니다.

플로우 크레딧을 Gemini API 토큰 과금과 혼동해서는 안 됩니다. 크레딧은 소비자용 제품의 할당량입니다. API 토큰은 개발자용 과금 단위입니다. 주요 질문이 “앱에서 1초당 생성되는 콘텐츠에 대해 얼마가 청구되나요?”라면 API 요금을 참고하세요. 주요 질문이 “Flow 내에서 몇 번의 크리에이티브 시도를 할 수 있나요?”라면 Google AI 요금제와 크레딧 할당량을 참고하세요.
옵션 3: GlobalGPT Pro
GlobalGPT Pro는 API 설정 프로젝트로 번거로워지지 않으면서 Gemini Omni Flash를 사용해 보고 싶은 사용자에게 가장 실용적인 방법입니다. 현재 연간 요금제는 월 $10.8이며, 현재 진행 중인 월간 프로모션에서는 Pro 요금제를 월 $15에 이용할 수 있습니다. 또한 GlobalGPT Pro를 이용하면 Google Veo 3.1을 제외한 플랫폼의 더 광범위한 모델 라인업을 이용할 수 있습니다.

GlobalGPT가 Gemini API를 대체한다는 점 자체가 이 제품의 가치는 아닙니다. 그렇지 않습니다. 진정한 가치는 많은 사용자가 일상적인 테스트를 위해 별도의 API 콘솔이 필요하지 않다는 점에 있습니다. 사용자들은 각 제공업체마다 별도의 유료 구독을 유지하지 않고도 모델 간을 이동하고, 결과를 비교하며, 콘텐츠를 제작할 수 있는 공간이 필요합니다.
Gemini Omni Flash API 가격 정책 설명
구글의 요금표는 간결하지만, 표면상의 요금만으로는 Omni Flash가 가성비가 좋은지 판단하기 어렵습니다. 유용한 비교 기준은 ‘성공적인 클립당 비용’입니다. 즉, 지침 준수 여부, 재시도 횟수, 문제 해결, 워크플로우 안정성 등을 모두 고려했을 때, 해당 모델이 동영상 출력 비용 대비 어떤 성과를 제공하는지를 살펴보는 것입니다.
- 입력: 토큰 100만 개당 $1.50.
- 텍스트 출력: 토큰 100만 개당 $9.00.
- 비디오 출력: 토큰 100만 개당 $17.50이며, 구글에 따르면 720p 동영상의 경우 초당 약 $0.10에 해당한다고 설명되어 있습니다.
- 무료 API 이용 한도: Gemini Omni Flash에서는 사용할 수 없습니다.
재생 시간에 따른 예상 영상 출력 비용
| 요청된 기간 | API 비디오 출력 비용(대략) | 참고 |
|---|---|---|
| 3초 | $0.30에 대하여 | 빠른 모션 테스트 및 전환 효과에 유용합니다 |
| 8초 | $0.80에 대하여 | 제품 데모 및 소셜 미디어용 영상에 적합한 길이 |
| 10초 | $1.00에 대하여 | 현재 API 기간 범위의 상한 |
이 추정치는 Google의 720p 동영상 출력 지침을 기준으로 합니다. 입력 토큰, 저장 공간, 재시도 횟수 및 기타 관련 앱 비용은 별도로 산정됩니다.
Omni Flash의 성능이 API 가격을 정당화할 수 있을까요?
동영상 화질을 명확한 가성비 지표로 환산해 주는 단일한 공개 벤치마크 점수는 없기 때문에, 저희는 실습용 테스트 세트 이 경우 합성 점수보다 더 유용합니다. 이 지표는 모델이 요청된 형식을 반환했는지, 주요 시각적 세부 사항을 유지했는지, 시간 제한이 있는 동작을 준수했는지, 그리고 워크플로를 안정적으로 완료했는지를 측정합니다.
실용적인 가성비 벤치마크
| 측정 항목 | 관측된 결과 | 가치 측면에서 이는 무엇을 의미하는가 |
|---|---|---|
| 완료된 기본 또는 생성 요청 | 5/5 | 텍스트-비디오, 세로 방향 출력, 이미지-비디오, 기본 클립, 시간 지정 시퀀스 모두 재생 가능한 동영상을 생성했습니다. |
| 성공적으로 촬영된 영상 및 예상 영상 제작 비용 | 약 $4.27에 42초 | 정가만으로도 막대한 테스트 예산 없이도 여러 개의 유용한 짧은 클립을 제작할 수 있었다. |
| 제어된 완료 시간 | 8~10초 소요되는 작업 완료에 25.7~39.2초가 걸림 | 반복적인 컨셉 작업에 충분히 빠른 속도입니다. 이 측정값들은 GlobalGPT 인터페이스 속도에 대한 측정값이 아닙니다. |
| 서식 및 일관성 | 9:16 원본 비율 및 참조 이미지 테스트 통과 | 첫 번째 출력물에서 이미 필요한 방향이 설정되어 있고 피사체가 그대로 유지된다면, 그 가격을 납득하기가 더 수월합니다. |
| 상태를 유지하는 후속 편집 | 1개 중 0개; HTTP 502 | 편집의 신뢰성이 낮으면, 제작 워크플로가 재시도에 의존하는 경우 실질적인 비용이 증가할 수 있습니다. |
이러한 점을 고려할 때, API 가격은 신속한 아이디어 구상, 제품 촬영, 소셜 미디어용 콘셉트 영상, 참고 자료를 기반으로 한 모션 테스트 등에 매우 적합합니다. 8초 또는 10초 분량의 720p 영상 결과물은 1달러 미만 또는 약 1달러의 비용으로 제작되며, 성공적인 실행 결과는 신속히 완료되어 신속한 반복 작업을 뒷받침합니다.
최종 납품물이나 장편 작업의 경우 그 가치는 다소 떨어집니다. 출력 해상도는 720p, 길이는 10초로 제한되며, 테스트 결과 정확한 타이밍은 대략적인 수준이었고, 상태 기반 편집이 한 번 실패했습니다. 여러 번의 재시도, 클립 연결, 업스케일링 또는 안정적인 후속 편집이 필요한 프로젝트의 경우, 초당 기본 요금만으로는 예상하기 어려운 상당한 추가 비용이 발생할 수 있습니다.
구글 AI 플랜 대 GlobalGPT: 어느 쪽 가격이 더 합리적일까?
이러한 옵션들은 월별 요금을 단순히 나열하는 방식보다는 실제 활용도를 기준으로 평가해야 합니다. 구글은 자사의 크리에이티브 환경 내에서 용량을 단계적으로 늘려 판매하고 있습니다. GlobalGPT는 구독 비용을 Omni 및 기타 모델에 분산합니다. 어느 접근 방식도 사용자가 더 비싼 요금제를 선택한다고 해서 기본이 되는 Omni 모델의 성능이 더 좋아지지는 않습니다.
구글의 가격 체계 이해하기
단순한 가격 요약보다 이 표가 더 중요합니다. 각 단계마다 Flow 할당량이 월 이용료보다 빠르게 증가하므로, 사용 약정량이 늘어날수록 포함된 크레딧당 명목 비용은 낮아집니다. 따라서 Pro 요금제는 정기적인 Flow 활용에 더 균형 잡힌 선택지인 반면, Ultra 요금제는 실제로 훨씬 더 많은 할당량을 소비할 수 있고 Google의 다른 프리미엄 기능을 활용할 수 있는 사용자를 위한 용량 구매형 요금제입니다.
| 구글의 AI 계획 | 미국 월간 가격 | 플로우 크레딧 | 포함된 크레딧당 명목 비용 | 가장 적합 |
|---|---|---|---|---|
| AI 플러스 | $4.99 | 200 | 약 2.50 센트 | Flow를 가끔 사용할 때 이용할 수 있는 가장 저렴한 공식 진입 경로 |
| AI Pro | $19.99 | 1,000 | 약 2.00 센트 | 매월 Flow에서 반복 작업을 진행할 예정인 정기 크리에이터 |
| AI Ultra | $99.99 | 10,000 | 약 1.00 센트 | 대용량 유량 작업을 수행하는 사용자 및 Ultra 기능을 중요하게 여기는 사용자 |
| AI 울트라, 한도 상향 옵션 | $199.99 | 25,000 | 약 0.80 센트 | 공식 도구의 사용 빈도가 매우 높아, 실제로 더 많은 할당량이 사용될 것으로 예상되는 경우 |
Plus에서 Pro로 업그레이드하면 허용 한도는 5배로 늘어나는 반면 요금은 약 4배 증가하므로, 포함된 크레딧당 명목 비용은 약 20% 감소합니다. 최상위 등급인 울트라(Ultra)는 프로(Pro)에 비해 그 효율성을 다시 두 배로 높입니다. 이는 서류상으로는 훌륭해 보이지만, 단위 비용이 낮다고 해서 총 지출이 줄어드는 것은 아닙니다. 미사용 용량이 있다면, 울트라가 가장 좋은 비율을 보여도 플러스나 프로가 더 나은 가성비를 제공할 수 있습니다.
약 $4.27에 대해 42초 분량의 동영상이 성공적으로 처리된 API 실측 결과는 유용한 성능 참고 자료이지만, 이를 바탕으로 특정 Flow 계획에서 생성될 Omni 클립의 수를 계산할 수는 없습니다. Flow 크레딧과 API 동영상 토큰은 서로 다른 과금 단위이며, 각 Omni 작업에 따른 실시간 크레딧 소모량은 여전히 별도로 확인해야 합니다.
GlobalGPT Pro의 적용 분야
GlobalGPT의 가치는 사용량 기반이 아닌 수평적 차원에 있습니다. Omni 모델만 사용할 계획이라면, Gemini API나 Google AI 요금제를 평가하는 것이 더 쉬운데, 이는 청구 단위가 요청 수나 Flow 용량과 직접 연동되기 때문입니다. 만약 동일한 구독을 글쓰기, 연구, 이미지 작업 및 여러 모델 간 비교 등에도 함께 사용한다면, 비용이 더 많은 워크플로우에 분산되므로 실질적인 가치는 높아집니다. 다만, 이는 여전히 Flow의 기본 기능이나 개발자 수준의 API 제어 기능을 대체할 수는 없습니다.

어느 옵션이 실제로 비용 대비 효과가 더 좋을까요?
| 만약 여러분이… | 선택하세요… | 왜 |
|---|---|---|
| Omni를 앱으로 구축하기 | Gemini API | 요청 제어 기능, 초당 비용의 예측 가능성, 그리고 기술적 통합이 필요합니다. |
| 최저 월 이용료로 Google Flow 공식 버전에서 Omni를 체험해 보세요 | Google AI 플러스 | 이는 총 투입량을 제한하면서도 ‘Flow’가 해당 워크플로우에 적합한지 판단할 수 있는 충분한 여유를 제공합니다. |
| 매월 Flow에서 작품을 만들고 수정하기 | 구글 AI 프로 | Plus와 비교했을 때, 이 요금제의 데이터 허용량은 요금보다 더 빠르게 증가하므로, 일상적인 사용에 가장 균형 잡힌 요금제입니다. |
| Google의 공식 크리에이티브 도구에서 대용량 작업 실행하기 | 구글 AI 울트라 | 이 서비스의 단위당 경제성은 높은 트래픽 처리 능력과 추가적인 Google 기능이 실제로 활용될 때만 가장 두드러집니다. |
| 콘텐츠 작업을 위해 Omni와 여러 AI 모델을 함께 테스트 중 | 글로벌GPT 프로 | 그 가치는 단순히 Omni의 생산량뿐만 아니라, 사용되는 모델 수와 비영상 워크플로우의 수에 따라 높아집니다. |
Omni를 넘어 AI 동영상 연구를 진행 중이라면, 향후 결정에 도움이 될 만한 비교 분석부터 시작해 보세요. 소라 2 API 가격 이 가이드는 개발자 비용을 비교할 때 유용하며, 반면 소라 영상 생성 이 가이드는 크리에이터의 작업 흐름을 돕습니다. 모델 간 선택의 경우, Veo 3.1 vs Sora 2 ‘breakdown’이 가장 가까운 다음 읽을거리입니다.
꼭 알아두어야 할 Gemini Omni Flash 제한 사항
옴니 플래시는 강력하지만, 미리보기 기능에는 분명한 한계가 있습니다. 크레딧을 사용하기 전에 이러한 한계를 이해하는 것이 모델 발표 내용을 외우는 것보다 더 중요합니다.

기간 및 해결 방안
현재 API 미리보기 버전은 다음 출처의 동영상을 지원합니다. 3~10초 에서 720p, 구글의 Gemini API 릴리스 노트. 따라서 Omni Flash는 짧은 클립을 생성하는 도구입니다. 제품 하이라이트, 소셜 미디어용 콘셉트, 전환 장면, 빠른 시각적 테스트 등에 매우 유용할 수 있지만, 한 번의 요청으로 몇 분 분량의 전체 영상을 생성하도록 설계되지는 않았습니다.
종횡비
풍경 16:9 기본값입니다. 세로 9:16 또한 요청할 수 있으며, 이는 TikTok, Reels, Shorts 및 모바일 우선 광고 테스트에 유용합니다.

이미지-동영상 변환
Omni는 참조 이미지 워크플로를 지원합니다. 이는 제품 촬영에 특히 중요한데, 모델에게 텍스트만 바탕으로 물체를 상상해 내도록 요청하는 대신 시각적 기준점을 바탕으로 작업을 시작할 수 있기 때문입니다. 단, 참조 이미지에도 명확한 동작 지침이 필요합니다. 좋은 프롬프트는 무엇이 움직여야 하고, 무엇이 일관되게 유지되어야 하며, 카메라가 어떻게 동작해야 하는지를 명확히 설명해야 합니다.

상태를 유지하는 동영상 편집
Interactions API는 이전 상호작용을 통해 후속 편집을 위한 영상 맥락을 유지할 수 있습니다. 사용자의 입장에서 보면, 이는 원래 프롬프트 전체를 다시 작성하지 않고도 제품 색상을 바꾸거나 장면의 세부 사항을 조정하는 등의 변경을 요청할 수 있음을 의미합니다. 가장 효과적인 편집은 여전히 범위가 좁고 구체적인 것입니다.

미리보기 제한 사항
이 미리보기 버전에는 중요한 기술적 제한 사항도 있습니다. 구글의 문서에는 지역별 이용 가능 여부, 참조 미디어, 음성 편집, 보간, 고급 매개변수 및 일부 명령 제어와 관련된 제한 사항이 명시되어 있습니다. 생성된 동영상에는 SynthID가 포함되며, 안전 필터가 출력 결과에 영향을 미칠 수 있습니다.

간단히 말해, Omni Flash는 프리뷰 도구처럼 테스트되어야 한다는 점입니다. 즉, 이를 기반으로 워크플로를 구축할 수 있을 만큼 충분히 견고하지만, 변경 사항을 모니터링하지 않고는 완전히 정립된 운영 환경으로 간주해서는 안 된다는 것입니다.
Gemini Omni Flash 실사용 테스트 결과
우리는 동일한 것을 테스트했습니다 gemini-omni-flash-preview GlobalGPT Pro에서 제어된 API 워크플로를 통해 사용할 수 있는 모델입니다.
이번 테스트에서는 다섯 가지 실제 워크플로를 검증했습니다. 바로 기본 텍스트-비디오 변환, 네이티브 9:16 출력, 참조 이미지와 일치성, 상태 기반 후속 편집, 그리고 10초 분량의 타이밍이 지정된 시퀀스입니다.
결과 해석 방법: 각 출력 영상에는 해당 영상의 측정 데이터와 검토 메모가 함께 제공됩니다. 실행 시간은 제어된 워크플로우에서 측정된 종단 간 시간이며, GlobalGPT 인터페이스 속도가 아닙니다.
T1 · 텍스트를 동영상으로 변환
카페 라떼 아트 동작 테스트
샘플링된 프레임에서 로제타 무늬는 여전히 알아볼 수 있고, 김이 보이는 상태이며, 손의 움직임도 깔끔하게 나타납니다. 컵은 제자리에서 회전하기만 하는 것이 아니라 중간 지점 부근에서 약간 들어 올려졌기 때문에, 지침을 잘 따랐지만 완전히 정확하지는 않았습니다.
테이크아웃: 시각적 사실감이 뛰어난 만족스러운 결과물이지만, 미세한 신체 동작 디테일에 대해서는 여전히 프레임 단위로 검토가 필요합니다.
정확한 프롬프트 보기
8초 분량의 16:9 비율, 사실감 넘치는 영상을 한 번의 연속 촬영으로 제작하세요. 햇살이 비치는 창가 옆 호두나무 카페 테이블 위에 라떼가 담긴 세라믹 컵이 놓여 있습니다. 바리스타의 손이 컵을 약 30도 정도 부드럽게 회전시키면 선명한 로제타 라떼 아트 패턴이 드러납니다. 가늘고 사실적인 증기가 자연스럽게 피어오르며 아침 햇살 속에서 소용돌이쳐야 하며, 액체 표면과 손의 움직임은 실제 물리 법칙을 따라야 합니다. 느리고 미묘한 카메라 푸시인, 얕은 피사계 심도, 따뜻하고 자연스러운 빛, 그리고 실제 카페 분위기를 활용하십시오. 대사, 음악, 컷, 자막, 눈에 띄는 브랜드명, 로고, 워터마크는 포함되지 않아야 합니다.
T2 · 세로형 동영상
9:16 제품 개봉 테스트
출력 결과물은 요청된 세로 형식을 준수했습니다. 케이스는 중앙에 위치해 있으며, 뚜껑이 열리고 양쪽 이어버드가 모두 보입니다. 뚜껑을 연 후에도 손이 화면 안에 남아 있지만, 제품의 형태는 안정적이며 샘플링된 프레임에는 로고나 텍스트가 나타나지 않습니다.
테이크아웃: Gemini Omni Flash는 가로 방향으로 잘린 출력물 대신 진정한 세로형 제품 클립을 제공할 수 있습니다.
정확한 프롬프트 보기
8초 분량의 세로형(9:16) 사실적인 제품 영상을 한 번의 연속 샷으로 제작하십시오. 매트한 코발트 블루 색상의 무선 이어버드 충전 케이스를 깔끔한 밝은 회색 스튜디오 받침대 중앙에 배치하십시오. 화면 하단 가장자리에서 사람의 손이 들어와 부드럽게 뚜껑을 열고, 두 개의 같은 색상인 파란색 이어버드를 드러냅니다. 동시에 카메라는 충전 케이스를 화면 중앙에 두고 전체가 보이도록 유지한 채, 전면 왼쪽에서 전면 오른쪽으로 반 바퀴를 회전합니다. 부드러운 상업용 스튜디오 조명, 사실적인 소재, 안정적인 기하학적 구조, 정교한 손과 물체의 상호작용을 활용하십시오. 로고, 텍스트, 컷, 불필요한 물체, 왜곡된 손가락, 워터마크는 포함되지 않아야 합니다.
T3 · 이미지에서 동영상으로
참조 이미지 일관성 테스트
파란색 본체, 노란색 손잡이, 짧은 주둥이, 돌로 된 표면, 햇살이 비치는 주방 배경 등은 일관되게 유지됩니다. 오프닝 장면이 지나면 김이 피어오릅니다. 이 영상은 원본 이미지보다 약간 더 넓은 화각을 사용하고 있으므로, 픽셀 단위로 완벽하게 일치하기보다는 원본의 특징을 잘 보존하고 있습니다.
테이크아웃: 제공된 참조 이미지는 장면을 정적인 프레임으로 고정시키지 않으면서도 유용한 정체성 조절을 가능하게 했다.
정확한 애니메이션 프롬프트 보기
이 참조 이미지를 바탕으로 8초 분량의 16:9 비율의 사실적인 동영상을 제작해 주세요. 찻주전자의 코발트 블루 색상의 몸체, 밝은 노란색 손잡이, 비율, 주둥이 모양, 탁상 위 위치, 조명 방향 및 전체적인 구도를 정확히 재현해 주세요. 카메라가 약 20도 정도 천천히 부드럽게 오른쪽으로 회전하는 동안, 주둥이에서 얇은 실감 나는 증기가 피어오르게 표현해 주십시오. 찻주전자는 참조 이미지와 시각적으로 일관성을 유지하며 고정된 상태로 유지해야 합니다. 어떤 물체도 추가, 제거, 색상 변경 또는 형태 변경을 해서는 안 됩니다. 텍스트, 로고, 컷, 인물, 워터마크는 포함되지 않아야 합니다.
T4 · 상태 기반 편집
파란색에서 빨간색으로 바뀐 자전거에 대한 후속 조치
기본 클립에는 젖은 거리에서 파란색 자전거 옆에 노란색 비옷을 입은 성인 여성이 제대로 나타나 있습니다. 후속 작업에서는 동일한 세션을 사용했고 기본 영상의 메시지를 그대로 전달하려 했으나, 편집 결과 스트리밍되지 않는 502 오류 응답이 반환되었고, 미디어도 없었으며, 사용 기록도 생성되지 않았습니다.
테이크아웃: 이번 실행 결과만으로는 상태 기반 편집이 안정적으로 작동한다는 것을 입증할 수 없습니다. 이는 명백한 실패 사례이며, 연속성을 평가할 수 없었습니다.
기본 프롬프트 및 후속 프롬프트 보기
기본 설정: 8초 분량의 16:9 비율, 사실감 넘치는 영화 같은 영상을 한 번의 연속 샷으로 제작하십시오. 비가 갓 그친 젖은 도시 거리에서, 밝은 노란색 비옷을 입은 성인 여성이 파란색 도시 자전거 옆에 서 있습니다. 그녀는 핸들을 가볍게 잡고 있으며, 포장 도로에는 반사광이 반짝이고 차양에서 빗방울 몇 방울이 떨어지고 있습니다. 카메라를 천천히 옆으로 이동시키고, 흐린 날의 자연광을 활용하며, 사실적인 인체 해부학적 묘사와 안정적인 자전거 형태, 일관된 색상을 사용하십시오. 대사, 텍스트, 로고, 컷, 워터마크는 포함하지 마십시오. 후속 과제: 자전거 색상을 파란색에서 빨간색으로 변경하십시오. 그 외 모든 요소는 동일하게 유지하십시오.
T5 · 타이밍과 한계
10초 타임라인 제어 테스트
관측된 경계 표본: 4.0초 시점에서는 상자가 여전히 닫혀 있었고, 4.5초 시점에는 뚜껑이 열렸으며, 6.5초 시점에는 별이 보이기 시작했다. 순서는 정확했으나, 첫 번째 전환이 요청된 시간보다 늦게 시작되었다.
테이크아웃: 이 모델은 이벤트 순서를 따랐고 최대 10초를 모두 반환했으나, 2단계 타이밍은 프레임 단위의 정확한 값이 아닌 대략적인 값이었습니다.
정확한 프롬프트 보기
10초 분량의 16:9 비율, 사실감 넘치는 스튜디오 영상을 고정 샷 하나로 연속 촬영하여 제작하십시오. 금색 리본이 묶인 작은 무광 빨간색 선물 상자가 어두운 중성색 탁자 위 중앙에 놓여 있습니다. 다음 타임라인을 정확히 따르십시오: [0-3초] 상자는 완전히 닫힌 상태로 움직이지 않습니다; [3-6초] 상자는 제자리에 고정된 채 뚜껑이 저절로 천천히 부드럽게 열립니다; [6-10초] 열린 상자 안에서 여러 개의 작은 금속성 금색 종이 별들이 부드럽게 떠오르며 위로 떠다닙니다. 전체 샷 동안 카메라, 배경, 상자의 위치, 크기, 조명 및 피사체의 정체성을 변경하지 마십시오. 사람, 텍스트, 로고, 컷, 불필요한 물체, 갑작스러운 움직임, 워터마크는 포함되어서는 안 됩니다.
크레딧 낭비를 방지하기 위한 유용한 팁
옴니 플래시의 가격은 실험해 볼 수 있을 만큼 저렴하지만, 낭비되는 프롬프트 비용도 누적됩니다. 가장 효과적인 프롬프트는 과도하지 않으면서도 구체적이어야 합니다.
안정감을 주고 싶을 때는 원 컷으로 촬영하세요
클립이 일관성 있게 느껴져야 한다면, “단일 연속 샷”이나 “끊김 없는 카메라 이동”이라고 말하세요. 이렇게 하면 모델이 클립 도중에 갑작스러운 컷을 넣거나 주제를 바꾸는 일이 줄어들 것입니다.
피사체뿐만 아니라 카메라에 대해서도 설명해 주세요
제품 설명은 단순히 “파란색 헤드폰 케이스”에 그쳐서는 안 됩니다. 움직임을 더해보세요. “반 바퀴 정도 천천히 회전하는 카메라 움직임”, “손으로 케이스를 여는 동작”, “스튜디오의 은은한 반사광”, 또는 “카메라가 살짝 클로즈업하는 장면” 등이 있습니다. 대개 사물에 형용사를 더 붙이는 것보다 카메라 기법을 활용하는 것이 더 유용한 결과물을 만들어 냅니다.
화면 비율을 미리 명시하십시오
모바일 콘텐츠의 경우 9:16 비율을 직접 요청하세요. 웹사이트나 유튜브 스타일의 클립의 경우 16:9를 사용하세요. 화면 비율은 단순한 형식상의 선택이 아니라, 모델의 손, 제품, 배경 움직임을 담을 수 있는 공간을 결정합니다.
수정 시 변경 범위를 좁게 유지하십시오
상태 기반 편집은 후속 작업이 간단한 경우에 가장 효과적입니다. 예를 들어, “자전거 색상을 파란색에서 빨간색으로 변경하되, 그 외 모든 사항은 그대로 유지하세요.”와 같은 경우입니다. 재시도 비용을 감당할 수 있는 경우가 아니라면, 서로 관련 없는 여러 가지 변경 사항을 한 번에 요청하는 것은 피하십시오.
시간 제한이 있는 행동의 경우, 시간 범위를 사용하십시오.
클립에 시퀀스가 있다면 다음과 같이 대괄호를 사용하세요. [0-3초], [3~6초], 및 [6~10초]. 이를 통해 모델에 진행 속도를 조절할 수 있는 명확한 구조가 제공됩니다. 프레임 단위의 완벽한 제어를 보장하는 것은 아니지만, 타이밍을 막연하게 문단으로 기술하는 것보다 훨씬 명확합니다.
API, Google Flow, GlobalGPT 중 어떤 것을 사용해야 할까요?
사용하십시오 Gemini API 개발, 자동화 또는 측정 작업을 수행하고 계신다면, 프로그래밍 방식의 제어, 요청별 비용 추적 및 반복 가능한 프롬프트가 필요한 경우 이 API가 최적의 선택입니다.
사용 구글 AI 계획을 통한 구글 플로우 이미 구글의 기본 크리에이티브 환경을 원하신다면 말이죠. 또한, 크레딧 시스템이 본인의 작업 방식에 잘 맞고 공식 소비자용 도구에 접근하고 싶다면 Pro 및 Ultra 요금제를 선택하는 것이 합리적입니다.
사용 글로벌GPT 프로 별도의 구독 및 API 콘솔을 관리할 필요 없이 Gemini Omni Flash를 다른 주요 모델과 함께 사용하는 것이 주된 목표라면, Pro 요금제는 현재 연간 결제 시 월 $10.8, 월별 프로모션 적용 시 월 $15입니다. 많은 사용자에게 이는 실질적인 이점입니다. Omni를 더 광범위한 작업 공간 내에서 사용할 수 있어, 글쓰기, 기획, 연구 및 창작 작업을 위해 다른 모델들과 비교하며 활용할 수 있기 때문입니다.

선택 GlobalGPT 무제한 모델 사용량이 많아 더 큰 요금제를 선택하는 것이 더 편할 경우입니다. 현재 연간 무제한 요금제의 월 이용료는 $25이며, 현재 진행 중인 월간 프로모션에서는 무제한 요금제를 월 $37에 이용할 수 있습니다.
최종 평결
Gemini Omni Flash는 영상 생성, 참조 미디어, 대화형 편집 기능을 비교적 저렴한 가격대에 결합한 모델로, 주목할 만한 흥미로운 숏폼 영상 모델 중 하나입니다. 720p API 영상 출력 기준 초당 약 $0.10의 비용으로, 비용 측면을 합리적으로 판단하기 쉽습니다. 한계도 명확합니다. 3~10초, 720p, 미리보기 상태, 그리고 고급 편집 및 매개변수와 관련된 몇 가지 기술적 제약이 있습니다.
개발자라면 Gemini API부터 시작하여 생성된 1초당 비용을 추적해 보세요. 이미 Google의 크리에이티브 도구를 사용하고 계신다면, Flow 크레딧을 기준으로 Google AI 요금제 등급을 비교해 보세요. API 워크플로를 구축하지 않고 단순히 Gemini Omni Flash를 사용하고 싶다면, GlobalGPT의 동영상 작업 공간 특히 같은 작업 공간 내의 다른 모델에 대한 Pro 액세스 권한이 필요할 때, 이 방법이 더 직접적이고 일상적으로 활용하기 좋은 선택지입니다.
자주 묻는 질문
Gemini Omni Flash는 무료인가요?
아니요, Gemini API를 통해서가 아닙니다. 구글은 Gemini Omni Flash를 무료 API 사용 한도가 없는 유료 등급 API 모델로 분류하고 있습니다. 구글 AI 구독 서비스에는 Flow 크레딧이 포함될 수 있지만, 해당 크레딧은 소비자용 요금제의 할당량일 뿐, 무료 API 이용권과는 다릅니다.
Gemini Omni Flash API의 가격은 얼마인가요?
Gemini Omni Flash API의 요금은 입력 토큰 100만 개당 $1.50, 텍스트 출력 토큰 100만 개당 $9, 동영상 출력 토큰 100만 개당 $17.50입니다. 구글은 720p 동영상의 경우 동영상 출력 요금을 초당 약 $0.10으로 설명하고 있습니다.
Gemini Omni Flash API 모델 ID는 무엇입니까?
API 모델 ID는 gemini-omni-flash-preview.
Google AI Pro에 Gemini Omni Flash가 포함되어 있나요?
네. Google AI Pro 요금제는 월 $19.99로 책정되어 있으며, Omni 이용 권한과 함께 1,000 Flow 크레딧이 포함됩니다.
GlobalGPT에 Gemini Omni Flash가 포함되어 있나요?
네. GlobalGPT Pro에는 Gemini Omni Flash 이용 권한이 포함되어 있습니다. 현재 Pro 요금제는 연간 결제 시 월 $10.8이며, 현재 진행 중인 월별 프로모션 적용 시 월 $15입니다.
Gemini Omni Flash의 비디오 제한 사항은 무엇인가요?
현재 API 프리뷰 버전은 720p 해상도에서 3~10초 분량의 동영상 생성을 지원합니다. 기본 설정은 가로 화면(16:9)이며, 세로 화면(9:16)도 요청할 수 있습니다.
Gemini Omni Flash에서 이미지-투-비디오 기능을 사용할 수 있나요?
네. Gemini Omni Flash는 참조 이미지 워크플로를 지원하므로, 사용자는 이미지를 제공하여 모델이 해당 시각적 참조를 바탕으로 동작을 생성하도록 지시할 수 있습니다.
Gemini Omni Flash로 기존 동영상을 편집할 수 있나요?
구글의 문서에서는 Interactions API를 통해 생성된 동영상에 대한 상태 기반 후속 편집을 지원한다고 명시하고 있습니다. 저희가 직접 한 번 시도해 본 결과, 기본 동영상 생성은 성공했으나 후속 편집 시 HTTP 502 오류가 발생했고 편집된 미디어는 생성되지 않았습니다. 따라서 특히 모델이 아직 프리뷰 단계에 있는 동안에는, 필요한 정확한 워크플로우에 맞춰 이 기능을 테스트해 보셔야 합니다.

