FLUX 3 리뷰: 영상, 오디오, 가격 및 이용 방법

flux-3-비디오-리뷰

간단한 답변: FLUX 3는 Black Forest Labs가 개발한 이미지, 동영상, 오디오 및 동작 예측을 지원하는 다중 모달 파운데이션 모델입니다. 2026년 8월 11일 기준, BFL은 FLUX 3 Video를 얼리 액세스(Early Access) 단계로 공개했으며, 최대 20초 길이의 클립, 선택 가능한 네이티브 오디오, 초당 공개 요금제를 제공합니다. GlobalGPT에도 검증된 FLUX 3 Video 경로가 있습니다. 세 번에 걸친 테스트에서 모든 작업이 완료되어 오디오 스트림이 포함된 5.04초 분량의 MP4 파일이 반환되었으나, 정확한 재생 시간 제어, 타이포그래피 간격, 객체의 일관성 측면에서는 완벽하지 않았습니다.

그 지위에 대해서는 여전히 신중한 표현이 필요합니다. 그 공식 출시 게시물 그리고 공식 모델 페이지 FLUX 3 Video는 ‘얼리 액세스’ 단계로 설명되며, BFL의 가격 페이지에는 현재 동영상 요금이 게시되어 있습니다. GlobalGPT는 해당 모델을 기반으로 하는 별도의 플랫폼 경로를 제공합니다. 이 경로를 통해 액세스한다고 해서 모든 BFL API, 비공개 가중치 옵션, 이미지 모델, 액션 모델 또는 FLUX 3 개발자용 릴리스가 일반적으로 이용 가능한 것은 아닙니다.

이번 업데이트에는 간단한 실습 확인 단계가 추가되었습니다. 8월 11일, 테스트 환경을 사용하여 3세대에 걸쳐 flux-3-video 모델 ID, 정확한 프롬프트 반복이 한 번 포함된 경우. 실제 동작과 눈에 띄는 오류 지점을 기록하는 데는 충분하지만, 세 개의 출력 결과만으로는 포괄적인 벤치마크라고 할 수 없다.

리뷰 요약

FLUX 3 Video의 자체 테스트 3회 결과일 뿐, 광범위한 벤치마크는 아닙니다.

런반환된 기간해상도오디오
3/3 성공5.04초 클립당1280 × 704모든 파일의 디코딩된 데이터

FLUX 3란 무엇인가요?

FLUX 3는 Black Forest Labs가 개발한 다중 모달 파운데이션 모델입니다. BFL에 따르면, 이 모델은 단순히 텍스트를 이미지로 변환하도록만 훈련된 시스템과 달리, 하나의 아키텍처 내에서 이미지, 영상, 오디오를 종합적으로 학습합니다. 이 모델의 목표는 각 매체를 독립된 특징으로 취급하기보다는, 공간적 구조, 움직임, 소리, 원인, 행동을 연결하는 표현을 구축하는 데 있습니다.

이미지, 동영상, 오디오 및 행동 예측을 보여주는 FLUX 3 공식 페이지
Black Forest Labs는 이미지, 동영상, 오디오 및 동작 예측을 아우르는 단일 다중 모달 모델인 FLUX 3를 선보입니다.

이름만 보면 FLUX.1과 FLUX.2의 단순한 후속작처럼 들릴 수 있지만, 그 범위는 훨씬 더 넓습니다. FLUX.2는 여전히 현재 사용 중인 이미지 생성 및 편집 제품군이며, FLUX 2 Pro 사용 설명서 해당 세대의 이미지 워크플로우, 가격 책정 환경 및 프롬프팅을 다룹니다. FLUX 3는 콘텐츠 생성 및 행동 예측을 위한 공유 기반 플랫폼으로 자리매김하고 있습니다.

BFL은 이러한 방향을 설명하기 위해 “세계 모델(world model)”이라는 용어를 사용합니다. 여기서 이는 회사가 일반 지능을 발표했다는 의미가 아닙니다. 이는 해당 모델이 시각적 대상, 움직임, 오디오, 행동이 시간의 흐름에 따라 어떻게 연관되는지를 학습하도록 설계되었다는 뜻입니다. 이러한 구분이 중요한 이유는, FLUX 3의 가장 흥미로운 주장이 단순히 “더 나은 이미지”가 아니라, 여러 유형의 생성 및 제어 기능을 수행하는 하나의 기본 모델이라는 점이기 때문입니다.

FLUX 3가 단순한 이미지 생성기를 넘어서는 이유

대부분의 창의적 AI 제품은 여전히 별개의 도구로 사용되고 있습니다. 한 모델은 이미지를 생성하고, 다른 모델은 동영상을 제작하며, 또 다른 모델은 음성이나 음향 효과를 추가하는 식입니다. FLUX 3는 이와는 다른 전제를 바탕으로 설계되었습니다. 하나의 아키텍처가 이러한 모달리티를 함께 학습한다면, 프롬프트, 참조 이미지, 모션 시퀀스, 사운드트랙이 잠재적으로 동일한 내부적 이해를 공유할 수 있게 됩니다.

  • 이미지는 공간을 마련해 줍니다: 사물, 구도, 질감, 타이포그래피, 그리고 시각적 관계.
  • 동영상이 재생 시간을 늘립니다: 프레임 간 움직임, 지속성, 접촉, 그리고 인과관계.
  • 오디오에는 또 다른 동기화 신호가 추가됩니다: 음성, 배경음, 그리고 눈에 보이는 사건과 연관된 소리들.
  • 행동 예측은 지각과 제어 기능을 연결해 줍니다: 이 모델의 표현을 활용하여 로봇이 다음에 무엇을 해야 할지 예측할 수 있다.

제작자 입장에서 볼 때, 생성 단계 간의 작업 이관이 줄어든다는 점이 실질적인 장점입니다. 네이티브 오디오는 클립 제작과 대사, 효과음, 싱크 작업을 별도로 진행하는 과정 간의 간극을 줄일 수 있기 때문에 특히 중요합니다. 음향에 가장 중점을 둔다면, 현재의 Veo 3.1 사운드 가이드 오늘날 또 다른 주요 동영상 플랫폼 계열사가 네이티브 오디오를 어떻게 다루고 있는지 보여줍니다.

FLUX 3 주요 기능 한눈에 보기

능력BFL이 발표한 내용2026년 8월 11일 현재 상황
FLUX 3 동영상음성, 효과, 스타일, 타이포그래피 및 멀티 샷 워크플로를 포함한, 선택 가능한 네이티브 오디오를 활용한 동영상 생성 및 편집BFL 얼리 액세스; 공식 가격 공개; GlobalGPT 노선 확정
FLUX 3 이미지API 및 비공개 가중치 접근을 통한 이미지 생성 및 편집얼리 액세스 발표; 이 기사에서는 해당 기능을 테스트하지 않았습니다
FLUX 3 액션네이티브 동작 예측과 비디오 백본을 기반으로 구축된 특화 모델선정된 파트너사를 시작으로
FLUX 3 개발동영상, 오디오, 이미지 및 동작 예측을 위한 계획된 오픈 웨이트 멀티모달 백본발표됨; 날짜 및 라이선스 정보는 공개되지 않음

FLUX 3 Video는 당분간 출시될 제품 중 가장 확실한 후보입니다. BFL에 따르면 이 제품은 텍스트를 영상으로 변환하는 기능과 편집, 오디오 동기화, 다국어 대사, 다양한 화면비, 타이포그래피, 클립 연쇄 편집 등을 지원한다고 합니다. 이러한 기능들로 인해 이 제품은 점점 더 경쟁이 치열해지는 시장에 진입하게 되는데; 최고의 AI 동영상 생성기 비교 FLUX 3의 이용이 아직 제한적인 상황에서, 크리에이터들이 이미 활용할 수 있는 기능에 대한 유용한 정보를 제공합니다.

출시 게시물에는 예비 평가 결과로 10초 분량의 720p 화질 텍스트-투-비디오 클립(음성 포함)에 대한 내용도 설명되어 있습니다. BFL은 해당 모델과 평가 도구가 아직 개발 중임을 분명히 밝혔습니다. 따라서 이러한 수치는 기업이 보고한 초기 증거로서 유용하지만, 일반 공개가 확대된 후 진행될 독립적이고 재현 가능한 테스트를 대체할 수는 없습니다.

현재 모델 설명 페이지에는 더 자세한 내용이 나와 있습니다. FLUX 3 Video는 한 번의 실행으로 최대 20초 분량의 영상을 생성할 수 있으며, 오디오는 선택 사항이고 프레임과 함께 다국어 음성, 효과음, 배경음도 생성된다고 설명하고 있습니다. 이는 공식적인 성능 한계치이며, 아래의 실습 테스트에서는 연결된 플랫폼 경로를 통해 우리의 프롬프트에 대해 실제로 어떤 결과가 반환되었는지 기록해 두었습니다.

FLUX 3는 현재 출시되었나요?

네, 하지만 단계적으로 진행되는 얼리 액세스를 통해서만 가능합니다. BFL은 광범위한 셀프 서비스 출시 대신 신청 절차를 마련했습니다. 따라서 모델, API, 비공개 가중치 옵션 및 평가 절차가 아직 변경 중인 동안, 회사는 선별된 사용자와 파트너와 협력할 수 있습니다.

FLUX 3의 비디오, 이미지, 액션 및 개발용 공식 출시 계획
BFL의 출시 계획에 따라 FLUX 3의 ‘Video’, ‘Image’, ‘Action’, ‘Dev’ 버전이 단계별 얼리 액세스 출시로 나뉘어 제공됩니다.
질문알려진여전히 제한적이거나 알려지지 않음
누구나 BFL에 지원할 수 있나요?네, 공식 요청 양식을 통해수락 기준 및 응답 시간
사용자들이 GlobalGPT에서 FLUX 3 Video를 사용해 볼 수 있나요?네, 인증된 제품 구매 경로는 아래에 링크되어 있습니다.노선 제한 및 할당량은 플랫폼 계정에 따라 다릅니다.
BFL은 공개적으로 어떤 가격을 책정하고 있나요?텍스트/이미지-동영상 변환, 연속, 초안, HD 및 FHD 화질비공개 가중치 및 기업 관련 용어
오픈 체급이 있을까요?FLUX 3 Dev는 오픈 웨이트로 계획되어 있습니다출시일, 라이선스 및 하드웨어 사양
GlobalGPT FLUX 3: 텍스트-비디오 및 이미지-비디오 기능을 보여주는 비디오 제품 경로
검증된 GlobalGPT 제품 경로에는 텍스트-비디오, 이미지-비디오 및 네이티브 오디오 위치 지정 기능을 갖춘 FLUX 3 Video가 포함되어 있습니다.

가장 안전한 해석은 간단합니다. FLUX 3는 실제로 존재하며 출시가 진행 중이지만, “얼리 액세스(Early Access)”를 “누구나 이용할 수 있다”고 해석해서는 안 됩니다. 실제 운영 일정이 필요하다면, 서면으로 된 이용 확인 및 약관을 받은 후에야 이를 바탕으로 워크플로를 설계해야 합니다.

FLUX 3 테스트 영상: 세 번의 실행, 실제 결과

3/3완료된 작업
5.04초각각 반환된 클립
1280 × 704각 MP4 파일
오디오 포함모든 파일에서 디코딩됨

시험 설정: 2026년 8월 11일, 플랫폼에 연결된 Broly 태스크 테스트 환경을 통해 정확한 모델 ID를 사용하여 테스트를 수행했습니다. flux-3-video. 각 요청에는 모델 ID와 프롬프트만 포함되었습니다. 우리는 제품 광고 프롬프트, 시간적 일관성 프롬프트, 그리고 첫 번째 프롬프트를 정확히 반복한 프롬프트 등 세 가지 작업을 제출했습니다. 작업 API에 따르면 실제 처리 시간은 각각 88초, 190초, 77초로 보고되었습니다. 실행이 동시에 이루어졌으며 경로가 아직 발전 중인 단계이므로, 이러한 시간은 지연 시간 벤치마크로 간주해서는 안 됩니다.

테스트 1: 타이포그래피, 변환, 기본 오디오

작업 ID: task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. 주어진 과제에는 정확한 라벨 문구, 향수병이 도시로 변하는 장면, 유리병이 딸깍거리는 소리, 슝 하는 소리, 그리고 대사 한 줄이 포함된 8초 분량의 2인 샷 향수 광고를 제작하라는 내용이 담겨 있었습니다.

프롬프트테스트 프롬프트 1
두 개의 연결된 샷으로 구성된 8초 분량의 16:9 시네마틱 제품 광고를 제작하십시오. 샷 1: 어두운 스튜디오 테이블 위에서, 반투명한 코발트 블루 색상의 향수병이 좁은 흰색 스포트라이트 아래에서 천천히 회전합니다. 앞면 라벨에는 다른 문구 없이 깔끔한 흰색 산세리프 글꼴로 정확히 'FLUX 3'라고 표기되어야 합니다. 숏 2: 병이 열리면서 파란 빛의 리본이 쏟아져 나오며, 이는 밤의 도시 스카이라인으로 변해가는 동안 동일한 병이 화면 중앙에 위치하며 식별 가능해야 합니다. 부드러운 고품질 카메라 움직임, 사실적인 유리 반사 효과, 그리고 동기화된 오디오를 사용하십시오: 뚜껑이 열릴 때 나는 은은한 유리 마찰음, 변형 과정에서 점점 커지는 전자음, 그리고 'Make the moment move'라고 정확히 말하는 차분한 목소리. 자막, 로고, 워터마크 또는 추가 텍스트는 추가하지 마십시오.

워드프레스 설정에서 복사 제어 기능이 비활성화되어 있다면 프롬프트를 수동으로 선택하세요.

FLUX 3 실습 테스트 1: 반품된 상품 광고 영상.
FLUX 3 타이포그래피 및 오디오 테스트에서 추출한 5개의 프레임
다섯 개의 프레임에는 라벨, 병 회전, 푸른 빛으로의 변화, 그리고 도시가 드러나는 장면이 담겨 있습니다.

무슨 일이 있었나요? 최종 결과물은 요청된 시각적 흐름을 완성했으며, 두 장면 모두에서 파란색 향수 콘셉트가 명확하게 드러나도록 했습니다. 라벨은 가독성을 유지했으나, 시각적으로는 요청된 공간이 축소되어 정확한 “FLUX 3”보다는 “FLUX3”에 더 가깝게 보였습니다. 또한 병은 변형 과정에서 캡과 몸체 모양이 바뀌었습니다. MP4 파일에는 디코딩된 오디오 데이터가 포함되어 있었으나, 당사의 자동 검사 시스템이 음성 대사를 텍스트로 변환하지 못했기 때문에 대사를 단어 단위로 채점하지는 않습니다. 무엇보다 중요한 점은, 반환된 클립의 길이가 요청된 8초가 아닌 5.04초였다는 것입니다.

테스트 2: 원샷 동작 및 객체 일관성

작업 ID: task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. 이 프롬프트는 장면 전환을 제거하고, 한 대의 태엽 로봇이 그 고유한 특징을 유지한 채 정해진 순서대로 세 개의 마커를 통과하도록 지시했습니다.

프롬프트테스트 프롬프트 2
컷 없이 8초 분량의 16:9 비율로 촬영된 단일 연속 트래킹 샷을 제작하십시오. 정사각형 머리, 두 개의 둥근 은색 눈, 등에 황동 열쇠 하나가 달려 있고 흰색 부츠를 신은 작은 빨간색 태엽 로봇이 왼쪽에서 오른쪽으로 걸어가며 노란색, 파란색, 녹색 순서대로 바닥에 표시된 세 개의 마커를 정확히 이 순서대로 밟습니다. 로봇이 샷 전체에 걸쳐 몸의 형태, 색상, 눈의 개수, 등 뒤의 열쇠, 걷는 방향을 그대로 유지하는 동안, 카메라는 허리 높이로 트래킹합니다. 동기화된 금속성 발소리와 조용한 실내 배경음을 추가하십시오. 대사, 텍스트, 추가 등장인물, 카메라 컷, 의상 변경은 없어야 합니다.

워드프레스 설정에서 복사 제어 기능이 비활성화되어 있다면 프롬프트를 수동으로 선택하세요.

FLUX 3 실습 테스트 2: 반환된 원샷 로봇 영상.
FLUX 3 시간적 일관성 테스트에서 추출한 5개의 프레임
로봇은 빨간색 몸통, 두 개의 눈, 흰색 부츠, 그리고 등 부분의 키를 유지한 채 노란색, 파란색, 녹색을 가로질러 왼쪽에서 오른쪽으로 이동합니다.

무슨 일이 있었나요? 이 영상이 더 깔끔한 결과물이었다. 로봇은 요청된 방향으로 이동하며 노란색, 파란색, 녹색 마커를 순서대로 통과했다. 촬영 내내 로봇의 주요 식별 특징이 선명하게 드러났으며, 불필요한 요소나 눈에 띄는 카메라 컷도 없었다. 움직임은 영화적인 느낌보다는 단순해 보였지만, 그 단순함 덕분에 일관성을 판단하기가 더 쉬웠다. 이번 결과물의 재생 시간도 5.04초였으며, 디코딩된 오디오 데이터가 포함되어 있었다.

테스트 3: 첫 번째 프롬프트와 정확히 동일한 내용

작업 ID: task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. 우리는 첫 번째 프롬프트를 한 글자도 바꾸지 않고 다시 보냈습니다.

프롬프트프롬프트 다시 읽기
두 개의 연결된 샷으로 구성된 8초 분량의 16:9 시네마틱 제품 광고를 제작하십시오. 샷 1: 어두운 스튜디오 테이블 위에서, 반투명한 코발트 블루 색상의 향수병이 좁은 흰색 스포트라이트 아래에서 천천히 회전합니다. 앞면 라벨에는 다른 문구 없이 깔끔한 흰색 산세리프 글꼴로 정확히 'FLUX 3'라고 표기되어야 합니다. 숏 2: 병이 열리면서 파란 빛의 리본이 쏟아져 나오며, 이는 밤의 도시 스카이라인으로 변해가는 동안 동일한 병이 화면 중앙에 위치하며 식별 가능해야 합니다. 부드러운 고품질 카메라 움직임, 사실적인 유리 반사 효과, 그리고 동기화된 오디오를 사용하십시오: 뚜껑이 열릴 때 나는 은은한 유리 마찰음, 변형 과정에서 점점 커지는 전자음, 그리고 'Make the moment move'라고 정확히 말하는 차분한 목소리. 자막, 로고, 워터마크 또는 추가 텍스트는 추가하지 마십시오.

워드프레스 설정에서 복사 제어 기능이 비활성화되어 있다면 프롬프트를 수동으로 선택하세요.

반복된 FLUX 3 제품 광고 프롬프트에서 추출한 5개의 프레임
프롬프트를 반복해서 입력하자, 동일한 개요의 스토리가 나왔지만 병 디자인, 뚜껑, 카메라 이동 경로, 그리고 도시가 드러나는 장면은 달라졌습니다.

무슨 일이 있었나요? 이 반복 작업은 정확한 결과물보다는 개념을 그대로 유지했습니다. 다시 파란색 병, 읽을 수 있는 “FLUX3” 글자, 빛의 띠, 그리고 밤의 스카이라인이 표현되었지만, 병의 형태, 뚜껑, 구도, 그리고 전환 효과는 달랐습니다. 이는 시드 데이터가 없는 생성 과정에서는 흔한 현상이지만, 브랜드 팀이 제품 디테일의 재현성을 기대할 때는 중요한 문제입니다.

시험 치수관측된 결과실용적인 요점
작업 완료3개 작업 중 3개가 성공했습니다이번 테스트 기간 동안 해당 연결 노선은 정상적으로 운영되었습니다.
재생 시간 제어세 가지 프롬프트 모두 8초를 요청했으나, 모두 5.04초를 반환했습니다.실제 운영 전, 경로별 소요 시간 제어 기능을 확인하십시오
타이포그래피라벨은 읽을 수 있지만, “FLUX 3”의 정확한 간격은 유지되지 않았습니다.브랜드 문구에 대한 재시도 또는 사후 편집 계획
시간적 일관성이 간단한 로봇은 그 특징과 마커 순서를 그대로 유지했다제약 조건이 있는 단일 프롬프트도 꽤 잘 작동할 수 있다
재현성같은 이야기지만, 제품의 형상과 카메라 선택은 다릅니다.프롬프트를 정확히 반복한다고 해서 시각적으로도 정확히 반복되는 것은 아니다
오디오모든 MP4 파일에는 디코딩된 오디오 데이터가 포함되어 있었으며, 대사는 자동으로 텍스트로 변환되지 않았습니다.승인 전에 수동으로 동기화 상태를 확인하고 검토하십시오

우리의 평가: FLUX 3 Video는 정확한 제작 제약 조건보다는 고수준의 장면 논리를 더 잘 따랐습니다. 매끄러운 제품 변환과 로봇의 질서 정연한 움직임은 고무적이었습니다. 5.04초로 고정된 리턴 시간, 불완전한 텍스트 간격, 병 모양의 편차는 적용하기 전에 직접 워크플로를 테스트해야 하는 이유입니다. 이는 모델 전반에 대한 점수가 아닌, 유용한 실무적 지표입니다.

FLUX 3 대 FLUX.2: 실제로 무엇이 달라졌을까?

지역FLUX.2FLUX 3
주요 공적 정체성이미지 생성 및 편집 제품군다모달 파운데이션 모델
치료법이미지 및 이미지 편집 워크플로우이미지, 동영상, 오디오 및 동작 예측
현재 접속 상태공개된 API 모델 및 요금 정보BFL 비디오 얼리 액세스, 공식 비디오 가격, 그리고 검증된 GlobalGPT 경로
모델 방향 열기여러 FLUX.2 변이체 및 기록된 종점FLUX 3 개발자용 오픈 웨이트 발표, 세부 사항은 추후 공개 예정
공정한 성과 평가오늘 바로 이미지 모델로 테스트해 볼 수 있습니다비디오는 검증될 수 있지만, 가족 전체에 대한 포괄적인 결론을 내리기에는 아직 이르다

가장 큰 변화는 검증된 성능 향상률이 아니라 적용 범위입니다. FLUX 3는 단순히 새로운 화질 점수를 적용한 FLUX.2가 아니라, 창의적 생성 기능과 물리적 동작 기능을 하나의 제품군으로 통합하기 위해 고안되었습니다. 현재 이미지만을 기반으로 한 의사결정의 경우, FLUX 2와 Nano Banana Pro 비교 오늘날 양쪽 모두 이미지 도구로 평가될 수 있기 때문에 더 실질적인 활용이 가능합니다.

FLUX 3와 FLUX.2를 전면적으로 비교하려면 여전히 일치하는 이미지 프롬프트, 참조 편집, 타이포그래피, 프롬프트 준수 여부, 지연 시간, 비용 등을 고려해야 합니다. 위의 세 차례 실행 영상 비교를 통해 증거의 격차는 좁혀졌으며, BFL은 현재 FLUX 3 비디오 요금을 공개하고 있지만, 이미지 모델이나 오픈 웨이트 변종과는 비교하지 않고 있습니다.

공식 데모와 로봇 공학 결과에서 드러나는 점

BFL의 출시 자료에는 생성된 영상, 동기화된 오디오, 시각적 스타일, 애니메이션 텍스트, 초기 편집 기능이 담겨 있습니다. 이 자료들은 제품의 방향성과 회사가 목표로 하는 결과물의 유형을 보여줍니다. 그러나 이는 선별된 공식 예시일 뿐이므로, 일반 사용자가 동일한 품질의 결과를 얼마나 자주 재현할 수 있는지, 생성 데드라인이 얼마나 걸리는지, 각 결과물의 비용은 얼마인지에 대해서는 알 수 없습니다.

FLUX 모방형 소프트 바디 키팅 벤치마크 차트
BFL의 소프트 바디 키팅 차트에 따르면, FLUX-mimic은 20회의 자율 주행 시험에서 95%의 중앙값 성공률을 기록했습니다.

로봇 공학 분야는 좀 더 구체적입니다. 이 FLUX 3 x 미믹 보고서, BFL 및 mimic robotics는 로봇 동작 예측을 위해 FLUX 3 비디오 백본을 적용한 방법을 설명합니다. 표시된 소프트 바디 키팅 차트에 따르면 FLUX-mimic의 성공률 중앙값은 95%이며, 각 점선으로 표시된 중앙값은 20회의 자율 실험을 바탕으로 산출되었습니다.

이는 로봇공학 분야의 연구 결과일 뿐, 이미지나 영상 품질에 대한 벤치마크는 아닙니다. 이 연구의 의의는 개념적인 차원에 있습니다. BFL은 운동, 접촉, 무게, 인과관계를 모델링하도록 훈련된 백본이 물리적 작업에 유용한 표현을 도출해 낼 수 있다고 주장합니다. 동일한 접근 방식이 다양한 로봇, 공장, 작업 전반에 걸쳐 일반화될 수 있는지 여부는 더 광범위한 독립적인 증거를 통해 검증되어야 할 것입니다.

X와 레딧에서 나타난 초기 커뮤니티 반응

FLUX 3는 출시와 동시에 큰 주목을 받았습니다. 7월 27일 검증 스냅샷에서, X에 게시된 BFL 공식 발표 ‘좋아요’ 6,088개, ‘재게시’ 862건, ‘인용’ 365건, ‘댓글’ 314건이 기록되었습니다. 이러한 수치는 출시 당시의 관심을 나타내는 것이지 모델의 신뢰성을 나타내는 것은 아니며, 앞으로도 계속 변동될 것입니다.

Black Forest Labs X 게시물: FLUX 3 얼리 액세스 발표
BFL의 출시 게시물에서는 FLUX 3를 이미지, 동영상, 오디오 및 동작 예측을 위한 통합 모델로 설명하고 있습니다.

A r/StableDiffusion 게시판의 레딧 게시물 “Flux 3가 정말 대단하네요. 이건 프롬프트 하나뿐이었어요”라는 제목의 게시물은 동일한 검증 창에서 370개의 좋아요와 63개의 댓글을 기록했습니다. 이 게시물의 분할 화면 예시는 난이도가 높은 프롬프트를 사용했지만, 이는 통제된 벤치마크라기보다는 단순히 공유된 하나의 예시에 불과합니다.

레딧 FLUX 3 분할 화면 동영상 예시 게시물
한 레딧 사용자가 까다로운 분할 화면 FLUX 3 프롬프트를 공유했는데, 이 게시물에는 63개의 댓글이 달렸고 열광적인 제목이 붙었습니다.

올바른 결론은 창작자들이 프롬프트의 복잡성, 움직임, 원본 음향, 시각적 일관성에 대해 궁금해한다는 점입니다. 접근성이 확대되면 프롬프트 재현성이 핵심 평가 항목이 되어야 할 것입니다. 그동안, Kling 3.0 프롬프트 공식 현재 이용 가능한 영상 편집 도구에서 장면 구성, 카메라 동작, 움직임 및 제약 조건을 설정하는 데 유용한 참고 자료입니다.

FLUX 3 API, 가격 및 오픈 웨이트

8월 11일 현재, BFL의 공개된 가격 관련 문서 FLUX 3 Video가 포함됩니다. 1크레딧은 $0.01에 해당합니다. 텍스트-비디오 및 이미지-비디오 변환 비용은 HD 기준 초당 $0.17, FHD 기준 초당 $0.29이며, HD 초안 생성 비용은 초당 $0.06입니다. 동영상 연속 재생 비용은 HD 기준 초당 $0.43, FHD 기준 초당 $0.54이며, 초안 재생 비용은 초당 $0.12입니다.

항목게시됨 또는 확인됨여전히 제한적이거나 알려지지 않음
FLUX 3 비디오 가격T2V/I2V: $0.17/s HD, $0.29/s FHD; 초안: $0.06/s. 계속: $0.43/s HD, $0.54/s FHD; 초안: $0.12/s비공개 가중치 및 기업 관련 용어
BFL 접속동영상 얼리 액세스, 모델 개요 및 가격 정보가 공개되었습니다.API 일반 승인, 할당량 및 계정별 제한 사항
GlobalGPT 액세스FLUX 3 비디오 제품 경로 검증 및 3회 실행 과제 테스트 성공계정 할당량 및 경로별 제어 기능은 BFL의 직접 제공 서비스와 다를 수 있습니다.
FLUX 3 개발개방형 중량 다중 모드 백본으로 계획됨출시일, 라이선스, 매개변수 크기 및 하드웨어 요구 사항

“오픈 웨이트(open weight)”를 “오픈 소스(open source)”와 동일시해서는 안 됩니다. 가중치, 코드, 훈련 데이터, 라이선스는 각각 서로 다른 접근 조건을 가질 수 있습니다. 오픈 웨이트에 대한 의미 있는 판단은 BFL이 실제 FLUX 3 Dev 릴리스와 라이선스를 공개할 때까지 기다려야 합니다.

FLUX 3 얼리 액세스 신청 방법

  1. 열기 FLUX 3 공식 모델 페이지 그리고 현재의 역량 라벨을 검토하십시오.
  2. “요청” 버튼을 따라 FLUX 3 공식 얼리 액세스 신청서.
  3. 필요한 기능(동영상, 이미지, 액션, 비공개 가중치 또는 개발자 액세스)과 구축하고자 하는 워크플로를 설명해 주세요.
  4. 실제 사용 사례, 예상 처리량, 조직 정보, 그리고 초기 접근 권한이 해당 프로젝트에 왜 중요한지를 포함해 주십시오.
  5. 접근 권한, 가격, 한도 또는 배송 일정을 확정하기 전에 서면 확인을 기다려 주십시오.

“한 번 해보고 싶다”는 식의 막연한 표현보다 구체적인 신청 내용이 더 설득력이 있습니다. 예를 들어, 한 스튜디오는 브랜드 홍보용 단편 영상에 다국어 대사와 효과 음향의 싱크 조정이 필요하다고 설명할 수 있고, 로봇 공학 팀은 조작 과제, 로봇 플랫폼, 데이터 및 배치 환경에 대해 설명할 수 있습니다.

대화를 이끌어내는 것이 목표라면, 단순히 프롬프트 생성만 계획하기보다는 전체 프로세스를 체계적으로 계획해야 합니다. Veo 3.1 대화 및 입모양 동기화 워크플로우 FLUX 3 Video를 평가할 때에도 중요하게 고려해야 할 실용적인 문제들—발언 시간 관리, 목소리의 일관성, 샷 구성, 재생—을 강조합니다.

누가 ‘FLUX 3’를 봐야 할까요?

  • AI 동영상 제작자 원어 오디오, 다국어 대사, 편집, 멀티 샷 연결, 일관성, 속도, 그리고 최종 가격 등을 주의 깊게 살펴봐야 합니다.
  • 이미지 제작자 프롬프트 준수, 참조 편집, 타이포그래피, 비용 등을 포괄하는 재현 가능한 비교 결과가 나올 때까지 기다려야 한다. 그때까지는, 2026년에 테스트된 최고의 AI 이미지 생성기 이것이 보다 실용적인 후보 목록입니다.
  • 개발자들 공개 모델 ID, 요청 제한, SDK 지원 현황, 비공개 가중치 관련 약관, 그리고 FLUX 3 Dev의 향후 라이선스 조건을 주시해야 합니다.
  • 로봇공학 및 물리 AI 팀 FLUX-mimic 접근법이 발표된 과제 이외의 영역으로도 적용 가능한지, 그리고 과제별 데이터 적응이 어느 정도 필요한지 검토해야 한다.

제작 워크플로를 확정하기 전에, 4단계 FLUX 3 준비도 점검을 실시하십시오. 런칭 데모를 통해 접근성, 경제성 또는 근거 요건을 충족하지 못하더라도 기능 요건 단계는 통과할 수 있습니다.

게이트무엇이 사실이어야 하는가수집해야 할 증거
액세스귀 팀은 필수 역량에 대한 서면 승인을 받았습니다.계정 초대, 이용 약관, 지역, 할당량 및 지원 문의처
능력이 모델은 단순한 시연용 프롬프트가 아니라, 사용자의 실제 작업을 수행해 줍니다.일치하는 프롬프트, 참조 입력, 오류 사례 및 반복 실행
경제학비용과 소요 기간이 생산 계획에 부합합니다가격, 생성 시간, 재시도 빈도, 볼륨 제한 및 인프라
증거선정된 초기 사례 외의 경우에도 결과는 여전히 신뢰할 만하다독립적인 테스트, 재현 가능한 설정, 버전 정보가 포함된 출력 결과

저희 테스트에서 사용한 모델을 직접 사용해 보시겠습니까? 열기 GlobalGPT에 대한 FLUX 3 동영상. 해당 제품 경로는 가동 중이었으며, 연결된 작업 환경은 2026년 8월 11일에 세 번의 실행을 모두 완료했습니다. 프로덕션 배치 작업을 시작하기 전에 본인의 계정에 표시된 제어 사항과 할당량을 확인하시기 바랍니다.

FLUX 3에 관한 자주 묻는 질문

FLUX 3는 언제 발표되었나요?

블랙 포레스트 랩스는 2026년 7월 23일 FLUX 3를 발표했습니다. 출시 공지에서는 이미지, 동영상, 오디오 및 동작 예측을 아우르는 다중 모달 파운데이션 모델을 소개했으며, 이 모델의 기능은 일괄적인 공개 출시 대신 단계별 얼리 액세스를 통해 순차적으로 제공될 예정입니다.

FLUX 3는 일반에 공개되어 있나요?

BFL은 얼리 액세스를 통해 FLUX 3 Video를 제공하고 있으며, 현재 해당 서비스의 가격 정책을 공개했습니다. GlobalGPT 역시 검증된 FLUX 3 Video 제품 경로를 갖추고 있습니다. 그렇다고 해서 FLUX 3 Image, Action, 비공개 가중치 또는 FLUX 3 Dev가 전반적으로 셀프 서비스 방식으로 제공되는 것은 아니며, 각 기능은 여전히 별도의 출시 일정과 이용 약관이 적용됩니다.

FLUX 3에서 원본 오디오가 포함된 동영상을 생성할 수 있나요?

네. BFL에 따르면 FLUX 3 Video는 영상 프레임과 함께 다국어 음성, 효과음, 배경음을 생성할 수 있다고 합니다. 8월 11일 테스트에서 확인된 세 개의 MP4 파일 모두 디코딩된 오디오 데이터가 포함되어 있었습니다. 해당 트랙을 자동으로 텍스트로 변환하지는 않았기 때문에, 이번 테스트는 대사의 단어 하나하나까지 정확히 재현되었는지보다는 오디오가 존재하는지 여부를 확인한 것입니다.

FLUX 3도 이미지 모델인가요?

네. 이미지 생성 및 편집 기능은 FLUX 3 제품군의 일부이지만, BFL은 FLUX 3 Image 얼리 액세스 버전이 초기 발표 후 몇 주 내에 공개될 것이라고 밝혔습니다. 이 업데이트 시점에서는 공개 엔드포인트 이름, 최종 출시 일정 및 가격은 공개되지 않았습니다.

FLUX 3는 오픈 소스인가요, 아니면 오픈 웨이트인가요?

BFL은 FLUX 3 Dev를 통해 향후 오픈 웨이트(open-weight) 접근 방식을 제공할 것이라고 발표했습니다. 아직 출시일, 라이선스, 매개변수 크기, 코드 범위, 하드웨어 요구 사항 등은 공개되지 않았습니다. 이러한 세부 사항이 공개되기 전까지는 “오픈 소스”라기보다는 “오픈 웨이트 계획”이라고 표현하는 것이 더 정확합니다.”

FLUX 3는 FLUX.2와 어떻게 다른가요?

FLUX.2는 주로 공개된 엔드포인트와 가격 정책이 마련된 최신 이미지 생성 및 편집 모델군입니다. FLUX 3는 이미지, 동영상, 오디오, 동작 예측을 연결하기 위해 설계된 보다 광범위한 다중 모달 기반 모델입니다. 공정한 품질 또는 비용 비교를 위해서는 FLUX 3에 대한 접근성이 확대될 때까지 기다려야 합니다.

FLUX 3 실사용 테스트 결과는 어땠을까요?

3가지 작업 중 3가지 모두 다음을 통해 성공적으로 완료되었습니다. flux-3-video 모델 ID. 출력 결과는 요청된 고수준 장면을 따랐으며, 로봇 테스트에서는 동작 순서와 주요 특징이 유지되었습니다. 8초 분량의 프롬프트가 주어졌음에도 세 클립 모두 5.04초였으며, 정확한 레이블 간격과 반복되는 제품 형상은 완벽하지 않았습니다.

GlobalGPT에서 FLUX 3를 사용할 수 있나요?

네. 확인된 경로는 다음과 같습니다. GlobalGPT에 대한 FLUX 3 동영상. 또한 2026년 8월 11일, 연결된 작업 환경을 통해 3세대를 완료했습니다. 플랫폼 접근은 직접적인 BFL API 또는 비공개 가중치 접근과는 별개입니다.

최종 결론

FLUX 3는 더 이상 출시 페이지상의 약속에 그치지 않습니다. BFL은 비디오 기능과 가격 정책을 공개했으며, GlobalGPT는 검증된 경로를 확보했고, 세 번의 실행을 통해 오디오 스트림이 포함된 사용 가능한 MP4 파일을 생성했습니다. 이 모델은 장면 논리와 제약된 동작을 잘 처리했으나, 요청된 재생 시간을 맞추지 못했고, 정확한 텍스트와 제품 일관성을 다소 떨어뜨렸습니다. 스케일링을 진행하기 전에 실제 프롬프트를 테스트해 보시고, FLUX 3 Image, Action, 비공개 가중치 및 FLUX 3 Dev 라이선스 등 제품군의 각 구성 요소가 성숙해가는 과정을 계속 지켜봐 주시기 바랍니다.

게시물을 공유하세요:

관련 게시물