Kurze Antwort: FLUX 3 ist das multimodale Grundmodell von Black Forest Labs für Bilder, Videos, Audio und Aktionsvorhersagen. Stand 11. August 2026 listet BFL ’FLUX 3 Video“ im Early-Access-Zugang mit Clips von bis zu 20 Sekunden, optionalem nativem Audio und einer öffentlichen Preisgestaltung pro Sekunde auf. Auch GlobalGPT verfügt über eine verifizierte FLUX-3-Video-Route. In unserem Test mit drei Durchläufen wurde jede Aufgabe abgeschlossen und gab eine 5,04 Sekunden lange MP4-Datei mit einem Audiostream zurück, doch die genaue Steuerung der Dauer, der Abstände im Textlayout und die Konsistenz der Objekte waren nicht perfekt.
Dieser Status muss noch sorgfältig formuliert werden. Der Beitrag zur offiziellen Markteinführung und offizielle Modellseite FLUX 3 Video wird als „Early Access“ bezeichnet, während auf der Preisseite von BFL nun die Videotarife veröffentlicht werden. GlobalGPT stellt einen separaten Plattformzugang bereit, der auf dem Modell basiert. Der Zugriff über diesen Zugang bedeutet nicht, dass alle BFL-APIs, die Option für private Gewichte, das Bildmodell, das Aktionsmodell oder die FLUX 3 Dev-Version allgemein verfügbar sind.
Dieses Update enthält eine kleine praktische Überprüfung: drei Generationen am 11. August unter Verwendung der Testumgebung flux-3-video Modell-ID, einschließlich einer exakten Wiederholung der Eingabeaufforderung. Dies reicht aus, um das tatsächliche Verhalten und sichtbare Fehlerquellen zu dokumentieren, doch drei Ausgaben stellen keinen umfassenden Benchmark dar.
Drei von FLUX 3 selbst durchgeführte Videotests – kein umfassender Benchmark.
| Läufe | Zurückgegebene Dauer | Auflösung | Audio |
|---|---|---|---|
| 3 von 3 erfolgreich | 5,04 s pro Clip | 1280 × 704 | Dekodierte Daten in allen Dateien |

Was ist FLUX 3?
FLUX 3 ist ein multimodales Grundmodell von Black Forest Labs. Im Gegensatz zu einem System, das ausschließlich darauf trainiert ist, Text in Bilder umzuwandeln, lernt das Modell laut BFL in einer einzigen Architektur gemeinsam aus Bildern, Videos und Audiodaten. Das Ziel besteht darin, Darstellungen zu erstellen, die räumliche Struktur, Bewegung, Klang, Ursache und Handlung miteinander verknüpfen, anstatt jedes Medium als isoliertes Merkmal zu behandeln.

Der Name mag wie ein gewöhnlicher Nachfolger von FLUX.1 und FLUX.2 klingen, doch der Anwendungsbereich ist weitaus größer. FLUX.2 bleibt weiterhin eine aktuelle Produktfamilie zur Bildgenerierung und -bearbeitung; die FLUX 2 Pro – Anleitung behandelt den Bild-Workflow, den Preiskontext und die Eingabeaufforderungen dieser Generation. FLUX 3 wird als gemeinsames Rückgrat für die Erstellung von Inhalten und die Vorhersage von Handlungen positioniert.
BFL verwendet den Begriff “Weltmodell”, um diese Ausrichtung zu beschreiben. Das bedeutet hier nicht, dass das Unternehmen allgemeine Intelligenz angekündigt hat. Es bedeutet vielmehr, dass das Modell lernen soll, wie sichtbare Objekte, Bewegungen, Audiodaten und Aktionen im Zeitverlauf miteinander in Beziehung stehen. Diese Unterscheidung ist wichtig, denn die interessanteste Aussage zu FLUX 3 ist nicht einfach “bessere Bilder”, sondern dass ein einziges zugrunde liegendes Modell verschiedene Arten der Generierung und Steuerung bedient.
Warum FLUX 3 mehr ist als nur ein Bildgenerator
Die meisten kreativen KI-Produkte werden nach wie vor als separate Werkzeuge wahrgenommen: Ein Modell generiert Bilder, ein anderes erstellt Videos und ein drittes fügt Sprache oder Soundeffekte hinzu. FLUX 3 basiert auf einer anderen Prämisse. Wenn eine Architektur diese Modalitäten gemeinsam erlernt, können eine Eingabeaufforderung, ein Referenzbild, eine Bewegungssequenz und ein Soundtrack potenziell auf demselben internen Verständnis beruhen.
- Bilder schaffen Raum: Objekte, Komposition, Textur, Typografie und visuelle Beziehungen.
- Das Video verlängert die Dauer um: Bewegung, Kontinuität, Kontakt und Ursache-Wirkungs-Zusammenhänge über Bildrahmen hinweg.
- Audio fügt ein weiteres synchronisiertes Signal hinzu: Sprache, Raumklang und Geräusche, die mit sichtbaren Ereignissen verbunden sind.
- Die Handlungsvorhersage verbindet Wahrnehmung und Steuerung: Die Darstellung des Modells lässt sich so anpassen, dass vorhergesagt werden kann, was ein Roboter als Nächstes tun sollte.
Für Kreative liegt der praktische Vorteil darin, dass weniger Übergänge zwischen den einzelnen Produktionsphasen erforderlich sind. Natives Audio ist besonders wichtig, da es die Lücke zwischen der Erstellung eines Clips und der separaten Produktion von Dialogen, Effekten und Synchronisation verringern kann. Wenn der Ton für Sie im Vordergrund steht, ist die aktuelle Veo 3.1 – Audioanleitung zeigt, wie eine weitere führende Videoplattform heute mit nativem Audio umgeht.
FLUX 3 – Funktionen im Überblick
| Fähigkeit | Was BFL bekannt gegeben hat | Stand: 11. August 2026 |
|---|---|---|
| FLUX 3 – Video | Erstellung und Bearbeitung von Videos mit optionalem nativem Audio, einschließlich Sprache, Effekten, Stilen, Typografie und Workflows mit mehreren Aufnahmen | BFL Early Access; offizielle Preise veröffentlicht; Route GlobalGPT bestätigt |
| FLUX 3 Bild | Erstellung und Bearbeitung von Bildern über APIs und Zugriff auf private Gewichtungskennzahlen | Early-Access-Phase angekündigt; in diesem Artikel wurde diese noch nicht getestet |
| FLUX 3 – Aktion | Vorhersage nativer Aktionen sowie spezielle Modelle, die auf der Grundlage des Video-Backbones erstellt wurden | Zunächst mit ausgewählten Partnern |
| FLUX 3 Dev | Geplantes, offenes, multimodales Backbone für Video, Audio, Bilder und Aktionsvorhersagen | Angekündigt; Datum und Lizenz noch nicht veröffentlicht |
FLUX 3 Video ist das konkreteste Produkt, das in naher Zukunft auf den Markt kommen wird. Laut BFL unterstützt es die Umwandlung von Text in Video sowie die Bearbeitung, synchronisierten Ton, mehrsprachige Dialoge, verschiedene Seitenverhältnisse, Typografie und verkettete Clips. Mit diesen Funktionen bewegt es sich in einem zunehmend umkämpften Markt; das Der beste Vergleich von KI-Videogeneratoren bietet nützliche Hintergrundinformationen dazu, welche Funktionen Kreative bereits nutzen können, solange der Zugriff auf FLUX 3 noch eingeschränkt ist.
In dem Ankündigungsbeitrag werden in den vorläufigen Auswertungen zudem 10-Sekunden-Clips in 720p beschrieben, die aus Text generiert wurden und über Ton verfügen. BFL weist ausdrücklich darauf hin, dass sich das Modell und das Auswertungs-Harness noch in der Entwicklung befinden. Daher sind die Zahlen zwar als erste vom Unternehmen gemeldete Belege nützlich, ersetzen jedoch keine unabhängigen, wiederholbaren Tests, sobald der öffentliche Zugang erweitert wird.
Die aktuelle Modellseite geht noch einen Schritt weiter: Dort heißt es, dass FLUX 3 Video in einem Durchlauf bis zu 20 Sekunden generieren kann, wobei Audio optional ist und mehrsprachige Sprache, Effekte und Umgebungsgeräusche zusammen mit den Einzelbildern erzeugt werden. Das sind die offiziellen Leistungsgrenzen; der folgende Praxistest zeigt, was die angeschlossene Plattform auf unsere Eingaben tatsächlich zurückgegeben hat.
Ist FLUX 3 bereits erhältlich?
Ja, aber nur im Rahmen eines gestaffelten Early-Access-Programms. BFL hat einen Bewerbungsweg eingerichtet, anstatt eine breit angelegte Selbstbedienungs-Einführung zu starten. Das Unternehmen kann daher mit ausgewählten Nutzern und Partnern zusammenarbeiten, während sich die Modelle, APIs, Optionen für private Gewichtung und der Bewertungsprozess noch in der Entwicklung befinden.

| Frage | Bekannt | Noch begrenzt oder unbekannt |
|---|---|---|
| Können sich Personen bei BFL bewerben? | Ja, über das offizielle Antragsformular | Abnahmekriterien und Reaktionszeit |
| Können Nutzer FLUX 3 Video auf GlobalGPT testen? | Ja; der Link zum verifizierten Produkt ist unten angegeben | Die Routenbeschränkungen und Kontingente hängen vom Plattformkonto ab |
| Zu welchem Preis wird BFL öffentlich gehandelt? | Text/Bild-zu-Video, Fortsetzung, Entwurf, HD- und FHD-Auflösungen | Begriffe aus den Bereichen „Private-Weight“ und „Enterprise“ |
| Wird es eine offene Gewichtsklasse geben? | FLUX 3 Dev ist als Open-Weight-Modell geplant | Veröffentlichungsdatum, Lizenz und Systemvoraussetzungen |

Die sicherste Interpretation ist ganz einfach: FLUX 3 existiert tatsächlich und die Einführung läuft bereits, aber “Early Access” sollte nicht als “für alle verfügbar” umgedeutet werden. Wenn Sie einen Termin für die Produktionsfreigabe benötigen, warten Sie auf eine schriftliche Zugangsbestätigung und die entsprechenden Bedingungen, bevor Sie einen entsprechenden Arbeitsablauf planen.
Wir haben FLUX 3 getestet – Video: Drei Durchläufe, echte Ergebnisse
Testaufbau: Wir haben die Tests am 11. August 2026 über die mit der Plattform verbundene Broly-Task-Testumgebung unter Verwendung der genauen Modell-ID durchgeführt flux-3-video. Jede Anfrage enthielt lediglich die Modell-ID und die Eingabeaufforderung. Wir haben drei Aufgaben übermittelt: eine Eingabeaufforderung zur Produktwerbung, eine zur zeitlichen Konsistenz sowie eine exakte Wiederholung der ersten Eingabeaufforderung. Die Aufgaben-API meldete tatsächliche Verarbeitungszeiten von 88, 190 bzw. 77 Sekunden. Da die Durchläufe parallel liefen und sich die Route noch weiterentwickelt, sollten diese Zeiten nicht als Latenz-Benchmark betrachtet werden.
Test 1: Typografie, Transformation und natives Audio
Aufgaben-ID: task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. Die Vorgabe lautete: eine achtsekündige Parfümwerbung mit zwei Einstellungen, genauem Etikettentext, einer Verwandlung des Flakons in eine Stadt, einem Glasklirren, einem Rauschen und einer gesprochenen Zeile.

Was geschah: Das Ergebnis schloss den gewünschten visuellen Bogen ab und sorgte dafür, dass das blaue Parfüm-Konzept in beiden Szenen erkennbar blieb. Das Etikett blieb lesbar, verdichtete jedoch optisch den gewünschten Raum und ähnelte eher “FLUX3” als dem exakten “FLUX 3”. Auch die Flasche änderte während der Transformation die Form von Verschluss und Flaschenkörper. Die MP4-Datei enthielt dekodierte Audiodaten, doch unsere automatisierte Überprüfung hat die gesprochene Zeile nicht transkribiert, sodass wir den Dialog nicht Wort für Wort bewerten können. Vor allem aber war der zurückgesendete Clip 5,04 Sekunden lang statt der angeforderten acht Sekunden.
Test 2: Einmalige Bewegung und Objektkonsistenz
Aufgaben-ID: task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. Bei dieser Aufgabe wurden Szenenwechsel weggelassen, und ein Aufziehroboter sollte drei Markierungen in einer festgelegten Reihenfolge überqueren, wobei er seine charakteristischen Merkmale beibehalten sollte.

Was geschah: Dies war das sauberere Ergebnis. Der Roboter bewegte sich in die gewünschte Richtung und überquerte nacheinander die gelben, blauen und grünen Markierungen. Seine wichtigsten Erkennungsmerkmale blieben während der gesamten Aufnahme sichtbar, ohne zusätzliche Effekte oder offensichtliche Kameraschnitte. Die Bewegung wirkte eher schlicht als filmisch, doch gerade diese Schlichtheit erleichterte die Beurteilung der Konsistenz. Die Ausgabe dauerte erneut 5,04 Sekunden und enthielt dekodierte Audiodaten.
Test 3: exakte Wiederholung der ersten Eingabeaufforderung
Aufgaben-ID: task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. Wir haben die erste Aufforderung noch einmal verschickt, ohne auch nur ein Wort zu ändern.

Was geschah: Bei der Wiederholung wurde eher das Konzept als das genaue Ergebnis beibehalten. Es entstand erneut eine blaue Flasche, der lesbare Schriftzug “FLUX3”, ein Lichtband und eine nächtliche Skyline, doch die Geometrie der Flasche, der Verschluss, die Einrahmung und der Übergang unterschieden sich. Das ist bei einer nicht vorbestimmten Generierung normal, spielt jedoch eine Rolle, wenn ein Markenteam wiederholbare Produktdetails erwartet.
| Testdimension | Beobachtetes Ergebnis | Praktische Erkenntnisse |
|---|---|---|
| Aufgabenabschluss | 3 von 3 Aufgaben wurden erfolgreich abgeschlossen | Die verbundene Strecke war während dieses Tests in Betrieb. |
| Dauersteuerung | Alle drei Befehle erforderten 8 Sekunden; alle lieferten 5,04 Sekunden | Überprüfen Sie die Laufzeitsteuerungen auf Routenebene vor der Inbetriebnahme |
| Typografie | Das Etikett ist lesbar, aber der genaue Abstand bei “FLUX 3” wurde nicht beibehalten | Planung von Nachdreharbeiten oder Nachbearbeitung bei Markentexten |
| Zeitliche Konsistenz | Der einfache Roboter behielt seine charakteristischen Merkmale und die Reihenfolge der Marker bei | Eingeschränkte Single-Shot-Prompts können sich gut behaupten |
| Wiederholbarkeit | Gleiche Geschichte, unterschiedliche Produktgeometrie und Kameraauswahl | Eine exakte Wiederholung der Eingabeaufforderung ist keine exakte visuelle Wiederholung. |
| Audio | Jede MP4-Datei enthielt dekodierte Audiodaten; die Dialoge wurden nicht automatisch transkribiert | Vor der Freigabe die Synchronisation manuell anhören und überprüfen |
Unser Fazit: Das FLUX-3-Video orientierte sich stärker an der übergeordneten Szenenlogik als an den genauen Produktionsvorgaben. Die flüssige Produkttransformation und die geordnete Bewegung des Roboters waren vielversprechend. Die festgelegte Rücklaufzeit von 5,04 Sekunden, der ungenaue Textabstand und die Abweichung der Flaschenform sind Gründe dafür, den eigenen Arbeitsablauf vor der endgültigen Umsetzung zu testen. Dies ist ein nützliches praktisches Feedback, keine modellweite Bewertung.
FLUX 3 vs. FLUX.2: Was hat sich eigentlich geändert?
| Fläche | FLUX.2 | FLUX 3 |
|---|---|---|
| Primäre öffentliche Identität | Produktfamilie für die Bilderstellung und -bearbeitung | Multimodales Grundmodell |
| Modalitäten | Bilder und Arbeitsabläufe bei der Bildbearbeitung | Bilder, Video, Audio und Handlungsvorhersage |
| Aktueller Zugriff | Veröffentlichte API-Modelle und Preise | BFL-Video im Vorabzugang, offizielle Videopreise und eine verifizierte GlobalGPT-Route |
| Richtung des offenen Modells | Mehrere FLUX.2-Varianten und dokumentierte Endpunkte | Gewichte für FLUX 3 Dev bekannt gegeben, Details folgen |
| Faires Leistungsurteil | Kann heute als Bildmodell getestet werden | Das Video lässt sich überprüfen; ein pauschales Urteil für die gesamte Familie wäre noch verfrüht |
Die größte Veränderung betrifft den Anwendungsbereich und nicht eine nachgewiesene prozentuale Verbesserung. FLUX 3 ist nicht einfach nur FLUX.2 mit einem neuen Bildqualitätswert; es soll die kreative Generierung und physische Aktionen in einer einzigen Produktfamilie vereinen. Für eine aktuelle Entscheidung, die ausschließlich auf dem Bild basiert, ist die Vergleich zwischen FLUX 2 und Nano Banana Pro ist besser umsetzbar, da beide Seiten heute als Bildbearbeitungswerkzeuge genutzt werden können.
Für einen umfassenden Vergleich zwischen FLUX 3 und FLUX.2 müssen noch folgende Aspekte berücksichtigt werden: passende Bild-Prompts, Referenzbearbeitungen, Typografie, Einhaltung der Prompts, Latenz und Kosten. Die oben gezeigte Videoanalyse mit drei Durchläufen schließt die Lücke in der Evidenz, und BFL veröffentlicht nun zwar die FLUX-3-Videoraten, vergleicht jedoch weder das Bildmodell noch die Open-Weight-Varianten.
Was die offiziellen Demos und die Ergebnisse im Bereich Robotik zeigen
Die Einführungsmaterialien von BFL zeigen generierte Videos, synchronisierten Ton, visuelle Stile, animierten Text und erste Bearbeitungsfunktionen. Sie veranschaulichen die Produktrichtung und die Art von Ergebnissen, die das Unternehmen anstrebt. Da es sich hierbei um ausgewählte offizielle Beispiele handelt, geben sie keinen Aufschluss darüber, wie oft ein gewöhnlicher Nutzer die gleiche Qualität erzielen wird, wie lange die Generierung dauert oder welche Kosten pro Ergebnis anfallen.

Die Arbeit im Bereich Robotik ist spezifischer. In der FLUX 3 x Mimic-Bericht, BFL und Mimic Robotics beschreiben die Anpassung des FLUX-3-Video-Backbones zur Vorhersage von Roboteraktionen. Das dargestellte Soft-Body-Kitting-Diagramm weist für FLUX-Mimic eine mediane Erfolgsrate von 95% aus, wobei jeder gestrichelte Medianwert auf 20 autonomen Versuchen basiert.
Dies ist ein Ergebnis aus der Robotik und kein Benchmark für Bild- oder Videoqualität. Seine Relevanz ist konzeptioneller Natur: BFL argumentiert, dass ein Backbone, der darauf trainiert wurde, Bewegung, Kontakt, Gewicht und Ursache zu modellieren, Darstellungen liefern kann, die für physische Aufgaben nützlich sind. Ob sich derselbe Ansatz auf verschiedene Roboter, Fabriken und Aufgaben verallgemeinern lässt, muss durch umfassendere unabhängige Belege bestätigt werden.
Erste Reaktionen der Community auf X und Reddit
FLUX 3 erregte sofort Aufmerksamkeit. Im Verifizierungs-Snapshot vom 27. Juli war der Offizielle BFL-Mitteilung auf X Es wurden 6.088 Likes, 862 Reposts, 365 Zitate und 314 Antworten verzeichnet. Diese Zahlen spiegeln das Interesse an der Markteinführung wider, nicht die Zuverlässigkeit des Modells, und sie werden sich weiterhin ändern.

A Reddit-Beitrag in r/StableDiffusion Der Beitrag mit dem Titel “Flux 3 sieht wahnsinnig aus. Das war eine einzige Eingabe” wies im selben Überprüfungsfenster 370 Upvotes und 63 Kommentare auf. Das Split-Screen-Beispiel des Beitrags verwendet zwar eine anspruchsvolle Eingabe, handelt es sich jedoch nach wie vor um ein einzelnes Beispiel und nicht um einen kontrollierten Benchmark.

Die richtige Schlussfolgerung lautet, dass die Entwickler an der Komplexität der Prompts, der Bewegung, den nativen Klängen und der visuellen Konsistenz interessiert sind. Sobald der Zugang erweitert wird, sollte die Reproduzierbarkeit der Prompts zu einem zentralen Testkriterium werden. In der Zwischenzeit ist die Kling 3.0 – Formel für die Eingabeaufforderung ist eine nützliche Orientierungshilfe für die Gestaltung von Szenen, das Kameraverhalten, Bewegungen und Einschränkungen in den derzeit verfügbaren Videotools.
FLUX 3 – API, Preise und offene Gewichte
Stand: 11. August, BFLs veröffentlichte Preisdokumente Beinhaltet FLUX 3 Video. Ein Credit entspricht $0,01. Text-zu-Video und Bild-zu-Video kosten $0,17 pro Sekunde in HD oder $0,29 pro Sekunde in FHD, während HD-Entwürfe $0,06 pro Sekunde kosten. Die Videofortsetzung kostet $0,43 pro Sekunde in HD oder $0,54 pro Sekunde in FHD, Entwürfe kosten $0,12 pro Sekunde.
| Artikel | Veröffentlicht oder überprüft | Noch begrenzt oder unbekannt |
|---|---|---|
| Preise für FLUX 3 Video | T2V/I2V: $0,17/s HD, $0,29/s FHD; Entwurf: $0,06/s. Fortsetzung: $0,43/s HD, $0,54/s FHD; Entwurf: $0,12/s | Begriffe aus den Bereichen „Private-Weight“ und „Enterprise“ |
| BFL-Zugang | Das Video zum Early Access, die Modellübersicht und die Preise sind öffentlich zugänglich | Allgemeine API-Zulassung, Kontingente und kontospezifische Beschränkungen |
| GlobalGPT-Zugang | Überprüfung der FLUX-3-Video-Produktroute und erfolgreicher Test der Aufgabe mit drei Durchläufen | Kontokontingente und Steuerungsmöglichkeiten auf Routenebene können von dem direkten Angebot von BFL abweichen |
| FLUX 3 Dev | Als multimodales Backbone mit offenem Gewichtsstandard konzipiert | Veröffentlichungsdatum, Lizenz, Parametergröße und Hardwareanforderungen |
Man sollte “Open Weight” nicht mit “Open Source” gleichsetzen. Für die Gewichte, den Code, die Trainingsdaten und die Lizenz können jeweils unterschiedliche Zugangsbedingungen gelten. Eine aussagekräftige Einschätzung zu „Open Weight“ kann erst erfolgen, wenn BFL die eigentliche FLUX 3 Dev-Version und die Lizenz veröffentlicht hat.
So beantragen Sie den vorzeitigen Zugang zu FLUX 3
- Öffnen Sie die Offizielle Modellseite zu FLUX 3 und die aktuellen Leistungsangaben überprüfen.
- Klicken Sie auf die Schaltfläche „Anfrage“, um zur Offizielles FLUX 3-Formular für den Early Access.
- Beschreiben Sie die von Ihnen benötigte Funktion – Video, Bild, Aktion, private Gewichte oder Entwicklerzugriff – sowie den Workflow, den Sie erstellen möchten.
- Geben Sie einen realistischen Anwendungsfall, das erwartete Volumen, Angaben zur Organisation sowie die Gründe an, warum der frühzeitige Zugang für das Projekt wichtig ist.
- Warten Sie auf eine schriftliche Bestätigung, bevor Sie von einem Zugang, Preisen, Limits oder einem Liefertermin ausgehen.
Eine konkrete Anfrage ist aussagekräftiger als ein allgemeines “Ich möchte es ausprobieren”. Ein Studio könnte beispielsweise erläutern, dass es mehrsprachige Dialoge und synchronisierte Effekte für kurze Markenclips benötigt, während ein Robotik-Team seine Manipulationsaufgabe, die Roboterplattform, die Daten und die Einsatzumgebung beschreiben könnte.
Wenn der Dialog das Ziel ist, planen Sie die gesamte Pipeline und nicht nur die Eingabeaufforderung zur Generierung. Die Veo 3.1 Arbeitsablauf für Dialoge und Lippensynchronisation hebt die praktischen Aspekte hervor – Sprechzeit, stimmliche Konsistenz, Bildgestaltung und Regeneration –, die auch bei der Bewertung von „FLUX 3 Video“ eine Rolle spielen werden.
Für wen ist „FLUX 3“ geeignet?
- KI-Videoproduzenten Man sollte auf die Original-Tonspur, mehrsprachige Dialoge, den Schnitt, die Verknüpfung mehrerer Einstellungen, die Konsistenz, das Tempo und die endgültige Preisgestaltung achten.
- Bildgestalter sollte man abwarten, bis wiederholbare Vergleiche vorliegen, die die Einhaltung der Vorgaben, die Bearbeitung der Referenztexte, die Typografie und die Kosten abdecken. Bis dahin ist die Die besten KI-Bildgeneratoren im Test 2026 sind die praktischere Vorauswahl.
- Entwickler sollte öffentliche Modell-IDs, Ratenbeschränkungen, SDK-Unterstützung, Bedingungen für private Gewichtung sowie die künftige Lizenz von FLUX 3 Dev im Auge behalten.
- Teams für Robotik und physikalische KI sollte untersucht werden, ob sich der FLUX-Mimic-Ansatz über die veröffentlichte Aufgabe hinaus übertragen lässt und inwieweit eine aufgabenspezifische Datenanpassung erforderlich ist.
Bevor Sie einen Produktions-Workflow freigeben, sollten Sie eine FLUX-3-Bereitschaftsprüfung mit vier Prüfschritten durchführen. Eine Einführungsdemo kann den Prüfschritt „Funktionsfähigkeit“ bestehen, ohne dass die Prüfschritte „Zugang“, „Wirtschaftlichkeit“ oder „Nachweis“ erfüllt sein müssen.
| Tor | Was muss wahr sein? | Zu sammelnde Beweise |
|---|---|---|
| Zugang | Ihr Team verfügt über eine schriftliche Genehmigung für die erforderliche Befähigung | Einladung zur Kontoeröffnung, Nutzungsbedingungen, Region, Kontingente und Support-Kontakt |
| Fähigkeit | Das Modell erledigt Ihre eigentliche Aufgabe und dient nicht nur als Vorzeigebeispiel. | Abgestimmte Eingabeaufforderungen, Referenzeingaben, Fehlerfälle und Wiederholungsläufe |
| Wirtschaft | Kosten und Durchlaufzeit entsprechen dem Produktionsplan | Preis, Generierungszeit, Wiederholungsrate, Volumenbeschränkungen und Infrastruktur |
| Beweise | Die Ergebnisse sind auch außerhalb ausgewählter Anwendungsbeispiele weiterhin glaubwürdig | Unabhängige Tests, reproduzierbare Einstellungen und versionierte Ausgaben |
Möchten Sie das in unserem Test verwendete Modell ausprobieren? Öffnen Sie FLUX 3 – Video zu GlobalGPT. Die Produkt-Route war in Betrieb, und die zugehörige Aufgabenumgebung hat am 11. August 2026 alle drei Durchläufe abgeschlossen. Überprüfen Sie die in Ihrem eigenen Konto angezeigten Kontrollen und Kontingente, bevor Sie einen Produktionslauf starten.
Häufig gestellte Fragen zu FLUX 3
Wann wurde FLUX 3 angekündigt?
Black Forest Labs kündigte am 23. Juli 2026 FLUX 3 an. In der Ankündigung wurde ein multimodales Grundmodell vorgestellt, das Bilder, Videos, Audio und Aktionsvorhersagen umfasst. Die Funktionen werden nicht im Rahmen einer einzigen breiten öffentlichen Veröffentlichung, sondern schrittweise im Rahmen eines Early-Access-Programms bereitgestellt.
Ist FLUX 3 öffentlich zugänglich?
BFL bietet „FLUX 3 Video“ im Rahmen des Early-Access-Programms an und veröffentlicht nun die Preise für dieses Video-Angebot. Auch GlobalGPT verfügt über einen verifizierten Produktpfad für „FLUX 3 Video“. Das bedeutet jedoch nicht, dass „FLUX 3 Image“, „Action“, private Gewichte oder „FLUX 3 Dev“ allgemein im Selbstbedienungsmodus verfügbar sind; für jede Funktion gelten weiterhin eigene Einführungsphasen und Bedingungen.
Kann FLUX 3 Videos mit nativem Ton erstellen?
Ja. Laut BFL kann FLUX 3 Video mehrsprachige Sprache, Effekte und Umgebungsgeräusche anhand der Einzelbilder generieren. Alle drei MP4-Dateien in unserem Test vom 11. August enthielten dekodierte Audiodaten. Da wir die Tonspuren nicht automatisch transkribiert haben, bestätigt der Test lediglich das Vorhandensein von Audio und nicht die wortgetreue Wiedergabe von Dialogen.
Ist FLUX 3 ebenfalls ein Bildmodell?
Ja. Die Bildgenerierung und -bearbeitung sind Teil der FLUX-3-Produktfamilie, doch laut BFL soll der „FLUX 3 Image Early Access“ erst in den Wochen nach der ersten Ankündigung starten. Öffentliche Endpunktnamen, der endgültige Verfügbarkeitszeitpunkt und die Preise wurden zum Zeitpunkt dieser Aktualisierung noch nicht bekannt gegeben.
Ist FLUX 3 Open Source oder Open Weight?
BFL hat angekündigt, dass FLUX 3 Dev künftig als Open-Weight-Version verfügbar sein wird. Das Unternehmen hat bislang weder das Veröffentlichungsdatum noch die Lizenz, die Parametergröße, den Codeumfang oder die Hardwareanforderungen bekannt gegeben. Solange diese Details noch nicht vorliegen, ist es zutreffender, von “geplantem Open Weight” statt von “Open Source” zu sprechen.”
Inwiefern unterscheidet sich FLUX 3 von FLUX.2?
FLUX.2 ist in erster Linie eine Familie von Modellen zur Erzeugung und Bearbeitung von Bildern, deren Endpunkte und Preise bereits veröffentlicht wurden. FLUX 3 ist eine umfassendere multimodale Grundlage, die darauf abzielt, Bilder, Videos, Audio und Aktionsvorhersagen miteinander zu verknüpfen. Ein fairer Qualitäts- oder Kostenvergleich muss bis zu einem breiteren Zugang zu FLUX 3 warten.
Was hat der Praxistest des FLUX 3 ergeben?
Drei von drei Aufgaben wurden erfolgreich mit dem flux-3-video Modell-ID. Die Ausgaben entsprachen den angeforderten übergeordneten Szenen, und der Robotertest behielt seine Bewegungsreihenfolge und die Hauptmerkmale bei. Alle drei Clips waren 5,04 Sekunden lang, obwohl die Vorgaben acht Sekunden betrugen; der genaue Abstand zwischen den Markierungen und die wiederholte Produktgeometrie waren nicht perfekt.
Kann ich FLUX 3 auf GlobalGPT verwenden?
Ja. Die verifizierte Route lautet FLUX 3 – Video zu GlobalGPT. Am 11. August 2026 haben wir zudem drei Generationen über die vernetzte Aufgabenumgebung abgeschlossen. Der Zugriff auf die Plattform erfolgt unabhängig vom direkten Zugriff über die BFL-API oder auf private Gewichte.
Abschließende Erkenntnis
FLUX 3 ist nicht mehr nur ein Versprechen auf der Startseite. BFL veröffentlicht Informationen zu Videofunktionen und Preisen, GlobalGPT verfügt über eine verifizierte Route, und unsere drei Durchläufe lieferten brauchbare MP4-Dateien mit Audiostreams. Das Modell bewältigte die Szenenlogik und eingeschränkte Bewegungen gut, verfehlte jedoch die gewünschte Dauer und ließ bei der exakten Textwiedergabe sowie der Produktkonsistenz nach. Testen Sie Ihre eigentliche Eingabe vor der Skalierung und behalten Sie FLUX 3 Image, Action, die privaten Gewichte sowie die FLUX 3 Dev-Lizenz im Auge, während sich diese Teile der Produktfamilie weiterentwickeln.



