Réponse rapide : FLUX 3 est le modèle de base multimodal de Black Forest Labs dédié aux images, à la vidéo, à l’audio et à la prédiction d’actions. Au 11 août 2026, BFL propose FLUX 3 Video en accès anticipé, avec des extraits d’une durée maximale de 20 secondes, un son natif en option et une tarification publique à la seconde. GlobalGPT dispose également d’un parcours FLUX 3 Video vérifié. Lors de notre test en trois essais, toutes les tâches ont été menées à bien et ont généré un fichier MP4 de 5,04 secondes avec un flux audio, mais le contrôle précis de la durée, l’espacement typographique et la cohérence des objets n’étaient pas parfaits.
La formulation de ce statut doit encore être affinée. Le article officiel de lancement et page officielle du modèle FLUX 3 Video est présenté comme étant en « accès anticipé », tandis que la page des tarifs de BFL affiche désormais les tarifs des vidéos. GlobalGPT met à disposition une interface distincte alimentée par le modèle. L'accès via cette interface ne signifie pas que toutes les API BFL, l'option de poids privés, le modèle Image, le modèle Action ou la version FLUX 3 Dev soient disponibles pour tous.
Cette mise à jour inclut un petit test pratique : trois générations le 11 août à l'aide de l'environnement de test flux-3-vidéo ID du modèle, incluant une répétition exacte de la requête. Cela suffit pour documenter le comportement réel et les points de défaillance visibles, mais trois résultats ne constituent pas un benchmark représentatif.
Trois tests vidéo FLUX 3 réalisés en interne — il ne s'agit pas d'un test de performance à grande échelle.
| Séries | Durée renvoyée | Résolution | Audio |
|---|---|---|---|
| 3 sur 3 réussis | 5,04 s par clip | 1 280 × 704 | Données décodées dans tous les fichiers |

Qu'est-ce que FLUX 3 ?
FLUX 3 est un modèle de base multimodal développé par Black Forest Labs. Contrairement à un système uniquement entraîné à transformer du texte en images, BFL précise que ce modèle apprend simultanément à partir d’images, de vidéos et de fichiers audio au sein d’une même architecture. L’objectif est de construire des représentations qui relient la structure spatiale, le mouvement, le son, la cause et l’action, plutôt que de traiter chaque support comme une caractéristique isolée.

Ce nom peut sembler être une simple suite logique de FLUX.1 et FLUX.2, mais son champ d'application est bien plus large. FLUX.2 reste une gamme de logiciels de création et de retouche d'images ; le Guide FLUX 2 Pro couvre le flux de travail en matière d'images, le contexte tarifaire et les consignes de cette génération. FLUX 3 est présenté comme une infrastructure commune pour la création de contenu et la prédiction d'actions.
BFL utilise l'expression “ modèle du monde ” pour décrire cette orientation. Cela ne signifie pas pour autant que l’entreprise ait annoncé la mise au point d’une intelligence générale. Cela signifie plutôt que le modèle est conçu pour apprendre comment les objets visibles, les mouvements, les sons et les actions s’articulent entre eux au fil du temps. Cette distinction est importante, car l’argument le plus intéressant avancé par FLUX 3 ne se résume pas simplement à des “ images de meilleure qualité ” ; il s’agit d’un modèle sous-jacent unique servant à plusieurs types de génération et de contrôle.
Pourquoi FLUX 3 est bien plus qu'un simple générateur d'images
La plupart des produits d'IA créative sont encore perçus comme des outils distincts : un modèle génère des images, un autre produit des vidéos et un troisième ajoute des voix ou des effets sonores. FLUX 3 repose sur un principe différent. Si une seule architecture apprend ces modalités ensemble, une consigne, une image de référence, une séquence animée et une bande-son peuvent potentiellement partager la même compréhension interne.
- Les images offrent de l'espace : les objets, la composition, la texture, la typographie et les relations visuelles.
- La vidéo ajoute du temps : le mouvement, la persistance, le contact et la relation de cause à effet d'une image à l'autre.
- L'audio ajoute un autre signal synchronisé : la parole, l'ambiance sonore et les sons liés à des événements visibles.
- La prédiction de l'action fait le lien entre la perception et le contrôle : La représentation du modèle peut être adaptée pour prédire ce qu'un robot devrait faire ensuite.
Pour les créateurs, l'intérêt pratique réside dans la réduction du nombre de passages de relais entre les différentes étapes de production. L'audio natif revêt une importance particulière, car il permet de réduire le décalage entre la création d'un clip et la production séparée des dialogues, des effets et de la synchronisation. Si le son est votre principale préoccupation, la solution actuelle Veo 3.1 Guide audio montre comment une autre grande famille de services vidéo aborde aujourd'hui l'audio natif.
Aperçu des fonctionnalités de FLUX 3
| Capacité | Ce qu'a annoncé BFL | Situation au 11 août 2026 |
|---|---|---|
| Vidéo FLUX 3 | Création et montage de vidéos avec, en option, de l'audio natif, notamment des voix off, des effets, des styles, de la typographie et des workflows multi-plans | Accès anticipé à BFL ; publication des tarifs officiels ; itinéraire GlobalGPT confirmé |
| Image FLUX 3 | Génération et retouche d'images via des API et l'accès aux poids privés | Lancement de l'accès anticipé annoncé ; cet article ne l'a pas testé |
| FLUX 3 Action | Prédiction d'actions natives et modèles spécialisés développés à partir de l'infrastructure vidéo | En collaboration avec des partenaires triés sur le volet |
| FLUX 3 Dev | Infrastructure multimodale ouverte prévue pour la vidéo, l'audio, l'image et la prédiction d'actions | Annoncé ; date et licence non publiées |
FLUX 3 Video est le produit le plus abouti à court terme. Selon BFL, il prend en charge la conversion de texte en vidéo et le montage, la synchronisation audio, les dialogues multilingues, divers formats d'image, la typographie et l'enchaînement de clips. Ces fonctionnalités le placent sur un marché de plus en plus concurrentiel ; le Comparatif des meilleurs générateurs de vidéos basés sur l'IA fournit des informations utiles sur les fonctionnalités dont les créateurs peuvent déjà profiter tant que l'accès à FLUX 3 reste limité.
Le billet annonçant le lancement décrit également, dans le cadre de ses évaluations préliminaires, des clips vidéo de 10 secondes en 720p générés à partir de texte et comportant du son. BFL précise explicitement que le modèle et le cadre d’évaluation sont encore en cours de développement. Ces chiffres constituent donc des premières données utiles fournies par l’entreprise, mais ne sauraient se substituer à des tests indépendants et reproductibles qui seront menés une fois que l’accès public aura été élargi.
La page de présentation actuelle va plus loin : elle indique que FLUX 3 Video peut générer jusqu’à 20 secondes en un seul passage, avec un son facultatif et des voix multilingues, des effets et des ambiances générés en même temps que les images. Il s’agit là des limites officielles ; le test pratique ci-dessous montre ce que la plateforme connectée a réellement généré à partir de nos requêtes.
FLUX 3 est-il déjà disponible ?
Oui, mais uniquement dans le cadre d'un accès anticipé par étapes. BFL a mis en place une procédure de candidature plutôt qu'un lancement en libre-service à grande échelle. L'entreprise peut ainsi travailler avec des utilisateurs et des partenaires sélectionnés, alors que les modèles, les API, les options de poids privés et le processus d'évaluation sont encore en cours d'évolution.

| Question | Connu | Encore limitées ou inconnues |
|---|---|---|
| Peut-on postuler chez BFL ? | Oui, via le formulaire de demande officiel | Critères d'acceptation et délai de réponse |
| Les utilisateurs peuvent-ils tester FLUX 3 Video sur GlobalGPT ? | Oui ; le lien vers la procédure de vérification du produit se trouve ci-dessous | Les limites et quotas par itinéraire dépendent du compte de la plateforme |
| Quel est le cours officiel du BFL ? | Taux de conversion texte/image en vidéo, continuation, brouillon, HD et FHD | Conditions relatives aux abonnements « Private-weight » et aux abonnements d'entreprise |
| Y aura-t-il des catégories sans limite de poids ? | Le FLUX 3 Dev est prévu en catégorie « open weight » | Date de sortie, licence et configuration matérielle requise |

L'interprétation la plus prudente est simple : FLUX 3 existe bel et bien et son déploiement est en cours, mais il ne faut pas confondre “ accès anticipé ” et “ accessible à tous ”. Si vous avez besoin d'une date butoir de mise en production, attendez de recevoir une confirmation écrite de l'accès ainsi que les conditions d'utilisation avant de concevoir un processus de travail autour de cette solution.
Nous avons testé FLUX 3 en vidéo : trois essais, des résultats concrets
Configuration du test : Nous avons effectué les tests le 11 août 2026 via l'environnement de test de tâches Broly connecté à la plateforme, en utilisant l'identifiant exact du modèle flux-3-vidéo. Chaque requête ne contenait que l'identifiant du modèle et la consigne. Nous avons soumis trois tâches : une consigne relative à une publicité pour un produit, une consigne relative à la cohérence temporelle et une répétition exacte de la première consigne. L’API des tâches a indiqué des durées de traitement réelles de 88, 190 et 77 secondes respectivement. Étant donné que les exécutions étaient simultanées et que l’infrastructure est encore en cours d’évolution, ces durées ne doivent pas être considérées comme une référence en matière de latence.
Test n° 1 : typographie, transformation et audio natif
ID de la tâche : task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. Le sujet demandait de créer une publicité pour un parfum de huit secondes comportant deux plans, avec le texte exact figurant sur l'étiquette, une transformation du flacon en ville, le bruit d'un verre qui s'ouvre, un effet sonore de souffle et une réplique prononcée.

Ce qui s'est passé : Le résultat final a respecté l’arc visuel demandé et a permis de conserver la lisibilité du concept de parfum bleu dans les deux scènes. L’étiquette est restée lisible, mais elle a visuellement réduit l’espace demandé et ressemblait davantage à “ FLUX3 ” qu’à “ FLUX 3 ” exactement. Le flacon a également changé de forme au niveau du bouchon et du corps au cours de la transformation. Le fichier MP4 contenait des données audio décodées, mais notre inspection automatisée n’a pas transcrit la réplique prononcée ; nous ne notons donc pas le dialogue mot pour mot. Plus important encore, le clip fourni durait 5,04 secondes au lieu des huit secondes demandées.
Test 2 : mouvement ponctuel et cohérence des objets
ID de la tâche : task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. Cette consigne supprimait les changements de scène et demandait à un robot à remontoir de franchir trois repères dans un ordre précis tout en conservant ses caractéristiques distinctives.

Ce qui s'est passé : C'était le résultat le plus net. Le robot s'est déplacé dans la direction demandée et a franchi les marqueurs jaunes, bleus et verts dans l'ordre. Ses principaux éléments distinctifs sont restés visibles tout au long du plan, sans personnage supplémentaire ni coup de caméra évident. Le mouvement semblait simple plutôt que cinématographique, mais cette simplicité facilitait l'évaluation de la cohérence. La séquence a de nouveau duré 5,04 secondes et contenait des données audio décodées.
Test n° 3 : répétition exacte de la première consigne
ID de la tâche : task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. Nous avons renvoyé la première consigne telle quelle, sans en changer un mot.

Ce qui s'est passé : La répétition a conservé le concept plutôt que le résultat exact. Elle a de nouveau donné une bouteille bleue, l’inscription “ FLUX3 ” lisible, un ruban de lumière et une ligne d’horizon nocturne, mais la géométrie de la bouteille, le bouchon, le cadrage et la transition différaient. C’est normal pour une génération non guidée, mais cela a son importance lorsqu’une équipe de marque s’attend à ce que les détails du produit soient reproductibles.
| Dimension de test | Résultat observé | Points à retenir |
|---|---|---|
| Réalisation de la tâche | 3 tâches sur 3 ont été menées à bien | Le parcours connecté était opérationnel pendant ce test |
| Contrôle de la durée | Les trois requêtes demandaient 8 secondes ; toutes ont renvoyé 5,04 secondes. | Vérifier les contrôles de durée au niveau des itinéraires avant la mise en production |
| Typographie | L'étiquette est lisible, mais l'espacement exact de “ FLUX 3 ” n'a pas été conservé | Prévoir des retouches ou un travail de post-production sur le texte de la marque |
| Cohérence temporelle | Le robot simple a conservé ses caractéristiques distinctives et l'ordre de ses marqueurs | Les invites à tir unique avec contraintes peuvent donner de bons résultats |
| Répétabilité | Même principe, mais avec une géométrie du produit et des choix de caméras différents | Une répétition exacte de la consigne n'est pas une répétition visuelle exacte |
| Audio | Chaque fichier MP4 contenait des données audio décodées ; les dialogues n'étaient pas transcrits automatiquement. | Écouter et vérifier manuellement la synchronisation avant validation |
Notre verdict : La vidéo FLUX 3 a mieux respecté la logique générale de la scène que les contraintes de production précises. La fluidité de la transformation du produit et les mouvements ordonnés du robot étaient encourageants. Le retour fixe de 5,04 secondes, l’espacement imparfait du texte et la dérive de la forme de la bouteille sont autant de raisons de tester votre propre workflow avant de vous engager. Il s’agit d’un indicateur pratique utile, et non d’une note valable pour l’ensemble du modèle.
FLUX 3 vs FLUX.2 : Qu'est-ce qui a réellement changé ?
| Zone | FLUX.2 | FLUX 3 |
|---|---|---|
| Identité publique principale | Famille de produits de création et d'édition d'images | Modèle de base multimodal |
| Modalités | Images et processus de traitement d'images | Images, vidéo, audio et prédiction d'actions |
| Accès actuel | Modèles d'API publiés et tarifs | Accès anticipé à la vidéo BFL, tarifs officiels des vidéos et itinéraire GlobalGPT vérifié |
| Direction du modèle ouvert | Plusieurs variants de FLUX.2 et des critères d'évaluation documentés | Annonce des poids pour la version « Dev » de FLUX 3 ; détails à venir |
| Un bilan équitable | Peut être testé dès aujourd'hui en tant que modèle d'image | La vidéo peut être examinée ; il est encore trop tôt pour tirer des conclusions générales concernant l'ensemble de la famille |
Le changement le plus important concerne la portée, et non une amélioration en pourcentage vérifiée. FLUX 3 n'est pas simplement une version de FLUX.2 dotée d'un nouvel indice de qualité d'image ; il vise à unifier la création et l'action physique au sein d'une même famille. Pour une décision actuelle basée uniquement sur l'image, le Comparaison entre le FLUX 2 et le Nano Banana Pro est plus exploitable, car ces deux aspects peuvent aujourd'hui être considérés comme des outils visuels.
Une comparaison complète entre FLUX 3 et FLUX.2 doit encore prendre en compte la correspondance des prompts d'images, les modifications de référence, la typographie, le respect des prompts, la latence et le coût. La vérification vidéo en trois passages présentée ci-dessus comble en partie ce manque de données, et BFL publie désormais les tarifs de FLUX 3 pour la vidéo, mais cette comparaison ne porte pas sur le modèle d'image ni sur les variantes à poids ouvert.
Ce que révèlent les démonstrations officielles et les résultats en robotique
Les supports de lancement de BFL présentent des vidéos générées, des pistes audio synchronisées, des styles visuels, du texte animé et des premiers exemples de montage. Ils illustrent l'orientation du produit et les types de résultats visés par l'entreprise. Comme il s'agit d'exemples officiels sélectionnés, ils ne nous indiquent pas dans quelle mesure un utilisateur lambda pourra reproduire la même qualité, combien de temps prend la génération, ni quel sera le coût de chaque résultat.

Les travaux en robotique sont plus spécifiques. Dans le FLUX 3 x rapport Mimic, Les travaux sur le BFL et la robotique mimétique décrivent l'adaptation de l'infrastructure vidéo FLUX 3 à la prédiction des actions robotiques. Le graphique de kitting des corps souples présenté indique un taux de réussite médian de 95% pour FLUX-mimic, chaque médiane en pointillés étant calculée à partir de 20 essais autonomes.
Il s'agit d'un résultat issu de la robotique, et non d'un test de performance portant sur la qualité des images ou des vidéos. Sa pertinence est d'ordre conceptuel : BFL soutient qu'un réseau de base entraîné à modéliser le mouvement, le contact, le poids et la cause peut mettre en évidence des représentations utiles pour des tâches physiques. Pour déterminer si cette approche est transposable à l'ensemble des robots, des usines et des tâches, il faudra disposer de preuves indépendantes plus étendues.
Premières réactions de la communauté sur X et Reddit
FLUX 3 a immédiatement attiré l'attention. Lors du snapshot de vérification du 27 juillet, le Communiqué officiel de BFL sur X a enregistré 6 088 « J'aime », 862 partages, 365 citations et 314 réponses. Ces chiffres reflètent l'intérêt suscité par le lancement, et non la fiabilité du modèle, et ils continueront d'évoluer.

A Message publié sur Reddit dans le subreddit r/StableDiffusion Intitulé “ Flux 3 a l'air dingue. C'était une seule consigne ”, ce post affichait 370 votes positifs et 63 commentaires dans la même fenêtre de vérification. L'exemple en écran partagé présenté dans ce post utilise une consigne exigeante, mais il s'agit tout de même d'un exemple isolé plutôt que d'un test de performance contrôlé.

La conclusion qui s'impose est que les créateurs s'intéressent à la complexité des prompts, au mouvement, au son natif et à la cohérence visuelle. Une fois que l'accès se sera généralisé, la reproductibilité des prompts devrait devenir un critère d'évaluation essentiel. En attendant, le Formule de l'invite Kling 3.0 constitue une référence utile pour structurer les scènes, le comportement de la caméra, les mouvements et les contraintes dans les outils vidéo actuellement disponibles.
API FLUX 3, tarifs et poids ouverts
Au 11 août, BFL’s documentation tarifaire publiée Comprend FLUX 3 Video. Un crédit équivaut à $0,01. La conversion de texte en vidéo et d’image en vidéo coûte $0,17 par seconde en HD ou $0,29 par seconde en FHD, tandis que les brouillons en HD coûtent $0,06 par seconde. La poursuite de la vidéo coûte $0,43 par seconde en HD ou $0,54 par seconde en FHD, les ébauches étant facturées à $0,12 par seconde.
| Objet | Publié ou vérifié | Encore limitées ou inconnues |
|---|---|---|
| Tarifs de la vidéo FLUX 3 | T2V/I2V : $0,17/s HD, $0,29/s FHD ; version préliminaire : $0,06/s. Suite : $0,43/s HD, $0,54/s FHD ; projet : $0,12/s | Conditions relatives aux abonnements « Private-weight » et aux abonnements d'entreprise |
| Accès à BFL | La vidéo sur l'accès anticipé, la présentation des modèles et les tarifs sont désormais accessibles au public | Acceptation générale de l'API, quotas et limites spécifiques à chaque compte |
| Accès à GlobalGPT | Vérification du parcours du produit vidéo FLUX 3 et réussite du test de la tâche en trois passes | Les limites par compte et les contrôles au niveau des itinéraires peuvent différer de l'offre directe de BFL |
| FLUX 3 Dev | Conçu comme une infrastructure multimodale à capacité illimitée | Date de sortie, licence, taille des paramètres et configuration matérielle requise |
Il ne faut pas confondre “ poids ouvert ” et “ open source ”. Les poids, le code, les données d'entraînement et la licence peuvent chacun être soumis à des conditions d'accès différentes. Pour se prononcer de manière pertinente sur la question du « poids ouvert », il faudra attendre que BFL publie la version FLUX 3 Dev et sa licence.
Comment demander un accès anticipé à FLUX 3
- Ouvrir le Page officielle du modèle FLUX 3 et passer en revue les étiquettes de capacités actuelles.
- Cliquez sur le bouton « Demander » pour accéder à la Formulaire officiel d'accès anticipé à FLUX 3.
- Décrivez la fonctionnalité dont vous avez besoin (vidéo, image, action, paramètres privés ou accès développeur) ainsi que le flux de travail que vous souhaitez mettre en place.
- Veuillez indiquer un cas d'utilisation réaliste, le volume prévu, les informations relatives à l'organisation, ainsi que les raisons pour lesquelles l'accès anticipé est important pour le projet.
- Attendez de recevoir une confirmation écrite avant de considérer comme acquis les conditions d'accès, les tarifs, les limites ou la date de livraison.
Une demande précise a plus de poids qu'une simple volonté générale du type “ Je veux essayer ça ”. Par exemple, un studio pourrait expliquer qu'il a besoin de dialogues multilingues et d'effets synchronisés pour de courts clips publicitaires, tandis qu'une équipe de robotique pourrait décrire sa tâche de manipulation, sa plateforme robotique, ses données et son environnement de déploiement.
Si l'objectif est le dialogue, il faut planifier l'ensemble du processus plutôt que de se limiter à la consigne de génération. Le Veo 3.1 : processus de création des dialogues et de la synchronisation labiale met en avant les aspects pratiques — la gestion du temps de parole, la cohérence vocale, la conception des plans et la régénération — qui auront également leur importance lors de l'évaluation de FLUX 3 Video.
À qui s'adresse FLUX 3 ?
- Créateurs de vidéos basés sur l'IA Il convient de prêter attention à l'audio d'origine, aux dialogues multilingues, au montage, à l'enchaînement des plans, à la cohérence, au rythme et au prix final.
- Créateurs d'images Il faudrait attendre des comparaisons reproductibles portant sur le respect des consignes, la révision des textes de référence, la typographie et le coût. D’ici là, le Les meilleurs générateurs d'images basés sur l'IA testés en 2026 voici la liste restreinte, plus pratique.
- Développeurs Il convient de surveiller les identifiants des modèles publics, les limites de débit, la prise en charge des SDK, les conditions relatives aux poids privés, ainsi que la licence qui sera finalement proposée par FLUX 3 Dev.
- Équipes de robotique et d'IA physique Il conviendrait d'examiner si l'approche FLUX-mimic est transposable au-delà de la tâche publiée et dans quelle mesure l'adaptation des données spécifiques à la tâche est nécessaire.
Avant de valider un workflow de production, procédez à une vérification de l'état de préparation FLUX 3 en quatre étapes. Une démonstration de lancement peut permettre de valider l'étape relative aux capacités sans pour autant valider celles concernant l'accès, les aspects économiques ou les preuves.
| Portail | Ce qui doit être vrai | Éléments de preuve à recueillir |
|---|---|---|
| Accès | Votre équipe dispose d'une autorisation écrite attestant qu'elle dispose des compétences requises | Invitation à créer un compte, conditions générales, zone géographique, quotas et coordonnées du service d'assistance |
| Capacité | Le modèle réalise votre tâche réelle, et ne se contente pas d'une simple demande d'exemple. | Consignes correspondantes, données de référence, cas d'échec et exécutions répétées |
| Économie | Les coûts et les délais correspondent au plan de production | Prix, temps de génération, fréquence des tentatives, limites de volume et infrastructure |
| Preuves | Les résultats restent fiables en dehors des exemples de lancement sélectionnés | Tests indépendants, paramètres reproductibles et résultats versionnés |
Vous souhaitez essayer le modèle utilisé lors de notre test ? Ouvrir Vidéo FLUX 3 sur GlobalGPT. Le parcours de production était opérationnel et l'environnement de tâches associé a mené à bien les trois exécutions le 11 août 2026. Vérifiez les paramètres de contrôle et les quotas indiqués dans votre propre compte avant de lancer un lot de production.
Foire aux questions sur FLUX 3
Quand FLUX 3 a-t-il été annoncé ?
Black Forest Labs a annoncé FLUX 3 le 23 juillet 2026. Le communiqué de lancement présentait un modèle de base multimodal couvrant les images, la vidéo, l'audio et la prédiction d'actions, dont les fonctionnalités seront déployées progressivement via un accès anticipé par étapes plutôt que par le biais d'une seule et même mise à disposition publique à grande échelle.
FLUX 3 est-il accessible au grand public ?
BFL propose FLUX 3 Video en accès anticipé et publie désormais ses tarifs pour ce service. GlobalGPT dispose également d'un parcours produit validé pour FLUX 3 Video. Cela ne signifie pas pour autant que FLUX 3 Image, Action, les poids privés ou FLUX 3 Dev soient largement accessibles en libre-service ; chaque fonctionnalité suit toujours son propre calendrier de déploiement et ses propres conditions.
FLUX 3 permet-il de générer des vidéos avec leur piste audio d'origine ?
Oui. Selon BFL, FLUX 3 Video est capable de générer des dialogues multilingues, des effets sonores et des ambiances à partir des images. Les trois fichiers MP4 de notre test du 11 août contenaient tous des données audio décodées. Nous n'avons pas transcrit automatiquement les pistes ; ce test confirme donc la présence d'un son, mais ne garantit pas la transcription mot pour mot des dialogues.
FLUX 3 est-il également un modèle d'image ?
Oui. La génération et l'édition d'images font partie de la gamme FLUX 3, mais BFL a indiqué que l'accès anticipé à FLUX 3 Image serait disponible dans les semaines suivant l'annonce initiale. Les noms des points de terminaison publics, la date de disponibilité définitive et les tarifs n'avaient pas encore été communiqués au moment de la rédaction de cette mise à jour.
FLUX 3 est-il open source ou « open weight » ?
BFL a annoncé qu'un accès “ open-weight ” serait prochainement disponible via FLUX 3 Dev. La société n'a pas encore communiqué la date de sortie, la licence, la taille des paramètres, l'étendue du code ni la configuration matérielle requise. En attendant ces précisions, il est plus juste de parler d“” open-weight prévu » que d'« open source ».”
En quoi FLUX 3 diffère-t-il de FLUX.2 ?
FLUX.2 est avant tout une suite d'outils de génération et d'édition d'images, dont les paramètres et les tarifs ont été rendus publics. FLUX 3 constitue une base multimodale plus large, destinée à relier les images, la vidéo, l'audio et la prédiction d'actions. Une comparaison équitable en termes de qualité ou de coût devra attendre que FLUX 3 soit accessible à un public plus large.
Quels ont été les résultats du test pratique du FLUX 3 ?
Les trois tâches ont été menées à bien avec le flux-3-vidéo ID du modèle. Les résultats correspondaient aux scènes de haut niveau demandées, et le test du robot a conservé l'ordre de ses mouvements ainsi que ses principales caractéristiques. Les trois extraits duraient tous 5,04 secondes malgré des consignes de huit secondes ; l'espacement exact des étiquettes et la géométrie répétée du produit n'étaient pas parfaits.
Puis-je utiliser FLUX 3 sur GlobalGPT ?
Oui. L'itinéraire validé est le suivant : Vidéo FLUX 3 sur GlobalGPT. Nous avons également mené à bien trois générations via l'environnement de tâches connecté le 11 août 2026. L'accès à la plateforme est distinct de l'accès direct à l'API BFL ou aux poids privés.
Conclusion finale
FLUX 3 n'est plus seulement une promesse de page de lancement. BFL publie les fonctionnalités vidéo et les tarifs, GlobalGPT dispose d'un parcours validé, et nos trois essais ont produit des fichiers MP4 exploitables avec des flux audio. Le modèle a bien géré la logique des scènes et les mouvements contraints, mais il n'a pas respecté la durée demandée et a atténué la précision du texte ainsi que la cohérence des produits. Testez votre prompt réel avant de passer à l'échelle, et continuez à suivre FLUX 3 Image, Action, les poids privés et la licence FLUX 3 Dev à mesure que ces éléments de la famille mûrissent.



