Avis sur FLUX 3 : vidéo, audio, tarifs et accès

flux-3-critique-vidéo

Réponse rapide : FLUX 3 est le modèle de base multimodal de Black Forest Labs dédié aux images, à la vidéo, à l’audio et à la prédiction d’actions. Au 11 août 2026, BFL propose FLUX 3 Video en accès anticipé, avec des extraits d’une durée maximale de 20 secondes, un son natif en option et une tarification publique à la seconde. GlobalGPT dispose également d’un parcours FLUX 3 Video vérifié. Lors de notre test en trois essais, toutes les tâches ont été menées à bien et ont généré un fichier MP4 de 5,04 secondes avec un flux audio, mais le contrôle précis de la durée, l’espacement typographique et la cohérence des objets n’étaient pas parfaits.

La formulation de ce statut doit encore être affinée. Le article officiel de lancement et page officielle du modèle FLUX 3 Video est présenté comme étant en « accès anticipé », tandis que la page des tarifs de BFL affiche désormais les tarifs des vidéos. GlobalGPT met à disposition une interface distincte alimentée par le modèle. L'accès via cette interface ne signifie pas que toutes les API BFL, l'option de poids privés, le modèle Image, le modèle Action ou la version FLUX 3 Dev soient disponibles pour tous.

Cette mise à jour inclut un petit test pratique : trois générations le 11 août à l'aide de l'environnement de test flux-3-vidéo ID du modèle, incluant une répétition exacte de la requête. Cela suffit pour documenter le comportement réel et les points de défaillance visibles, mais trois résultats ne constituent pas un benchmark représentatif.

APERÇU DE L'AVIS

Trois tests vidéo FLUX 3 réalisés en interne — il ne s'agit pas d'un test de performance à grande échelle.

SériesDurée renvoyéeRésolutionAudio
3 sur 3 réussis5,04 s par clip1 280 × 704Données décodées dans tous les fichiers

Qu'est-ce que FLUX 3 ?

FLUX 3 est un modèle de base multimodal développé par Black Forest Labs. Contrairement à un système uniquement entraîné à transformer du texte en images, BFL précise que ce modèle apprend simultanément à partir d’images, de vidéos et de fichiers audio au sein d’une même architecture. L’objectif est de construire des représentations qui relient la structure spatiale, le mouvement, le son, la cause et l’action, plutôt que de traiter chaque support comme une caractéristique isolée.

Page officielle de FLUX 3 présentant des images, des vidéos, des fichiers audio et des prévisions d'actions
Black Forest Labs présente FLUX 3, un modèle multimodal couvrant l'image, la vidéo, l'audio et la prédiction d'actions.

Ce nom peut sembler être une simple suite logique de FLUX.1 et FLUX.2, mais son champ d'application est bien plus large. FLUX.2 reste une gamme de logiciels de création et de retouche d'images ; le Guide FLUX 2 Pro couvre le flux de travail en matière d'images, le contexte tarifaire et les consignes de cette génération. FLUX 3 est présenté comme une infrastructure commune pour la création de contenu et la prédiction d'actions.

BFL utilise l'expression “ modèle du monde ” pour décrire cette orientation. Cela ne signifie pas pour autant que l’entreprise ait annoncé la mise au point d’une intelligence générale. Cela signifie plutôt que le modèle est conçu pour apprendre comment les objets visibles, les mouvements, les sons et les actions s’articulent entre eux au fil du temps. Cette distinction est importante, car l’argument le plus intéressant avancé par FLUX 3 ne se résume pas simplement à des “ images de meilleure qualité ” ; il s’agit d’un modèle sous-jacent unique servant à plusieurs types de génération et de contrôle.

Pourquoi FLUX 3 est bien plus qu'un simple générateur d'images

La plupart des produits d'IA créative sont encore perçus comme des outils distincts : un modèle génère des images, un autre produit des vidéos et un troisième ajoute des voix ou des effets sonores. FLUX 3 repose sur un principe différent. Si une seule architecture apprend ces modalités ensemble, une consigne, une image de référence, une séquence animée et une bande-son peuvent potentiellement partager la même compréhension interne.

  • Les images offrent de l'espace : les objets, la composition, la texture, la typographie et les relations visuelles.
  • La vidéo ajoute du temps : le mouvement, la persistance, le contact et la relation de cause à effet d'une image à l'autre.
  • L'audio ajoute un autre signal synchronisé : la parole, l'ambiance sonore et les sons liés à des événements visibles.
  • La prédiction de l'action fait le lien entre la perception et le contrôle : La représentation du modèle peut être adaptée pour prédire ce qu'un robot devrait faire ensuite.

Pour les créateurs, l'intérêt pratique réside dans la réduction du nombre de passages de relais entre les différentes étapes de production. L'audio natif revêt une importance particulière, car il permet de réduire le décalage entre la création d'un clip et la production séparée des dialogues, des effets et de la synchronisation. Si le son est votre principale préoccupation, la solution actuelle Veo 3.1 Guide audio montre comment une autre grande famille de services vidéo aborde aujourd'hui l'audio natif.

Aperçu des fonctionnalités de FLUX 3

CapacitéCe qu'a annoncé BFLSituation au 11 août 2026
Vidéo FLUX 3Création et montage de vidéos avec, en option, de l'audio natif, notamment des voix off, des effets, des styles, de la typographie et des workflows multi-plansAccès anticipé à BFL ; publication des tarifs officiels ; itinéraire GlobalGPT confirmé
Image FLUX 3Génération et retouche d'images via des API et l'accès aux poids privésLancement de l'accès anticipé annoncé ; cet article ne l'a pas testé
FLUX 3 ActionPrédiction d'actions natives et modèles spécialisés développés à partir de l'infrastructure vidéoEn collaboration avec des partenaires triés sur le volet
FLUX 3 DevInfrastructure multimodale ouverte prévue pour la vidéo, l'audio, l'image et la prédiction d'actionsAnnoncé ; date et licence non publiées

FLUX 3 Video est le produit le plus abouti à court terme. Selon BFL, il prend en charge la conversion de texte en vidéo et le montage, la synchronisation audio, les dialogues multilingues, divers formats d'image, la typographie et l'enchaînement de clips. Ces fonctionnalités le placent sur un marché de plus en plus concurrentiel ; le Comparatif des meilleurs générateurs de vidéos basés sur l'IA fournit des informations utiles sur les fonctionnalités dont les créateurs peuvent déjà profiter tant que l'accès à FLUX 3 reste limité.

Le billet annonçant le lancement décrit également, dans le cadre de ses évaluations préliminaires, des clips vidéo de 10 secondes en 720p générés à partir de texte et comportant du son. BFL précise explicitement que le modèle et le cadre d’évaluation sont encore en cours de développement. Ces chiffres constituent donc des premières données utiles fournies par l’entreprise, mais ne sauraient se substituer à des tests indépendants et reproductibles qui seront menés une fois que l’accès public aura été élargi.

La page de présentation actuelle va plus loin : elle indique que FLUX 3 Video peut générer jusqu’à 20 secondes en un seul passage, avec un son facultatif et des voix multilingues, des effets et des ambiances générés en même temps que les images. Il s’agit là des limites officielles ; le test pratique ci-dessous montre ce que la plateforme connectée a réellement généré à partir de nos requêtes.

FLUX 3 est-il déjà disponible ?

Oui, mais uniquement dans le cadre d'un accès anticipé par étapes. BFL a mis en place une procédure de candidature plutôt qu'un lancement en libre-service à grande échelle. L'entreprise peut ainsi travailler avec des utilisateurs et des partenaires sélectionnés, alors que les modèles, les API, les options de poids privés et le processus d'évaluation sont encore en cours d'évolution.

Plan officiel de lancement de FLUX 3 pour les branches Video, Image, Action et Dev
Le plan de lancement de BFL prévoit de déployer FLUX 3 Video, Image, Action et Dev par étapes, dans le cadre d'un accès anticipé.
QuestionConnuEncore limitées ou inconnues
Peut-on postuler chez BFL ?Oui, via le formulaire de demande officielCritères d'acceptation et délai de réponse
Les utilisateurs peuvent-ils tester FLUX 3 Video sur GlobalGPT ?Oui ; le lien vers la procédure de vérification du produit se trouve ci-dessousLes limites et quotas par itinéraire dépendent du compte de la plateforme
Quel est le cours officiel du BFL ?Taux de conversion texte/image en vidéo, continuation, brouillon, HD et FHDConditions relatives aux abonnements « Private-weight » et aux abonnements d'entreprise
Y aura-t-il des catégories sans limite de poids ?Le FLUX 3 Dev est prévu en catégorie « open weight »Date de sortie, licence et configuration matérielle requise
GlobalGPT FLUX 3 : parcours produit vidéo illustrant l'accès aux fonctionnalités « texte vers vidéo » et « image vers vidéo »
La fiche produit certifiée du modèle GlobalGPT mentionne la fonction FLUX 3 Video, qui permet la conversion de texte en vidéo, d'image en vidéo et le positionnement de l'audio natif.

L'interprétation la plus prudente est simple : FLUX 3 existe bel et bien et son déploiement est en cours, mais il ne faut pas confondre “ accès anticipé ” et “ accessible à tous ”. Si vous avez besoin d'une date butoir de mise en production, attendez de recevoir une confirmation écrite de l'accès ainsi que les conditions d'utilisation avant de concevoir un processus de travail autour de cette solution.

Nous avons testé FLUX 3 en vidéo : trois essais, des résultats concrets

3/3tâches réalisées
5,04 schaque extrait renvoyé
1 280 × 704chaque fichier MP4
Son disponibledécodé dans chaque fichier

Configuration du test : Nous avons effectué les tests le 11 août 2026 via l'environnement de test de tâches Broly connecté à la plateforme, en utilisant l'identifiant exact du modèle flux-3-vidéo. Chaque requête ne contenait que l'identifiant du modèle et la consigne. Nous avons soumis trois tâches : une consigne relative à une publicité pour un produit, une consigne relative à la cohérence temporelle et une répétition exacte de la première consigne. L’API des tâches a indiqué des durées de traitement réelles de 88, 190 et 77 secondes respectivement. Étant donné que les exécutions étaient simultanées et que l’infrastructure est encore en cours d’évolution, ces durées ne doivent pas être considérées comme une référence en matière de latence.

Test n° 1 : typographie, transformation et audio natif

ID de la tâche : task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. Le sujet demandait de créer une publicité pour un parfum de huit secondes comportant deux plans, avec le texte exact figurant sur l'étiquette, une transformation du flacon en ville, le bruit d'un verre qui s'ouvre, un effet sonore de souffle et une réplique prononcée.

PROMPTConsigne d'examen n° 1
Réaliser une publicité cinématographique de 8 secondes au format 16:9, composée de deux plans enchaînés. Plan 1 : sur une table sombre de studio, un flacon de parfum bleu cobalt translucide tourne lentement sous un faisceau lumineux blanc étroit ; l’étiquette avant doit porter exactement l’inscription ' FLUX 3 ' en lettres blanches épurées sans empattement, sans aucun autre texte. Plan 2 : le flacon s’ouvre pour laisser place à un ruban de lumière bleue qui se transforme en silhouette urbaine nocturne, tandis que le même flacon reste centré et reconnaissable. Utilisez des mouvements de caméra fluides et de haute qualité, des reflets réalistes sur le verre et un son synchronisé : un léger cliquetis de verre lorsque le bouchon se soulève, un sifflement électronique croissant pendant la transformation, et une voix calme prononçant exactement ' Make the moment move '. N’ajoutez pas de sous-titres, de logos, de filigranes ni de texte supplémentaire.

Sélectionnez manuellement l'invite si votre configuration WordPress désactive le contrôle de copie.

FLUX 3 : test pratique n° 1 : la vidéo publicitaire sur les produits retournés.
Cinq images extraites du test typographique et audio FLUX 3
Cinq images montrent l'étiquette, la rotation de la bouteille, le passage à la lumière bleue et la révélation de la ville.

Ce qui s'est passé : Le résultat final a respecté l’arc visuel demandé et a permis de conserver la lisibilité du concept de parfum bleu dans les deux scènes. L’étiquette est restée lisible, mais elle a visuellement réduit l’espace demandé et ressemblait davantage à “ FLUX3 ” qu’à “ FLUX 3 ” exactement. Le flacon a également changé de forme au niveau du bouchon et du corps au cours de la transformation. Le fichier MP4 contenait des données audio décodées, mais notre inspection automatisée n’a pas transcrit la réplique prononcée ; nous ne notons donc pas le dialogue mot pour mot. Plus important encore, le clip fourni durait 5,04 secondes au lieu des huit secondes demandées.

Test 2 : mouvement ponctuel et cohérence des objets

ID de la tâche : task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. Cette consigne supprimait les changements de scène et demandait à un robot à remontoir de franchir trois repères dans un ordre précis tout en conservant ses caractéristiques distinctives.

PROMPTConsigne d'examen n° 2
Réalisez un travelling continu de 8 secondes au format 16:9, sans aucune coupure. Un petit robot rouge à remontoir, doté d’une tête carrée, de deux yeux ronds argentés, d’une clé en laiton dans le dos et de bottes blanches, marche de gauche à droite en passant sur trois repères au sol dans cet ordre précis : jaune, bleu, puis vert. La caméra effectue le travelling à hauteur de taille tandis que le robot conserve la même silhouette, les mêmes couleurs, le même nombre d’yeux, la même clé dans le dos et la même direction de marche pendant toute la durée du plan. Ajoutez des bruits de pas métalliques synchronisés et un fond sonore discret de la pièce. Pas de dialogue, pas de texte, pas de personnages supplémentaires, pas de changement de plan et pas de changement de costume.

Sélectionnez manuellement l'invite si votre configuration WordPress désactive le contrôle de copie.

FLUX 3 : deuxième essai pratique : la vidéo du robot « one-shot » qui est revenu.
Cinq images extraites du test de cohérence temporelle FLUX 3
Le robot se déplace de gauche à droite en passant par les couleurs jaune, bleu et vert, tout en conservant son corps rouge, ses deux yeux, ses bottes blanches et sa touche « retour ».

Ce qui s'est passé : C'était le résultat le plus net. Le robot s'est déplacé dans la direction demandée et a franchi les marqueurs jaunes, bleus et verts dans l'ordre. Ses principaux éléments distinctifs sont restés visibles tout au long du plan, sans personnage supplémentaire ni coup de caméra évident. Le mouvement semblait simple plutôt que cinématographique, mais cette simplicité facilitait l'évaluation de la cohérence. La séquence a de nouveau duré 5,04 secondes et contenait des données audio décodées.

Test n° 3 : répétition exacte de la première consigne

ID de la tâche : task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. Nous avons renvoyé la première consigne telle quelle, sans en changer un mot.

PROMPTRépéter la demande
Réaliser une publicité cinématographique de 8 secondes au format 16:9, composée de deux plans enchaînés. Plan 1 : sur une table sombre de studio, un flacon de parfum bleu cobalt translucide tourne lentement sous un faisceau lumineux blanc étroit ; l’étiquette avant doit porter exactement l’inscription ' FLUX 3 ' en lettres blanches épurées sans empattement, sans aucun autre texte. Plan 2 : le flacon s’ouvre pour laisser place à un ruban de lumière bleue qui se transforme en silhouette urbaine nocturne, tandis que le même flacon reste centré et reconnaissable. Utilisez des mouvements de caméra fluides et de haute qualité, des reflets réalistes sur le verre et un son synchronisé : un léger cliquetis de verre lorsque le bouchon se soulève, un sifflement électronique croissant pendant la transformation, et une voix calme prononçant exactement ' Make the moment move '. N’ajoutez pas de sous-titres, de logos, de filigranes ni de texte supplémentaire.

Sélectionnez manuellement l'invite si votre configuration WordPress désactive le contrôle de copie.

Cinq images extraites de la publicité répétée pour le produit FLUX 3
La demande répétée a donné lieu au même scénario général, mais avec un design de bouteille, un bouchon, un angle de caméra et une révélation de la ville différents.

Ce qui s'est passé : La répétition a conservé le concept plutôt que le résultat exact. Elle a de nouveau donné une bouteille bleue, l’inscription “ FLUX3 ” lisible, un ruban de lumière et une ligne d’horizon nocturne, mais la géométrie de la bouteille, le bouchon, le cadrage et la transition différaient. C’est normal pour une génération non guidée, mais cela a son importance lorsqu’une équipe de marque s’attend à ce que les détails du produit soient reproductibles.

Dimension de testRésultat observéPoints à retenir
Réalisation de la tâche3 tâches sur 3 ont été menées à bienLe parcours connecté était opérationnel pendant ce test
Contrôle de la duréeLes trois requêtes demandaient 8 secondes ; toutes ont renvoyé 5,04 secondes.Vérifier les contrôles de durée au niveau des itinéraires avant la mise en production
TypographieL'étiquette est lisible, mais l'espacement exact de “ FLUX 3 ” n'a pas été conservéPrévoir des retouches ou un travail de post-production sur le texte de la marque
Cohérence temporelleLe robot simple a conservé ses caractéristiques distinctives et l'ordre de ses marqueursLes invites à tir unique avec contraintes peuvent donner de bons résultats
RépétabilitéMême principe, mais avec une géométrie du produit et des choix de caméras différentsUne répétition exacte de la consigne n'est pas une répétition visuelle exacte
AudioChaque fichier MP4 contenait des données audio décodées ; les dialogues n'étaient pas transcrits automatiquement.Écouter et vérifier manuellement la synchronisation avant validation

Notre verdict : La vidéo FLUX 3 a mieux respecté la logique générale de la scène que les contraintes de production précises. La fluidité de la transformation du produit et les mouvements ordonnés du robot étaient encourageants. Le retour fixe de 5,04 secondes, l’espacement imparfait du texte et la dérive de la forme de la bouteille sont autant de raisons de tester votre propre workflow avant de vous engager. Il s’agit d’un indicateur pratique utile, et non d’une note valable pour l’ensemble du modèle.

FLUX 3 vs FLUX.2 : Qu'est-ce qui a réellement changé ?

ZoneFLUX.2FLUX 3
Identité publique principaleFamille de produits de création et d'édition d'imagesModèle de base multimodal
ModalitésImages et processus de traitement d'imagesImages, vidéo, audio et prédiction d'actions
Accès actuelModèles d'API publiés et tarifsAccès anticipé à la vidéo BFL, tarifs officiels des vidéos et itinéraire GlobalGPT vérifié
Direction du modèle ouvertPlusieurs variants de FLUX.2 et des critères d'évaluation documentésAnnonce des poids pour la version « Dev » de FLUX 3 ; détails à venir
Un bilan équitablePeut être testé dès aujourd'hui en tant que modèle d'imageLa vidéo peut être examinée ; il est encore trop tôt pour tirer des conclusions générales concernant l'ensemble de la famille

Le changement le plus important concerne la portée, et non une amélioration en pourcentage vérifiée. FLUX 3 n'est pas simplement une version de FLUX.2 dotée d'un nouvel indice de qualité d'image ; il vise à unifier la création et l'action physique au sein d'une même famille. Pour une décision actuelle basée uniquement sur l'image, le Comparaison entre le FLUX 2 et le Nano Banana Pro est plus exploitable, car ces deux aspects peuvent aujourd'hui être considérés comme des outils visuels.

Une comparaison complète entre FLUX 3 et FLUX.2 doit encore prendre en compte la correspondance des prompts d'images, les modifications de référence, la typographie, le respect des prompts, la latence et le coût. La vérification vidéo en trois passages présentée ci-dessus comble en partie ce manque de données, et BFL publie désormais les tarifs de FLUX 3 pour la vidéo, mais cette comparaison ne porte pas sur le modèle d'image ni sur les variantes à poids ouvert.

Ce que révèlent les démonstrations officielles et les résultats en robotique

Les supports de lancement de BFL présentent des vidéos générées, des pistes audio synchronisées, des styles visuels, du texte animé et des premiers exemples de montage. Ils illustrent l'orientation du produit et les types de résultats visés par l'entreprise. Comme il s'agit d'exemples officiels sélectionnés, ils ne nous indiquent pas dans quelle mesure un utilisateur lambda pourra reproduire la même qualité, combien de temps prend la génération, ni quel sera le coût de chaque résultat.

Tableau de référence des kits de corps souples de type FLUX-mimic
Dans le tableau des kits de corps souples de BFL, FLUX-mimic affiche un taux de réussite médian de 95% sur 20 essais autonomes.

Les travaux en robotique sont plus spécifiques. Dans le FLUX 3 x rapport Mimic, Les travaux sur le BFL et la robotique mimétique décrivent l'adaptation de l'infrastructure vidéo FLUX 3 à la prédiction des actions robotiques. Le graphique de kitting des corps souples présenté indique un taux de réussite médian de 95% pour FLUX-mimic, chaque médiane en pointillés étant calculée à partir de 20 essais autonomes.

Il s'agit d'un résultat issu de la robotique, et non d'un test de performance portant sur la qualité des images ou des vidéos. Sa pertinence est d'ordre conceptuel : BFL soutient qu'un réseau de base entraîné à modéliser le mouvement, le contact, le poids et la cause peut mettre en évidence des représentations utiles pour des tâches physiques. Pour déterminer si cette approche est transposable à l'ensemble des robots, des usines et des tâches, il faudra disposer de preuves indépendantes plus étendues.

Premières réactions de la communauté sur X et Reddit

FLUX 3 a immédiatement attiré l'attention. Lors du snapshot de vérification du 27 juillet, le Communiqué officiel de BFL sur X a enregistré 6 088 « J'aime », 862 partages, 365 citations et 314 réponses. Ces chiffres reflètent l'intérêt suscité par le lancement, et non la fiabilité du modèle, et ils continueront d'évoluer.

Publication de Black Forest Labs X annonçant l'accès anticipé à FLUX 3
Dans son article annonçant le lancement, BFL décrit FLUX 3 comme un modèle unifié permettant de prédire les images, les vidéos, les sons et les actions.

A Message publié sur Reddit dans le subreddit r/StableDiffusion Intitulé “ Flux 3 a l'air dingue. C'était une seule consigne ”, ce post affichait 370 votes positifs et 63 commentaires dans la même fenêtre de vérification. L'exemple en écran partagé présenté dans ce post utilise une consigne exigeante, mais il s'agit tout de même d'un exemple isolé plutôt que d'un test de performance contrôlé.

Exemple de publication vidéo en écran partagé sur Reddit FLUX 3
Un utilisateur de Reddit a partagé une commande FLUX 3 complexe en écran partagé ; la publication a suscité 63 commentaires et un titre enthousiaste.

La conclusion qui s'impose est que les créateurs s'intéressent à la complexité des prompts, au mouvement, au son natif et à la cohérence visuelle. Une fois que l'accès se sera généralisé, la reproductibilité des prompts devrait devenir un critère d'évaluation essentiel. En attendant, le Formule de l'invite Kling 3.0 constitue une référence utile pour structurer les scènes, le comportement de la caméra, les mouvements et les contraintes dans les outils vidéo actuellement disponibles.

API FLUX 3, tarifs et poids ouverts

Au 11 août, BFL’s documentation tarifaire publiée Comprend FLUX 3 Video. Un crédit équivaut à $0,01. La conversion de texte en vidéo et d’image en vidéo coûte $0,17 par seconde en HD ou $0,29 par seconde en FHD, tandis que les brouillons en HD coûtent $0,06 par seconde. La poursuite de la vidéo coûte $0,43 par seconde en HD ou $0,54 par seconde en FHD, les ébauches étant facturées à $0,12 par seconde.

ObjetPublié ou vérifiéEncore limitées ou inconnues
Tarifs de la vidéo FLUX 3T2V/I2V : $0,17/s HD, $0,29/s FHD ; version préliminaire : $0,06/s. Suite : $0,43/s HD, $0,54/s FHD ; projet : $0,12/sConditions relatives aux abonnements « Private-weight » et aux abonnements d'entreprise
Accès à BFLLa vidéo sur l'accès anticipé, la présentation des modèles et les tarifs sont désormais accessibles au publicAcceptation générale de l'API, quotas et limites spécifiques à chaque compte
Accès à GlobalGPTVérification du parcours du produit vidéo FLUX 3 et réussite du test de la tâche en trois passesLes limites par compte et les contrôles au niveau des itinéraires peuvent différer de l'offre directe de BFL
FLUX 3 DevConçu comme une infrastructure multimodale à capacité illimitéeDate de sortie, licence, taille des paramètres et configuration matérielle requise

Il ne faut pas confondre “ poids ouvert ” et “ open source ”. Les poids, le code, les données d'entraînement et la licence peuvent chacun être soumis à des conditions d'accès différentes. Pour se prononcer de manière pertinente sur la question du « poids ouvert », il faudra attendre que BFL publie la version FLUX 3 Dev et sa licence.

Comment demander un accès anticipé à FLUX 3

  1. Ouvrir le Page officielle du modèle FLUX 3 et passer en revue les étiquettes de capacités actuelles.
  2. Cliquez sur le bouton « Demander » pour accéder à la Formulaire officiel d'accès anticipé à FLUX 3.
  3. Décrivez la fonctionnalité dont vous avez besoin (vidéo, image, action, paramètres privés ou accès développeur) ainsi que le flux de travail que vous souhaitez mettre en place.
  4. Veuillez indiquer un cas d'utilisation réaliste, le volume prévu, les informations relatives à l'organisation, ainsi que les raisons pour lesquelles l'accès anticipé est important pour le projet.
  5. Attendez de recevoir une confirmation écrite avant de considérer comme acquis les conditions d'accès, les tarifs, les limites ou la date de livraison.

Une demande précise a plus de poids qu'une simple volonté générale du type “ Je veux essayer ça ”. Par exemple, un studio pourrait expliquer qu'il a besoin de dialogues multilingues et d'effets synchronisés pour de courts clips publicitaires, tandis qu'une équipe de robotique pourrait décrire sa tâche de manipulation, sa plateforme robotique, ses données et son environnement de déploiement.

Si l'objectif est le dialogue, il faut planifier l'ensemble du processus plutôt que de se limiter à la consigne de génération. Le Veo 3.1 : processus de création des dialogues et de la synchronisation labiale met en avant les aspects pratiques — la gestion du temps de parole, la cohérence vocale, la conception des plans et la régénération — qui auront également leur importance lors de l'évaluation de FLUX 3 Video.

À qui s'adresse FLUX 3 ?

  • Créateurs de vidéos basés sur l'IA Il convient de prêter attention à l'audio d'origine, aux dialogues multilingues, au montage, à l'enchaînement des plans, à la cohérence, au rythme et au prix final.
  • Créateurs d'images Il faudrait attendre des comparaisons reproductibles portant sur le respect des consignes, la révision des textes de référence, la typographie et le coût. D’ici là, le Les meilleurs générateurs d'images basés sur l'IA testés en 2026 voici la liste restreinte, plus pratique.
  • Développeurs Il convient de surveiller les identifiants des modèles publics, les limites de débit, la prise en charge des SDK, les conditions relatives aux poids privés, ainsi que la licence qui sera finalement proposée par FLUX 3 Dev.
  • Équipes de robotique et d'IA physique Il conviendrait d'examiner si l'approche FLUX-mimic est transposable au-delà de la tâche publiée et dans quelle mesure l'adaptation des données spécifiques à la tâche est nécessaire.

Avant de valider un workflow de production, procédez à une vérification de l'état de préparation FLUX 3 en quatre étapes. Une démonstration de lancement peut permettre de valider l'étape relative aux capacités sans pour autant valider celles concernant l'accès, les aspects économiques ou les preuves.

PortailCe qui doit être vraiÉléments de preuve à recueillir
AccèsVotre équipe dispose d'une autorisation écrite attestant qu'elle dispose des compétences requisesInvitation à créer un compte, conditions générales, zone géographique, quotas et coordonnées du service d'assistance
CapacitéLe modèle réalise votre tâche réelle, et ne se contente pas d'une simple demande d'exemple.Consignes correspondantes, données de référence, cas d'échec et exécutions répétées
ÉconomieLes coûts et les délais correspondent au plan de productionPrix, temps de génération, fréquence des tentatives, limites de volume et infrastructure
PreuvesLes résultats restent fiables en dehors des exemples de lancement sélectionnésTests indépendants, paramètres reproductibles et résultats versionnés

Vous souhaitez essayer le modèle utilisé lors de notre test ? Ouvrir Vidéo FLUX 3 sur GlobalGPT. Le parcours de production était opérationnel et l'environnement de tâches associé a mené à bien les trois exécutions le 11 août 2026. Vérifiez les paramètres de contrôle et les quotas indiqués dans votre propre compte avant de lancer un lot de production.

Foire aux questions sur FLUX 3

Quand FLUX 3 a-t-il été annoncé ?

Black Forest Labs a annoncé FLUX 3 le 23 juillet 2026. Le communiqué de lancement présentait un modèle de base multimodal couvrant les images, la vidéo, l'audio et la prédiction d'actions, dont les fonctionnalités seront déployées progressivement via un accès anticipé par étapes plutôt que par le biais d'une seule et même mise à disposition publique à grande échelle.

FLUX 3 est-il accessible au grand public ?

BFL propose FLUX 3 Video en accès anticipé et publie désormais ses tarifs pour ce service. GlobalGPT dispose également d'un parcours produit validé pour FLUX 3 Video. Cela ne signifie pas pour autant que FLUX 3 Image, Action, les poids privés ou FLUX 3 Dev soient largement accessibles en libre-service ; chaque fonctionnalité suit toujours son propre calendrier de déploiement et ses propres conditions.

FLUX 3 permet-il de générer des vidéos avec leur piste audio d'origine ?

Oui. Selon BFL, FLUX 3 Video est capable de générer des dialogues multilingues, des effets sonores et des ambiances à partir des images. Les trois fichiers MP4 de notre test du 11 août contenaient tous des données audio décodées. Nous n'avons pas transcrit automatiquement les pistes ; ce test confirme donc la présence d'un son, mais ne garantit pas la transcription mot pour mot des dialogues.

FLUX 3 est-il également un modèle d'image ?

Oui. La génération et l'édition d'images font partie de la gamme FLUX 3, mais BFL a indiqué que l'accès anticipé à FLUX 3 Image serait disponible dans les semaines suivant l'annonce initiale. Les noms des points de terminaison publics, la date de disponibilité définitive et les tarifs n'avaient pas encore été communiqués au moment de la rédaction de cette mise à jour.

FLUX 3 est-il open source ou « open weight » ?

BFL a annoncé qu'un accès “ open-weight ” serait prochainement disponible via FLUX 3 Dev. La société n'a pas encore communiqué la date de sortie, la licence, la taille des paramètres, l'étendue du code ni la configuration matérielle requise. En attendant ces précisions, il est plus juste de parler d“” open-weight prévu » que d'« open source ».”

En quoi FLUX 3 diffère-t-il de FLUX.2 ?

FLUX.2 est avant tout une suite d'outils de génération et d'édition d'images, dont les paramètres et les tarifs ont été rendus publics. FLUX 3 constitue une base multimodale plus large, destinée à relier les images, la vidéo, l'audio et la prédiction d'actions. Une comparaison équitable en termes de qualité ou de coût devra attendre que FLUX 3 soit accessible à un public plus large.

Quels ont été les résultats du test pratique du FLUX 3 ?

Les trois tâches ont été menées à bien avec le flux-3-vidéo ID du modèle. Les résultats correspondaient aux scènes de haut niveau demandées, et le test du robot a conservé l'ordre de ses mouvements ainsi que ses principales caractéristiques. Les trois extraits duraient tous 5,04 secondes malgré des consignes de huit secondes ; l'espacement exact des étiquettes et la géométrie répétée du produit n'étaient pas parfaits.

Puis-je utiliser FLUX 3 sur GlobalGPT ?

Oui. L'itinéraire validé est le suivant : Vidéo FLUX 3 sur GlobalGPT. Nous avons également mené à bien trois générations via l'environnement de tâches connecté le 11 août 2026. L'accès à la plateforme est distinct de l'accès direct à l'API BFL ou aux poids privés.

Conclusion finale

FLUX 3 n'est plus seulement une promesse de page de lancement. BFL publie les fonctionnalités vidéo et les tarifs, GlobalGPT dispose d'un parcours validé, et nos trois essais ont produit des fichiers MP4 exploitables avec des flux audio. Le modèle a bien géré la logique des scènes et les mouvements contraints, mais il n'a pas respecté la durée demandée et a atténué la précision du texte ainsi que la cohérence des produits. Testez votre prompt réel avant de passer à l'échelle, et continuez à suivre FLUX 3 Image, Action, les poids privés et la licence FLUX 3 Dev à mesure que ces éléments de la famille mûrissent.

Partager l'article :

Articles connexes