
FLUX 3 est un modèle de fondation multimodal disponible sur Promptus
Black Forest Labs a lancé FLUX 3 le 23 juillet 2026. Il s'agit de son premier modèle entraîné simultanément sur l'image, la vidéo et l'audio au sein d'une architecture unique, plutôt que via des systèmes distincts assemblés. Cet article détaille les fonctionnalités réelles de FLUX 3, ses performances comparées aux autres modèles vidéo selon les premiers tests de Black Forest Labs, ainsi que tout ce qu'il faut savoir sur son accès via Promptus, incluant la tarification et les détails de l'API.
Qu'est-ce que FLUX 3 ?
FLUX 3 est un modèle de fondation multimodal qui apprend à partir d'images, de vidéos et de sons simultanément, au sein d'une architecture unique, évitant ainsi l'entraînement de modèles séparés. Le raisonnement de Black Forest Labs est le suivant : le son doit correspondre à l'impact physique et le mouvement doit respecter les lois de la masse ; un modèle qui ne traite que des images fixes ne peut pas intégrer ces notions. En les entraînant ensemble, les contraintes de chaque modalité enrichissent les deux autres : le modèle ne devine pas le mouvement et le son séparément, il développe une représentation interne unifiée qui génère l'ensemble de manière cohérente.
Concrètement, cela se traduit par une génération audio native : FLUX 3 Video produit un son synchronisé lors de la même passe que la vidéo, sans nécessiter d'étape de montage ultérieure.
Ce que FLUX 3 peut faire
Capacités confirmées, selon l'annonce de Black Forest Labs :
- Text-to-video avec audio natif, générant des clips allant jusqu'à 20 secondes avec des dialogues, des effets sonores et une ambiance sonore synchronisés.
- Image-to-video, avec deux modes distincts : l'animation à partir d'une image fixe de départ, ou l'utilisation d'une image de référence pour guider la scène sans imposer strictement la première image.
- Video-to-video et continuation, permettant de conserver des éléments centraux — y compris un personnage spécifique — d'un clip existant vers une nouvelle scène.
- Keyframe-to-video, générant une transition contrôlée entre deux moments définis plutôt qu'une animation libre.
- Dialogue multilingue et expressions faciales, générés directement plutôt que doublés a posteriori.
- Large gamme de styles et de formats, allant de séquences de type caméra à l'épaule à des compositions cinématographiques, avec une excellente gestion de la typographie à l'écran et du texte animé.
- Enchaînement de plans par agent, reliant des clips générés individuellement en séquences plus longues — bien qu'il s'agisse d'une succession de clips et non d'une génération continue unique ; la durée native reste limitée à 20 secondes par génération.
Les capacités de génération d'images et de prédiction d'actions (ces dernières destinées à la robotique, en partenariat avec mimic robotics) font partie de la même annonce mais suivent un calendrier de déploiement distinct — l'accès aux images est prévu dans les semaines à venir, et non immédiatement.
Comment FLUX 3 se compare aux autres modèles vidéo
Black Forest Labs a publié des tests de préférence préliminaires, comparant un candidat FLUX 3 précoce aux modèles vidéo actuels. Dans leur propre évaluation, utilisant des clips texte-vidéo de 10 secondes en 720p :
Contexte important concernant ces chiffres : il s'agit des tests internes de Black Forest Labs, et non d'un benchmark indépendant. Les résultats publiés n'incluent pas l'ensemble des prompts, les instructions données aux évaluateurs, le nombre d'échantillons ou les intervalles de confiance, et le test a utilisé des clips plus courts et de plus faible résolution que la gamme complète annoncée pour FLUX 3. Considérez ceci comme un signal précoce encourageant provenant du développeur du modèle, et non comme un classement tiers vérifié. Nous mettrons à jour cette section si et quand des tests indépendants seront disponibles.
FLUX 3 sur Promptus — état actuel
En attente. À l'heure où nous écrivons ces lignes, FLUX 3 Video n'est pas encore répertorié comme un modèle disponible dans Promptus. Black Forest Labs déploie FLUX 3 Video d'abord via API et accès aux poids privés, une disponibilité plus large suivra — il ne s'agit pas encore d'un point de terminaison public instantané en libre-service de leur côté non plus. Promptus ajoutera FLUX 3 au sélecteur de modèles selon son propre calendrier une fois l'intégration terminée, avec sa propre tarification, ses modes pris en charge et ses éventuelles limites de génération.
Une fois en ligne, FLUX 3 apparaîtra dans le Playground de Promptus sous la tâche Vidéo, dans le menu de sélection des modèles. Nous confirmerons le processus exact ici dès qu'il sera disponible — y compris s'il est lancé en tant que fonctionnalité basée sur des crédits cloud (comme le font actuellement Veo 3 et Seedance 2.0 sur Promptus) ou avec des exigences d'accès supplémentaires héritées du contrôle d'accès anticipé de Black Forest Labs.
Tarification
Tarification spécifique à FLUX 3 : en attente. Black Forest Labs n'a pas publié de tarification publique pour FLUX 3 Video, et Promptus n'a pas encore listé FLUX 3 dans sa tarification des modèles. Nous ne publierons aucun chiffre ici tant qu'il ne sera pas confirmé — si vous voyez un coût en crédits spécifique pour FLUX 3 cité ailleurs en ce moment, considérez-le comme non vérifié.
Promptus tarifie généralement les modèles vidéo cloud comparables :
- Promptus fonctionne sur un système de crédits à travers ses niveaux d'abonnement. Les générations simples utilisent généralement environ 1 crédit ; les sorties complexes en haute résolution utilisent environ 3 à 5 crédits. Les crédits n'expirent pas.
- Artisan — 5 $/mois, 5 000 crédits/mois, inclut les modèles standard et les outils proches de ComfyUI.
- Designer — 25 $/mois, 25 000 crédits/mois, débloque ComfyUI, CosyCloud, les domaines personnalisés et un accès à des modèles supplémentaires.
- Licence unique — 49 $, déverrouille l'application de bureau Promptus avec ComfyUI pour une génération locale illimitée sur votre propre GPU. Cela couvre spécifiquement la génération locale hors ligne — les modèles connectés au cloud qui s'exécutent sur les serveurs de Black Forest Labs ou d'un autre fournisseur (ce qui sera le fonctionnement initial de FLUX 3 Video, selon le déploiement basé sur l'API de BFL) sont facturés séparément via le système de crédits et ne sont pas couverts par la licence locale unique.
- À titre de comparaison uniquement : la génération vidéo Veo 3 sur Promptus coûte actuellement 4 500 crédits par génération, soit environ 5 $ avec le forfait Artisan. Il s'agit du prix de Veo 3, pas de celui de FLUX 3 — nous l'incluons uniquement pour vous donner une idée réaliste de l'échelle de coût d'un modèle vidéo cloud comparable sur Promptus aujourd'hui.
- Des crédits peuvent également être obtenus en partageant la capacité GPU inutilisée via le réseau de calcul distribué de Promptus.
Accès API
Point de terminaison spécifique à FLUX 3 : Promptus a publié un identifiant de modèle ou un point de terminaison FLUX 3.
Vous trouverez ci-dessous le modèle d'API général de Promptus, basé sur les modèles vidéo cloud actuellement en ligne (Seedance 2.0), afin que les développeurs sachent à quoi s'attendre une fois l'accès à FLUX 3 ouvert.
L'API de génération vidéo cloud de Promptus suit un modèle de tâche asynchrone :
POST /contents/generations
{
"model": "<model-id>",
"mode": "text_to_video" | "image_to_video" | "images_to_video",
"images": ["url_1", "url_2"],
"prompt": "description of the desired output"
}
Vous soumettez une requête avec votre identifiant de modèle, le mode de génération, les éventuelles images de référence et votre prompt. Cela renvoie un identifiant de tâche. Vous interrogez ensuite cet identifiant de tâche jusqu'à ce que le travail soit terminé pour recevoir un fichier de sortie téléchargeable. Il s'agit d'un modèle entièrement asynchrone — il ne bloque pas votre application pendant l'exécution de la génération.
Si vous développez actuellement avec l'API Promptus, nous vous recommandons de structurer votre intégration autour de ce même modèle d'identifiant de tâche asynchrone dès maintenant, afin que le passage ultérieur à l'identifiant de modèle FLUX 3 ne nécessite que des modifications minimales.
%20(2).avif)
%20transparent.avif)

