
FLUX 3 es un modelo base multimodal disponible en Promptus
Black Forest Labs lanzó FLUX 3 el 23 de julio de 2026; su primer modelo entrenado conjuntamente en imagen, vídeo y audio bajo una arquitectura única, en lugar de sistemas separados integrados a la fuerza. Este artículo analiza qué hace realmente FLUX 3, cómo se compara con otros modelos de vídeo según las pruebas iniciales de Black Forest Labs y todo lo que se sabe actualmente sobre cómo acceder a él a través de Promptus, incluyendo precios y detalles de la API.
Qué es realmente FLUX 3
FLUX 3 es un modelo base multimodal que aprende de imágenes, vídeo y audio simultáneamente dentro de una misma arquitectura, en lugar de entrenar modelos separados para cada uno. El razonamiento de Black Forest Labs es que el sonido debe coincidir con el impacto físico y el movimiento debe obedecer a la masa; un modelo que solo ve imágenes estáticas nunca aprende nada de eso. Entrenar los tres juntos, según su planteamiento, significa que las limitaciones de cada modalidad enseñan a las otras dos: el modelo no adivina el movimiento y el sonido por separado, sino que aprende una representación interna única que produce todo el conjunto.
En la práctica, esto se traduce en una generación de audio nativa: FLUX 3 Video genera sonido sincronizado en la misma pasada que el vídeo, no como un paso adicional añadido posteriormente.
Qué puede hacer FLUX 3
Capacidades confirmadas, según el propio anuncio de Black Forest Labs:
- Texto a vídeo con audio nativo, generando clips de hasta 20 segundos de duración con diálogos, efectos de sonido y sonido ambiente sincronizados.
- Imagen a vídeo, en dos modos distintos: animando a partir de un fotograma inicial fijo o utilizando una imagen de referencia para guiar la escena sin fijar el primer fotograma exacto.
- Vídeo a vídeo y continuación, trasladando elementos centrales —incluyendo un personaje específico— de un clip existente a una nueva escena.
- Fotograma clave a vídeo, generando una transición controlada entre dos momentos definidos en lugar de una animación abierta.
- Diálogo multilingüe y expresión facial, generados directamente en lugar de doblados posteriormente.
- Amplia gama de estilos y relaciones de aspecto, desde metraje estilo cámara doméstica hasta composición cinematográfica completa, además de una sólida tipografía en pantalla y texto animado.
- Encadenamiento de múltiples tomas mediante agentes, vinculando clips generados individualmente en secuencias más largas; aunque se trata de una secuencia de clips y no de una única generación continua, la duración nativa del clip sigue siendo de hasta 20 segundos por generación.
Las capacidades de generación de imágenes y predicción de acciones (estas últimas orientadas a la robótica, en colaboración con mimic robotics) forman parte del mismo anuncio, pero siguen un cronograma de lanzamiento distinto: se espera que el acceso a las imágenes esté disponible en las próximas semanas, no de forma inmediata.
Cómo se compara FLUX 3 con otros modelos de vídeo
Black Forest Labs publicó pruebas de preferencia preliminares, comparando un candidato inicial de FLUX 3 con los modelos de vídeo actuales. En su propia evaluación, utilizando clips de texto a vídeo de 10 segundos y 720p:
Contexto importante sobre estas cifras: esta es una prueba interna de Black Forest Labs, no un análisis comparativo independiente. Los resultados publicados no incluyen el conjunto completo de prompts, las instrucciones para los evaluadores, el número de muestras ni los intervalos de confianza, y la prueba utilizó clips más cortos y de menor resolución que el rango completo anunciado para FLUX 3. Considere esto como una señal inicial sólida por parte del propio desarrollador del modelo, no como una clasificación verificada por terceros. Actualizaremos esta sección si llegan a estar disponibles pruebas independientes.
FLUX 3 en Promptus: estado actual
Pendiente. Al momento de escribir este artículo, FLUX 3 Video aún no aparece como un modelo disponible en Promptus. Black Forest Labs está lanzando FLUX 3 Video primero a través de API y acceso a pesos privados, y la disponibilidad general llegará más adelante; tampoco se trata todavía de un endpoint público de autoservicio inmediato por su parte. Promptus añadirá FLUX 3 al selector de modelos según su propio calendario una vez que se complete la integración, junto con sus propios precios, modos compatibles y cualquier límite de generación.
Una vez activo, FLUX 3 aparecerá en el Playground de Promptus bajo la tarea de Vídeo, en el menú de selección de modelos. Confirmaremos el proceso exacto aquí tan pronto como esté disponible, incluyendo si se lanza como una función de créditos en la nube (como funcionan actualmente Veo 3 y Seedance 2.0 en Promptus) o con cualquier requisito de acceso adicional derivado de las restricciones de acceso anticipado de Black Forest Labs.
Precios
Precios específicos de FLUX 3: pendiente. Black Forest Labs no ha publicado precios públicos para FLUX 3 Video, y Promptus aún no ha incluido a FLUX 3 en su lista de precios de modelos. No publicaremos ninguna cifra aquí hasta que esté confirmada; si ve un coste específico en créditos para FLUX 3 mencionado en cualquier otro lugar en este momento, considérelo no verificado.
Promptus generalmente aplica los siguientes precios a modelos de vídeo en la nube comparables:
- Promptus funciona con un sistema de créditos en todos sus niveles de suscripción. Las generaciones sencillas suelen consumir alrededor de 1 crédito; las salidas complejas de alta resolución utilizan aproximadamente entre 3 y 5 créditos. Los créditos no caducan.
- Artisan — 5 $/mes, 5000 créditos/mes, incluye modelos estándar y herramientas similares a ComfyUI.
- Designer — 25 $/mes, 25 000 créditos/mes, desbloquea ComfyUI, CosyCloud, dominios personalizados y acceso a modelos adicionales.
- Licencia de pago único — 49 $, desbloquea la aplicación de escritorio Promptus con ComfyUI para generación local ilimitada en tu propia GPU. Esto cubre específicamente la generación local y sin conexión; los modelos conectados a la nube que se ejecutan en los servidores de Black Forest Labs u otro proveedor (que es como funcionará inicialmente FLUX 3 Video, según el despliegue basado en API de BFL) se facturan por separado a través del sistema de créditos y no están cubiertos por la licencia local de pago único.
- Solo como comparación orientativa: la generación de vídeo con Veo 3 en Promptus cuesta actualmente 4500 créditos por generación, aproximadamente 5 $ en el plan Artisan. Este es el precio de Veo 3, no el de FLUX 3; lo incluimos solo para que tengas una idea realista de la escala de costes de un modelo de vídeo en la nube comparable en Promptus hoy en día.
- También se pueden obtener créditos compartiendo la capacidad inactiva de la GPU a través de la red de computación distribuida de Promptus.
Acceso a la API
Punto de conexión específico para FLUX 3: Promptus ha publicado un identificador de modelo o punto de conexión para FLUX 3.
A continuación se muestra el patrón general de la API de Promptus, basado en los modelos de vídeo en la nube actualmente activos (Seedance 2.0), para que los desarrolladores sepan qué estructura esperar una vez que se abra el acceso a FLUX 3.
La API de generación de vídeo en la nube de Promptus sigue un patrón de trabajo asíncrono:
POST /contents/generations
{
"model": "<model-id>",
"mode": "text_to_video" | "image_to_video" | "images_to_video",
"images": ["url_1", "url_2"],
"prompt": "description of the desired output"
}
Envías una solicitud con tu ID de modelo, modo de generación, cualquier imagen de referencia y tu prompt. Esto devuelve un ID de tarea. Luego, consultas ese ID de tarea hasta que el trabajo se completa y recibes un archivo de salida descargable. Se trata de un patrón totalmente asíncrono: no bloquea tu aplicación mientras se ejecuta la generación.
Si estás desarrollando con la API de Promptus hoy, te recomendamos estructurar tu integración siguiendo este mismo patrón de ID de tarea asíncrono desde ahora, de modo que cambiar al ID de modelo de FLUX 3 más adelante requiera cambios mínimos.
%20(2).avif)
%20transparent.avif)

