Black Forest Labs revoluciona criação multimídia com o FLUX 3: Imagens e Vídeos de um único prompt
Aprofundamento CEVIU
Aprofundamento
A Black Forest Labs lança o FLUX 3 com uma proposta ambiciosa: unificar a geração e a compreensão multimodal. Diferente de outros modelos que tratam imagem, vídeo e áudio isoladamente, o FLUX 3 foi construído na arquitetura Self-Flow, aprendendo com essas modalidades de forma conjunta. O objetivo é que a IA entenda a realidade de forma mais coesa, percebendo como objetos interagem, como as coisas se movem e os sons dos eventos. Isso significa um salto na inteligência visual, que a empresa aposta ser o caminho para IA que percebe, prediz e age em ambientes físicos e digitais.
O modelo gera imagens e clipes de vídeo com áudio de até 20 segundos a partir de um único prompt de texto, ou usando referências visuais e sonoras. Suas capacidades incluem geração de vídeo a partir de imagem (para animação ou referência visual), vídeo-a-vídeo (mantendo elementos centrais), continuação generativa de vídeo-áudio e transições controladas com keyframes. Em avaliações preliminares, o FLUX 3 superou concorrentes como Grok Imagine Video, Kling v3 Pro, Runway Gen-4.5 e Luma Ray 3.2. A novidade não se limita à criação de conteúdo; a Black Forest Labs também explora seu uso em IA física, com o FLUX-mimic, um modelo de vídeo-ação desenvolvido com a mimic robotics para manipulação robótica, testado pela Audi.
O que mudou
O FLUX 3 marca uma evolução importante em relação às versões anteriores do FLUX. A Black Forest Labs afirma que este é o primeiro modelo construído inteiramente sob o princípio de aprender de todas as modalidades de uma vez, tratando-as como evidências de uma realidade subjacente. Isso difere de abordagens que ensinam a IA sobre cada elemento isoladamente. A capacidade do FLUX 3 de lidar com prompts complexos e gerar texto com precisão também melhorou significativamente, como visto em avaliações durante o desenvolvimento. Embora outras empresas, como a OpenArt com seu Director, lancem ferramentas de geração de vídeo, a aposta do FLUX 3 na unificação multimodal e na IA física representa um avanço conceitual distinto na forma como modelos de fundação são projetados.
Por que isso importa
A chegada do FLUX 3 mostra que os modelos de IA estão se tornando cada vez mais sofisticados em sua compreensão do mundo real. Ao unificar a aprendizagem de imagens, vídeos e áudio, a Black Forest Labs não apenas simplifica a criação de conteúdo multimídia, mas também abre portas para aplicações em IA física e robótica que exigem uma percepção mais rica e contextual. Essa abordagem holística pode levar a sistemas autônomos mais capazes e a experiências criativas mais intuitivas. É um passo significativo na corrida por modelos de IA que não apenas geram, mas realmente 'entendem' a realidade.
Linha do tempo
OpenArt lança Director: IA para criar vídeos com prompts e Vibe Directing
Notion ganha bloco de HTML interativo para revolucionar a criação de protótipos com IA
NVIDIA Apresenta Flex-Forcing: Revolução na Geração de Vídeos por IA
Meta Lança Muse Spark 1.1: Novo Modelo Multimodal Aprimora Tarefas Agentic e Desenvolvimento com IA
Google Fotos turbina edição de vídeo com IA e efeitos artísticos avançados
DeepMind Repensa Geradores de Vídeo como Modelos de Visão Multiuso
Black Forest Labs revoluciona criação multimídia com o FLUX 3
Perguntas frequentes
O que é o FLUX 3 da Black Forest Labs?
É um modelo multimodal de IA que gera imagens, vídeos e áudios de até 20 segundos a partir de um único prompt de texto. Ele se destaca por aprender de forma conjunta com diferentes modalidades, buscando uma compreensão mais unificada da realidade.
Como o FLUX 3 se diferencia de outros modelos de geração de vídeo?
Sua principal diferença é a arquitetura Self-Flow, que unifica a aprendizagem de imagem, vídeo e áudio. Isso permite uma geração mais coesa e um entendimento mais profundo. Em avaliações, o FLUX 3 superou modelos como Grok Imagine Video e Runway Gen-4.5 em preferência.
Quais são as aplicações do FLUX 3 além da criação de conteúdo?
Além da geração de multimídia, o FLUX 3 é aplicado em IA física. Em parceria com a mimic robotics, ele foi usado para desenvolver o FLUX-mimic, um modelo de vídeo-ação para previsão de ações em robótica, com testes na Audi.
O FLUX 3 já está disponível para todos os usuários?
Ele está disponível em acesso antecipado. A Black Forest Labs planeja um lançamento faseado, com APIs e acesso a pesos privados para diferentes funcionalidades (vídeo, áudio, imagem e ação) após um período de testes e feedback.
Fontes
- bfl.aifonte original
- Categoria
- CEVIU IA
- Publicado
- 24 de julho de 2026
- Editoria
- CEVIU IA

