CEVIU Logo
Voltar
Black Forest Labs lança FLUX 3: um modelo multimodal para geração de vídeo e imagem a partir de um único prompt

Black Forest Labs revoluciona criação multimídia com o FLUX 3: Imagens e Vídeos de um único prompt

Aprofundamento CEVIU

Aprofundamento

A Black Forest Labs lança o FLUX 3 com uma proposta ambiciosa: unificar a geração e a compreensão multimodal. Diferente de outros modelos que tratam imagem, vídeo e áudio isoladamente, o FLUX 3 foi construído na arquitetura Self-Flow, aprendendo com essas modalidades de forma conjunta. O objetivo é que a IA entenda a realidade de forma mais coesa, percebendo como objetos interagem, como as coisas se movem e os sons dos eventos. Isso significa um salto na inteligência visual, que a empresa aposta ser o caminho para IA que percebe, prediz e age em ambientes físicos e digitais.

O modelo gera imagens e clipes de vídeo com áudio de até 20 segundos a partir de um único prompt de texto, ou usando referências visuais e sonoras. Suas capacidades incluem geração de vídeo a partir de imagem (para animação ou referência visual), vídeo-a-vídeo (mantendo elementos centrais), continuação generativa de vídeo-áudio e transições controladas com keyframes. Em avaliações preliminares, o FLUX 3 superou concorrentes como Grok Imagine Video, Kling v3 Pro, Runway Gen-4.5 e Luma Ray 3.2. A novidade não se limita à criação de conteúdo; a Black Forest Labs também explora seu uso em IA física, com o FLUX-mimic, um modelo de vídeo-ação desenvolvido com a mimic robotics para manipulação robótica, testado pela Audi.

O que mudou

O FLUX 3 marca uma evolução importante em relação às versões anteriores do FLUX. A Black Forest Labs afirma que este é o primeiro modelo construído inteiramente sob o princípio de aprender de todas as modalidades de uma vez, tratando-as como evidências de uma realidade subjacente. Isso difere de abordagens que ensinam a IA sobre cada elemento isoladamente. A capacidade do FLUX 3 de lidar com prompts complexos e gerar texto com precisão também melhorou significativamente, como visto em avaliações durante o desenvolvimento. Embora outras empresas, como a OpenArt com seu Director, lancem ferramentas de geração de vídeo, a aposta do FLUX 3 na unificação multimodal e na IA física representa um avanço conceitual distinto na forma como modelos de fundação são projetados.

Por que isso importa

A chegada do FLUX 3 mostra que os modelos de IA estão se tornando cada vez mais sofisticados em sua compreensão do mundo real. Ao unificar a aprendizagem de imagens, vídeos e áudio, a Black Forest Labs não apenas simplifica a criação de conteúdo multimídia, mas também abre portas para aplicações em IA física e robótica que exigem uma percepção mais rica e contextual. Essa abordagem holística pode levar a sistemas autônomos mais capazes e a experiências criativas mais intuitivas. É um passo significativo na corrida por modelos de IA que não apenas geram, mas realmente 'entendem' a realidade.

Linha do tempo

  1. OpenArt lança Director: IA para criar vídeos com prompts e Vibe Directing

  2. Notion ganha bloco de HTML interativo para revolucionar a criação de protótipos com IA

  3. NVIDIA Apresenta Flex-Forcing: Revolução na Geração de Vídeos por IA

  4. Meta Lança Muse Spark 1.1: Novo Modelo Multimodal Aprimora Tarefas Agentic e Desenvolvimento com IA

  5. Google Fotos turbina edição de vídeo com IA e efeitos artísticos avançados

  6. DeepMind Repensa Geradores de Vídeo como Modelos de Visão Multiuso

  7. Black Forest Labs revoluciona criação multimídia com o FLUX 3

Perguntas frequentes

O que é o FLUX 3 da Black Forest Labs?

É um modelo multimodal de IA que gera imagens, vídeos e áudios de até 20 segundos a partir de um único prompt de texto. Ele se destaca por aprender de forma conjunta com diferentes modalidades, buscando uma compreensão mais unificada da realidade.

Como o FLUX 3 se diferencia de outros modelos de geração de vídeo?

Sua principal diferença é a arquitetura Self-Flow, que unifica a aprendizagem de imagem, vídeo e áudio. Isso permite uma geração mais coesa e um entendimento mais profundo. Em avaliações, o FLUX 3 superou modelos como Grok Imagine Video e Runway Gen-4.5 em preferência.

Quais são as aplicações do FLUX 3 além da criação de conteúdo?

Além da geração de multimídia, o FLUX 3 é aplicado em IA física. Em parceria com a mimic robotics, ele foi usado para desenvolver o FLUX-mimic, um modelo de vídeo-ação para previsão de ações em robótica, com testes na Audi.

O FLUX 3 já está disponível para todos os usuários?

Ele está disponível em acesso antecipado. A Black Forest Labs planeja um lançamento faseado, com APIs e acesso a pesos privados para diferentes funcionalidades (vídeo, áudio, imagem e ação) após um período de testes e feedback.

Fontes

Avalie este artigo:
Compartilhar:
Categoria
CEVIU IA
Publicado
24 de julho de 2026
Editoria
CEVIU IA

Quer receber mais sobre CEVIU IA?

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser