Voltar
Inception Labs lança Mercury 2.5, o maior modelo de linguagem de difusão já treinado

Inception Labs Apresenta Mercury 2.5: Um Gigante em Modelos de Linguagem de Difusão

Aprofundamento CEVIU

Aprofundamento

A Inception Labs surpreende o mercado de IA com o lançamento do Mercury 2.5, um modelo de linguagem de difusão (dLLM) que estabelece um novo recorde como o maior já treinado. Este dLLM se destaca pela eficiência, processando 1.107 tokens por segundo em GPUs Nvidia amplamente disponíveis, com uma janela de contexto de 260K tokens. A arquitetura de difusão, geralmente associada à geração de imagens, aqui é aplicada a textos, permitindo um processamento rápido e, segundo a empresa, uma inteligência comparável a modelos de ponta otimizados para custo.

Entre as capacidades do Mercury 2.5, estão o raciocínio ajustável, chamadas de ferramentas paralelas e JSON alinhado a esquemas. Ele é projetado para lidar com cargas de trabalho sensíveis à latência em aplicações como agentes de busca, onde múltiplas chamadas ao modelo são necessárias para uma única consulta, e agentes de voz, onde a rapidez da resposta é crucial para a experiência do usuário. A Inception Labs está oferecendo um desconto inicial de 80%, precificando a US$ 0,04 por milhão de tokens de entrada e US$ 0,15 por milhão de tokens de saída, posicionando-o como uma alternativa competitiva frente a outros modelos.

O que mudou

O Mercury 2.5 representa um salto significativo de qualidade em relação ao seu antecessor, o Mercury 2. A Inception Labs afirma um aumento de 40% na inteligência do modelo, mantendo o perfil de baixa latência e custo. Desde o lançamento do Mercury 2, a base de usuários e o volume de uso cresceram mais de dez vezes, com o modelo sendo empregado em busca, voz e produtos de codificação. Essa evolução é o resultado direto do feedback dos clientes e da análise de falhas em produção, que orientaram o treinamento e as avaliações do novo modelo, transformando dados do mundo real em aprimoramentos concretos. Além disso, a empresa lançou o Mercury Voice e o Mercury Router em prévia, expandindo as funcionalidades da plataforma.

Por que isso importa

A chegada do Mercury 2.5 é importante porque redefine o balanço entre desempenho e custo no universo dos LLMs. Ao rivalizar com modelos como GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite e Claude Haiku 4.5, ele prova que é possível ter alta capacidade sem um custo proibitivo. A velocidade de processamento e a janela de contexto robusta o tornam ideal para aplicações que exigem respostas rápidas e contexto extenso, como assistentes de voz e sub-agentes de codificação. A estratégia de preço agressiva, com um desconto inicial, democratiza o acesso a uma IA de ponta, incentivando a adoção e a inovação em diversas frentes, como vimos no CEVIU News em matérias sobre o DeepSeek V4-Flash em 4 de agosto de 2026 e o Claude Opus 5 em 27 de julho de 2026, que também focavam na relação custo-benefício.

Linha do tempo

  1. Subquadratic estreia janela de 12 milhões de tokens.

  2. SpaceXAI lança Grok 4.5, prometendo eficiência e custos reduzidos.

  3. Anthropic apresenta Claude Opus 5, focado em desempenho e custo-benefício.

  4. Thinking Machines desvenda Inkling-Small, IA MoE com 276 bilhões de parâmetros.

  5. DeepSeek V4-Flash redefine custo-benefício em modelos de IA.

  6. Inception Labs lança Mercury 2.5, o maior modelo de linguagem de difusão.

Perguntas frequentes

O que é um modelo de linguagem de difusão (dLLM)?

Um modelo de linguagem de difusão, ou dLLM, aplica princípios dos modelos de difusão (popularmente usados em geração de imagens) ao processamento de linguagem. Ele busca uma forma mais eficiente e rápida de gerar e entender texto. O Mercury 2.5 é o maior dLLM já treinado, segundo a Inception Labs.

Quais são as principais melhorias do Mercury 2.5 em relação ao Mercury 2?

O Mercury 2.5 apresenta um aumento de 40% na inteligência, mantendo o baixo custo e a baixa latência. Ele também oferece raciocínio ajustável, chamadas de ferramentas paralelas e suporte a JSON alinhado a esquemas. Essas melhorias vieram de feedback real de milhares de desenvolvedores e dezenas de empresas que usaram o Mercury 2 em produção.

Como o Mercury 2.5 se compara a outros modelos de IA do mercado?

O Mercury 2.5 rivaliza em inteligência com modelos otimizados para custo, como GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite e Claude Haiku 4.5. Ele se destaca pela velocidade de 1.107 tokens por segundo e pelo preço competitivo, especialmente com o desconto de lançamento. A Inception Labs também o posiciona como uma opção superior para aplicações sensíveis à latência.

Para quais tipos de aplicação o Mercury 2.5 é mais indicado?

Graças à sua alta velocidade e baixa latência, o Mercury 2.5 é ideal para agentes de busca, que precisam de várias chamadas rápidas ao modelo, e agentes de voz, onde a resposta instantânea é fundamental. Ele também é eficiente para sub-agentes de codificação e assistentes que gerenciam múltiplas tarefas e precisam de compactação de contexto e roteamento rápido de modelos.

Fontes

Avalie este artigo:
Categoria
CEVIU IA
Publicado
09 de setembro de 2026
Editoria
CEVIU IA

Quer receber mais sobre CEVIU IA?

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser