CEVIU Logo
Voltar

Nvidia Lança Nemotron 3.5 Lightning e NeMo Switchyard para Otimizar Modelos de IA e Reduzir Custos

Aprofundamento CEVIU

Aprofundamento

A Nvidia segue na ofensiva para dominar o campo dos agentes de IA, e os lançamentos do Nemotron 3.5 Lightning e NeMo Switchyard reforçam essa estratégia. O Nemotron 3.5 Lightning, um modelo aberto de mixture-of-experts (MoE) com 30 bilhões de parâmetros, é construído para tarefas especializadas e de alto volume. Ele estende a arquitetura híbrida Mamba-Transformer com latent MoE, apresentada na família Nemotron 3 em dezembro de 2025, a mesma linha por trás do Nemotron 3 Super, que o CEVIU News noticiou em 12 de março de 2026. A principal proposta do Lightning é a eficiência: ele entrega resultados até quatro vezes mais rápido e completa tarefas agentic 30% mais veloz que modelos similares, mantendo a precisão.

Complementar ao Lightning está o NeMo Switchyard, uma biblioteca de código aberto focada em roteamento dinâmico de modelos. O Switchyard decide qual modelo usar em cada etapa do fluxo de trabalho de um agente, considerando fatores como estado do agente e custo de tokens. Essa inteligência no roteamento não só otimiza a performance, mas também derruba os custos. O lançamento faz parte do ecossistema NeMo, que já inclui ferramentas como o NeMo AutoModel, noticiado em 25 de junho de 2026, para fine-tuning de modelos.

O que mudou

O Nemotron 3.5 Lightning representa uma evolução clara dentro da família Nemotron 3 da Nvidia, que o CEVIU News acompanha desde o lançamento do Nemotron 3 Super em 12 de março de 2026. Enquanto o Nemotron 3 Super era um MoE híbrido de 120 bilhões de parâmetros (com 12 bilhões ativos) focado em sistemas de IA agentic e multiagentes de forma mais geral, o Nemotron 3.5 Lightning (30 bilhões de parâmetros) tem um propósito mais refinado. Ele é otimizado especificamente para tarefas agentic especializadas de alto volume, visando velocidade e eficiência de custo, não tanto ser um líder em inteligência geral para sua classe de tamanho. O foco mudou para a otimização de custo e performance em cenários bem definidos, usando a mesma arquitetura de base.

Por que isso importa

Para as empresas, a combinação Nemotron 3.5 Lightning e NeMo Switchyard é um avanço significativo na corrida por IA agentic mais acessível. A capacidade de manter a conclusão de tarefas em nível de modelo 'frontier', mas com custos reduzidos a um terço do valor de operar modelos potentes isoladamente, resolve um dos maiores gargalos na adoção de agentes de IA em larga escala. Isso significa que a escolha do

Linha do tempo

  1. NVIDIA lança Nemotron 3 Super, modelo MoE híbrido para IA agentic.

  2. NVIDIA lança stack empresarial completo para agentes de IA.

  3. NVIDIA NeMo AutoModel acelera fine-tuning de Transformers.

  4. NVIDIA lança Nemotron 3 Embed, modelos open-source de embedding.

  5. NVIDIA apresenta Cosmos 3 Edge para robôs autônomos.

  6. NVIDIA ModelExpress revoluciona distribuição de modelos com P2P RDMA.

  7. Nvidia Lança Nemotron 3.5 Lightning e NeMo Switchyard.

Perguntas frequentes

O que é o Nemotron 3.5 Lightning?

É um modelo de IA de mixture-of-experts (MoE) aberto com 30 bilhões de parâmetros, desenvolvido pela Nvidia. Ele é otimizado para tarefas agentic especializadas e de alto volume, entregando resultados mais rápidos e eficientes em comparação com outros modelos.

Como o NeMo Switchyard contribui para a economia de custos?

O NeMo Switchyard é uma biblioteca de código aberto que roteia dinamicamente cada etapa de um fluxo de trabalho de agente para o modelo de IA mais adequado. Ele considera fatores como o estado do agente e o custo de tokens, garantindo que a tarefa seja executada pelo modelo mais eficiente e barato, sem comprometer a qualidade.

Qual a relação entre o Nemotron 3.5 Lightning e a família Nemotron 3?

O Nemotron 3.5 Lightning é parte da família Nemotron 3 da Nvidia. Ele estende a arquitetura híbrida Mamba-Transformer com latent mixture-of-experts, que foi introduzida com o Nemotron 3 em dezembro de 2025. O Nemotron 3 Super, noticiado em 12 de março de 2026, é um dos predecessores na mesma linha.

Que tipo de ganhos as empresas podem esperar com essas novas ferramentas?

As empresas podem esperar uma redução drástica nos custos de operação de agentes de IA, chegando a um terço do valor de usar modelos 'frontier' isoladamente. Além disso, há ganhos de velocidade e eficiência, com tarefas agentic sendo concluídas cerca de 30% mais rápido que modelos concorrentes, como o Qwen3.6-35B.

Fontes

Avalie este artigo:
Compartilhar:
Categoria
CEVIU IA
Publicado
12 de agosto de 2026
Editoria
CEVIU IA

Quer receber mais sobre CEVIU IA?

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser