DeepSeek R2: o que se sabe sobre o próximo modelo da DeepSeek
Aprofundamento CEVIU
Aprofundamento
O DeepSeek-R2 não é um único modelo confirmado, mas duas linhas de especulação que se cruzam: uma aponta para um modelo de raciocínio aberto de 32 bilhões de parâmetros, lançado em abril de 2026 e já disponível em repositórios como Hugging Face (embora sem anúncio oficial da DeepSeek); outra refere-se a um projeto MoE de 1.2 trilhão de parâmetros, adiado desde 2025 por dificuldades com chips Huawei Ascend. O primeiro R2, o de 32B, é real, open-source, otimizado para matemática e código, roda em uma RTX 4090 e custa cerca de 70% menos por token que APIs ocidentais de raciocínio. Já o R2 de escala V4 (1.2T) ainda não foi lançado, nem listado nas páginas oficiais da DeepSeek em junho de 2026.
O DeepSeek-V4, lançado em abril de 2026, continua sendo o modelo mais recente oficialmente divulgado pela empresa. Sua versão Pro (1.6 trilhão de parâmetros) teve preço reduzido em 75% a partir de 22 de maio de 2026, agora a US$ 0.435/milhão de tokens de entrada (cache-miss), e supera o GPT-5.5 em custo-benefício. A confusão com o R2 surge porque alguns relatos de abril/maio de 2026 usaram 'R2' para nomear o modelo de 32B, enquanto outros mantinham o termo para o projeto MoE maior, ainda em desenvolvimento.
Por que isso importa
Para empresas e devs brasileiros que precisam de raciocínio forte sem depender de APIs caras ou sujeitas a bloqueios, o R2 de 32B é relevante agora: é executável localmente, tem licença comercial permissiva e performance comprovada no AIME 2025 (92.7%). Já o atraso do R2 MoE de 1.2T mostra os limites reais da migração para hardware chinês, especialmente na fase crítica de treinamento, mesmo com avanços recentes, como o pós-treinamento bem-sucedido do V4-Pro em cluster Huawei Ascend 910C em junho de 2026.
Impacto para desenvolvedores
Desenvolvedores podem usar o R2 de 32B hoje via Hugging Face ou Ollama, sem dependência de API, e com baixo custo de inferência, ideal para agentes locais de matemática ou assistência técnica. Já quem espera um sucessor direto do R1 ou do V4-Pro deve manter foco no V4-Flash (284B) ou no V4-Pro, já que nenhum ID de modelo 'deepseek-r2' aparece na documentação oficial da DeepSeek em junho de 2026. A ausência de anúncio oficial significa que integrações críticas não devem assumir a existência do R2 MoE como fato, apenas como rumor persistente.
Perguntas frequentes
O DeepSeek-R2 já foi lançado?
Há dois modelos chamados R2 em circulação. Um é real: o DeepSeek-R2 de 32 bilhões de parâmetros, open-source, lançado em abril de 2026 e já disponível em repositórios públicos. O outro, o R2 MoE de 1.2 trilhão de parâmetros, ainda não foi lançado oficialmente. A DeepSeek não listou nenhum modelo 'R2' em sua documentação ou página de preços até junho de 2026.
Qual é a diferença entre DeepSeek-R2 e DeepSeek-V4?
O DeepSeek-V4 é um modelo oficial, lançado em abril de 2026, com versões Pro (1.6T) e Flash (284B), janela de contexto de 1 milhão de tokens e precificação pública. O R2 de 32B é um modelo distinto, focado em raciocínio matemático/código, open-source e executável em GPU de consumidor. Não há relação arquitetônica direta entre eles, o R2 de 32B não é uma versão 'leve' do V4, nem um predecessor.
O DeepSeek-R2 usa chips da Huawei?
O R2 de 32B não tem informação pública sobre dependência de hardware Huawei. Já o projeto R2 MoE de 1.2T foi adiado em 2025 devido a falhas de treinamento com chips Ascend da Huawei. Relatos de junho de 2026 mostram que a DeepSeek conseguiu usar esses chips com sucesso no pós-treinamento do V4-Pro, mas não há confirmação de que o R2 MoE tenha retomado essa trajetória.
Quanto custa o DeepSeek-R2?
O R2 de 32B é open-source e gratuito para uso local. Se for usado via API de terceiros, o custo é aproximadamente 70% menor por token que APIs ocidentais de raciocínio, mas não há precificação oficial da DeepSeek para ele. Já o R2 MoE de 1.2T nunca teve preço divulgado, pois não foi lançado.
Links relacionados
Fontes
- bentoml.comfonte original
- Categoria
- CEVIU IA
- Publicado
- 14 de junho de 2026
- Editoria
- CEVIU IA

