
A Cloudflare está aprofundando seus investimentos em IA com a contratação de membros da equipe da Ensemble AI, focando em infraestrutura e eficiência de machine learning.

Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2317 notícias

A Cloudflare está aprofundando seus investimentos em IA com a contratação de membros da equipe da Ensemble AI, focando em infraestrutura e eficiência de machine learning.

ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. 16/03/2026, NVIDIA Vera Rubin foi anunciada como a próxima plataforma de IA, incluindo a CPU NVIDIA Vera e a GPU NVIDIA Rubin, e já está em plena produção para as maiores fábricas de IA do mundo. A plataforma Vera Rubin unifica sete novos chips, incluindo a CPU Vera, GPU Rubin, NVLink 6, ConnectX-9 SuperNIC, BlueField-4 DPU e Spectrum-6 Ethernet, além da recém-integrada LPU NVIDIA Groq 3. Produtos baseados na plataforma Vera Rubin estarão disponíveis a partir do segundo semestre de 2026 através de parceiros como Amazon Web Services, Google Cloud, Microsoft Azure e Oracle Cloud Infrastructure. LANCADO: 01/06/2026, A NVIDIA lançou o chip RTX Spark para PCs pessoais com IA, prometendo levar funções avançadas de IA diretamente para notebooks e computadores de mesa. O CEO da NVIDIA, Jensen Huang, anunciou a novidade na Computex, afirmando que a Microsoft e a NVIDIA irão "reinventar o PC" para a era da IA. Novos modelos de PCs com o RTX Spark de marcas como Microsoft e Dell estão previstos para chegar ao mercado ainda este ano. LANCADO: 18/03/2024, A plataforma NVIDIA Blackwell, incluindo o B200 e o superchip GB200 Grace Blackwell, foi lançada para impulsionar a era da computação de IA. Os sistemas GB200 NVL72 começaram a ser enviados para os principais provedores de nuvem em dezembro de 2024, com a produção em massa aumentando no segundo e terceiro trimestres de 2025. O Blackwell Ultra, uma iteração aprimorada, foi apresentado em março de 2025 na GTC e começou a ser enviado em setembro de 2025. (Rumor original) A NVIDIA mantém dois eixos de atuação para seus chips de IA, combinando lançamentos recentes e expectativas para o segundo semestre de 2026. Entre as novidades concretas, o chip B200 com arquitetura Blackwell já foi introduzido, enquanto o RTX Spark, voltado para laptops e PCs Windows com foco em agentes de IA, foi anunciado em junho de 2026. No campo das expectativas, a plataforma Vera Rubin, sucessora da Blackwell, está prevista para o final de 2026, prometendo ganhos em eficiência e custos. Esta nova geração incluirá componentes como a CPU Vera e a GPU Rubin, com o objetivo de reduzir a necessidade de hardware em treinos de modelos complexos, contando já com o interesse de empresas como OpenAI, Anthropic e SpaceX.

ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. **Família Mistral 3 e Mistral Large 3**: Lançados em 2 de dezembro de 2025, estes modelos representam a próxima geração de modelos abertos, multimodais e multilíngues da Mistral AI. Mistral Large 3 é um modelo de mixture-of-experts (MoE) com 41 bilhões de parâmetros ativos e 675 bilhões de parâmetros totais, lançado sob a licença Apache 2 (Rumor original) A Mistral AI atualizou recentemente seu ecossistema com o Mistral Medium 3.5, Mistral Small 4 e a plataforma Forge. Enquanto esses lançamentos consolidam capacidades multimodais, de raciocínio e de codificação, a expectativa agora gira em torno de variantes futuras. A comunidade aguarda uma versão de raciocínio do Mistral Large 3, considerada iminente, e especula sobre uma nova geração denominada Mistral 4, com potencial para competir com modelos de ponta. Adicionalmente, a empresa planeja introduzir a classe de modelos Physics AI para prever sistemas físicos e o Vibe, um agente unificado para produtividade e codificação, que incluirá modos dedicados e uma extensão para VS Code.

ATUALIZAÇÃO (16/06/2026): não é mais rumor, foi lançado. 11/06/2026 (data provável com base em relatórios) A OpenAI lançou o GPT-5.6 este mês, com (Rumor original) O modelo mais recente da OpenAI, o GPT-5.5 (codinome Spud), foi lançado em abril de 2026. Agora, surgem especulações sobre o desenvolvimento do GPT-5.6, com previsão de lançamento para junho de 2026. Segundo Jakub Pachocki, cientista-chefe da OpenAI, o modelo trará melhorias significativas. Internamente, ele é testado sob codinomes como Kindle, Kepler e, mais recentemente, Levi. O foco desta versão deve ser escalabilidade, acessibilidade, geração de interface de usuário, compreensão de imagens e fluxos de trabalho de codificação aprimorados. Além disso, Sam Altman indicou que o intervalo entre o GPT-5 e o GPT-6 será menor do que a lacuna observada entre as versões anteriores, sugerindo o lançamento do GPT-6 até o final de 2027.
Gemini 4 não foi lançado nem anunciado. O Google está no Gemini 3.6 Flash. Veja o que existe hoje, o que se espera da próxima geração e o que ainda é especulação.

ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. 8 de abril de 2026. DeepSeek R2 é um modelo de raciocínio de código aberto com 32 bilhões de parâmetros. Ele alcançou uma pontuação de 92,7% no AIME 2025 e pode ser executado em uma única GPU de consumidor de 24 GB. O modelo representa um desvio significativo dos rumores anteriores de um design MoE de 1,2 trilhão de parâmetros. (Rumor original) O modelo mais recente da DeepSeek é o DeepSeek-V4, lançado em abril de 2026 nas versões Pro e Flash. O V4-Pro conta com 1.6 trilhão de parâmetros totais, enquanto a versão Flash possui 284 bilhões, ambos suportando janelas de contexto de até 1 milhão de tokens. Desde maio de 2026, a empresa aplica uma redução permanente no preço do V4-Pro. Sobre o futuro, as especulações giram em torno do modelo DeepSeek-R2, cujo lançamento teria sido adiado devido a desafios no treinamento com chips da Huawei Technologies. Anteriormente, o modelo Hunter Alpha era associado à DeepSeek, mas foi confirmado como um projeto da Xiaomi denominado MiMo-V2-Pro.

ATUALIZAÇÃO (14/06/2026): não é mais rumor, foi lançado. 20 de fevereiro de 2026. A Alibaba lançou o Qwen-3.5, com uma versão open-weight e outra hospedada na nuvem (Qwen-3.5-Plus). Este modelo foca em agentes de IA, multimodalidade e custos reduzidos, buscando maior adoção internacional. O Qwen-3.5-Open-Source, com 397 bilhões de parâmetros, demonstrou melhorias significativas em relação ao modelo anterior, Qwen-3-Max-Thinking, e o Qwen-3.5-Plus alcançou desempenho comparável a modelos líderes. Outros lançamentos recentes incluem: * **Qwen3.6-35B-A3B e Qwen3.6-27B**: Lançados em abril de 2026. * **Qwen3.7 Max e Qwen3.7 Plus**: Lançados em 18 de maio de 2026. * **Qwen 3-Max**: Um modelo proprietário com mais de 1 trilhão de parâmetros, treinado com aproximadamente 36 trilhões de tokens, disponível via API, e sua variante de raciocínio, Qwen3-Max-Thinking, capaz de gerar texto, imagens ou vídeo. * **Qwen-VL 3 (Vision-Language)**: Integrado diretamente aos pesos principais do Qwen 3, oferece "Multimodalidade Nativa", permitindo que o modelo raciocine sobre imagens e texto no mesmo espaço de alta dimensão. (Rumor original) A linha de modelos Qwen da Alibaba Cloud tem apresentado lançamentos frequentes, incluindo o Qwen3.7-Plus, focado em agentes multimodais, e o Qwen3.7-Max, voltado para raciocínio complexo. O ecossistema recente também conta com modelos como Qwen3.5-Omni e Qwen3-Coder-Next. Sobre os próximos passos, existem rumores de que o futuro Qwen4 focará em pesos de autoevolução, permitindo que o modelo atualize sua base de conhecimento em tempo real. A visão da empresa é atingir uma Inteligência Universal até 2027, integrando IA nos mundos digital e físico.
ATUALIZAÇÃO (15/06/2026): não é mais rumor, foi lançado. Junho de 2026 (previsão) O OpenAI está se preparando para lançar o GPT-5.6 neste mês, de acordo com relatórios baseados em informações internas e declarações do cientista-chefe Jakub Pachocki. O modelo é descrito como uma "melhoria significativa" em relação ao GPT-5.5, focando em eficiência e segurança para competir com modelos rivais. Vazamentos e relatórios de testes indicam melhorias em geração de interface de usuário (UI), codificação agêntica e raciocínio, além de um possível aumento na janela de contexto. (Rumor original) A família GPT-5.5, composta pelos modelos Instant, Thinking e Pro, é a versão atual da OpenAI, tendo o GPT-5.5 Instant recebido uma atualização em 28 de maio de 2026. Em 12 de junho de 2026, os modelos GPT-5.2 foram descontinuados e as conversas migradas para o GPT-5.5. Outras versões recentes incluem o GPT-5.3-Codex, lançado em fevereiro de 2026 para codificação, e modelos como o GPT-Rosalind, focados em ciências da vida e biodefesa. Para o futuro, especula-se o lançamento do GPT-5.6, de codinome kindle-alpha, que já circula em canais de teste. Rumores apontam para melhorias em raciocínio, codificação, visão e uma janela de contexto expandida, com expectativa de lançamento ainda em junho de 2026, conforme indicações da liderança da empresa sobre novos modelos em desenvolvimento.
O Vercel AI SDK agora permite programar e gerenciar agent harnesses, oferecendo suporte para ferramentas como Claude Code, Codex e Pi.
O acesso ao Claude Fable 5 foi suspenso no AI Gateway da Vercel.
O Google DeepMind introduziu o Gemini Omni, uma nova arquitetura multimodal projetada para processar e responder a inputs e outputs de áudio, visão e texto de forma nativa e em tempo real.
Melhor orquestração, menos transferências de contexto e progresso mais rápido, sem a necessidade de novos controles adicionais.
O AgentPerf da Artificial Analysis, o primeiro benchmark do setor para IA agentic, oferece a desenvolvedores, empresas e provedores de infraestrutura uma forma clara de comparar sistemas. Nos resultados iniciais, a plataforma NVIDIA Blackwell Ultra NVL72 demonstrou desempenho superior nas cargas de trabalho testadas, executando 20 vezes mais agentes por megawatt do que a geração anterior da NVIDIA.
O modelo Kimi K2.7 Code já está disponível para uso por meio do AI Gateway da Vercel.
A OpenAI apresenta três cursos da Academy para ajudar profissionais a desenvolver habilidades práticas em IA, criar fluxos de trabalho repetíveis e aplicar agentes no cotidiano laboral.
O olmo-eval é uma ferramenta desenvolvida para facilitar o processo de avaliação contínua durante o ciclo de desenvolvimento de modelos de IA, permitindo uma análise mais eficiente no loop de experimentação.
O artigo aborda o processo de profiling no PyTorch, detalhando a transição de um componente nn.Linear padrão para a implementação de um MLP com técnica de fusion.
A OpenAI planeja adquirir a Ona para expandir o Codex com ambientes de cloud seguros e persistentes, permitindo a execução de agentes de IA de longa duração em fluxos de trabalho corporativos.
O sistema automatizado de pesquisa em IA da Recursive alcançou resultados de estado da arte em treinamento de modelos de linguagem com orçamento fixo, velocidade de modelos pequenos e otimização de kernel de GPU.
O desempenho dos modelos de IA tem melhorado continuamente sem sinais de estagnação. Atualmente, modelos com pesos abertos estão apenas alguns meses atrás dos frontier models em termos de benchmarks. Se a tendência atual persistir, é provável que, até o início de 2029, seja possível rodar um modelo aberto com capacidade equivalente ao Claude Fable 5 em dispositivos equipados com 16 GB de RAM.