Os grandes modelos de linguagem são construídos, em essência, empilhando blocos transformer repetidamente. O que os diferencia de verdade está nos dados usados no treinamento, nas escolhas de escala e configuração arquitetural, e no pós-treinamento aplicado sobre o modelo base, etapa que molda comportamento, tom e capacidades finais.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2317 notícias
A Anthropic enviou cerca de seis engenheiros para trabalhar diretamente na NSA, apoiando a implantação do modelo Mythos em operações ofensivas. A equipe auxiliará a agência na customização do modelo para atividades de infiltração em redes de países como China e Irã, embora não esteja claro se participarão ativamente dessas operações. O movimento gera contradição: a própria Anthropic mantém um processo judicial contra o Pentágono sobre o uso de seus modelos em contextos de guerra.
O Cursor renovou seu Design Mode e agora permite que usuários apontem, desenhem, cliquem em elementos ou descrevam alterações diretamente em um produto em execução, sem sair do fluxo de desenvolvimento. A atualização aproxima ainda mais o editor de código de uma experiência visual e interativa.
O Google disponibilizou checkpoints do Gemma 4 otimizados com Quantization-Aware Training (QAT), técnica que minimiza a perda de desempenho na compressão de modelos de IA. O resultado: modelos mais leves, capazes de rodar com eficiência em dispositivos de borda como celulares e laptops, com redução significativa de consumo de memória sem abrir mão da qualidade.
Nos laboratórios de IA de fronteira, pesquisa avançada e engenharia de trincheira não são competências separadas, são duas faces da mesma moeda: a capacidade de operar sem um mapa. O verdadeiro produto de uma pesquisa não é o artigo publicado, mas a habilidade refinada de avançar mesmo na ausência de certeza.
O LangSmith apresentou os Sandboxes, microVMs virtualizadas por hardware que fornecem aos agentes de IA um ambiente de computação isolado e seguro. A solução resolve um dos maiores riscos do setor: a execução de códigos não confiáveis em produção. Com os Sandboxes, agentes conseguem realizar tarefas dinâmicas, manter estados persistentes e executar fluxos de trabalho complexos sem ameaçar a infraestrutura principal.
Alex Imas, diretor de economia de AGI no Google DeepMind, e Philip Trammell, pesquisador do Digital Economy Lab de Stanford, discutem como a economia pode lidar com o impacto da IA em larga escala, incluindo estratégias de tributação e redistribuição da riqueza gerada por esses sistemas.
O Amazon Bedrock lançou uma interface de console reformulada, otimizada para APIs compatíveis com Anthropic e OpenAI. A novidade facilita a seleção e o deploy de modelos de IA, com catálogo abrangente, fluxos de trabalho baseados em projetos e documentação dinâmica com geração automática de snippets de código.
Desenvolvido durante um hackathon, o jogo Thousand Token Wood v2 explora o potencial dos modelos de linguagem compactos ao integrar soluções da OpenAI, NVIDIA, OpenBMB e Qwen. Cada modelo assume o papel de um agente com comportamentos distintos, gerando interações que simulam um autêntico drama financeiro, tudo isso com baixo custo computacional.
O Scout é o novo agente persistente da Microsoft voltado aos usuários do programa Frontier. Integrado ao ecossistema Microsoft 365, ele executa rotinas de múltiplas etapas, acessa arquivos locais e suporta modelos da OpenAI e da Anthropic. Com acesso ainda restrito, o lançamento posiciona a empresa estrategicamente na corrida por agentes autônomos frente aos principais concorrentes do setor.
O Claude, da Anthropic, demonstrou desempenho sólido na predição de espectros de RMN, equiparando-se, e às vezes superando, ferramentas consagradas como ChemDraw e MestReNova. O Opus 4.7, variante do modelo, previu com precisão deslocamentos químicos de hidrogênio e carbono, além de propor estruturas moleculares a partir de dados espectrais. Essa capacidade de engenharia reversa molecular abre caminho para aplicações que antes exigiam softwares altamente especializados.
A OpenAI introduziu o Lockdown Mode, recurso de segurança voltado a reduzir a exposição a ataques de prompt injection vindos de páginas web e conteúdos externos. No modo ativado, funções como navegação ao vivo, recuperação de imagens da web, pesquisa profunda e modo agente ficam desabilitadas, permanecendo disponíveis apenas parte do conteúdo em cache e a geração de imagens.
O artigo descreve o desenvolvimento do Pakistan Notice Helper, uma ferramenta de IA criada durante o hackathon 'Build Small' para identificar e classificar avisos públicos críticos, como alertas de desastres naturais ou ordens judiciais, em documentos oficiais paquistaneses. Baseada em modelos de linguagem finetunados para urdu e inglês, a solução prioriza baixo custo computacional e alta interpretabilidade, provando que aplicações práticas de IA não precisam ser grandes para gerar impacto real em contextos locais de safety.
Um ano após o anúncio conjunto de Jensen Huang e do primeiro-ministro Keir Starmer na London Tech Week, de transformar o Reino Unido num criador, e não só consumidor, de IA, a NVIDIA e seus parceiros já mostram resultados concretos: novos centros de computação, aceleradores para startups e iniciativas de formação técnica estão fortalecendo a soberania tecnológica britânica. A edição 2024 do evento evidencia o salto da ambição para a execução, com foco em infraestrutura de alto desempenho e ecossistema de inovação.
O GPT-5.5, codinome 'Spud', foi oficialmente lançado pela OpenAI em 23 de abril de 2026. As versões Thinking e Pro chegaram na data de lançamento, inicialmente restritas a assinantes, e a API foi liberada no dia seguinte. Em 5 de maio, o GPT-5.5 Instant substituiu o GPT-5.3 Instant como modelo padrão do ChatGPT para todos os usuários, inclusive gratuitos, com ganhos em precisão, clareza e personalização. Projetado para fluxos profissionais complexos, opera com janela de contexto acima de 1 milhão de tokens e suporta entrada de texto e imagem. O GPT-4o saiu do ChatGPT em fevereiro de 2026, restando apenas no modo voz.
GPT-6 não foi lançado nem anunciado. A OpenAI está na família GPT-5.6 (Sol, Terra e Luna). Veja fatos confirmados, preços oficiais e o que se espera da próxima geração.
A OpenAI lançou oficialmente o GPT-5 em 7 de agosto de 2025: mais preciso, rápido e resistente a alucinações, disponível gratuitamente no ChatGPT, com planos pagos oferecendo maior limite de uso. Antes disso, versões como GPT-5.5 (desde 23/04/2026), GPT-5.5 Thinking e o3-pro já estavam em circulação. A empresa confirma uso de IA no desenvolvimento de modelos, exemplo: GPT-5.3-Codex. Rumores apontam para uma próxima geração projetada por IA, alinhada à visão de superinteligência de Masayoshi Son. O ChatGPT também passa por reformulação como plataforma integrada com agentes e ferramentas de terceiros.
O Google divulgou, em maio de 2026, novas funcionalidades de IA, incluindo o lançamento do Gemini 2.5 Pro com maior contexto (2 milhões de tokens), agentes autônomos capazes de executar tarefas complexas em múltiplas etapas e integração profunda da IA com o Android 15, permitindo ações contextuais em tempo real sem sair dos apps. Também foram anunciadas melhorias na segurança de modelos e redução de 40% no custo de inferência para clientes empresariais via Vertex AI.
O AI Gateway da Vercel passou a oferecer suporte nativo ao Grok Imagine Video 1.5, modelo de geração de vídeo da xAI. A atualização permite que desenvolvedores rotem, monitorem e gerenciem chamadas para o modelo diretamente pela plataforma, com balanceamento de carga, logging, rate limiting e segurança centralizados. A integração reforça a posição do AI Gateway como hub unificado para modelos de IA de múltiplos fornecedores, incluindo OpenAI, Anthropic e agora xAI.
Na CVPR, a NVIDIA anunciou novas capacidades de agentes de IA física para impulsionar pesquisas em veículos autônomos, robótica e visão computacional. O foco não está só em modelos mais potentes, mas em construir um fluxo de trabalho completo: reconstrução fiel de cenas reais, geração automatizada de cenários críticos (edge cases) e treinamento/avaliação robustos de políticas de decisão, tudo integrado para reduzir o gap entre simulação e mundo real.





