Os grandes modelos de linguagem são construídos, em essência, empilhando blocos transformer repetidamente. O que os diferencia de verdade está nos dados usados no treinamento, nas escolhas de escala e configuração arquitetural, e no pós-treinamento aplicado sobre o modelo base, etapa que molda comportamento, tom e capacidades finais.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
819 notícias encontradas
A Anthropic enviou cerca de seis engenheiros para trabalhar diretamente na NSA, apoiando a implantação do modelo Mythos em operações ofensivas. A equipe auxiliará a agência na customização do modelo para atividades de infiltração em redes de países como China e Irã, embora não esteja claro se participarão ativamente dessas operações. O movimento gera contradição: a própria Anthropic mantém um processo judicial contra o Pentágono sobre o uso de seus modelos em contextos de guerra.
O Cursor renovou seu Design Mode e agora permite que usuários apontem, desenhem, cliquem em elementos ou descrevam alterações diretamente em um produto em execução, sem sair do fluxo de desenvolvimento. A atualização aproxima ainda mais o editor de código de uma experiência visual e interativa.
O Claude, da Anthropic, demonstrou desempenho sólido na predição de espectros de RMN, equiparando-se, e às vezes superando, ferramentas consagradas como ChemDraw e MestReNova. O Opus 4.7, variante do modelo, previu com precisão deslocamentos químicos de hidrogênio e carbono, além de propor estruturas moleculares a partir de dados espectrais. Essa capacidade de engenharia reversa molecular abre caminho para aplicações que antes exigiam softwares altamente especializados.
O Google firmou um acordo bilionário com a SpaceX para garantir capacidade computacional dedicada à IA: cerca de 110.000 GPUs NVIDIA por mês, ao custo de US$ 920 milhões. O contrato funciona como infraestrutura de suporte enquanto o Google expande seus próprios data centers, sustentando a crescente demanda do Gemini Enterprise.
ATUALIZAÇÃO (08/06/2026): não é mais rumor, foi lançado. 05/06/2026 O governo dos EUA, sob a administração Trump, anunciou oficialmente negociações com a OpenAI para uma possível participação acionária estatal. O Presidente Donald Trump confirmou publicamente as discussões, que se estendem por mais de um ano e foram inicialmente propostas pelo CEO da OpenAI, Sam Altman, em 2025. A ideia central por trás da potencial aquisição de ações é a criação de um "Fundo de Riqueza Pública" para distribuir os ganhos impulsionados pela inteligência artificial diretamente aos cidadãos americanos. (Rumor original) A OpenAI e a administração Trump discutiram uma possível entrada do governo americano no capital da empresa por meio de doação de participação. A proposta estaria vinculada ao conceito de um Fundo de Riqueza Pública, mecanismo que permitiria aos cidadãos americanos se beneficiarem dos ganhos econômicos gerados pelo avanço das tecnologias de IA.
A codificação assistida por LLM ainda não tem sustentabilidade econômica real. O modelo atual sobrevive de subsídios agressivos nas assinaturas, e casos de uso mais exigentes, com loops e raciocínio via API, já se tornaram caros demais para a maioria. Desenvolvedores precisam se preparar para alta contínua nos custos e arquitetar sistemas mais eficientes e resilientes.
O Scout é o novo agente persistente da Microsoft voltado aos usuários do programa Frontier. Integrado ao ecossistema Microsoft 365, ele executa rotinas de múltiplas etapas, acessa arquivos locais e suporta modelos da OpenAI e da Anthropic. Com acesso ainda restrito, o lançamento posiciona a empresa estrategicamente na corrida por agentes autônomos frente aos principais concorrentes do setor.
Desenvolvido durante um hackathon, o jogo Thousand Token Wood v2 explora o potencial dos modelos de linguagem compactos ao integrar soluções da OpenAI, NVIDIA, OpenBMB e Qwen. Cada modelo assume o papel de um agente com comportamentos distintos, gerando interações que simulam um autêntico drama financeiro, tudo isso com baixo custo computacional.
O Amazon Bedrock lançou uma interface de console reformulada, otimizada para APIs compatíveis com Anthropic e OpenAI. A novidade facilita a seleção e o deploy de modelos de IA, com catálogo abrangente, fluxos de trabalho baseados em projetos e documentação dinâmica com geração automática de snippets de código.
Alex Imas, diretor de economia de AGI no Google DeepMind, e Philip Trammell, pesquisador do Digital Economy Lab de Stanford, discutem como a economia pode lidar com o impacto da IA em larga escala, incluindo estratégias de tributação e redistribuição da riqueza gerada por esses sistemas.
O LangSmith apresentou os Sandboxes, microVMs virtualizadas por hardware que fornecem aos agentes de IA um ambiente de computação isolado e seguro. A solução resolve um dos maiores riscos do setor: a execução de códigos não confiáveis em produção. Com os Sandboxes, agentes conseguem realizar tarefas dinâmicas, manter estados persistentes e executar fluxos de trabalho complexos sem ameaçar a infraestrutura principal.
Nos laboratórios de IA de fronteira, pesquisa avançada e engenharia de trincheira não são competências separadas, são duas faces da mesma moeda: a capacidade de operar sem um mapa. O verdadeiro produto de uma pesquisa não é o artigo publicado, mas a habilidade refinada de avançar mesmo na ausência de certeza.
O Google disponibilizou checkpoints do Gemma 4 otimizados com Quantization-Aware Training (QAT), técnica que minimiza a perda de desempenho na compressão de modelos de IA. O resultado: modelos mais leves, capazes de rodar com eficiência em dispositivos de borda como celulares e laptops, com redução significativa de consumo de memória sem abrir mão da qualidade.
O artigo descreve o desenvolvimento do Pakistan Notice Helper, uma ferramenta de IA criada durante o hackathon 'Build Small' para identificar e classificar avisos públicos críticos, como alertas de desastres naturais ou ordens judiciais, em documentos oficiais paquistaneses. Baseada em modelos de linguagem finetunados para urdu e inglês, a solução prioriza baixo custo computacional e alta interpretabilidade, provando que aplicações práticas de IA não precisam ser grandes para gerar impacto real em contextos locais de safety.
Um ano após o anúncio conjunto de Jensen Huang e do primeiro-ministro Keir Starmer na London Tech Week, de transformar o Reino Unido num criador, e não só consumidor, de IA, a NVIDIA e seus parceiros já mostram resultados concretos: novos centros de computação, aceleradores para startups e iniciativas de formação técnica estão fortalecendo a soberania tecnológica britânica. A edição 2024 do evento evidencia o salto da ambição para a execução, com foco em infraestrutura de alto desempenho e ecossistema de inovação.
O GPT-5.5, codinome 'Spud', foi oficialmente lançado pela OpenAI em 23 de abril de 2026. As versões Thinking e Pro chegaram na data de lançamento, inicialmente restritas a assinantes, e a API foi liberada no dia seguinte. Em 5 de maio, o GPT-5.5 Instant substituiu o GPT-5.3 Instant como modelo padrão do ChatGPT para todos os usuários, inclusive gratuitos, com ganhos em precisão, clareza e personalização. Projetado para fluxos profissionais complexos, opera com janela de contexto acima de 1 milhão de tokens e suporta entrada de texto e imagem. O GPT-4o saiu do ChatGPT em fevereiro de 2026, restando apenas no modo voz.
A OpenAI confirmou oficialmente que o GPT-6 será lançado em 2026, não em 2025, com data provável no início do ano. Sam Altman destacou que o ciclo entre GPT-5 e GPT-6 será mais curto que o anterior. A principal novidade é a memória de longo prazo, capaz de reter preferências e históricos de conversa por semanas ou meses. Também são esperados agentes autônomos, multimodalidade avançada (incluindo vídeo), personalização granular e versões open-weight para execução local. O treinamento ocorre no centro de dados Stargate, no Texas, e especula-se que o modelo tenha entre 20 e 50 trilhões de parâmetros.
A OpenAI lançou oficialmente o GPT-5 em 7 de agosto de 2025: mais preciso, rápido e resistente a alucinações, disponível gratuitamente no ChatGPT, com planos pagos oferecendo maior limite de uso. Antes disso, versões como GPT-5.5 (desde 23/04/2026), GPT-5.5 Thinking e o3-pro já estavam em circulação. A empresa confirma uso de IA no desenvolvimento de modelos, exemplo: GPT-5.3-Codex. Rumores apontam para uma próxima geração projetada por IA, alinhada à visão de superinteligência de Masayoshi Son. O ChatGPT também passa por reformulação como plataforma integrada com agentes e ferramentas de terceiros.
O Google divulgou, em maio de 2026, novas funcionalidades de IA, incluindo o lançamento do Gemini 2.5 Pro com maior contexto (2 milhões de tokens), agentes autônomos capazes de executar tarefas complexas em múltiplas etapas e integração profunda da IA com o Android 15, permitindo ações contextuais em tempo real sem sair dos apps. Também foram anunciadas melhorias na segurança de modelos e redução de 40% no custo de inferência para clientes empresariais via Vertex AI.
