A OpenAI lançou os modelos GPT-5.4 mini e nano, versões menores projetadas para cargas de trabalho de alto volume com maior velocidade e menor custo. O GPT-5.4 mini apresenta melhorias substanciais em relação ao GPT-5 mini e se aproxima do modelo GPT-5.4 maior em alguns benchmarks, enquanto o GPT-5.4 nano é focado em tarefas mais leves, como classificação, extração e ranqueamento.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2347 notícias
A Google DeepMind lançou um artigo que detalha uma taxonomia cognitiva para medir o progresso da IA em direção à AGI, identificando 10 habilidades cognitivas essenciais como percepção, aprendizado e raciocínio. O estudo propõe um protocolo de avaliação de três estágios que compara o desempenho da IA a benchmarks humanos . Além disso, um hackathon no Kaggle, com um prêmio de US$ 200.000, convida pesquisadores a desenvolver avaliações para cinco habilidades ainda pouco exploradas, utilizando a nova plataforma Community Benchmarks .
O Unsloth Studio é uma UI web no-code para treinar, executar e exportar modelos abertos. ️ Ele permite que os usuários rodem modelos GGUF e safe tensor localmente em Mac, Windows e Linux, além de executar e treinar modelos de texto, visão, áudio TTS e embedding. O estúdio pode, ainda, criar automaticamente conjuntos de dados a partir de arquivos PDF, CSV, JSON, DOCX e TXT. Um tutorial em vídeo sobre como começar a usar o Unsloth Studio está disponível.
A Nvidia retomou a fabricação de processadores H200 para venda na China. Em dezembro, os EUA anunciaram que permitiriam à Nvidia vender seus processadores H200 no país, desde que 25% das vendas fossem compartilhadas com o governo norte-americano. O CEO da Nvidia, Jensen Huang, declarou no evento GTC da empresa na terça-feira que os sinais de demanda vindos da China se fortaleceram nas últimas semanas e que a cadeia de suprimentos da companhia está sendo ativada. A empresa não comentou sobre o quanto espera faturar com as vendas dos H200 na China, mas o mercado chinês é estimado em dezenas de bilhões de dólares por ano.
A Cursor descreveu como seu modelo Composer aprende a resumir seu próprio contexto durante longas sessões de codificação , comprimindo etapas anteriores em representações mais curtas para estender a memória de trabalho efetiva. Esse comportamento treinado aprimora o desempenho em tarefas de programação multi-etapas, mantendo o uso de tokens gerenciável.
A Microsoft está reorganizando as equipes que trabalham em seu produto de IA carro-chefe, o Copilot . A empresa está unificando as equipes responsáveis pelas ofertas de produtividade do Microsoft 365 Copilot e pela versão para consumidor do Copilot . Jacob Andreou, que lidera produto e crescimento na Microsoft IA, assumirá como vice-presidente executivo do Copilot, sendo responsável por seu design, produto, crescimento e engenharia. Mustafa Suleyman, CEO da Microsoft IA, focará principalmente nos modelos proprietários da empresa e na busca pela superinteligência . A nova estrutura permitirá à companhia oferecer uma experiência mais coerente e competitiva.
A AWS concordou em distribuir produtos da OpenAI para sua base de clientes do setor público. Este movimento sinaliza uma expansão significativa da presença da OpenAI no segmento governamental.
A OpenAI planeja abrir capital (IPO) até o final do ano, com foco estratégico em transformar o ChatGPT em uma ferramenta de alta produtividade para empresas .
O recurso Personal Intelligence permite que o assistente de IA do Google personalize suas respostas ao se conectar com diversos aplicativos dentro do ecossistema Google.
O padrão de subagents agora conta com amplo suporte em agentes de codificação. No OpenAI Codex, os subagents já estão geralmente disponíveis. O sistema inclui subagents padrão como 'explorer', 'worker' e 'default', embora as diferenças entre eles não sejam claras. Usuários também podem definir agentes customizados, utilizando instruções personalizadas e modelos específicos para suas necessidades.
Drew Bent, o líder de educação da Anthropic, compartilha suas reflexões e aprendizados após um ano na empresa.
Um desenvolvedor perguntou ao seu agente de IA como ele queria se lembrar das coisas. O agente redesenhou seu próprio sistema de memória, realizou uma autoavaliação, diagnosticou seus pontos cegos e melhorou o recall de 60% para 93%, tudo isso por apenas US$ 2. O experimento demonstra o que acontece quando a IA é tratada como participante em sua própria arquitetura cognitiva.
A NVIDIA delineou um vasto escopo na GTC 2026, abrangendo parcerias em modelos de fundação abertos, tooling para agentes, novos modelos de raciocínio e segurança, sistemas robóticos e IA para saúde focada em descoberta e simulação de medicamentos. Essa expansão demonstra um compromisso com a inovação em diversas frentes da IA, do desenvolvimento de modelos à aplicação prática em setores cruciais.
O Alibaba está estabelecendo uma unidade de negócios para consolidar seus serviços de IA e esforços de desenvolvimento sob uma única estrutura. O novo Alibaba Token Hub integrará a equipe de pesquisa responsável pelos modelos Qwen da empresa, sua divisão de aplicativos voltados para o consumidor e outros produtos chave relacionados à IA. Além disso, a unidade supervisionará o aplicativo DingTalk, similar ao Slack, e os dispositivos da marca Quark. Esta reestruturação visa acelerar a interação entre as diversas equipes envolvidas na iniciativa mais ampla de IA da Alibaba .
Sachin Katti ingressou na OpenAI em novembro para atuar como chefe de industrial compute ️, após mais de 15 anos como professor em Stanford e quatro na Intel. Sua função atual é crucial: encontrar capacidade adicional de data center e assegurar o fornecimento de componentes essenciais, como chips de IA e memória. Este desafio é complexo , com operadores de data centers enfrentando restrições na rede elétrica, escassez de chips de memória e crescente oposição das comunidades locais.
A OpenAI planeja redirecionar seus esforços para usuários de codificação e para o setor corporativo. Seus líderes estão ativamente buscando áreas para despriorizar. A estratégia da empresa de 'fazer tudo ao mesmo tempo' a ajudou a conquistar a reputação de pioneira da era da IA. No entanto, sob crescente pressão de rivais, a empresa agora necessita de uma direção estratégica mais clara para o futuro.
A OpenAI explicou que o Codex Security foi projetado para analisar repositórios diretamente, em vez de fazer a triagem de relatórios de static analysis. A abordagem se concentra na arquitetura do sistema, limites de confiança e validação de descobertas antes de apresentá-las a humanos. Este método visa especificamente falhas de segurança semânticas, onde as defesas parecem presentes, mas falham em realmente impor a proteção pretendida. ️
A Apple planeja investir US$ 14 bilhões em IA este ano, um valor modesto se comparado aos US$ 700 bilhões que Amazon, Alphabet, Meta e Microsoft estão aportando. Aparentemente, a empresa crê que a construção de infraestrutura de IA não trará retornos proporcionais. Seu menor gasto se baseia na convicção de que os modelos de IA se tornarão commodities e mais compactos, que suas linhas de produtos existentes podem absorver as cargas de trabalho que o cloud foi projetado para atender, e que a vantagem duradoura pertence a quem detém o cliente. A Apple está apostando em seus dispositivos com capacidade de IA em vez de infraestrutura centralizada.
O Mistral Small 4 integra as capacidades dos modelos Magistral, Pixtral e Devstral, oferecendo uma IA unificada multimodal e otimizada para raciocínio, com esforço de raciocínio configurável. Ele emprega uma arquitetura Mixture of Experts com 119 bilhões de parâmetros, suportando entradas de texto e imagem, e apresenta escalabilidade eficiente. O Mistral Small 4 alcança desempenho competitivo com comprimento de saída reduzido, é open-source e está disponível em plataformas como vLLM, llama.cpp e Transformers, facilitando sua adoção e uso pela comunidade de desenvolvedores.
Este artigo traça paralelos entre o desenvolvimento de armas nucleares e a IA, argumentando que a IA apresenta riscos globais semelhantes. ️ A Anthropic, um player chave em IA, hesita em conceder acesso ao governo dos EUA, refletindo dilemas de controle privado semelhantes ao cenário hipotético da "McBombalds Corp". Isso levanta o debate sobre se entidades privadas deveriam controlar tecnologias com um impacto global tão imenso , ou se a supervisão governamental é mais apropriada.





