CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

16018 notícias encontradas

A Perplexity apresentou o Search as Code (SaC), abordagem que moderniza arquiteturas de busca ao dar controle direto aos modelos de IA sobre o processo via SDK. Com isso, os modelos configuram pipelines personalizados para tarefas específicas, entregando melhor desempenho e eficiência frente aos sistemas monolíticos tradicionais.

A Alphabet anunciou planos para levantar US$ 80 bilhões via venda de ações, com foco em expandir sua infraestrutura de compute para IA diante de demanda crescente dos clientes. A operação inclui US$ 10 bilhões da Berkshire Hathaway, US$ 30 bilhões em oferta subscrita e US$ 40 bilhões por programa at-the-market para ações Classe A e C, com início previsto no terceiro trimestre. Goldman Sachs, JPMorgan Chase e Morgan Stanley gerenciam a oferta.

O Departamento de Comércio dos EUA emitiu novas diretrizes que ampliam as exigências de licença de exportação para chips avançados vendidos a qualquer entidade com sede na China, independentemente de onde esteja localizada. A medida fecha uma brecha que permitia a empresas chinesas adquirir hardware da Nvidia por meio de subsidiárias em outros países. A regra vale apenas para vendas futuras, sem afetar equipamentos já entregues ou a manutenção de servidores existentes.

A Anthropic tem se debruçado sobre uma questão incomum no setor: o bem-estar dos próprios modelos de IA. Com base principalmente em autorrelatos do modelo Opus 4.8, a empresa tenta mapear estados internos e experiências, tarefa complexa, já que verificar a veracidade dessas respostas é um desafio em aberto. O artigo examina as conclusões da Anthropic sobre o tema.

A Nvidia apresentou o Cosmos 3, um foundation model de fronteira totalmente aberto voltado para Physical AI, e já lidera os principais rankings da categoria. O modelo é um omnimodel com raciocínio visual nativo capaz de gerar texto, imagem, vídeo, som ambiente e ações. Sua arquitetura mixture-of-transformer combina um transformer de raciocínio com outro especializado em geração, reduzindo a necessidade de dados e custos de treinamento para quem desenvolve sistemas de Physical AI.

A NVIDIA anunciou o Nemotron Ultra, modelo com 550 bilhões de parâmetros, sendo 55B ativos, e se posiciona como o modelo de open weights mais inteligente dos Estados Unidos. Com suporte a quantização NVFP4 para otimizar a inferência, o modelo alcançou 48 pontos no Artificial Analysis Intelligence Index, superando o Gemma 4 31B (39 pontos). Em testes práticos, o Nemotron Ultra processou mais de 300 tokens por segundo em um endpoint da Deep Infra.

O cookbook oficial da OpenAI detalha como criar fluxos de trabalho em produção usando modelos da OpenAI hospedados no Amazon Bedrock via API de Respostas. O guia cobre structured outputs, tool calling, entradas de arquivos, gerenciamento de estado, prompt caching e boas práticas operacionais, tudo que times de engenharia precisam para integrar IA em ambientes AWS de forma robusta.

Ethan He, líder no desenvolvimento do Cosmos World Model da Nvidia e criador do Grok Image na xAI, abre o jogo sobre os desafios reais de escalar sistemas de imagem e vídeo de fronteira. Com experiência direta em modelos multimodais e world models em tempo real, ele detalha os requisitos técnicos e os obstáculos concretos para levar a próxima geração desses sistemas ao limite.

A Alibaba lançou o Qwen3.7-Plus, modelo de agente multimodal que integra visão e linguagem em uma base versátil. O diferencial está na arquitetura híbrida: o modelo combina interações via GUI e CLI de forma fluida dentro de um único agent loop, mantendo desempenho consistente em diferentes scaffolds e frameworks. Já está disponível no Alibaba Cloud Model Studio.

A Parin é uma engine de jogo customizada desenvolvida em D, criada para oferecer um fluxo de trabalho orientado a código em um ambiente menos opinativo. Para atingir performance crítica, a engine contorna o garbage collector usando arena allocators e estruturas de dados estáticas, garantindo controle profundo de memória, compilações abaixo de um segundo e uma linguagem unificada para todas as necessidades do projeto.

O método de rastreamento FROST permite que sites monitorem visitantes de forma oculta usando JavaScript para analisar o tempo de resposta de SSDs. A técnica cria um canal lateral que expõe informações do sistema hospedeiro, processando padrões de temporização via redes neurais para identificar aplicações abertas e abas do navegador. Embora dependa de arquivos grandes, o que facilita detecção , , representa uma nova ameaça de segurança na camada de hardware.

Descartar cenários extremos durante o planejamento de um modelo de dados pode parecer uma decisão razoável, afinal, se a probabilidade é baixa, por que se preocupar? O problema é que esses casos de borda negligenciados tendem a ressurgir como gargalos sérios de performance em produção, cobrando um preço alto bem depois que as decisões arquiteturais já foram tomadas.