CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

18838 notícias encontradas

O Code Review é uma nova funcionalidade para o Claude Code que mobiliza uma equipe de agentes em cada Pull Request (PR) para identificar bugs . Desenvolvido com foco na profundidade, e não na velocidade, o sistema está agora em preview de pesquisa para clientes Team e Enterprise. A Anthropic utiliza o Code Review em quase todos os seus Pull Requests. A ferramenta não aprova PRs, mas ela preenche lacunas, permitindo que os revisores humanos foquem no que será entregue . As revisões são cobradas com base no uso de tokens, e os administradores têm diversas maneiras de controlar os gastos e o consumo.

A Amazon criticou a solicitação da SpaceX para lançar uma frota de satélites de datacenters orbitais, classificando-a como incompleta, especulativa e irrealista. A empresa quer que os reguladores rejeitem a aplicação, afirmando que se trata de uma proposta especulativa, e não de uma solicitação completa de acordo com as regras da Comissão. A Amazon também levantou preocupações sobre interferência de satélites e objeções ambientais. Analistas consideram o plano da SpaceX de instalar datacenters no espaço como "extrema insanidade", apontando que a operação de instalações espaciais seria antieconômica e jamais conseguiria satisfazer a demanda terrestre por compute. Descubra os detalhes dessa polêmica proposta que busca levar a infraestrutura de dados para além da atmosfera. ️

A IA elimina a necessidade de aprender a usar interfaces, mas também remove a descoberta natural que revela o valor de um produto aos usuários. O novo desafio é tornar as capacidades visíveis e apresentar o valor adequado no momento certo.

A Meta lançou silenciosamente o editor Vibes IA, transformando-o de um recurso integrado ao Meta IA para um estúdio de criação autônomo, similar ao Google Flow. O editor suporta criação de projetos, geração de imagens e vídeos, edição de linha do tempo e outras ferramentas de produção. Embora o tooling seja robusto, a qualidade da saída precisa de aprimoramento.

Chips focados em SRAM , como os da Cerebras e Groq, estão ganhando destaque devido às suas vantagens em cargas de trabalho de inferência de IA, especialmente na minimização da latência e no aumento do throughput em comparação com GPUs tradicionais. Essa mudança é impulsionada pela demanda por arquiteturas de memória near-compute, que oferecem acesso a dados mais rápido do que abordagens far-compute como o DRAM. O desafio reside no equilíbrio entre largura de banda da memória e capacidade de compute, levando a novas estratégias de hardware desagregado que otimizam tanto as fases de prefill quanto de decode de tarefas de IA em diversas plataformas de hardware.

O Claude Marketplace, uma iniciativa da Anthropic, permite que organizações utilizem parte de seu compromisso existente com a Anthropic para adquirir ferramentas impulsionadas por Claude. As compras de parceiros serão contabilizadas como parte do compromisso da organização com a Anthropic, com a Anthropic gerenciando todas as faturas referentes a esses gastos. O marketplace está sendo lançado com parceiros como GitLab, Harvey, Lovable, Replit, Rogo e Snowflake, e a Anthropic busca ativamente expandir o número de empresas parceiras para esta plataforma.

Agentes de raciocínio operam com maior eficácia ao utilizar ferramentas de busca simples. Desenvolvedores são encorajados a empregar sistemas de busca descomplicados, de fácil compreensão e transparentes, como grep ou busca básica por palavra-chave. Estes agentes são capazes de filtrar os resultados, aprender e refazer tentativas com o conhecimento adquirido. Solicitar que um agente explique a intenção por trás de uma consulta o auxilia a raciocinar sobre a melhor forma de satisfazer a requisição, forçando-o a considerar o que o usuário realmente deseja.

Um rewrite de SQLite em Rust gerado por LLM, testado com benchmark, operou 20.171x mais lento em buscas de chaves primárias . Isso ocorreu porque o query planner nunca verificou o is_ipk flag, direcionando cada cláusula WHERE para um full table scan em vez de uma busca em B-tree. Outro exemplo do mesmo autor envolveu um daemon de limpeza de disco com 82.000 linhas, incorporando um Bayesian scoring engine e um PID controller, para resolver um problema que uma simples cron job de uma linha já gerenciava. A falha principal é estrutural: LLMs otimizam para uma saída plausível que corresponda à intenção do usuário. Um Randomized Controlled Trial (RCT) da METR, envolvendo 16 desenvolvedores open-source experientes, confirmou que o problema escala, revelando que usuários de IA foram 19% mais lentos, apesar de acreditarem ser 20% mais rápidos ️.

O Claude Opus 4.6 encontrou mais bugs de alta severidade no Firefox em um período de duas semanas do que o restante do mundo normalmente reporta em dois meses. No total, o modelo descobriu mais de 100 bugs, sendo 14 deles classificados como de alta severidade. Apesar de ter sido solicitado a escrever código para explorar essas falhas, o Claude se mostrou muito mais eficiente em encontrá-las do que em explorá-las, já que as tentativas de exploração que ele elaborou teriam sido impedidas por outros mecanismos de segurança do Firefox no mundo real. ️