CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

16837 notícias encontradas

O Exército de Salvação implementou uma campanha de varejo inovadora, divulgando itens de segunda mão únicos que já haviam sido vendidos, em vez de estoque disponível. A estratégia aproveitou a escassez e o medo de perder (FOMO) para incentivar visitas às lojas. A IA Gemini analisou milhares de fotos de produtos do inventário nacional, enquanto o gerador de imagens Nano Banana converteu imagens básicas de estoque em criações de qualidade editorial. A campanha hiperlocal visou códigos postais específicos próximos às lojas, utilizando o Google Demand Gen para veicular conteúdo visual personalizado no YouTube, Discover, Gmail e na Rede de Display. Nos primeiros 30 dias, a iniciativa alcançou um custo de $11 por visita à loja, superando o benchmark da indústria em 138%, com mais de 58% dos cliques resultando em buscas dentro das lojas.

O sistema COSMO da Amazon aborda uma limitação fundamental na busca de produtos ao ensinar os motores de recomendação o porquê as pessoas compram, e não apenas o que elas compram. A equipe alimentou milhões de pares de comportamento de compra em LLMs e então construiu um pipeline multiestágio para filtrar cerca de 65% a 91% das saídas que eram circulares, genéricas ou trivialmente óbvias. Um modelo menor, ajustado por instruções e chamado COSMO-LM, gera agora conhecimento de senso comum fresco em tempo real, com uma fração do custo de inference original. Testes A/B mostraram um aumento de 0,7% nas vendas de produtos e um crescimento de 8% no engajamento de navegação em apenas 10% do tráfego dos EUA. A Amazon projeta bilhões em receita potencial se a solução for estendida para todo o tráfego.

O Kubernetes v1.36 promoveu para beta a capacidade de modificar requisições de CPU, memória, GPU e outros recursos em templates de pod de Jobs suspensos. Essa funcionalidade elimina a necessidade de deletar e recriar Jobs quando os requisitos de recursos mudam. Habilitada por padrão, ela permite que controladores de fila e administradores ajustem os recursos antes que os Jobs comecem a ser executados, sendo particularmente útil para workloads de batch e machine learning, onde a alocação ideal depende das condições atuais do cluster.

A DigitalOcean anunciou a general availability do DeepSeek V3.2, MiniMax-M2.5 e Qwen 3.5 397B em sua plataforma Serverless Inference. A plataforma alcançou as velocidades de output mais rápidas entre todos os provedores testados, com o DeepSeek V3.2 entregando 230 tokens por segundo e tempo para o primeiro token em menos de 1 segundo para 10.000 tokens de input. Esse desempenho notável foi obtido com o uso de GPUs NVIDIA HGX B300, que contam com 288GB de memória. As otimizações incluíram a aplicação da quantization NVFP4, que resultou em uma redução de 1.8x na pegada de memória, e ajustes customizados ao framework de serving vLLM, realizados em colaboração com a Inferact.

O GitHub afirma que as recentes interrupções foram causadas pelo rápido crescimento no desenvolvimento orientado por IA, o que levou a plataforma além de seus limites atuais de escalabilidade. A empresa está priorizando a confiabilidade ao expandir a capacidade, isolar sistemas críticos e reduzir pontos únicos de falha para lidar com o aumento.

Este post descreve a experiência de IA SRE em evolução da incident.io, que automatiza a investigação, o debugging e a resolução de incidentes em um workflow unificado. Isso reduz a troca de contexto ao integrar Slack, ferramentas de codificação e atualizações, possibilitando diagnóstico rápido, correções e relatórios com esforço manual mínimo.

O GitHub mitiga dependências circulares de deployment, onde interrupções podem bloquear sua própria recuperação, ao usar eBPF para monitorar e restringir o acesso à rede de scripts de deployment e detectar dependências ocultas, diretas e transitórias. Isso permite controle por processo, interceptação de DNS e auditoria em tempo real de chamadas arriscadas, como o uso da API do GitHub durante a recuperação de incidentes.

Este artigo demonstra como construir uma plataforma Kubernetes multi-cluster escalável no OpenStack, utilizando k0s, k0rdent e Hosted Control Planes (HCP). Essa abordagem elimina a necessidade de control planes dedicados de 3 nós por cluster, centralizando-os em um único cluster de gerenciamento. A arquitetura proposta transforma a gestão de clusters individuais em um sistema declarativo que orquestra o provisionamento, a escalabilidade e os upgrades em frotas inteiras, resultando em uma significativa redução nos custos de infraestrutura e na complexidade operacional.

Mitchell Hashimoto, cofundador da HashiCorp, anunciou a mudança do projeto Ghostty para fora do GitHub após 18 anos de profundo apego pessoal e profissional, citando crescente frustração e decepção com a plataforma.

Agentes de IA automatizam tarefas de desenvolvimento e negócios, mas introduzem novos riscos como prompt injection, escalonamento de privilégios e falhas em cascata que expandem as superfícies de ataque, gerando preocupação do NIST. A mitigação eficaz exige controles em camadas que abranjam o design do modelo, as permissões do sistema e a supervisão humana para garantir uma implantação segura.

Reguladores da União Europeia propuseram medidas que exigiriam que o Google concedesse a serviços de IA rivais um acesso mais profundo às capacidades do Android atualmente vinculadas ao Gemini. O Google tem resistido, argumentando que a proposta poderia elevar custos e fragilizar as proteções de privacidade e segurança. Os reguladores afirmam que terceiros deveriam ser capazes de executar tarefas através dos aplicativos preferidos dos usuários.

CIOs estão aplicando cada vez mais a transformação por IA aos seus próprios fluxos de trabalho de TI, abrangendo desde assistentes de IA específicos para funções até a automação de processos e a gestão do conhecimento interno. A área de TI emerge como a principal facilitadora e, simultaneamente, o primeiro campo de prova concreto para a produtividade da IA no ambiente corporativo.

O padrão OAuth 2.0 não consegue dar suporte a agentes de IA que tomam decisões em runtime e delegam tarefas. Padrões emergentes como MCP, A2A e AAuth abordam essas lacunas ao introduzir identidade criptográfica, requisições assinadas e atenuação de token para garantir delegação segura, auditável e com escopo definido em fluxos de trabalho multiagente complexos.

A AWS anunciou novos serviços de IA, incluindo o Amazon Quick, um assistente de desktop que se conecta a aplicativos de trabalho como Google Workspace, Microsoft 365, Zoom e Salesforce. O lançamento posiciona a Amazon mais diretamente no concorrido mercado de assistentes de produtividade empresarial, onde o contexto, o acesso a aplicativos e a governança estão se tornando o campo de batalha.

As ações da Oracle, CoreWeave, Arm, AMD, Broadcom, Nvidia e de outras empresas ligadas à IA registraram queda após relatórios indicarem que a OpenAI não atingiu suas metas internas de receita e crescimento de usuários. Essa reação demonstra o quanto as avaliações de infraestrutura de IA no mercado público estão agora atreladas à capacidade da OpenAI de manter um crescimento acelerado para suportar seus massivos compromissos de poder computacional.