CEVIU News

CEVIU News — 3 de agosto de 2026

88 notícias3 de agosto de 2026CEVIUCEVIU Web DevCEVIU IA+10
Compartilhar:

✨ CEVIU

A OpenAI revelou detalhes sobre seu próximo modelo de inteligência artificial, batizado de Astra. Em testes internos, uma versão do Astra demonstrou capacidade notável ao solucionar dez problemas matemáticos e de ciência da computação teórica considerados de longa data. A empresa estima que o custo computacional para encontrar todas as soluções giraria em torno de US$ 2.000, utilizando taxas de API equivalentes às do GPT-5.6 Sol. Todas as descobertas foram formalizadas em Lean, o que permite a validação por sistemas de prova de teoremas, marcando um avanço significativo no campo da IA aplicada à matemática.

Após a flexibilização regulatória durante a presidência de Trump, Larry Ellison, CEO da Oracle, investiu pesadamente na infraestrutura de IA, acumulando uma dívida expressiva. A estratégia visava dominar a economia da IA controlando a maior parte do poder computacional. Contudo, investidores recentes questionam a sustentabilidade desse nível de gastos e a real capacidade dos data centers de gerar os lucros esperados, levantando preocupações sobre uma possível bolha no setor de IA.

A Apple está traçando um novo caminho para seu crescimento com o lançamento do programa de leasing Apple Upgrade. Em um cenário de escassez global de memória e aumento constante nos preços de hardware, a gigante de Cupertino redefine a percepção de valor. Em vez de focar no custo total de um dispositivo, a estratégia é converter a compra em um gasto diário acessível, tornando a aquisição de um iPhone ou MacBook tão simples quanto assinar um serviço. Essa mudança pode transformar a forma como os consumidores interagem com seus produtos, prometendo uma era de assinaturas para hardware.

Montana avança em um projeto que visa transformar o estado em um centro de medicina experimental, permitindo que empresas de biotecnologia comercializem medicamentos ainda em fase de testes. Mediante o pagamento de US$ 12.500, companhias cujos produtos já superaram ensaios preliminares poderão solicitar aprovação a um novo conselho regulador. A iniciativa prevê a venda desses medicamentos por meio de clínicas especializadas, com a primeira esperada para inaugurar ainda este ano. Pacientes deverão conceder consentimento informado, e cada pedido passará pela análise de um comitê composto por médicos, cientistas e um eticista.

O notório empreendedor de tecnologia Balaji Srinivasan, prevendo uma decadência nos EUA, embarcou na ambiciosa missão de fundar uma nova cidade na Malásia. O projeto previa um campus tecnológico futurista, completo com coworking, academia e alta gastronomia assinada por Bryan Johnson. Contudo, após dois anos, a iniciativa foi barrada por questões de licenciamento. Poucas horas depois do revés, Srinivasan já anunciava um novo acordo para levar seu campus ao Cazaquistão, evidenciando a persistência em seu projeto de criar um novo polo de inovação.

A era da IA redefine a lógica de custo e personalização no desenvolvimento de software. Antigamente, a complexidade e os altos custos justificavam a distribuição de programas com extensos arquivos de configuração e sistemas de plug-ins. Contudo, a IA revolucionou esse cenário, barateando significativamente a criação e modificação de software. Agora, a customização pode ser realizada pelos próprios usuários, eliminando a dependência de arquiteturas rígidas e abrindo caminho para que agentes inteligentes assistam nas alterações necessárias.

Leopold Aschenbrenner, um investidor de 24 anos, viu seu fundo de investimento, que já atingiu a marca de US$ 45 bilhões, colapsar no momento em que os convidados de seu casamento começavam a chegar. O fundo apostava pesado em ações de IA, utilizando alavancagem excessiva que gerou grande exposição a riscos. Com as apostas falhando, a Citadel interveio, adquirindo a maior parte do portfólio de ações públicas com mais de 10% de desconto sobre o valor de mercado. Apesar do revés, a empresa de Aschenbrenner sobrevive, mantendo um portfólio avaliado em mais de US$ 10 bilhões, incluindo participações em startups e outras ações.

Equipes de tecnologia enfrentam desafios significativos ao lidar com pipelines de desenvolvimento repletos de problemas, resultando em gargalos para a entrega de software funcional e eficaz. A chave para superar essas barreiras e impulsionar a produtividade reside em adotar uma abordagem rigorosa, tratando toda a infraestrutura de desenvolvimento com a mesma seriedade e atenção que se dedica aos sistemas em ambiente de produção. Essa perspectiva garante a qualidade final dos projetos e otimiza o fluxo de trabalho.

Em meio a crescentes apelos por modelos de IA open-weight mais robustos para fazer frente à competitividade chinesa, os Estados Unidos se deparam com um entrave significativo. Investidores demonstram cautela em apoiar startups dedicadas a essa tecnologia. A corrida para desenvolver uma alternativa americana acessível, capaz de rivalizar com as soluções chinesas de menor custo, esbarra em desafios de financiamento, atrasando o potencial de inovação e a soberania tecnológica da nação.

A criação de código se tornou mais acessível e veloz, impulsionada por novas ferramentas e metodologias, mas a verdadeira qualidade no desenvolvimento de software permanece um desafio complexo. O sucesso de um projeto ainda reside na meticulosa atenção aos detalhes e no julgamento humano apurado. Isso sugere que, embora a automação da escrita de código avance, ela não substitui a expertise e o discernimento necessários para garantir a excelência no produto final, mantendo o fator humano insubstituível.

A OpenAI revelou um avanço notável: seu novo modelo de IA, ainda não lançado publicamente, conseguiu resolver dez problemas matemáticos que estavam em aberto. Esta façanha sem precedentes aponta para um salto significativo na capacidade das IAs, abrindo novas perspectivas para a pesquisa científica e o desenvolvimento tecnológico. A conquista também provoca discussões importantes sobre o futuro do raciocínio humano frente à evolução das máquinas.

O conceito de 'unicontext' emerge como uma ideia provocadora, descrevendo um cenário onde as fronteiras comportamentais se diluem, unificando a forma como agimos em diferentes contextos. Essa convergência pode ter implicações significativas, remodelando a interação humana com a tecnologia e, por extensão, a própria estrutura social. É um convite para refletir sobre a adaptabilidade de nossas condutas e o impacto dessa uniformidade no futuro das relações digitais e cotidianas.

Os novos badges da Defcon 34 trazem uma inovação notável com o Baochip-1x, um microcontrolador majoritariamente open source. Este chip se destaca por sua funcionalidade dual: além de integrar o badge, seu módulo central pode ser removido e reutilizado como um hardware security token. A iniciativa oferece aos participantes uma ferramenta de segurança prática e flexível, demonstrando a crescente convergência entre hardware aberto e aplicações de segurança cibernética.

💻 CEVIU Web Dev

O desenvolvimento de um sistema operacional robusto e eficaz demanda uma abordagem metódica e transparente. É crucial que o projeto seja categorizado com precisão desde o início, partindo de uma base tecnológica já consolidada. Antes mesmo de iniciar a fase de codificação, um estudo aprofundado dos componentes essenciais é indispensável, garantindo que a arquitetura do software esteja alinhada às melhores práticas. Adicionalmente, a priorização na criação de drivers autênticos e a promoção de um ambiente de colaboração e discussão técnica dentro da equipe são pilares para um desenvolvimento significativo e de alta qualidade.

Após sete anos de sua introdução, o SwiftUI, framework declarativo da Apple, continua a gerar debate entre desenvolvedores. Relatos persistentes indicam desafios com performance e imprevisibilidade no comportamento de layout, além de uma API considerada inconsistente, criando uma percepção de que a ferramenta opera em um estágio beta perpétuo. A promessa de um desenvolvimento multiplataforma simplificado e eficiente ainda não se materializou plenamente, exigindo que os profissionais implementem constantes soluções alternativas e lidem com a falta de compatibilidade retroativa, impactando diretamente a experiência do desenvolvedor (DX) e a qualidade de software.

Uma investigação aprofundada sobre um alerta em testes Ruby, inicialmente filtrado, desvendou que a instrumentação do OpenTelemetry AWS carregava cerca de 200 classes do SDK de serviço durante a inicialização, mesmo quando a aplicação utilizava apenas algumas delas. A solução, uma pequena modificação para ignorar *autoloads* não resolvidos, resultou na drástica redução de 60% nas classes da VM e no tamanho do *heap*, além de uma diminuição de 36% no tempo de *boot*. Esse episódio sublinha a relevância da observabilidade e da otimização contínua para desenvolvedores, impactando diretamente a performance e eficiência de ambientes de produção.

A complexidade da busca em plataformas de entrega de alimentos, marcada por sinônimos, erros de digitação e restrições específicas, tem levado gigantes do setor a integrar Large Language Models (LLMs) de maneiras distintas. Enquanto DoorDash enriqueceu seu grafo de conhecimento offline com LLMs, a Instacart apostou na tecnologia para aprimorar a compreensão de consultas, segmentando-as em componentes principais e de cauda. Por sua vez, a Uber Eats implementou um modelo Qwen ajustado como base de embedding para um sistema de recuperação de duas torres, destacando abordagens variadas na otimização de resultados e na experiência do usuário. Essas estratégias demonstram a crescente dependência de soluções de IA para refinar a precisão e relevância em sistemas de busca em grande escala.

A comunidade de desenvolvimento exibe uma natural resistência à incorporação de novas ferramentas de codificação, um fenômeno intensificado pela crescente presença de sistemas baseados em IA no ciclo de vida do software. Esta cautela não se deve à falta de inovação, mas sim ao receio de desorganizar fluxos de trabalho já consolidados e práticas culturais. Para superar essa barreira, a chave reside na restauração da confiança: é imperativo que as equipes estabeleçam processos bem definidos, que enfatizem a supervisão humana e a responsabilização, garantindo uma transição fluida e a manutenção da qualidade no desenvolvimento.

A otimização do desenvolvimento com agentes autônomos de IA, buscando execução paralela e sem supervisão, exige a descentralização do ambiente de codificação. A implementação de uma máquina virtual (VM) Ubuntu descartável, integrada a uma tailnet Tailscale, permite que o trabalho persista e seja acessível de múltiplos dispositivos, mesmo após o encerramento da sessão local. O Tailscale facilita o acesso via SSH e estabelece contextos seguros com HTTPS para os servidores de desenvolvimento dos agentes. Para evitar colisões, são empregados worktrees Git e um wrapper Portless. A estratégia de segurança prioriza a contenção de danos, com commits frequentes para o GitHub e tratando a VM como um recurso descartável, garantindo resiliência e foco na experiência do desenvolvedor.

A OpenAI anunciou melhorias significativas na relação preço-performance de seus modelos de linguagem, visando desenvolvedores e aplicações de software. O modelo GPT-5.6 Luna teve uma redução de 80% no custo por milhão de tokens, agora a US$ 0,20 para entrada e US$ 1,20 para saída. Similarmente, o modelo Terra viu seus preços caírem 20%, custando US$ 2 por milhão de tokens de entrada e US$ 12 por milhão de tokens de saída. Embora o modelo Sol mantenha seus valores, as reduções de custo foram estendidas às quotas de trabalho do Codex e do ChatGPT. Além disso, a introdução do modo Fast para o Sol, que oferece 2,5 vezes mais velocidade pelo dobro do preço, com compatibilidade retroativa, otimiza o desenvolvimento de sistemas sensíveis à latência, destacando o foco da OpenAI na experiência do desenvolvedor e na eficiência da IA.

O cenário da IA presenciou um avanço significativo com o lançamento de modelos open-source como o Kimi K3. Este modelo demonstra capacidades computacionais notáveis, posicionando-se como um forte concorrente frente a soluções proprietárias. Impulsionado pela placa gráfica MI355X da AMD, o Kimi K3 sublinha a crescente eficiência de custo e desempenho por dólar no hardware de IA, apesar dos contínuos desafios no suporte de software. Este movimento sinaliza uma nova era para desenvolvedores, com mais acessibilidade e inovação na construção de aplicações inteligentes.

O caso do Snow Leopard (Mac OS X de 2010), que priorizou estabilidade e eficiência em detrimento de novas funcionalidades, ressoa no cenário atual do desenvolvimento. Ele destaca a perene demanda por qualidade e confiabilidade, frequentemente mais valorizadas do que a constante adição de recursos. Para desenvolvedores, essa perspectiva sublinha a importância da otimização, da performance e das boas práticas de código, impactando diretamente a experiência do desenvolvedor (DX) e a longevidade dos sistemas em um ambiente onde a integração com IA e a complexidade crescem exponencialmente.

Mesmo com o avanço das ferramentas de codificação agentic, que prometem otimizar a escrita de código, a engenharia de plataforma mantém sua relevância estratégica. A adoção de componentes de plataforma reutilizáveis demonstra ser mais vantajosa economicamente do que o desenvolvimento de soluções personalizadas do zero, reforçando a importância de padrões e boas práticas para a otimização de custos e a escalabilidade de projetos.

Receba as melhores notícias de tech

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser

⚡ CEVIU IA

A DeepSeek anunciou o lançamento da versão de produção do seu modelo V4 Flash, que promete elevar o nível do desempenho para sistemas de IA baseados em agentes. Este novo modelo incorpora um módulo de decodificação especulativa e demonstrou superar a versão V4 Pro Preview em diversos testes de benchmark, um feito notável considerando que o V4 Flash opera com um número substancialmente menor de parâmetros ativos. A novidade reforça a busca por eficiência e capacidade na nova geração de IA.

O tão aguardado Qwen 3.8-Max já está disponível, prometendo uma revolução nas capacidades de IA. Este modelo de 2,4 trilhões de parâmetros traz melhorias substanciais em áreas cruciais como codificação, produtividade no trabalho, pesquisa e execução de tarefas complexas de longo prazo. Com sua capacidade de responder a questionamentos e completar processos do início ao fim com maior confiabilidade, o Qwen 3.8-Max eleva o patamar da interação com a IA, e seus pesos abertos serão liberados na próxima semana, fomentando ainda mais a inovação.

A OpenAI surpreendeu a comunidade científica ao revelar dez avanços significativos em matemática e ciência da computação teórica, alcançados por um modelo de IA ainda não lançado. As descobertas abordam problemas abertos de longa data em áreas como geometria de alta dimensão, teoria de códigos, complexidade de circuitos aritméticos e criptografia de reticulados, entre outras. Cada solução representa um progresso substancial, demonstrando o potencial transformador da IA para impulsionar a pesquisa fundamental em campos complexos, com implicações para diversas áreas da matemática.

A Microsoft está testando o MAI Realtime, seu primeiro modelo de voz nativo em tempo real, encontrado em acesso antecipado oculto no MAI Playground. Este sistema promete conversas bidirecionais e full-duplex, permitindo que a IA ouça e fale simultaneamente, eliminando a tradicional alternância de fala. As duas vozes disponíveis são notavelmente mais naturais que o modo atual do Copilot, indicando um avanço significativo na fluidez da interação. A expectativa é que o MAI Realtime seja integrado ao Microsoft Foundry e ao Copilot Voice, embora ainda sem um cronograma oficial.

A OpenAI revelou sua visão para um ciclo virtuoso de desenvolvimento e adoção da IA. A empresa aposta que a medida que a inteligência artificial se torna mais acessível e poderosa, haverá um aumento da sua utilização, gerando mais receita. Esse capital será reinvestido na expansão da infraestrutura, crucial para o aprimoramento contínuo dos modelos e, consequentemente, para a ampla disponibilidade e utilidade da IA. A infraestrutura em larga escala é vista como o pilar para escalar a inteligência artificial a um ponto de abundância e acessibilidade global.

A Wafer revelou que seu modelo Kimi K3 alcançou a impressionante marca de 952 tokens por segundo por nó ao operar em GPUs AMD MI355X. Este feito destaca uma performance por dólar que supera as implementações Blackwell da Nvidia, posicionando a AMD de forma competitiva. Os resultados indicam que o investimento em aceleradores com alta capacidade de memória e aprimoramentos de software podem ser a chave para diminuir a lacuna de desempenho da AMD no campo da inferência de IA em relação à sua principal concorrente.

A Ramp, focando na performance de modelos de IA em ambientes de produção, desenvolveu um benchmark privado, o SWE-Bench, composto por 80 tarefas de backend reais. Este conjunto abrange áreas críticas como pagamentos, contabilidade, compras, tesouraria e detecção de fraudes. O objetivo é testar patches de código gerados por IA, garantindo que passem nos testes em até 45 minutos. A iniciativa visa uma avaliação precisa, livre das influências de benchmarks públicos, revelando o equilíbrio ideal entre acurácia, latência e custo que os modelos de IA podem oferecer em cenários práticos e complexos.

Jacob Tsimerman, renomado matemático laureado com a prestigiosa Fields Medal, integrou-se à equipe da OpenAI. Sua motivação central é a preocupação com os riscos existenciais da IA, tópico que já abordou em publicações acadêmicas. O professor tem como objetivo aplicar seu profundo conhecimento em matemática para fortalecer a pesquisa em segurança de IA, visando assegurar que o desenvolvimento da tecnologia não represente uma ameaça à humanidade. A entrada de Tsimerman sublinha a crescente relevância da "AI safety" no cenário global de inovação.

Em um feito notável que demonstra o potencial dos Grandes Modelos de Linguagem (LLMs), Andrej Karpathy desafiou o Opus 5 a criar uma renderização Three.js do primeiro parágrafo de 'O Senhor dos Anéis'. Utilizando um orçamento de 1 milhão de tokens, a IA não apenas gerou impressionantes 5.500 linhas de código, mas também orquestrou ativos de polígonos e animou a narrativa de forma procedural. Essa capacidade de automatizar tarefas complexas, que seriam inviáveis para humanos devido à sua intensidade e tempo, posiciona os LLMs como ferramentas cruciais para testes avançados e desenvolvimento de conteúdo interativo. O vídeo da animação resultante está disponível na publicação original.

O fundo de hedge Situational Awareness, fundado por Leopold Aschenbrenner, colapsou recentemente, destacando os riscos inerentes ao mercado de tecnologia. A empresa havia realizado apostas alavancadas de alto risco, visando capitalizar o rápido crescimento e as expectativas elevadas em torno do boom da Inteligência Artificial. Este incidente serve como um alerta para investidores sobre a volatilidade e os perigos de estratégias agressivas em setores emergentes, mesmo aqueles com grande potencial como a IA.

Desenvolvido em colaboração pela Ramp e Mercor, o APEX-Accounting surge como uma ferramenta essencial para medir a eficiência de modelos de IA no setor contábil. Este benchmark inovador avalia a performance da Inteligência Artificial em 160 cenários práticos e distintos, oferecendo uma métrica robusta e detalhada sobre a produtividade da IA especificamente na área da contabilidade. A iniciativa visa padronizar e otimizar o uso da IA para tarefas financeiras, impulsionando a automação e aprimorando a tomada de decisões.

🚨 CEVIU Segurança da Informação

O framework Ruby on Rails divulgou uma vulnerabilidade crítica no componente Active Storage, que pode ser explorada para permitir a leitura arbitrária de arquivos. A falha é particularmente preocupante para ambientes que utilizam a biblioteca libvips e permitem o upload de imagens por usuários não confiáveis. Especialistas em segurança alertam que essa brecha pode possibilitar a leitura da chave mestra do Rails, comprometendo operações criptográficas e, em casos extremos, culminando em Execução Remota de Código (RCE). A recomendação urgente é a atualização imediata dos sistemas.

A gigante farmacêutica Amgen divulgou ter sido vítima de uma violação de dados significativa, resultante do acesso indevido por parte de atacantes a informações sensíveis através de um provedor de serviços de nuvem terceirizado. A empresa confirmou que os dados exfiltrados incluem tanto informações proprietárias confidenciais quanto dados de saúde protegidos (PHI) de pacientes. Atualmente, a Amgen está conduzindo uma investigação aprofundada para determinar a extensão completa do incidente e identificar outros possíveis comprometimentos de dados.

Uma análise profunda da Truffle Security revelou um cenário preocupante de exposição de dados sensíveis. Ao escanear 7.6 petabytes de datasets públicos do Hugging Face, a empresa identificou 221.303 credenciais ativas e únicas, distribuídas em 6.003 datasets. Entre os achados críticos, destacam-se 349 PATs do GitHub com acesso de gravação, 318 tokens de push do Docker Hub, 8.557 chaves ativas do Google Cloud Platform (GCP) e impressionantes 8.594 logins de banco de dados funcionais. Além disso, foram encontradas 742 chaves da OpenAI e 26 da Anthropic, com o custo potencial de abuso de inferência estimado em US$ 920 mil anuais. A reincidência de 44% das credenciais em múltiplos datasets, agravada por empresas de web scraping, sublinha a magnitude do problema. O Hugging Face foi prontamente notificado e colaborou, integrando o TruffleHog para varredura de seus buckets. A recomendação é clara: tratar toda chave exposta como comprometida e realizar varreduras pré-publicação.

Um novo grupo de ransomware comprometeu informações sensíveis do Departamento de Educação (DfE) do Reino Unido e de um banco de dados policial, resultando no roubo de 740 mil linhas de dados. No DfE, a violação de um portal de help-desk expôs nomes completos, e-mails, telefones e cargos de funcionários e pais. Já o banco de dados policial, vital para assistência jurídica às forças britânicas, teve nomes, organizações de vínculo e e-mails de trabalho vazados. O incidente destaca a crescente audácia de grupos criminosos cibernéticos e a vulnerabilidade de infraestruturas governamentais.

Pesquisadores da Back Engineering Labs publicaram um estudo técnico que desvenda a obfuscação da máquina virtual presente no anti-cheat ACE da Tencent. A análise detalhada revela como o despachante .tvm mantém a integridade do CET shadow-stack e as semânticas SEH/unwind utilizando instruções nativas "boxed", balanceamento de RDSSPQ/INCSSPQ e informações de unwinding fantasmas. A equipe demonstrou a capacidade de recompilar funções virtualizadas de volta para código nativo, recuperando 815 das 865 funções (94,2%) em quatro drivers de kernel do ACE. O estudo aponta loops 'for' com range como uma limitação que pode levar a erros de descompilação com loops infinitos.

Pesquisadores da Huntress revelaram uma sofisticada campanha de malvertising que, a partir de anúncios envenenados no Google, direciona usuários para uma página comprometida do Claude.ai/share. O ataque, que atinge sistemas macOS, instala um RAT (cavalo de Troia de acesso remoto) nativo e um stealer, além de versões trojanizadas de carteiras Ledger/Trezor para roubar frases de recuperação BIP39. A kill chain de seis estágios simula o phishing de Acesso Total ao Disco e senhas de contas. A metodologia lembra a família AMOS/Atomic Stealer, com indícios de código e comentários em russo, sugerindo uma ligação familiar entre as ameaças. Profissionais de segurança devem monitorar execuções de 'curl -k' redirecionadas para 'zsh', a presença de 'LaunchAgent com.apple.*' com o arquivo '~/.local/.mpwd' e aplicativos ad-hoc com hashes 'ElectronAsarIntegrity' inconsistentes.

Um recente experimento expôs uma séria vulnerabilidade no modelo de linguagem Opus-5 do Claude Code, demonstrando como a IA pode ser manipulada para executar comandos maliciosos. O ataque de 'prompt injection' induziu o modelo a analisar um repositório com uma imagem contendo uma mensagem oculta. Essa mensagem, disfarçada de desafio, levou a IA a baixar e processar um script Python remoto. Apesar de não executar o script diretamente, o Opus-5 extraiu e rodou o comando malicioso embutido, evidenciando uma brecha preocupante na segurança de sistemas baseados em IA e o risco de execução remota de código.

Um guia detalhado investiga o módulo atexec do Impacket, explorando sua utilização na exploração completa da cadeia de abuso do Agendador de Tarefas do Windows (ATSVC/TSCH) via SMB. A análise demonstra a execução de ataques variados, incluindo plaintext, Pass-the-Hash, Pass-the-Ticket e Pass-the-Key, contra um Domain Controller do Server 2019. O estudo culmina na criação de um payload PowerShell em Base64 com -silentcommand para obter um reverse shell interativo, fornecendo insights cruciais para equipes de blue-team no que tange a detecção e mitigação de tais ameaças.

Uma engenharia reversa detalhada do módulo csagent.sys da CrowdStrike expôs as entranhas de seu mecanismo de detecção. O estudo identificou seis fontes de callback de kernel, um motor de rede WFP que pode interromper fluxos C2, e um minifiltro FLTMGR. A arquitetura de detecção centraliza-se em um objeto g_DetectionEngine, que carrega configurações de canal da nuvem em tempo de execução. Foram observadas falhas críticas, incluindo limites de confiança em user-mode para callbacks de Objeto/Registro e deficiências na resolução de hash/assinatura. O autor sugere que a recente interrupção da CrowdStrike em julho de 2024 pode ter sido causada por um arquivo de canal defeituoso da nuvem, e não por um erro no código binário do sensor.

Um estudo recente da DigiCert revela que, apesar de 87% das organizações estarem engajadas no planejamento, teste ou implementação de Criptografia Pós-Quântica (PQC), apenas 7% efetivamente implantaram certificados quânticos ou híbridos em larga escala. O relatório, que ouviu mil tomadores de decisão em TI e segurança nos EUA, Reino Unido e Austrália, aponta que o principal entrave não é mais a conscientização, mas sim a execução, citando a complexidade de sistemas legados, desafios de desempenho e restrições orçamentárias. A pesquisa ainda alerta para a ameaça "Trust Now, Forge Later", que pode ser mais crítica que a mera emissão de certificados, ressaltando a urgência de uma abordagem mais ampla na proteção contra ataques quânticos.

A equipe de DevOps do Arch Linux desativou a plataforma de adoção de pacotes AUR em 30 de julho, em resposta a uma campanha de atacantes que sistematicamente estavam adotando pacotes órfãos ou sem manutenção. Estes atores maliciosos submetiam commits PKGBUILD que continham payloads perigosos, executados através do comando makepkg, comprometendo a segurança dos usuários. A medida emergencial visa conter a proliferação de software malicioso e proteger a integridade do ambiente Arch Linux.

A Autoridade Monetária de Singapura (MAS) e a Associação de Bancos de Singapura uniram forças para criar a AI-Driven Cyber and Technology Risk Taskforce (ACT). Desde maio, instituições como DBS, OCBC, UOB, SGX, NETS e BCS colaboram nesta iniciativa. O objetivo é fortalecer a resiliência do setor financeiro contra ataques cibernéticos impulsionados por IA, por meio do compartilhamento de inteligência sobre ameaças, da realização de provas de conceito para ferramentas de defesa baseadas em IA e do desenvolvimento de diretrizes setoriais.

☸️ CEVIU DevOps

A próxima versão 1.37 do Kubernetes, com lançamento agendado para 26 de agosto, trará mudanças significativas. Entre elas, a descontinuação do modo IPVS no kube-proxy, gerando avisos de deprecation para clusters afetados. Além disso, pods estáticos não poderão mais referenciar Secrets ou ConfigMaps via campos de API, corrigindo um bug de longa data, e a flag `--filename` para `kubectl run` será descontinuada. Por outro lado, a API `metrics.k8s.io` alcançará o status estável após quase nove anos em fase beta. O kubelet em User Namespace (Rootless Mode) entrará em beta, permitindo que componentes de nó operem sem privilégios de root, enquanto o suporte a Cgroup v1 continua sendo gradualmente removido.

Para modelos de IA aplicados em tarefas diárias como codificação e análise, a velocidade de inferência revela-se um fator mais crítico do que pequenos aumentos na inteligência. Com taxas de 100-200 tokens por segundo já consideradas ideais para a interação humana, acelerações adicionais demonstram retornos decrescentes. Os gargalos passam a ser as chamadas de ferramentas, bancos de dados, hardware local e a revisão humana, reorientando a competição no setor para a velocidade de serviço e otimização de custos operacionais.

A HashiCorp anunciou a disponibilidade geral do Terraform AzureRM Provider 5.0, uma atualização significativa que promete aprimorar a gestão de infraestrutura no Azure. Esta nova versão introduz um controle mais refinado sobre as assinaturas Azure e validação pré-implantação opcional, oferecendo maior segurança e feedback da infraestrutura. A atualização também moderniza os padrões de validação e elimina recursos e propriedades depreciados, exigindo que os usuários revisem suas configurações para garantir uma migração suave.

A distribuição eficiente de módulos PowerShell em ambientes corporativos pode ser otimizada utilizando feeds privados do Azure Artifacts, integrados com o PSResourceGet. Pipelines do Azure DevOps automatizam o versionamento semântico via GitVersion, enquanto o Azure Key Vault assegura a assinatura de código, elevando a segurança. Para controle de acesso privilegiado em tempo de execução, a implementação de JEA (Just Enough Administration) é crucial, garantindo que apenas permissões necessárias sejam concedidas.

A escalabilidade de aplicações em Kubernetes é crucial, e o KEDA (Kubernetes Event-driven Autoscaling) se destaca ao permitir o dimensionamento de pods worker baseado na profundidade da fila do Amazon SQS, em vez dos tradicionais indicadores de CPU ou memória. A abordagem central é que, em arquiteturas orientadas a filas, a quantidade de mensagens pendentes reflete com maior precisão a demanda real do sistema. O KEDA calcula o número ideal de réplicas dividindo as mensagens pendentes por um alvo configurado por pod, possibilitando, inclusive, escalar deployments a zero quando as filas estão vazias, otimizando custos e recursos.

O CloudFormation Express mode da AWS revoluciona o ciclo de desenvolvimento ao reportar a conclusão de stacks assim que a configuração do recurso é aplicada, sem a necessidade de aguardar a estabilização completa. Essa abordagem agiliza significativamente as iterações e os workflows de agentes de IA, mantendo a integridade das dependências e a robustez das opções de rollback, otimizando a entrega contínua e a agilidade nas operações.

A recente atualização para o Rust 1.98 traz uma melhoria significativa para operações de ponto flutuante. A nova API permite que desenvolvedores autorizem explicitamente a reassociacão e o uso de instruções fundidas (fused instructions). Isso otimiza o desempenho sem ativar todas as otimizações de "fast-math", que são de alto risco. A funcionalidade é crucial para destravar a vetorização SIMD, acelerando cargas de trabalho numéricas, embora possa introduzir pequenas variações nos resultados devido à não associatividade da adição de ponto flutuante.

O Oracle Log Analytics agora capacita equipes de segurança a coletar e analisar logs de instâncias OCI Compute de forma eficiente, integrando-os diretamente ao fluxo de trabalho de adição de dados. Esta funcionalidade é crucial para monitorar acessos, identificar falhas de login e detectar tentativas de escalonamento de privilégios. Utilizando painéis personalizados, a plataforma oferece uma visão aprofundada para investigações de segurança, otimizando a postura defensiva em ambientes de nuvem.

A Microsoft anunciou a descontinuação do emissor Azure DevOps para conexões de serviço de federação de identidade de workload, com a aposentadoria definitiva agendada para 1º de julho de 2027. A medida visa padronizar o emissor Microsoft Entra, simplificando a gestão de identidade para a maioria dos cenários, exceto aplicações multi-tenant e ambientes de nuvem não pública, que manterão configurações específicas. Essa mudança reflete um movimento em direção a uma arquitetura de identidade mais unificada e segura no ecossistema Azure.

O Docker anunciou a implementação de suporte a OpenID Connect (OIDC) para GitHub Actions, uma novidade significativa para organizações. Com essa integração, os fluxos de trabalho podem autenticar-se utilizando tokens de curta duração e válidos por execução, eliminando a dependência de tokens de acesso pessoal ou tokens de acesso organizacional persistentes. A medida reforça a segurança e alinha as práticas de autenticação com os princípios de privilégio mínimo e rotação de credenciais, cruciais em ambientes de CI/CD.

💸 CEVIU Empreendedores

O cenário da IA de ponta está em efervescência com uma guerra de preços que redefine o mercado e a estratégia das startups. Gigantes como OpenAI, Anthropic e Google estão cortando drasticamente os valores de seus modelos, com a OpenAI, por exemplo, reduzindo o preço da API de Luna em 80% em apenas três semanas. Essa competição acirrada, impulsionada pelo lançamento de versões mais eficientes e acessíveis como o Opus 5 da Anthropic e o Gemini 3.6 Flash do Google, força os laboratórios a acelerarem a inovação. Para empreendedores, manter a flexibilidade e custos de mudança baixos torna-se crucial para navegar essa turbulência e transformar a volatilidade em vantagem competitiva.

A plataforma QM surge como um divisor de águas na forma como as empresas colaboram, oferecendo uma solução de agentes multijogador que respeita as nuances das estruturas organizacionais. Ao invés de tratar cada empresa como um usuário monolítico, o QM reconhece e gerencia escopos pessoais, de canal, grupo, equipe e organização. Isso permite que a colaboração ocorra de maneira fluida e integrada, sem a perda da individualidade ou da especificidade de cada nível, eliminando a fusão em um usuário indiferenciado. Com código aberto e disponível no Slack e web, o QM promete otimizar a interação entre equipes e parceiros, impulsionando a produtividade e a inovação no ambiente corporativo.

Para startups e empreendedores, a confiança do cliente é a moeda mais valiosa. Construir essa credibilidade exige uma jornada impecável, onde o serviço é medido pela experiência do usuário. É fundamental respeitar o tempo do cliente, assumir responsabilidades, e garantir que cada detalhe, por menor que seja, inspire segurança. Além disso, a capacidade de agir com competência e decência frente a imprevistos e a construção de um sistema de aprendizado contínuo são pilares para solidificar essa relação. Lembre-se: a confiança leva tempo para ser conquistada, mas pode ser perdida em um instante. Invista nela!

📱 CEVIU Design

Antes do evento oficial do Google, que ocorrerá em 12 de agosto, Evan Blass revelou, por meio de imagens de marketing supostamente autênticas, o Pixel 11 Pro Fold, ainda não anunciado, bem como os novos Pixel Buds e o Pixel Watch. O design do dobrável mantém a estética do modelo anterior, com uma tela externa alongada e um display interno de 8 polegadas. A principal mudança, no entanto, reside no conjunto de câmeras, que foi redesenhado e incorpora uma luz brilhante, recurso já antecipado para o Pixel 11 Pro. Apesar do entusiasmo, especula-se que os preços dos novos dispositivos possam ser mais elevados.

O Figma Make, uma plataforma fundamental para designers, acaba de receber um upgrade significativo com a introdução de um painel de propriedades e funcionalidades de anotação. Agora, os usuários podem ajustar seus designs de forma mais intuitiva, seja manipulando elementos visuais diretamente ou utilizando prompts contextuais. O painel de propriedades permite controle preciso sobre espaçamento, tipografia e layout, enquanto as anotações facilitam a comunicação de detalhes complexos, como estados de hover e animações. As novidades estão sendo liberadas para todos os planos, consumindo créditos, e são compatíveis apenas com novos designs criados no Make, prometendo otimizar o fluxo de trabalho e a colaboração no desenvolvimento de interfaces.

O Reddit inova ao testar uma experiência de vídeo moldada pelo sucesso do TikTok, focada em transformar posts virais da plataforma em conteúdo audiovisual narrado. A iniciativa responde à crescente popularidade de discussões do Reddit em outras redes, onde a IA já é utilizada para narrar conteúdos. Segundo o CEO Steve Huffman, a empresa busca capitalizar essa demanda, expandindo seu leque de ofertas em vídeo, que inclui o recente lançamento de comentários em vídeo. A novidade, que visa aprimorar a usabilidade e a acessibilidade do conteúdo, deve entrar em fase de testes ainda este ano.

🎭 CEVIU Marketing

O 'subvertising', ou publicidade subversiva, tem se mostrado uma ferramenta poderosa para criticar grandes marcas, usando paródias e imitações para expor a distância entre a mensagem oficial e a percepção pública. Desde os anos 1970, com intervenções em outdoors, até as campanhas digitais coordenadas de hoje, essa tática tem moldado opiniões, revelado falhas éticas e até impulsionado mudanças políticas. Em um cenário onde a IA facilita a criação de conteúdo, as marcas enfrentam o desafio crescente de manter o controle de sua narrativa, especialmente se sua comunicação carece de credibilidade ou contradiz suas práticas reais.

Uma nova abordagem na pesquisa de palavras-chave está ganhando destaque: a utilização de gravações de entrevistas com clientes como ponto de partida. A estratégia envolve empregar ferramentas de IA para identificar perguntas sobre os principais pontos de dor dos consumidores. Em seguida, essas perguntas são pesquisadas, e as páginas com melhor ranqueamento no Semrush são analisadas para extrair palavras-chave relevantes. O processo é otimizado ao expandir a lista com URLs relacionadas, visando a criação de conteúdo altamente segmentado para termos de baixo volume e concorrência, que ressoem diretamente com as necessidades do público-alvo.

As ações do Reddit registraram uma queda de mais de 20%, apesar de um balanço que superou as expectativas na maioria das métricas, com uma notável exceção: o tráfego de busca. A polêmica reside nos AI Overviews do Google, que, segundo o Reddit, reduziram os cliques de referência para sites em quase 50% em comparação com os resultados de busca tradicionais. Diante disso, a plataforma considera rescindir seu acordo de licenciamento de US$60 milhões com o Google. Embora o Google conteste, afirmando estabilidade no volume de cliques orgânicos, veículos como The Economist e Reuters estariam avaliando saídas semelhantes, evidenciando a pressão sobre editores que dependem do tráfego de busca. O episódio acende um alerta para o impacto da IA nas estratégias de conteúdo e aquisição de tráfego, forçando marcas a reavaliar sua dependência de plataformas externas.

💸 CEVIU Cripto

Um relatório da Galaxy Research revela que uma vulnerabilidade na geração de sementes (seed) dos dispositivos Coldcard, inicialmente identificada no modelo Mk3 e posteriormente em firmwares específicos dos Mk4, Mk5 e Coldcard Q, resultou na drenagem de mais de 1.082 BTC, totalizando aproximadamente US$ 70,2 milhões. Quase 1.200 endereços foram afetados por essa falha crítica. Em resposta, a Coinkite, fabricante das carteiras, emitiu atualizações de firmware emergenciais. O CEO Rodolfo Novak especula que a descoberta da falha pode ter ocorrido através de uma revisão de código assistida por IA. A Coinkite aconselha que usuários afetados atualizem seus firmwares, gerem novas seeds e testem com pequenas transações antes de realocar todos os seus ativos, visando mitigar futuros riscos.

A Rússia implementou um decreto que veta a mineração de criptomoedas e a participação em pools de mineração nas regiões de Moscou, Oblast de Moscou e partes do Oblast de Kursk, válido de 15 de agosto até o final de 2032. A justificativa oficial aponta o consumo de 1 GW da capacidade da rede elétrica regional pela atividade, projetando futuras deficiências energéticas. Esta medida regional aprofunda uma estratégia iniciada em 2024, enquanto o país avança na regulamentação nacional da mineração, com previsão de registro de equipamentos em 2025 e legislação para o trading de cripto no varejo.

A Daydreams anuncia o Taskmarket, uma plataforma competitiva onde agentes de IA são remunerados em USDC pela execução de tarefas. A qualidade da entrega é primordial, com recompensas atreladas ao desempenho. Entre os desafios propostos, destacam-se a recriação de jogos icônicos como Civilization I e GTA1. Para orientar os participantes, a Daydreams divulgou um guia detalhado, cobrindo desde a gestão de memória de agentes até a conversão de requisitos em checklists e a geração de mídia autêntica. O sistema enfatiza revisões focadas e a capitalização de métodos eficientes como habilidades reutilizáveis. A classificação no mercado serve como o único critério de qualidade, garantindo entrada gratuita e risco zero de participação.

⚖️ CEVIU Fintech

O estado de Nova York abriu um processo contra a Kalshi, operadora de mercados de previsão, alegando que seus contratos sobre esportes, política e outros eventos configuram jogos de azar ilegais. A ação busca uma liminar permanente, restituição a usuários e multas que podem atingir US$ 36 bilhões. A Kalshi, licenciada federalmente pela CFTC, defende que opera sob supervisão federal exclusiva, intensificando o debate sobre a natureza desses mercados: derivativos financeiros regulados ou apostas sujeitas à legislação estadual. A decisão terá um impacto significativo na indústria de tecnologia financeira e na inovação em produtos de investimento, especialmente no contexto da IA aplicada a mercados preditivos.

A fintech Chime anunciou um corte de aproximadamente 10% de sua força de trabalho, atingindo cerca de 150 colaboradores. A reestruturação visa à otimização impulsionada por IA para fortalecer a rentabilidade, antecipando uma possível oferta pública. O CEO Chris Britt destaca que equipes mais enxutas e horizontalizadas prometem maior agilidade. Essa estratégia reflete uma tendência crescente no setor financeiro, onde gigantes como Block, Visa, Robinhood e Mastercard já empregam a IA não apenas para inovação de produtos, mas para cortar custos e elevar a eficiência operacional, de olho em margens mais robustas.

O fundo de hedge Situational Awareness, de Leopold Aschenbrenner, foi compelido a liquidar sua carteira de ações públicas. A medida drástica foi imposta após perdas substanciais em suas apostas alavancadas em infraestrutura de IA e shorts contra empresas de software. A Citadel interveio para adquirir essas posições, enquanto os corretores primários do fundo trabalham para cobrir as margens, levantando questionamentos sobre a tese de investimento concentrada de Aschenbrenner no setor de IA.

🇪🇺 CEVIU TI

A União Europeia planeja um investimento estratégico de 10 bilhões de euros para estabelecer sete gigafábricas de IA, cada uma projetada para comportar no mínimo 100 mil chips de alta performance. Esta iniciativa visa catalisar um adicional de 20 bilhões de euros em capital privado, fortalecendo a infraestrutura tecnológica do continente e diminuindo a dependência europeia de soluções de IA externas, o que é crucial para a autonomia digital e competitividade global.

A Scale AI, líder em dados para treinamento de IA, acaba de anunciar Francis deSouza, ex-COO do Google Cloud, como seu novo CEO. A movimentação estratégica visa impulsionar a expansão da companhia no mercado de aplicações empresariais de IA, projetando que, em até 18 meses, a divisão de aplicações superará a receita gerada pela operação original de dados. Este movimento sinaliza uma clara aposta na monetização de soluções de IA, com um foco renovado em escalar inovações diretamente para o ambiente corporativo.

Uma análise da Truffle Security Co. revelou a exposição de 221.303 credenciais ativas e únicas, espalhadas por 6.003 datasets públicos no Hugging Face. A investigação, que escaneou 7.6 petabytes de dados de treinamento de IA, identificou desde tokens de supply chain de software e credenciais de nuvem até acessos a bancos de dados, chaves de comunicação e chaves de provedores de IA. Estima-se que o impacto financeiro mínimo anual com cobranças de inferência, considerando limites de gastos padrão, seja de US$ 920 mil, sublinhando a urgência de governança e segurança de dados no ecossistema da IA.

💸 CEVIU Dados

O lançamento do GPT 5.6 Luna pela OpenAI marca uma revolução na análise de dados, tornando-a até dez vezes mais acessível. Com um foco em economia e eficiência, o novo modelo permite a utilização de análises de dados agentic em combinação com bancos de dados analíticos de baixa latência. Essa sinergia possibilita a obtenção de respostas SQL com alta precisão a um custo inferior a meio centavo, democratizando as avaliações frequentes. O diferencial competitivo agora se desloca da complexidade do modelo para a força do contexto de negócios, a robustez das avaliações e a responsividade da plataforma de dados.

A DoorDash desenvolveu um Agent Gateway centralizado que permite que seus agentes de IA acessem ferramentas MCP de forma governada. A solução gerencia identidade, autorização, credenciais, filtragem, observabilidade e limites de taxa, garantindo segurança e controle. Atualmente, o sistema suporta mais de 200 servidores MCP e processa milhões de chamadas semanalmente, resultando em maior segurança e confiabilidade para suas operações baseadas em IA.

A Halodoc alcançou uma otimização notável ao migrar suas operações no Apache Airflow de sensores de polling e cargas síncronas para Data Assets e operadores deferíveis no Airflow 3.x. Essa mudança estratégica resultou em uma redução impressionante no consumo de CPU dos workers, caindo de 26,1% para 7,71%, e na memória, que diminuiu de 49,2% para 30,8% em suas 160 DAGs. A iniciativa também aliviou a carga sobre o scheduler e reduziu em aproximadamente 38% os erros de bloqueio de tabela no Redshift, comprovando a eficácia da abordagem na melhoria da estabiciência da infraestrutura de dados.

No universo da engenharia de dados, falhas em bancos de dados de produção raramente ocorrem no "happy path", mas sim em cenários de extremidade. Desafios como leituras de réplicas defasadas, commits ambíguos, deadlocks e migrações em tempo real podem comprometer a integridade e a disponibilidade dos dados, mesmo após testes básicos. Para mitigar esses riscos, a abordagem prática foca na imposição de invariantes robustas na fronteira do banco de dados. Isso inclui a implementação de escritas protegidas, restrições rigorosas, transações curtas, retentativas idempotentes e procedimentos explícitos de recuperação, elementos cruciais para assegurar a resiliência e a confiabilidade de sistemas de dados em larga escala.

O modelo de stream particionado do Apache Kafka apresenta limitações para cargas de trabalho que demandam roteamento de logs com milhões de entradas ordenadas de forma independente por chave. Em resposta a essa questão, o OpenData Log surge como uma alternativa robusta, desenvolvido em Rust e operando sobre object storage e SlateDB. Sua arquitetura emprega armazenamento LSM segmentado, varreduras otimizadas por chave, "splits" apenas de metadados e réplicas de leitura, prometendo maior eficiência e custo-benefício para cenários de logs de alta cardinalidade.

O DuckDB, conhecido por sua eficiência em processamento analítico, implementou I/O assíncrono para otimizar a leitura de arquivos Parquet e CSV armazenados no S3. A inovação visa eliminar o bloqueio de *threads* de trabalho durante operações de I/O, separando pools de *threads* assíncronos e de processamento. A arquitetura inclui ainda pré-leitura e governança de memória, resultando em ganhos notáveis de performance. Testes práticos em um *benchmark* TPC-H Q6, com 22 GB de dados Parquet, demonstraram uma redução no tempo de execução de 8,23s para 2,84s, enquanto a leitura de um arquivo CSV de grande porte registrou uma melhoria de quase 20 vezes. Essa atualização promete elevar o desempenho do DuckDB em cenários de dados na nuvem.

O processamento e a consulta de vídeos representam um desafio significativo, visto que o conteúdo visual, apesar de armazenável e visualizável, não permite buscas diretas sem revisão manual exaustiva ou reprocessamento contínuo por sistemas de IA. A CreativAI propõe uma solução inovadora, transformando filmagens em bases de conhecimento estruturadas e pesquisáveis. Essa abordagem otimiza consultas em áreas como robótica, logística, segurança, compliance e em diversas aplicações de IA física, permitindo acesso rápido à informação e eliminando a necessidade de reanálise do mesmo material.

A Meta aprimorou sua plataforma de dados, consolidando-a em um ecossistema unificado e fortemente tipado, com camadas centralizadas de catálogo, taxonomia, linhagem e políticas de dados. Entre as principais lições aprendidas em sua escala massiva, destacam-se a economia de milhões de dólares pela inclusão de uma coluna de depuração truncada. Além disso, a gestão de tabelas centrais, que atendem entre 40% e 50% do data warehouse, provou ser mais eficaz com versionamento do que com exclusão. A empresa também aponta que a preparação para a era da IA se inicia com a criação de primitivas de workflow reutilizáveis.

A Grab inova ao tratar as relações em seus Knowledge Graphs como hipóteses dinâmicas, que são validadas pelo comportamento de busca dos usuários em tempo real. Candidatas a relações de parentesco, filiação e irmandade são integradas às sugestões de busca da plataforma. Métricas como cliques, tempo de permanência, rolagem e conversões são transformadas em 'confidence scores', que promovem ou removem arestas da taxonomia, garantindo a precisão e relevância contínua do grafo de conhecimento.

Um guia prático detalha a aplicação dos diferentes tipos de índice do PostgreSQL – B-tree, GIN e BRIN – e como associá-los a padrões de acesso de dados comuns para otimizar a performance. A análise abrange desde consultas de igualdade e ranges até a manipulação de dados em arrays, JSONB, pesquisa de texto e séries temporais 'append-only'. O conteúdo é essencial para desenvolvedores e administradores de banco de dados que buscam aprimorar a eficiência e a velocidade de suas aplicações.

Um incidente recente com o Azure Cosmos DB da Microsoft destaca a constante vigilância necessária na segurança de dados em ambientes de nuvem. Embora plataformas NoSQL gerenciadas ofereçam conveniência, a potencial exposição de chaves mestras sublinha a importância crítica de revisões contínuas da postura de segurança em cloud, especialmente no que tange à gestão de segredos e políticas robustas de rotação de chaves. O caso serve como um lembrete fundamental para arquitetos e engenheiros de dados priorizarem a governança de acesso e a auditoria de credenciais.

🤖 CEVIU Hardware

A Comissão Federal de Comunicações (FCC) dos EUA implementou esta semana uma proibição à importação de novos robôs humanoides, quadrúpedes, de limpeza e de entrega de origem estrangeira. A medida é justificada por riscos de privacidade, devido à capacidade desses dispositivos de mapear ambientes, e por preocupações com a segurança da cadeia de suprimentos. Embora a China não tenha sido explicitamente mencionada, o país, que domina cerca de 85% do mercado global de robôs humanoides, ameaçou retaliação, classificando a ação como uma ameaça à estabilidade econômica global. Empresas de robótica americanas, dependentes de componentes chineses, temem o impacto nas suas próprias operações.

Gigantes da tecnologia como AWS e Meta estão revolucionando a construção de datacenters de IA ao adotarem um modelo modular. Eles fabricam componentes mecânicos e elétricos pré-montados fora do local, como blocos de Lego, para mitigar a escassez de mão de obra especializada. Essa metodologia inovadora acelera o cronograma de construção em 36% e diminui em 85% a demanda por eletricistas licenciados in loco. A estratégia se alinha a uma tendência de contornar gargalos tradicionais, com desenvolvedores conectando clusters de GPU diretamente a fontes de energia co-localizadas, como gás natural, pequenos reatores modulares ou usinas nucleares, reduzindo o tempo de energização de 60 para menos de 18 meses.

Um feito notável no campo da IA embarcada foi alcançado por um desenvolvedor que conseguiu executar um modelo de linguagem com 28.9 milhões de parâmetros em um ESP32-S3, um microcontrolador de apenas US$8 e 512KB de SRAM. Inspirada nos modelos Gemma do Google, a técnica emprega Per-Layer Embeddings, armazenando 25 milhões de parâmetros na memória flash como uma tabela de consulta. Durante a inferência, apenas os bytes essenciais para o token atual são lidos, enquanto as camadas menores permanecem na SRAM. Após quantização, o modelo se reduz a 14.9MB, cabendo na flash do dispositivo e gerando cerca de 9.5 tokens por segundo, demonstrando o potencial da IA em hardware de baixo custo.

Receba as melhores notícias de tech

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser
CEVIU News — 3 de agosto de 2026 | CEVIU