A Anthropic propôs à Meta um acordo de computação de até US$ 10 bilhões por dois anos, visando suprir a crescente demanda por infraestrutura de IA. A gigante de Mark Zuckerberg avalia a proposta, que envolve pagamentos mensais e cláusulas de rescisão antecipada. A negociação destaca a corrida por recursos computacionais e pode representar uma nova e significativa fonte de receita para a Meta, à medida que equilibra o uso de seus próprios serviços de inteligência artificial com a demanda externa.

CEVIU News — 20 de julho de 2026
🤝 CEVIU

A Anthropic está mudando o cenário das migrações de código, historicamente projetos longos e complexos, com o auxílio do Claude Code. A empresa revela um processo estruturado em seis etapas, focado em otimizar o fluxo de trabalho de produção de software em vez de apenas corrigir o que já existe. Essa metodologia promete trazer eficiência e agilidade significativas para organizações que enfrentam o desafio de modernizar suas vastas bases de código legadas.
A SpaceX está em discussões avançadas para fornecer um robusto poder computacional ao Departamento de Defesa dos EUA. Este potencial contrato, estimado em bilhões de dólares, visa aprimorar significativamente as capacidades de IA militar do Pentágono. Contudo, essa aproximação acende um alerta entre autoridades de segurança nacional, que veem com preocupação a crescente dependência tecnológica do órgão em relação a provedores individuais, especialmente os ligados a Elon Musk. Paralelamente, o Pentágono busca um investimento de US$ 30 bilhões para garantir acesso a chips de IA de última geração, enquanto articula estratégias para diversificar seus fornecedores e evitar a concentração de poder tecnológico.
O foguete Vikram-1 da Skyroot Aerospace, marcando a estreia de um lançador de satélites 100% comercial da Índia, atingiu com sucesso uma órbita a 450 km de altitude. O lançamento, realizado no sábado a partir de uma ilha no Golfo de Bengala, enfrentou um atraso de mais de 30 minutos devido a uma questão técnica de última hora, mas foi aclamado como um êxito. Este feito posiciona o Vikram-1 como o primeiro foguete orbital privado indiano a alcançar a órbita em sua tentativa inicial, e um segundo voo já está agendado para o final do ano, consolidando a crescente capacidade espacial do país.
A ZTE Corp. acaba de entrar na acirrada disputa global por uma nova geração de smartphones, apresentando uma linha cocriada com serviços de IA. O destaque é o NaviX Ultra, que a empresa proclama como o primeiro 'smartphone agentic' do mundo. Este novo dispositivo integra o agente de IA Doubao da ByteDance, ativável por comando de voz ou botão, e está disponível em diversas cores vibrantes como preto, rosa, branco e azul, sinalizando o avanço chinês na reimaginação do aparelho móvel para a era da IA.
Apesar do salto de inteligência e capacidade demonstrado pelos chatbots de IA, seu impacto no uso prático diário ainda não atingiu o ápice esperado. A geração de ideias, antes um gargalo, mostra-se superada, mas a materialização dessas ideias em soluções funcionais e sustentáveis continua a ser o maior desafio, limitando a velocidade de implementação e a escalabilidade no mundo real.
A nova onda de empresas impulsionadas por IA está redesenhando fundamentalmente o ambiente de trabalho, operando com quadros de funcionários reduzidos e uma proporção significativamente maior de engenheiros. Essas organizações adotam um modelo horizontal, onde a figura do 'player-coach' substitui a supervisão tradicional, eliminando camadas hierárquicas. Tal abordagem funciona como um laboratório vivo para as estratégias que grandes corporações buscam implementar através de reestruturações, cortes de pessoal e investimentos massivos em IA, sinalizando uma transformação profunda no futuro corporativo.

A Apple, por um breve período na última sexta-feira, retomou o posto de empresa mais valiosa do planeta, evidenciando a acirrada disputa no topo do mercado global. Esse vaivém entre a gigante da maçã e a Nvidia sublinha a crescente relevância dos setores de eletrônicos de consumo e semicondutores, mostrando como a inovação e o domínio tecnológico se traduzem em valor de mercado.
A Amazon confirmou um erro nos preços unitários do AWS que levou ao envio de estimativas de cobrança estratosféricas, atingindo a casa dos trilhões de dólares para alguns clientes. O incidente causou preocupação entre os usuários da plataforma de computação em nuvem, mas a empresa já está trabalhando para recalcular todas as estimativas impactadas e corrigir o problema em caráter de urgência. O ocorrido ressalta a complexidade dos sistemas de faturamento em larga escala e a importância da precisão em serviços de nuvem.
O cenário atual das "guerras de LLM" levanta questionamentos sobre a possível repetição de um padrão histórico já observado nas "guerras de bancos de dados". Analisando o passado, é provável que os grandes vencedores da corrida da IA generativa não sejam os mesmos que hoje polarizam os debates. A discussão sugere que o futuro da dominância tecnológica pode divergir drasticamente das expectativas contemporâneas, com a verdadeira inovação surgindo de frentes inesperadas.
Para alcançar o desempenho máximo em sistemas complexos, a seleção criteriosa de configurações de modelos e harnesses é um diferencial. Isso porque diversas cargas de trabalho e tarefas podem apresentar resultados superiores ao serem combinadas com abordagens específicas, reforçando a necessidade de uma estratégia adaptada para cada domínio. A escolha correta é fundamental para potencializar a performance e a eficiência.

A gigante chinesa Alibaba acaba de anunciar o Qwen3.8, um novo modelo de linguagem massivo que ostenta impressionantes 2.4 trilhões de parâmetros. A grande novidade que promete agitar o cenário da inteligência artificial é a futura liberação de uma versão com pesos abertos (open weight). Essa iniciativa do Alibaba pode democratizar ainda mais o acesso a tecnologias avançadas de IA, abrindo caminho para inovação e pesquisa por parte de desenvolvedores e cientistas em todo o mundo.

Observadores apontam que líderes globais demonstram uma notável ausência de um plano estratégico ou de alternativas sólidas frente ao avanço acelerado da IA. A aparente única saída tem sido evitar o conflito e permitir a crescente influência da tecnologia. Este cenário sugere que a velocidade das inovações e a intensa pressão em torno da IA estão sobrepujando a capacidade de planejamento a longo prazo e a avaliação criteriosa de riscos. Entenda como essa dinâmica pode impactar o futuro das políticas internacionais e a governança tecnológica.
💸 CEVIU Web Dev
Um incidente de faturamento na Amazon Web Services (AWS) causou grande alarme entre usuários e desenvolvedores, com cobranças estimadas atingindo valores astronômicos, que variaram de centenas de milhões a impressionantes US$ 2,5 trilhões. A falha, que gerou faturas inflacionadas e irrealistas, levou a Amazon a paralisar imediatamente as atualizações da plataforma e a iniciar um processo de correção urgente dos valores. Esse cenário destaca a importância da robustez em sistemas de gerenciamento de custos na nuvem e o impacto direto de erros de software na experiência do usuário e na credibilidade de grandes provedores de infraestrutura.

A Netflix implementou uma plataforma interna robusta para a implantação e inferência de Large Language Models (LLMs), visando integrar esses modelos diretamente em seu ambiente de produção. A iniciativa elimina a dependência de APIs externas e otimiza o ciclo de desenvolvimento ao garantir uma transição fluida da experimentação para a produção. A arquitetura da plataforma emprega um sistema de serving unificado, utilizando tecnologias como vLLM e Triton, e oferece funcionalidades críticas como testes A/B e roteamento inteligente de modelos, assegurando alta performance e escalabilidade.
O Fetch API, fundamental para requisições de rede, apresenta uma limitação significativa ao agrupar todas as falhas de conexão em um único TypeError. Essa abordagem ignora os códigos de erro detalhados de protocolos como HTTP/2 e HTTP/3, dificultando o diagnóstico preciso para desenvolvedores. Uma proposta submetida ao TC39 visa solucionar essa questão ao introduzir uma propriedade padronizada `.code` no objeto `Error`. Tal implementação permitiria ao Fetch expor esses códigos de forma abstrata, sem a necessidade de reestruturar a API. Essa melhoria elevará consideravelmente a capacidade de depuração e otimização das interações com serviços web, impactando positivamente a experiência do desenvolvedor (DX) no gerenciamento de falhas de rede.

Desenvolvedores estão explorando métodos inovadores para aprimorar a eficiência de agentes de IA. Uma abordagem notável, o "swamp workflow", propõe estruturar tarefas complexas com código determinístico. Essa técnica não só otimiza o consumo de recursos, mas também mantém a integridade funcional. Em um caso prático de revisão de código, sua implementação resultou em uma redução de oito vezes no uso de tokens e diminuiu o tempo de execução pela metade, superando a ineficiência de métodos tradicionais que frequentemente desperdiçam tokens e ciclos de processamento.

Ferramentas de revisão de código impulsionadas por IA, a exemplo do CodeRabbit Review, estão revolucionando a análise de modificações em bases de código. Em vez de apresentar uma lista de arquivos estática, essas soluções organizam as alterações de forma estruturada, facilitando um percurso lógico pelas modificações. Tal abordagem é crucial para identificar dependências complexas e discernir funcionalidades relacionadas, mas distintas, em grandes refatorações ou remoções de features, otimizando de forma significativa a produtividade das equipes de desenvolvimento. A integração de IA visa aprimorar a experiência do desenvolvedor (DX), garantindo revisões mais eficazes e focadas na qualidade do código.

Desenvolvedores estão experienciando uma nova forma de fadiga ao trabalhar com Large Language Models (LLMs), decorrente da constante necessidade de supervisão e validação das saídas geradas por IA. Embora essas ferramentas apresentem grande utilidade, elas também introduzem uma camada de imprevisibilidade que exige o julgamento humano contínuo. Este cenário reflete uma transformação nas habilidades requeridas em engenharia de software, onde a capacidade de adaptação e aprimoramento em novas metodologias de interação com IA tornam-se cruciais para os profissionais da área.

Empresas e organizações estão imersas em um entusiasmo exacerbado pela IA, resultando em projetos que frequentemente não entregam os resultados prometidos e decisões estratégicas equivocadas. Apesar da ausência de ganhos tangíveis de produtividade em diversas implementações de IA, a pressão para sua adoção continua crescente. Esse cenário tem impedido debates críticos sobre as limitações da tecnologia, cultivando um ambiente de expectativas irreais e minando a capacidade de avaliação racional.
Um desenvolvedor explorou a complexidade de operar o SQLite em um projeto Django, evidenciando que, mesmo com soluções aparentemente mais simples, a gestão de bancos de dados exige atenção. Os desafios encontrados incluíram consultas de baixo desempenho, dificuldades com operações de escrita concorrentes e a necessidade de elaborar estratégias de backup confiáveis. A experiência sublinha a importância de um conhecimento aprofundado em otimização de banco de dados e integridade transacional, mesmo ao integrar um SGBD compacto como o SQLite em aplicações Python.
A ascensão dos Grandes Modelos de Linguagem (LLMs) está gerando debates sobre seu futuro no cenário tecnológico, com alguns analistas traçando paralelos com a evolução dos bancos de dados. Assim como os sistemas de gerenciamento de dados se tornaram componentes de infraestrutura onipresentes e muitas vezes 'invisíveis' no desenvolvimento de software, a expectativa é que os LLMs sigam caminho semelhante. A intensa competição entre provedores de banco de dados nos anos 90, que moldou a paisagem da tecnologia da informação, serve de referência para as atuais disputas no campo da IA. Observa-se que as soluções de banco de dados mais prevalentes hoje não eram necessariamente as protagonistas iniciais, sugerindo que o futuro dos LLMs pode ser moldado por escolhas de mercado e adoção, e não apenas por 'guerras' de empresas.

A crescente adoção de agentes de codificação baseados em IA está redefinindo as dinâmicas colaborativas nas equipes de engenharia de software. Apesar da inegável aceleração nos ciclos de desenvolvimento, a rapidez imposta por essas ferramentas de IA tem gerado preocupações significativas. Observa-se uma diminuição nas discussões aprofundadas sobre design técnico, resultando em potenciais fragilidades arquitetônicas. Além disso, a fragmentação dos requisitos de produto e a menor eficácia nos processos de code review emergem como desafios centrais, impactando a qualidade e a manutenibilidade do código-fonte. Este cenário exige uma reavaliação das práticas de desenvolvimento para integrar a IA sem comprometer a robustez colaborativa.

O recente desempenho do modelo Kimi K3, que alcança paridade com o aclamado Claude, porém com custos operacionais notavelmente inferiores, reacende o debate sobre o cenário regulatório da IA. Este avanço sublinha uma potencial falha nas políticas dos EUA, que impõem barreiras a modelos de IA domésticos. Enquanto competidores internacionais avançam sem as mesmas restrições, cria-se um desequilíbrio competitivo significativo, impactando a inovação e o desenvolvimento de software no mercado americano.
Receba as melhores notícias de tech
Conteúdo curado diariamente, direto no seu e-mail.
💻 CEVIU IA

A Netflix revelou os bastidores de como desenvolveu e operacionalizou a inferência de modelos de linguagem grandes (LLMs) em sua infraestrutura de produção já estabelecida. O artigo técnico detalha as escolhas cruciais, como a seleção do motor de inferência, o empacotamento dos modelos, a concepção da API e a estratégia de implantação. A gigante do streaming também aborda as restrições de saída e os compromissos enfrentados para garantir a performance e escalabilidade sob cargas de trabalho reais, oferecendo insights valiosos sobre a adoção de IA em larga escala.

A gigante tecnológica Alibaba acaba de anunciar o Qwen3.8, um novo modelo de IA que promete redefinir o cenário com seus impressionantes 2,4 trilhões de parâmetros. A grande novidade é a intenção da empresa de lançá-lo como open-weight, democratizando o acesso a uma tecnologia de ponta. Atualmente, uma versão de preview já se encontra disponível para entusiastas e desenvolvedores por meio das plataformas Token Plan, Qoder e QoderWork da Alibaba, sinalizando um passo importante na estratégia de inovação aberta da companhia no campo da IA.

A Apple iniciou um processo judicial contra a OpenAI, alegando roubo de segredos comerciais. A gigante de Cupertino enviou cartas legais a dezenas de ex-funcionários que hoje atuam na OpenAI, instruindo-os a preservar documentos e comunicações potencialmente relevantes. A acusação é que a OpenAI teria recrutado engenheiros-chave da Apple e se beneficiado de designs proprietários e processos de fabricação. Atualmente, mais de 400 ex-funcionários da Apple trabalham na empresa de IA. A OpenAI, por sua vez, nega veementemente as acusações, afirmando não ter evidências que sustentem a queixa.

Apesar de ambos os modelos, Claude Code e Codex, incorporarem o comando '/goal', suas abordagens são drasticamente distintas. O Claude Code o emprega como um 'hook' de parada com escopo de sessão, possibilitando uma interrupção antecipada, mas sem ponderar a relevância de milhões de iterações adicionais. Em contraste, o Codex concebe o 'goal' como um estado de 'thread' persistente, autoavaliando seu progresso com base em arquivos e ferramentas disponíveis. A utilização indiscriminada do '/goal' pode ser problemática, pois pode tanto potencializar decisões equivocadas quanto as acertadas.

A discussão sobre o uso de tecnologias de IA em contextos militares ganha novos contornos, com o Google sob escrutínio. Enquanto Demis Hassabis propõe um framework para a IA de fronteira, a empresa enfrenta críticas por seus acordos com o setor de defesa. A tensão culminou com a saída de Alex Turner, que se opôs veementemente ao uso irrestrito dos modelos do Google para aplicações governamentais, incluindo o desenvolvimento de armas autônomas, levantando questões cruciais sobre a responsabilidade ética na era da Inteligência Artificial.

A Sakana AI lança a técnica 'Diffusing Blame', uma inovação em redes neurais que incorpora o princípio de Dale para aprendizado eficiente. Esta abordagem, inspirada na Difusão de Erro, emprega matrizes de pesos não negativos para segregar fluxos excitatórios e inibitórios, eliminando a dependência do transporte de pesos. Com resultados promissores em classificação de imagens e aprendizado por reforço, a Sakana AI sugere um avanço significativo em regras de aprendizado mais alinhadas com a biologia neural, aproximando a IA de modelos cerebrais.

A Anthropic anunciou que o aguardado modelo Claude Fable 5 será integrado a todos os planos Max e Team Premium a partir de 20 de julho, oferecendo 50% dos limites de uso aos assinantes. Enquanto isso, usuários dos planos Pro e Team Standard continuarão acessando o Fable via créditos, recebendo um bônus único de US$ 100 para impulsionar a experimentação. A implementação faseada reflete a cautela da empresa diante da imprevisível demanda pelo poderoso modelo de IA, visando garantir uma transição suave e eficiente para sua base de usuários.
A Alibaba, gigante chinesa de tecnologia, anunciou a abertura do código-fonte de seu stack de software para a série Zhenwu de chips de IA. A iniciativa, batizada de SAIL (Software and AI co-design, co-optimization, co-exploration and co-evolution), busca mitigar a dependência do ecossistema CUDA da Nvidia, que atualmente domina o setor. Para a China, romper o 'lock-in' do CUDA é fundamental para alcançar a independência em IA, indo além da simples produção de hardware alternativo. Recentemente adicionada à lista negra militar do Pentágono, a Alibaba visa, com essa estratégia de código aberto, fortalecer a resiliência de seu ecossistema, dificultando futuras desativações impostas por governos.

O modelo de linguagem Kimi K3, da Moonshot AI, encontra-se diante de uma demanda que superou todas as expectativas, resultando na suspensão temporária de novas assinaturas. Para garantir a qualidade e a estabilidade do serviço, a empresa priorizará o acesso aos recursos de computação para seus membros já existentes. A medida sublinha o crescimento exponencial e a popularidade dos modelos de IA avançados.

O Google está preparando o terreno para uma significativa expansão de suas capacidades de IA, com o lançamento iminente do Gemini Live e de novos recursos de 'Skills' para desktops e navegadores web. Essa movimentação visa levar a interação conversacional em tempo real, antes restrita a dispositivos móveis, para um público mais amplo. A integração de 'Skills' promete aprimorar as funcionalidades do Gemini, permitindo que a IA execute tarefas mais complexas e diversificadas diretamente na experiência de navegação.

Para driblar o alto custo computacional na pesquisa com IA, a abordagem mais inteligente emprega uma estratégia em fases. Inicialmente, modelos de linguagem mais 'leves' e econômicos são acionados para a coleta preliminar de informações. Em seguida, para garantir a precisão e aprofundar a análise, são utilizados modelos mais robustos e avançados. Essa hierarquia no uso da IA assegura não só a eficiência do processo, mas também uma significativa redução no consumo de tokens, tornando a pesquisa mais viável e menos dispendiosa.
A startup chinesa Z.ai, líder em soluções de Inteligência Artificial, está prestes a atingir a marca de US$ 1 bilhão em vendas, mesmo disponibilizando seus modelos mais avançados gratuitamente. Tal feito é impulsionado, em grande parte, por implementações on-premises para estatais e instituições financeiras, além de uma expansão robusta no segmento de serviços em nuvem. A estratégia destaca um modelo de negócio disruptivo no competitivo cenário da IA global, onde a monetização se dá na infraestrutura e personalização, e não no acesso aos modelos básicos.

A Moonshot AI, conhecida por seu modelo de linguagem Kimi K3, está se preparando para abrir seu capital na Bolsa de Valores de Hong Kong. A empresa chinesa de inteligência artificial revelou que planeja realizar sua Oferta Pública Inicial (IPO) dentro dos próximos seis meses, marcando um movimento significativo no cenário global de tecnologia e IA.

A General Compute, uma promissora startup de nuvem focada em inferência de IA, acaba de garantir um empréstimo substancial de US$ 400 milhões, utilizando chips especializados em inferência como garantia. Este marco sinaliza uma reorientação estratégica dos financiadores de GPU, que agora voltam seus olhares para a infraestrutura de inferência. A crescente demanda por capacidade computacional para modelos de IA em produção impulsiona esse movimento, evidenciando a maturidade do setor e a busca por soluções otimizadas para as crescentes necessidades de processamento.
🚨 CEVIU Segurança da Informação
A Searchlight Cyber divulgou uma vulnerabilidade crítica de execução remota de código (RCE) no coração do WordPress, permitindo que atacantes anônimos explorem instalações padrão sem a necessidade de plugins adicionais. A falha afeta cerca de 500 milhões de sites rodando nas versões 6.9.0 a 6.9.4 e 7.0.0 a 7.0.1. Embora os detalhes técnicos completos tenham sido retidos para conceder tempo aos defensores para atualizações, a ferramenta wp2shell[.]com foi lançada para verificação pública. Administradores são urgentemente aconselhados a atualizar para o WordPress 7.0.2 (ou 6.9.5 para a série 6.9) ou, alternativamente, bloquear o acesso anônimo a /wp-json/batch/v1 e ?rest_route=/batch/v1 via WAF.

Uma séria vulnerabilidade, apelidada de HollowByte, foi descoberta no OpenSSL, permitindo que invasores, com apenas requisições TLS de 11 bytes, induzam os servidores a alocar até 131 KB de memória por conexão. Esta memória permanece retida em sistemas glibc até a reinicialização, com a Okta reportando que servidores NGINX já sofrem com centenas de megabytes perdidos devido à fragmentação de heaps. A correção foi implementada discretamente pelo OpenSSL em 9 de junho, sem a atribuição de um CVE, o que dificulta a detecção por scanners e o rastreamento de backports, expondo ainda mais sistemas críticos a riscos de inoperabilidade.

A Abbott confirmou o acesso não autorizado a sistemas legados da Exact Sciences após o grupo ShinyHunters listar a unidade de Diagnóstico de Câncer em seu site de vazamentos. O grupo alegou ter comprometido uma conta Microsoft Entra SSO através de um ataque de vishing em meados de junho, resultando no roubo de mais de 30 milhões de linhas de PII de clientes, incluindo mais de um milhão de números de Seguro Social, além de dezenas de milhões de registros médicos. Paralelamente, outro ator de ameaça, ShadowByt3$, afirmou ter violado o portal LabCentral da Abbott em 4 de julho, exfiltrando documentos comerciais. A Abbott contestou a sensibilidade dos dados neste segundo incidente, mas ativou a resposta a incidentes, contratou especialistas externos e notificou as autoridades em ambos os casos. Felizmente, nenhum dos dados roubados foi divulgado publicamente até o momento.
Uma análise recente revelou que aplicativos governamentais e da mídia estatal chinesa, baseados em plataformas SaaS de "marketing interativo" compartilhadas, estão utilizando um backend de recompensa vulnerável. A separação entre os locatários, baseada principalmente em um `client_id`, é comprometida por um esquema de assinatura deficiente. O problema central reside na exposição de um 'salt' público e de uma chave HMAC através de um endpoint de inicialização, permitindo a falsificação em larga escala de pontos, quizzes e sorteios. Usuários mal-intencionados estão automatizando a interação com esses aplicativos, utilizando scripts para resolver CAPTCHAs com ferramentas como ddddocr e resgatando recompensas via Alipay. Casos específicos incluem a manipulação de quizzes de serviços sociais municipais em Pequim com a ajuda de IAs como Xunfei Spark, gerando engajamento e inscrições falsas em loterias vinculadas a contas de cidadãos.

Pesquisadores do Bitdefender Labs revelaram três técnicas de pós-comprometimento que escalam privilégios ao explorar o driver minifiltro `bindflt.sys` do Windows, permitindo a evasão de soluções EDR. As táticas, denominadas File-Binding, Process-Binding e Silo-Binding, permitem que códigos maliciosos como o Invoke-Mimikatz sejam executados sem detecção, mascarados como processos ou arquivos legítimos. Embora exijam acesso de administrador local e reflitam o modelo de ameaça BYOVD (Bring Your Own Vulnerable Driver), a cadeia de ataque também introduz uma escalada de privilégios de usuários do Docker para SYSTEM. Essas abordagens sublinham a necessidade crítica de defensores de segurança revalidarem identidades em reaberturas de arquivos, enumerarem mapeamentos de bind-link e confirmarem a validação de resolução de bind-link com seus fornecedores de EDR, em vez de dependerem apenas da proteção parcial do Windows 24H2.
Uma abordagem inovadora permite que analistas de segurança identifiquem tráfego de Cobalt Strike de forma mais eficiente. Embora os perfis C2 maleáveis da ferramenta permitam diversas URIs, na prática, cada beacon se restringe a uma URI GET e uma POST estáticas. Essa particularidade cria uma vulnerabilidade: ao monitorar logs de proxy web para hosts internos que se comunicam com domínios suspeitos usando poucas URIs únicas, defensores podem flagrar potenciais beacons do Cobalt Strike. Este método serve como heurística inicial, otimizando a caça a ameaças ao focar na baixa prevalência e uniformidade das URIs.

Em um alerta crucial para a segurança cibernética, a pesquisadora Katie Paxton-Fear demonstrou a facilidade e o baixo custo de comprometer modelos de IA de código aberto. Com menos de US$100 e apenas dez exemplos de treinamento, ela conseguiu transformar um modelo de codificação em um sistema com backdoor, apto a gerar falhas de execução remota de código sob demanda. Outro experimento revelou a capacidade de um modelo exfiltrar dados sensíveis, utilizando uma ferramenta 'send_email' em fluxos de trabalho de descoberta de medicamentos. Esta técnica transforma os pesos do modelo em um insider persistente, operando com visibilidade mínima e sem verificações eficazes, evidenciando uma lacuna crítica na segurança da IA.

O projeto open source curl, crucial para a infraestrutura digital, está enfrentando uma enxurrada sem precedentes de relatórios de bugs gerados por LLMs. Em 2026, as submissões quadruplicaram em relação a 2024 e duplicaram as de 2025, impactando diretamente o bem-estar e a saúde mental da equipe. Embora a detecção de vulnerabilidades seja vital, o volume massivo, proveniente de IAs, tem sobrecarregado os desenvolvedores, levantando um alerta sobre a sustentabilidade de projetos críticos que recebem pouco apoio corporativo apesar de sua vasta utilização.
A usina nuclear de Kudankulam, a maior da Índia, foi alvo de um ataque cibernético reivindicado pelo grupo de ransomware World Leaks. Um provedor de serviços da usina confirmou um vazamento parcial de dados, atribuído a um fornecedor de serviços de nuvem de terceiros. Embora os sistemas centrais da usina não tenham sido comprometidos, arquivos como plantas, dados de sistemas de resfriamento e documentos de seguro foram expostos, levantando sérias preocupações sobre a segurança da infraestrutura crítica indiana.

A gigante de bebidas Coca-Cola confirmou um ataque de ransomware que paralisou as operações de sua unidade de laticínios Fairlife. O incidente cibernético comprometeu os sistemas de produção, resultando na interrupção temporária das atividades nos Estados Unidos. Este evento ressalta a crescente vulnerabilidade de infraestruturas críticas a ataques digitais, impactando cadeias de suprimentos e exigindo uma resposta rápida para conter os danos operacionais e financeiros.

O código-fonte da carteira de criptomoedas MetaMask foi acessível a um contratado terceirizado que, posteriormente, foi associado à Coreia do Norte. A exposição ocorreu entre 9 de março e abril, período em que o indivíduo chegou a contribuir com o código. A Consensys, desenvolvedora da MetaMask, agiu para encerrar o acesso e interromper os lançamentos do projeto assim que a conexão foi identificada, levantando sérias preocupações sobre a segurança e a integridade da plataforma.
🤖 CEVIU DevOps
A ascensão do código gerado por IA está redefinindo o processo de revisão. Agora, o foco migra da sintaxe e da implementação para a validação de requisitos, aderência arquitetural, segurança e correção funcional. Avaliações eficazes exigem que se priorize a capacidade do código de resolver o problema correto, tratar casos de borda e garantir sua integração fluida ao sistema, em vez de assumir a infalibilidade ou fragilidade da saída da IA.
O AWS Lambda acaba de anunciar o suporte ao armazenamento de código auto-gerenciado diretamente no Amazon S3. Com essa novidade, funções e camadas poderão referenciar seus pacotes de implantação a partir de buckets S3 sob total controle do cliente, dispensando as cópias gerenciadas anteriormente pelo Lambda. Essa flexibilidade aprimora a gestão de recursos e oferece maior controle sobre os artefatos de deploy, otimizando fluxos de trabalho DevOps e permitindo estratégias mais robustas de versionamento e distribuição de código.

A OpenAI ressalta a necessidade de avaliar investimentos em IA sob a ótica do "trabalho útil por dólar", em vez de focar apenas no custo por token. A empresa destaca pilares essenciais como visibilidade total dos gastos, ROI baseado em resultados concretos, governança robusta, automação de fluxos de trabalho e planejamento de capacidade. Para implementar IA com segurança, as organizações devem monitorar o uso, selecionar modelos adequados para cada tarefa, gerenciar riscos, financiar soluções escaláveis e replicar sucessos comprovados.
O GitLab lança a versão 19.2, destacando a disponibilidade geral do GitLab Duo CLI e fluxos de IA personalizados, que prometem transformar a automação e a segurança no ciclo de vida do desenvolvimento de software. A atualização inclui políticas agendadas para execução de pipelines, o CI Expert Agent e tokens de acesso pessoal com granularidade aprimorada. Além disso, a plataforma ganha novas capacidades de segurança e revisão de código baseadas em IA, auto-remediação de dependências e um Security Review Flow, visando otimizar a produtividade em CI/CD, gerenciamento de vulnerabilidades e workflows de merge request.
A gestão de concorrência e consistência em bancos de dados é crucial para a confiabilidade de sistemas, e os níveis de isolamento são a chave para este equilíbrio. O Read Committed prioriza o alto throughput, permitindo que dados consultados se alterem entre leituras, o que pode introduzir anomalias. Já o Repeatable Read mitiga muitas inconsistências através de isolamento por snapshot, embora ainda não garanta a eliminação de cenários como o write skew. Para máxima integridade, o Serializable assegura que as transações ocorram como se fossem executadas sequencialmente, prevenindo ou detectando conflitos para manter a coerência dos dados.

O k8s-aibom, um controlador Kubernetes de código aberto, chega ao Google Kubernetes Engine (GKE) para revolucionar a gestão de "AI Bill of Materials" (BOMs). A ferramenta permite a detecção de cargas de trabalho de IA em tempo de execução, gerando ML-BOMs CycloneDX 1.6 de forma automatizada. Sem exigir acessos privilegiados, sidecars ou modificações de código, o k8s-aibom garante visibilidade em runtime, classificação de ativos por confiança, registros de auditoria imutáveis e conformidade, oferecendo uma solução robusta para o gerenciamento seguro da IA 'invisível' na infraestrutura.

A Databricks inovou ao apresentar um aplicativo de detecção de fraudes que analisa transações de cartão de crédito com uma impressionante latência mediana de 27 milissegundos. Essa agilidade é viabilizada pela otimização de rotas do Model Serving em conjunto com o Lakehouse Postgres para consultas de *features* em tempo real, alcançando tempos de resposta de banco de dados na ordem de um dígito, mesmo sob alta demanda. A solução, de código aberto (com *backend* FastAPI e *frontend* React), valida como arquiteturas *lakehouse* podem agora atender requisitos críticos de latência em *checkouts*, eliminando a necessidade de infraestruturas separadas. Os *benchmarks* detalhados apontam que as consultas de *features* levam apenas 7,8ms na mediana, com a inferência do modelo adicionando 18,1ms.

O Datadog acaba de lançar uma nova skill de Custo em Nuvem para o Bits Chat, seu assistente de IA. A ferramenta visa otimizar a gestão de FinOps e engenharia, permitindo que as equipes investiguem gastos com cloud, IA e SaaS através de consultas conversacionais. A funcionalidade é capaz de identificar anomalias de custo em provedores como OpenAI, Anthropic e Amazon Bedrock, correlacionando dados de faturamento diretamente com métricas de observability.
O Amazon EC2 agora oferece maior facilidade na gestão de Imagens de Máquina da Amazon (AMIs) ao exibir parâmetros associados do AWS Systems Manager (SSM) Parameter Store diretamente nos metadados de AMIs públicas. Essa funcionalidade simplifica significativamente a descoberta e o gerenciamento de configurações, permitindo que desenvolvedores e engenheiros de plataformas identifiquem rapidamente os parâmetros relevantes para suas AMIs, agilizando processos de automação e garantindo a consistência das configurações em ambientes de nuvem.

A Cloudflare agiu proativamente ao implementar, em 17 de julho, proteções via Web Application Firewall (WAF) contra duas vulnerabilidades críticas no WordPress. As falhas, que incluem uma execução remota de código (RCE) não autenticada e uma injeção de SQL, afetam as versões 6.8 e posteriores da plataforma. Esta medida destaca a importância de um WAF robusto na linha de frente da segurança de aplicações web, especialmente em um CMS tão amplamente utilizado.
📈 CEVIU Empreendedores

O vertiginoso aumento dos custos de IA, que em algumas empresas chega a dobrar a cada 45 dias, exige uma análise crítica dos CEOs. Enquanto na 8090 o aumento de produtividade gerado pela IA é estimado em modestos 5% a 10%, a conta de tokens cresce exponencialmente. Para evitar que essa disparidade impacte negativamente as margens, é crucial monitorar o custo e a produção da IA por tarefa, alocando modelos mais baratos para trabalhos rotineiros e reservando os mais robustos para demandas estratégicas. Além disso, a supervisão dos prompts e correções dos colaboradores é vital, pois essas interações fornecem dados valiosos aos provedores de modelos, revelando o cerne da tomada de decisão corporativa.

O cenário de fornecedores SaaS em julho de 2026, conforme dados da Ramp, destaca uma mudança estratégica no uso de IA pelas empresas. Casos de uso como bots de suporte e agentes de codificação impulsionam essa demanda. Notavelmente, observa-se um crescimento significativo na adoção de modelos chineses de IA de código aberto. Essa tendência sugere que as companhias estão buscando soluções que preencham lacunas ou ofereçam vantagens específicas não encontradas nas alternativas americanas, sinalizando uma diversificação crucial no mercado global de inteligência artificial e uma oportunidade para inovar.

O cenário de captação para startups passou por uma transformação notável. O que antes era um 'pré-seed' de US$1 milhão para buscar o product-market fit em 2014, hoje pode ser facilmente uma rodada de US$10 milhões. Essa mudança, muitas vezes estratégica, permite que as empresas reservem o rótulo de 'seed' para rodadas ainda maiores. Para empreendedores, é crucial ir além do nome da rodada. Questionar investidores sobre o real significado de 'cedo' ou 'tarde' e analisar métricas como tamanho, participação, avaliação e marcos esperados antes da próxima captação oferece uma clareza muito maior do que o simples rótulo, que já não reflete o capital inicial de uma empresa.
🤳 CEVIU Design
O Google Vids acaba de anunciar uma atualização significativa, permitindo que usuários criem avatares de IA personalizados a partir de uma simples selfie e gravação de voz. Integrados à conta Google e protegidos por uma marca d'água invisível do SynthID, esses avatares marcam um avanço na personalização de conteúdo. A novidade é impulsionada pela chegada do modelo Gemini Omni ao Vids, que agora possibilita a geração de vídeos completos a partir de prompts e imagens de referência, além de oferecer correções automáticas de fundo e iluminação, e edições sequenciais sem interrupção. Com essas funcionalidades, o Google Vids transcende sua função original de ferramenta de apresentação, posicionando-se como um forte player no mercado de criação de vídeos por IA, competindo diretamente com plataformas como HeyGen e Synthesia. Vale ressaltar que o acesso é restrito a usuários maiores de 18 anos em regiões específicas.

A OpenAI respondeu às críticas da comunidade de usuários e atualizou seu aplicativo ChatGPT para Mac, redesenhando a interface para facilitar o acesso ao histórico de conversas e a projetos específicos. A nova versão do app agora apresenta uma clara distinção entre as seções 'Chat' e 'Work', além de um menu lateral que permite alternar entre ChatGPT e Codex. Essa reformulação visa aprimorar a usabilidade, tornando a experiência de chat padrão mais intuitiva. No entanto, o aplicativo ainda utiliza o framework Electron e, para alguns, sua complexidade visual levanta questões sobre o equilíbrio entre a integração de novas ferramentas de IA e a manutenção de uma experiência de usuário mais refinada no ambiente Mac.

O Figma acaba de lançar uma atualização que promete transformar o workflow de designers e desenvolvedores. Agora, ao importar telas baseadas em código, o software não apenas replica o design, mas também vincula cores, fontes e espaçamento a variáveis existentes, ao invés de valores estáticos. Essa funcionalidade se estende a visualizações do Make, códigos gerados via servidor Figma MCP e até páginas web ativas capturadas pela extensão do Chrome. Além disso, os frames importados chegam com Auto Layout aplicado com mais frequência, permitindo que as equipes refinem e adaptem designs de forma ágil, sem a necessidade de reconstrução, otimizando a colaboração e a consistência visual.
📚 CEVIU Marketing

Contrariando o pessimismo, dados de 2025 revelam o surgimento de quase 400 livrarias independentes e um aumento nas vendas de livros impressos, superando a última década. Leitores dedicam mais tempo à leitura diária do que há vinte anos, desafiando a narrativa de que a leitura está em declínio. Enquanto a atenção digital fragmentada sugere um colapso, o consumo de palavras em formatos digitais nunca foi tão alto. A verdadeira mudança reside na intencionalidade: a leitura de formatos longos transforma-se em uma escolha consciente, elevando o padrão para criadores que buscam engajamento e atenção sustentada em suas estratégias de conteúdo.

Em um cenário digital cada vez mais saturado por conteúdo, marcas de peso como Dentsu, NFL México e Warner Bros. Discovery estão redefinindo suas estratégias. A aposta agora é menos na produção massiva e mais na criação de comunidades vibrantes. A lógica é clara: o senso de pertencimento e o 'fandom' constroem laços muito mais profundos e duradouros do que o alcance puro e simples. As audiências atuais anseiam por participação ativa, transformando criadores e comunidades de fãs em aliados estratégicos. Para as marcas, a grande oportunidade reside em cultivar espaços onde os interesses compartilhados transcendam o mero consumo de conteúdo, gerando engajamento autêntico e de alto valor.
Um estudo de caso recente revela uma surpreendente estratégia de otimização de conversão: a remoção de um CTA proeminente da página inicial elevou as taxas de conversão em impressionantes 39%. A chave foi redirecionar visitantes de primeira viagem para detalhes de serviço antes de um pedido de orçamento, evitando um formulário técnico que causava abandono precoce. A nova jornada prioriza informações sobre o serviço, credenciais e provas sociais antes de apresentar um CTA contextualizado, alinhando-o ao nível de compreensão do usuário e simplificando o próximo passo na jornada do cliente.
⏳ CEVIU Cripto

O cenário regulatório para stablecoins nos Estados Unidos enfrenta um período de incerteza após OCC, FDIC, NCUA e o Tesouro Americano não cumprirem o prazo de 18 de julho do GENIUS Act para emitir regulamentações finais. Propostas cruciais permanecem incompletas, com a regra conjunta de identificação de clientes aberta para comentários até 21 de agosto e a proposta de combate à lavagem de dinheiro do FDIC até 4 de agosto. Esse atraso, embora não afete a data de efetivação da lei em 18 de janeiro, comprime o tempo para que as emissoras de stablecoins se preparem, intensificando a pressão. Questões como a proposta da BlackRock para derrubar o limite de 20% em ativos de reserva tokenizados e a defesa da autoridade regulatória estadual por senadores, evidenciam a complexidade e os interesses em jogo.
A Visa inova no cenário financeiro ao lançar a Visa Stablecoin Platform, uma iniciativa que integra stablecoins aos seus sistemas de pagamento e tesouraria. Com alcance a 15.000 parceiros financeiros e mais de 200 milhões de comerciantes, a novidade permite transações com moedas digitais sem a necessidade de infraestrutura adicional. A plataforma estreia com suporte à Open USD (OUSD), stablecoin emitida pelo consórcio Open Standard – que inclui a própria Visa, Mastercard e American Express – além de Circle USDC e Paxos USDG. Essa iniciativa capitaliza sobre os US$ 15 trilhões anuais em pagamentos já processados pela Visa e bilhões em liquidações de stablecoins, consolidando essas operações em uma interface única que promete liquidação instantânea e registros imutáveis em blockchain. A estratégia posiciona a Visa na vanguarda da evolução dos pagamentos digitais, facilitando a adoção de ativos digitais no comércio global.
O Bank of America anuncia a nomeação estratégica de Sonali Theisen como chefe da plataforma global de ativos digitais. A executiva, que já lidera a negociação eletrônica em renda fixa, moedas e commodities, passará a supervisionar stablecoins, depósitos tokenizados, custódia e liquidação de negociações cripto. Em paralelo, Kevin Milsom assume a liderança da transformação de IA, com a missão de acelerar a adoção da inteligência artificial nas operações de mercados globais do banco. Essas movimentações evidenciam uma tendência crescente em Wall Street, onde instituições como Vanguard e Morgan Stanley também vêm formalizando posições de liderança em cripto e IA.
💳 CEVIU Fintech

Uma proposta de US$53 bilhões da Stripe e da Advent para adquirir o PayPal está em análise, prometendo consolidar a maior plataforma de pagamentos dos Estados Unidos. Contudo, essa fusão ambiciosa pode acarretar sérios desafios para a Stripe, como o aumento da dívida, complexidades na integração de sistemas e uma recuperação do investimento que se estenderia por vários anos, colocando em xeque a estabilidade e o foco da fintech no longo prazo.

A gigante do mercado financeiro Citadel Securities realizou um investimento estratégico de US$400 milhões na Crypto.com, elevando a avaliação da exchange para US$20 bilhões. Esta rodada marca o primeiro aporte institucional recebido pela Crypto.com, que direcionará o capital para aprimorar sua segurança e expandir a oferta de derivativos tokenizados. O movimento reforça a crescente atuação da Citadel no ecossistema de criptoativos, evidenciada por seus investimentos anteriores em plataformas como Kraken, Ripple e Canton, consolidando seu foco na infraestrutura de ativos digitais.
Mais de 40 líderes financeiros e de tecnologia uniram forças com a Linux Foundation para fundar a x402 Foundation. O objetivo é estabelecer um protocolo de código aberto que permitirá pagamentos fluírem nativamente na internet. Originalmente concebido pela Coinbase, o padrão x402 foi desenhado para facilitar transações por agentes de IA, APIs e aplicativos, com a mesma fluidez da troca de dados, suportando desde cartões de crédito a stablecoins. Sua adoção em larga escala promete transformar a infraestrutura do comércio digital, pavimentando o caminho para pagamentos automatizados e padronizados na web, essenciais na economia impulsionada pela IA.
💰 CEVIU TI

A Databricks, líder em plataformas de dados e IA, acaba de anunciar uma rodada de financiamento estratégico que catapulta seu valuation para impressionantes US$188 bilhões. Liderado pela Coatue, um investidor já consolidado na empresa, o capital será crucial para acelerar a ambiciosa estratégia de IA da Databricks. Os recursos serão direcionados para o desenvolvimento de projetos como Unity AI Gateway, Genie e Lakebase, além de futuras aquisições e aprofundamento em pesquisa e desenvolvimento de IA, fortalecendo sua posição no mercado de computação em nuvem e governança de dados.
A Anthropic, proeminente desenvolvedora em IA, está em avançadas negociações com a Meta para um acordo estratégico de computação que pode atingir US$ 10 bilhões ao longo de dois anos. Este movimento tático visa não apenas fortalecer a infraestrutura de IA da Anthropic, mas também posicionar a Meta como um player significativo no mercado de cloud comercial, marcando uma potencial expansão de suas capacidades e ofertas. Tal parceria sublinha a crescente demanda por recursos computacionais de alta performance no setor de IA e a busca por alianças que impulsionem a inovação e a competitividade.

A Ernst & Young (EY) confirmou um incidente de segurança que resultou no vazamento de dados de clientes. O ataque, que comprometeu uma plataforma de tickets de suporte de terceiros utilizada pela equipe de TI da EY, permitiu acesso não autorizado a documentos sensíveis contendo informações fiscais, pessoais e financeiras. A invasão ocorreu entre 28 de março e 12 de abril, sendo detectada pela EY apenas em 23 de abril, levantando preocupações sobre a governança de segurança em ambientes de nuvem e a vigilância contínua sobre serviços terceirizados.
⚡️ CEVIU Dados

O Apache Spark 4.2 acaba de ser lançado, apresentando uma série de melhorias que reforçam sua posição como ferramenta central no processamento de dados. Entre as novidades, destacam-se as "metric views" para a definição de métricas de negócio, a busca de similaridade via SQL vector e a introdução de tipos geoespaciais nativos. A versão também incorpora queries de Change Data Capture (CDC) através da nova cláusula CHANGES, otimizando a sincronização de dados. A facilidade de uso foi aprimorada com o Spark Connect e a execução padrão otimizada com Arrow para Python. Com mais de 1.900 commits de 260 contribuidores, o Spark 4.2 promete maior eficiência e flexibilidade para o ecossistema de dados.

O Apache DataFusion Comet eleva o desempenho de leitura do Spark em tabelas Iceberg, combinando o planejamento de queries em Java com a execução nativa Arrow via Iceberg Rust. Testes de benchmark TPC-DS de 3 TB demonstraram um salto significativo: 102 de 103 queries aceleradas e uma redução de aproximadamente 40% no tempo total de execução. Adicionalmente, a interoperabilidade com os pacotes de testes Spark do Iceberg Java foi crucial, impulsionando mais de 40 pull requests que aprimoraram o Iceberg Rust.

A Meta está aprimorando a otimização de seu funil de anúncios por meio de uma abordagem inovadora: a compressão de bilhões de usuários e entidades em clusters de interesses latentes. Estes são enriquecidos com conteúdo de anúncios processado por Large Language Models (LLMs), incorporando tudo em um espaço compartilhado para pontuar qualquer usuário ou entidade. Ao aprender com a estrutura ampla do grafo, e não apenas com eventos de conversão raros, a Meta obtém um sinal robusto para o funil profundo, alimentando modelos de ranking de anúncios como GEM e Andromeda. Essa estratégia promete maior precisão e relevância em suas campanhas.
No recente evento VB Transform 2026, empresas como LinkedIn, Walmart e Zendesk compartilharam suas abordagens inovadoras para superar os desafios da infraestrutura legada frente à velocidade dos agentes de IA. O LinkedIn destacou a importância de pré-provisionar containers e a transição de 80% da orquestração para código determinístico. Já o Walmart focou na governança de agentes internos duplicados, enquanto a Zendesk aprimorou seus pipelines de dados para processar um volume massivo de 20 bilhões de conversas. As lições aprendidas apontam para a necessidade de avaliações contínuas, controle sobre o 'agent harness' e a portabilidade das cargas de trabalho entre diferentes modelos.

Para agentes de IA empresariais, a busca por vetores e o Retrieval Augmented Generation (RAG) não são suficientes. Embora o RAG consiga identificar passagens relevantes, ele não garante a preservação de limites de origem, o significado de negócio, a propriedade ou as restrições de uso dos dados. A solução proposta foca na construção de um modelo de produto de dados governado, compilado em diversas representações, como grafos, wikis Markdown, pacotes OKF e sidecars compactos (TOON/GCF). Isso demonstra que a preparação para a IA não se resume a um catálogo, mas sim a um contexto conectado, confiável e a operações repetíveis, garantindo que a IA opere com dados estruturados e bem definidos.

O vindouro Postgres 19 trará uma importante otimização na gestão de armazenamento, substituindo a compressão padrão de objetos TOAST do algoritmo pglz para o LZ4. Esta mudança, que será integrada ao framework unificado de compressão, abrange não apenas o armazenamento em heap, mas também TOAST e índices B-tree. Tipos de dados de comprimento variável como TEXT, VARCHAR, BYTEA e JSONB, que superam o limite de aproximadamente 2 KB, serão automaticamente beneficiados. Testes preliminares apontam que o LZ4 oferece desempenho superior ao pglz, garantindo compressão mais eficiente e detecção rápida de dados incompressíveis, resultando em maior eficiência e menor latência para operações de banco de dados.

A Trellis introduz os "experience graphs" como uma inovadora arquitetura de dados para o armazenamento persistente de artefatos de agentes, recompensas, dados de busca e histórico causal. Acessíveis via SQL, grafos, vetores e consultas temporais, essa abordagem permite que agentes de IA se autoaprimorem de forma eficiente. Pesquisas da Meta demonstraram que a reutilização de experiências anteriores acelera o desempenho em até 10 vezes e reduz os custos de token em 52% para soluções bem-sucedidas. Contudo, um reuso excessivo de memória pode impactar negativamente a capacidade de exploração dos agentes.

A Netflix implementou uma plataforma unificada para operar seus serviços de LLMs internamente, evitando APIs externas. A arquitetura, baseada em JVM com gRPC e uma API HTTP compatível com OpenAI, padroniza a implantação via Model Scoring Service. Este serviço é suportado pelo Triton e utiliza o vLLM como motor principal, após rigorosos testes de benchmark. A solução ainda inclui empacotamento customizado, atualizações sem interrupção e decodificação guiada, com patches específicos para garantir a correta geração de saídas JSON, otimizando performance e controle da IA.
A Airbnb implementou uma estratégia inovadora para acelerar a avaliação de Grandes Modelos de Linguagem (LLMs), condensando ciclos que antes levavam semanas para menos de um dia. A metodologia se apoia no caching inteligente de referências e pontuações de julgadores, otimizando o processo ao identificar que mais da metade das saídas de modelos candidatos são strings idênticas, com uma variação mínima de 1% no desempenho do julgador. Para ajustes rápidos, adaptadores LoRA de baixo rank são treinados em menos de uma hora utilizando uma única GPU, permitindo correções no mesmo dia. O processo é finalizado com uma etapa de validação em tráfego amostrado, assegurando a identificação de possíveis falhas em tempo real.

A Databricks, empresa que se consolidou no mercado de dados, está prestes a levantar US$3 bilhões, o que catapultaria seu valor de mercado para a impressionante cifra de US$188 bilhões. Este movimento estratégico reflete a bem-sucedida transição da companhia de uma plataforma de dados robusta para um dos principais fornecedores de soluções de IA para o setor corporativo, consolidando sua posição no cenário tecnológico global.
Aquisição da Dremio pela SAP levanta questões sobre o futuro do modelo 'Lakehouse-only' na era da IA
A recente aquisição da Dremio pela SAP sinaliza um desafio crescente para plataformas de dados que operam exclusivamente com o modelo lakehouse. A integração, em vez da substituição, da tecnologia da Dremio no SAP Datasphere sugere que as demandas da IA – que incluem amplo alcance de dados, frescor em tempo real e capacidade de consultas imprevisíveis – podem superar a capacidade de arquiteturas puramente lakehouse. Isso indica uma tendência em direção a abordagens mais híbridas e integradas para atender às necessidades complexas da análise e do aprendizado de máquina impulsionados pela IA.
Receba as melhores notícias de tech
Conteúdo curado diariamente, direto no seu e-mail.
