O foguete Vikram-1 da Skyroot Aerospace, marcando a estreia de um lançador de satélites 100% comercial da Índia, atingiu com sucesso uma órbita a 450 km de altitude. O lançamento, realizado no sábado a partir de uma ilha no Golfo de Bengala, enfrentou um atraso de mais de 30 minutos devido a uma questão técnica de última hora, mas foi aclamado como um êxito. Este feito posiciona o Vikram-1 como o primeiro foguete orbital privado indiano a alcançar a órbita em sua tentativa inicial, e um segundo voo já está agendado para o final do ano, consolidando a crescente capacidade espacial do país.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
14478 notícias encontradas
O cenário atual das "guerras de LLM" levanta questionamentos sobre a possível repetição de um padrão histórico já observado nas "guerras de bancos de dados". Analisando o passado, é provável que os grandes vencedores da corrida da IA generativa não sejam os mesmos que hoje polarizam os debates. A discussão sugere que o futuro da dominância tecnológica pode divergir drasticamente das expectativas contemporâneas, com a verdadeira inovação surgindo de frentes inesperadas.
Apesar do salto de inteligência e capacidade demonstrado pelos chatbots de IA, seu impacto no uso prático diário ainda não atingiu o ápice esperado. A geração de ideias, antes um gargalo, mostra-se superada, mas a materialização dessas ideias em soluções funcionais e sustentáveis continua a ser o maior desafio, limitando a velocidade de implementação e a escalabilidade no mundo real.
A SpaceX está em discussões avançadas para fornecer um robusto poder computacional ao Departamento de Defesa dos EUA. Este potencial contrato, estimado em bilhões de dólares, visa aprimorar significativamente as capacidades de IA militar do Pentágono. Contudo, essa aproximação acende um alerta entre autoridades de segurança nacional, que veem com preocupação a crescente dependência tecnológica do órgão em relação a provedores individuais, especialmente os ligados a Elon Musk. Paralelamente, o Pentágono busca um investimento de US$ 30 bilhões para garantir acesso a chips de IA de última geração, enquanto articula estratégias para diversificar seus fornecedores e evitar a concentração de poder tecnológico.
A nova onda de empresas impulsionadas por IA está redesenhando fundamentalmente o ambiente de trabalho, operando com quadros de funcionários reduzidos e uma proporção significativamente maior de engenheiros. Essas organizações adotam um modelo horizontal, onde a figura do 'player-coach' substitui a supervisão tradicional, eliminando camadas hierárquicas. Tal abordagem funciona como um laboratório vivo para as estratégias que grandes corporações buscam implementar através de reestruturações, cortes de pessoal e investimentos massivos em IA, sinalizando uma transformação profunda no futuro corporativo.

A Trellis introduz os "experience graphs" como uma inovadora arquitetura de dados para o armazenamento persistente de artefatos de agentes, recompensas, dados de busca e histórico causal. Acessíveis via SQL, grafos, vetores e consultas temporais, essa abordagem permite que agentes de IA se autoaprimorem de forma eficiente. Pesquisas da Meta demonstraram que a reutilização de experiências anteriores acelera o desempenho em até 10 vezes e reduz os custos de token em 52% para soluções bem-sucedidas. Contudo, um reuso excessivo de memória pode impactar negativamente a capacidade de exploração dos agentes.

O Apache DataFusion Comet eleva o desempenho de leitura do Spark em tabelas Iceberg, combinando o planejamento de queries em Java com a execução nativa Arrow via Iceberg Rust. Testes de benchmark TPC-DS de 3 TB demonstraram um salto significativo: 102 de 103 queries aceleradas e uma redução de aproximadamente 40% no tempo total de execução. Adicionalmente, a interoperabilidade com os pacotes de testes Spark do Iceberg Java foi crucial, impulsionando mais de 40 pull requests que aprimoraram o Iceberg Rust.
A Airbnb implementou uma estratégia inovadora para acelerar a avaliação de Grandes Modelos de Linguagem (LLMs), condensando ciclos que antes levavam semanas para menos de um dia. A metodologia se apoia no caching inteligente de referências e pontuações de julgadores, otimizando o processo ao identificar que mais da metade das saídas de modelos candidatos são strings idênticas, com uma variação mínima de 1% no desempenho do julgador. Para ajustes rápidos, adaptadores LoRA de baixo rank são treinados em menos de uma hora utilizando uma única GPU, permitindo correções no mesmo dia. O processo é finalizado com uma etapa de validação em tráfego amostrado, assegurando a identificação de possíveis falhas em tempo real.

O vindouro Postgres 19 trará uma importante otimização na gestão de armazenamento, substituindo a compressão padrão de objetos TOAST do algoritmo pglz para o LZ4. Esta mudança, que será integrada ao framework unificado de compressão, abrange não apenas o armazenamento em heap, mas também TOAST e índices B-tree. Tipos de dados de comprimento variável como TEXT, VARCHAR, BYTEA e JSONB, que superam o limite de aproximadamente 2 KB, serão automaticamente beneficiados. Testes preliminares apontam que o LZ4 oferece desempenho superior ao pglz, garantindo compressão mais eficiente e detecção rápida de dados incompressíveis, resultando em maior eficiência e menor latência para operações de banco de dados.

Para agentes de IA empresariais, a busca por vetores e o Retrieval Augmented Generation (RAG) não são suficientes. Embora o RAG consiga identificar passagens relevantes, ele não garante a preservação de limites de origem, o significado de negócio, a propriedade ou as restrições de uso dos dados. A solução proposta foca na construção de um modelo de produto de dados governado, compilado em diversas representações, como grafos, wikis Markdown, pacotes OKF e sidecars compactos (TOON/GCF). Isso demonstra que a preparação para a IA não se resume a um catálogo, mas sim a um contexto conectado, confiável e a operações repetíveis, garantindo que a IA opere com dados estruturados e bem definidos.

O Apache Spark 4.2 acaba de ser lançado, apresentando uma série de melhorias que reforçam sua posição como ferramenta central no processamento de dados. Entre as novidades, destacam-se as "metric views" para a definição de métricas de negócio, a busca de similaridade via SQL vector e a introdução de tipos geoespaciais nativos. A versão também incorpora queries de Change Data Capture (CDC) através da nova cláusula CHANGES, otimizando a sincronização de dados. A facilidade de uso foi aprimorada com o Spark Connect e a execução padrão otimizada com Arrow para Python. Com mais de 1.900 commits de 260 contribuidores, o Spark 4.2 promete maior eficiência e flexibilidade para o ecossistema de dados.

A Netflix implementou uma plataforma unificada para operar seus serviços de LLMs internamente, evitando APIs externas. A arquitetura, baseada em JVM com gRPC e uma API HTTP compatível com OpenAI, padroniza a implantação via Model Scoring Service. Este serviço é suportado pelo Triton e utiliza o vLLM como motor principal, após rigorosos testes de benchmark. A solução ainda inclui empacotamento customizado, atualizações sem interrupção e decodificação guiada, com patches específicos para garantir a correta geração de saídas JSON, otimizando performance e controle da IA.
No recente evento VB Transform 2026, empresas como LinkedIn, Walmart e Zendesk compartilharam suas abordagens inovadoras para superar os desafios da infraestrutura legada frente à velocidade dos agentes de IA. O LinkedIn destacou a importância de pré-provisionar containers e a transição de 80% da orquestração para código determinístico. Já o Walmart focou na governança de agentes internos duplicados, enquanto a Zendesk aprimorou seus pipelines de dados para processar um volume massivo de 20 bilhões de conversas. As lições aprendidas apontam para a necessidade de avaliações contínuas, controle sobre o 'agent harness' e a portabilidade das cargas de trabalho entre diferentes modelos.

A Meta está aprimorando a otimização de seu funil de anúncios por meio de uma abordagem inovadora: a compressão de bilhões de usuários e entidades em clusters de interesses latentes. Estes são enriquecidos com conteúdo de anúncios processado por Large Language Models (LLMs), incorporando tudo em um espaço compartilhado para pontuar qualquer usuário ou entidade. Ao aprender com a estrutura ampla do grafo, e não apenas com eventos de conversão raros, a Meta obtém um sinal robusto para o funil profundo, alimentando modelos de ranking de anúncios como GEM e Andromeda. Essa estratégia promete maior precisão e relevância em suas campanhas.

A Databricks, empresa que se consolidou no mercado de dados, está prestes a levantar US$3 bilhões, o que catapultaria seu valor de mercado para a impressionante cifra de US$188 bilhões. Este movimento estratégico reflete a bem-sucedida transição da companhia de uma plataforma de dados robusta para um dos principais fornecedores de soluções de IA para o setor corporativo, consolidando sua posição no cenário tecnológico global.
Aquisição da Dremio pela SAP levanta questões sobre o futuro do modelo 'Lakehouse-only' na era da IA
A recente aquisição da Dremio pela SAP sinaliza um desafio crescente para plataformas de dados que operam exclusivamente com o modelo lakehouse. A integração, em vez da substituição, da tecnologia da Dremio no SAP Datasphere sugere que as demandas da IA – que incluem amplo alcance de dados, frescor em tempo real e capacidade de consultas imprevisíveis – podem superar a capacidade de arquiteturas puramente lakehouse. Isso indica uma tendência em direção a abordagens mais híbridas e integradas para atender às necessidades complexas da análise e do aprendizado de máquina impulsionados pela IA.

No cenário dinâmico da Inteligência Artificial, o roteamento de modelos emerge como um pilar fundamental, impulsionado pela necessidade de mitigar os custos elevados associados aos modelos de ponta. A abordagem mais eficaz revela-se ser o roteamento altamente específico para cada tarefa. Ao focar em um fluxo de trabalho único e bem definido, as empresas podem maximizar a precisão e reduzir significativamente os gastos. O desafio reside em identificar o modelo ideal que satisfaça os requisitos técnicos e financeiros de cada aplicação, equilibrando custo e latência.

A Moonshot, em um movimento significativo no cenário da IA, anunciou o lançamento do Kimi K3, um modelo multimodal impressionante. Contando com 2.8 trilhões de parâmetros, este modelo se destaca por sua vasta janela de contexto de 1 milhão de tokens, prometendo revolucionar a forma como a IA processa e compreende informações. O K3 foi meticulosamente otimizado para uma decodificação ágil em contextos extensos e para uma eficiente codificação agentic, aprimorando suas capacidades operacionais. O acesso ao modelo já está disponível via produtos e API da Kimi, com a expectativa de que seus pesos abertos sejam liberados em 27 de julho, fomentando a inovação colaborativa.

A Anthropic tem implementado um método inovador de seis etapas, utilizando o Claude Code para otimizar migrações complexas de código. A abordagem envolve a criação de um 'rulebook' detalhado, análise minuciosa de dependências e testes de estresse rigorosos para as regras de tradução. O processo é aprimorado pelo uso de múltiplos agentes de IA que, de forma iterativa, traduzem, revisam e corrigem o código, empregando revisores adversariais e verificação mecânica, garantindo uma migração eficiente e robusta em grande escala.

As ações da Alphabet, controladora do Google, registraram uma queda de 4% nesta quarta-feira, após a circulação de notícias indicando que o lançamento do aguardado modelo de IA Gemini 3.5 Pro teria sido adiado. A decisão, segundo os relatos, visa otimizar o desempenho da ferramenta, com foco especial em suas capacidades de codificação. O Google, por sua vez, reforça que o Gemini 3.5 Pro segue em fase de testes rigorosos com parceiros, ao lado de uma versão aprimorada do modelo Flash e outras inovações no campo da IA, sinalizando um processo de desenvolvimento contínuo e estratégico para seus avanços em inteligência artificial.
