O chip Thus de IA personalizado da Anker é projetado para dispositivos de áudio com IA local, processando diretamente onde o modelo reside para aumentar a eficiência.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
16837 notícias encontradas
A Nvidia apoiou a rodada de financiamento de US$ 1 bilhão da Vast Data, avaliando a empresa de infraestrutura focada em IA em US$ 30 bilhões.
A IA está aprimorando os fluxos de trabalho de engenharia ao assumir a execução, permitindo que os humanos se concentrem no planejamento, revisão e garantia da qualidade do resultado. Enquanto a IA executa, os humanos se destacam na diagnóstico de problemas sob múltiplos ângulos, uma capacidade que ainda representa um desafio para a IA. No futuro, as estratégias organizacionais de IA provavelmente envolverão assistentes personalizados para os funcionários ou um super-agente singular com plugins departamentais.
Agentes podem se conectar a sistemas externos por meio de chamadas diretas de API, CLIs e MCP. Esta publicação examina onde cada um se encaixa e os padrões para construir essas integrações de forma eficaz. MCP se torna a camada de composição crítica à medida que agentes de produção migram para a nuvem. Cada integração construída sobre MCP fortalece o ecossistema.
A Gemini Enterprise Agent Platform é uma plataforma abrangente para construir, escalar, governar e otimizar agentes. Ela reúne capacidades de seleção de modelos, construção de modelos e construção de agentes, juntamente com novas funcionalidades para integração de agentes, DevOps, orquestração e segurança. A Agent Platform é um destino único para equipes técnicas desenvolverem agentes que podem transformar produtos, serviços e operações. Os agentes podem ser entregues aos funcionários através do aplicativo Gemini Enterprise.
A maioria do conteúdo inserido em arquivos AGENTS.md não ajuda ou, na verdade, prejudica. Os padrões eficazes são específicos e podem ser aprendidos. Este artigo analisa quais padrões funcionam, quais falham e como identificar a diferença para sua codebase. Padrões distintos afetam métricas diferentes, portanto, escolha aqueles que visam resolver o problema que você realmente enfrenta.
Workloads agentic estão redefinindo os benchmarks para motores de inference, exigindo cenários de múltiplas interações e uso de ferramentas. Tais cenários impõem desafios ao gerenciamento e ao escalonamento do KV cache devido a traces mais longos e a distribuições variadas de tokens. A Applied Compute introduziu três perfis de workload para auxiliar na otimização da performance de motores e aceleradores. A empresa lançou uma ferramenta de benchmarking open-source para replicar essas situações, destacando a necessidade de soluções como o offloading de KV cache e o roteamento sensível ao workload para aprimorar o throughput e a eficiência.
O teste não anunciado da OpenAI do GPT Image 2 na LM Arena demonstra seus avanços na geração de imagens por IA. Este desenvolvimento indica um salto significativo nas capacidades de criação visual, prometendo impactar o cenário atual do mercado de IA para imagens.
A personalização nas respostas dos LLM introduz variação, mas frequentemente mantém um núcleo semântico estável entre as diferentes respostas. Essa base compartilhada resulta de priors de modelo comuns, recuperações sobrepostas e restrições de produto, com as diferenças surgindo em exemplos e ênfase. Compreender esse comportamento permite que as empresas otimizem sua presença em conteúdo gerado por IA, focando em fazer parte do conhecimento central do modelo.
A Core Automation é um laboratório de IA fundado por Jerry Tworek, ex-pesquisador da OpenAI, com o objetivo de construir o laboratório de IA mais automatizado do mundo. A iniciativa começará automatizando sua própria pesquisa antes de desenvolver novos algoritmos que transcendem o pre-training e o reinforcement learning. O laboratório também se dedicará à criação de arquiteturas projetadas para escalar de forma mais eficiente do que os transformers. A equipe é composta por especialistas em frontier models, otimização e engenharia de sistemas.
Google lançou o Workspace Intelligence, aprimorando o Google Workspace com uma camada semântica para integrar e-mails, chats, arquivos e projetos para agentes movidos por Gemini. Esta atualização inclui grandes aprimoramentos de produto, como a construção de planilhas em linguagem natural no Sheets e recursos orientados por IA no Docs, Slides, Gmail e Drive. O Workspace Intelligence visa tornar o Workspace uma camada de controle centralizada para operações de negócios, enfatizando segurança, integração de contexto e funcionalidade entre aplicativos.
A Perplexity desenvolveu um pipeline de dois estágios para modelos de linguagem aumentados por busca. Esse pipeline emprega um Supervised Fine-Tuning (SFT) inicial, seguido por Reinforcement Learning (RL), com o objetivo de otimizar a precisão factual, a preferência do usuário e a eficiência no uso de ferramentas. Essa abordagem, que começou a ser aplicada com os modelos Qwen3, separa a conformidade da melhoria na busca, visando alcançar maior precisão sem comprometer os guardrails. Os modelos demonstraram maior acurácia em benchmarks como FRAMES e FACTS OPEN, além de um custo por consulta reduzido e uma eficiência aprimorada no uso de ferramentas em comparação com modelos existentes como o GPT-5.4.
A OpenAI introduziu agentes de workspace no ChatGPT, permitindo que equipes criem agentes de IA compartilhados para tarefas e fluxos de trabalho complexos. Esses agentes, potencializados por Codex, executam tarefas como gerar relatórios, escrever código e gerenciar comunicação, enquanto se integram a diversas ferramentas como o Slack. Os agentes de workspace estão atualmente disponíveis em prévia de pesquisa para planos selecionados do ChatGPT, com o objetivo de otimizar a colaboração e melhorar a produtividade.
O Qwen3.6-27B entrega performance de codificação agentic de nível flagship. A equipe Qwen afirma que ele supera o flagship da geração anterior, Qwen3.5-397B-A17B, em todos os principais benchmarks de codificação. O modelo possui 55.6 GB no Hugging Face, com versões quantizadas ainda menores disponíveis. Testes indicam que o modelo apresenta resultados excelentes, mesmo quando quantizado.
Uma anedota do segundo trimestre de 2026, de um candidato a emprego no setor de cripto, descreve ventos contrários no mercado de contratação, como demissões em nível de equipe, saídas de executivos C-suite no meio do processo e congelamento de contratações desencadeados por uma onda de hacks de protocolo que drenam fundos das empresas.
A Arkham integrou negociação descentralizada na Solana à sua plataforma de inteligência onchain, permitindo que os usuários monitorem tokens recém-lançados e carteiras de traders de destaque em tempo real, além de executar negociações diretamente da mesma interface.
O Conselho Consultivo Independente de Computação Quântica e Blockchain da Coinbase identificou duas vulnerabilidades estruturais em cadeias Proof-of-Stake (PoS): os esquemas de assinatura de validadores (BLS do Ethereum e Ed25519 da Solana) que garantem o consenso, e as assinaturas de carteira on-chain. O conselho alertou que os próprios mecanismos de consenso podem exigir uma reengenharia, em vez de simples atualizações de carteira. Desenvolvedores do Ethereum, liderados por Vitalik Buterin, propuseram substituir as assinaturas BLS de validadores, os compromissos KZG e as assinaturas ECDSA de carteiras por alternativas pós-quânticas. No entanto, o conselho projeta um cronograma de vários anos para a migração de carteiras, exchanges, custodiantes e redes descentralizadas.
A Ripple publicou um roadmap de quatro fases para tornar o XRP Ledger resistente a ataques quânticos até 2028, com testes de criptografia pós-quântica híbrida começando no primeiro semestre de 2026 e um protocolo de emergência "Quantum-Day" incluído para migração acelerada caso as ameaças se materializem antes dessa meta. Este roadmap surge em resposta a uma pesquisa da Google Quantum IA, que demonstrou que aproximadamente 500.000 qubits físicos poderiam derivar uma chave privada a partir de uma chave pública exposta em cerca de 9 minutos. Essa melhoria de 20 vezes em relação às estimativas anteriores representa um nível de ameaça que coloca aproximadamente 6.9M BTC com chaves públicas expostas em risco teórico. A rotação nativa de chaves do XRPL oferece aos usuários a capacidade de migrar contas sem abandoná-las, uma vantagem estrutural sobre o Ethereum, onde a migração pós-quântica exige a transferência manual de ativos.
Atacantes drenaram 116.500 rsETH, avaliados em US$ 292 milhões, da bridge LayerZero da Kelp DAO, expondo a Aave a US$ 230 milhões em potencial dívida incobrável. O incidente, ligado a hackers norte-coreanos, evidencia vulnerabilidades estruturais na infraestrutura cross-chain, enquanto a Arbitrum conseguiu congelar US$ 71 milhões dos ativos roubados para mitigar perdas adicionais.
Base Azul, a primeira atualização de rede independente da Base, tem como alvo a ativação na mainnet em 13 de maio. Sua principal característica é um sistema multiproof que combina provers TEE e ZK, onde qualquer um pode finalizar propostas de forma independente e o acordo duplo comprime os tempos de retirada para um dia.Melhorias de desempenho incluem a consolidação para um único cliente de execução, que reduziu os blocos vazios em aproximadamente 99%, e sustentou múltiplos picos de 5.000 TPS. Uma competição de auditoria Immunefi de $250.000 está em andamento até 4 de maio, com futuras atualizações planejadas para um padrão de token consagrado e account abstraction nativa até o final de agosto.
