CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

16994 notícias encontradas

O resumo da AWS de 20 de abril destacou a disponibilidade do Claude Opus 4.7 no Amazon Bedrock e o lançamento do AWS Interconnect para general availability. O panorama geral indica que os hyperscalers continuam a integrar frontier models com infraestrutura mais preparada para o ambiente corporativo, resultando na entrega conjunta de acesso a modelos e do tooling necessário para seu deployment.

A mudança da Broadcom para o licenciamento por assinatura e os próximos ciclos de renovação estão forçando as empresas a reavaliar sua estratégia VMware, em meio a custos crescentes e flexibilidade reduzida. Essa situação transforma a virtualização em um ponto de decisão estratégica, exigindo que as organizações avaliem se devem permanecer com a solução atual, renegociar contratos ou considerar alternativas como hyperscalers ou Nutanix, antes de se comprometerem com gastos de longo prazo.

A construção de sistemas baseados em agentes eficazes exige mais do que apenas LLMs. O sucesso depende de uma engenharia de contexto robusta, fluxos de trabalho modulares e uma separação clara entre a lógica determinística e as decisões impulsionadas por agentes. As arquiteturas mais confiáveis combinam processos estruturados com agentes embarcados, enfatizando a qualidade dos dados, a observability e os guardrails, em vez de designs totalmente autônomos.

Servidores de Model Context Protocol carecem de segurança nativa, espelhando as vulnerabilidades iniciais das APIs. Com 83% das organizações adotando IA baseada em agentes, mas apenas 29% preparadas, riscos como tool poisoning e escalonamento de privilégios estão aumentando. É crucial implementar autenticação rigorosa, sandboxing e tool definition pinning para proteger a infraestrutura contra ameaças autônomas orientadas por IA.

Agentes de IA com acesso de escrita a diretórios .git podem executar código arbitrário através da configuração do git, como diff drivers ou smudge filters. Desenvolvedores podem mitigar este risco montando o diretório .git como somente leitura dentro de contêineres, o que impede que os agentes modifiquem as configurações do git no host enquanto mantêm o acesso ao repositório.

A Cohere lançou um modelo speech-to-text open-source de 2 bilhões de parâmetros, projetado para ambientes corporativos. O modelo prioriza a precisão em condições reais e baixa latência, e atualmente lidera os rankings da Hugging Face. Seu objetivo é aprimorar a transcrição em ambientes ruidosos e com múltiplos oradores, com planos futuros de integração direta à plataforma de IA corporativa North da Cohere.

O Google está implementando o “Connect Room” para todos os clientes Workspace, permitindo que os usuários iniciem ou participem de reuniões em hardware Meet diretamente de seus notebooks usando detecção de proximidade, eliminando a necessidade de códigos de reunião. Essa funcionalidade otimiza o uso das salas, incluindo o agendamento automático de salas vazias, e impulsiona o Meet em direção a uma colaboração mais fluida e independente de dispositivo em escritórios físicos.

A startup de IA de Jeff Bezos, que busca desenvolver modelos com capacidade de compreender o mundo físico, está perto de finalizar uma rodada de financiamento de US$ 10 bilhões. A empresa, com nome-código Project Prometheus, utilizará a IA para acelerar a engenharia e a manufatura em setores como o aeroespacial e o automotivo. Ela foi estabelecida com um financiamento inicial de US$ 6,2 bilhões, parcialmente provido pelo próprio Bezos. A nova rodada de financiamento, que deve ser concluída em breve, mas ainda não foi finalizada, incluirá JPMorgan e BlackRock como investidores.

O Gemini CLI do Google agora inclui subagentes para dividir tarefas de codificação, aprimorando a execução paralela ao delegar funções específicas, como atualizações de frontend ou testes. Isso permite que múltiplas tarefas sejam processadas simultaneamente sem interferência, otimizando os workflows para desenvolvedores. A configuração do Gemini se diferencia de sistemas como o Claude Code, que estende a coordenação de agentes por múltiplas sessões.

Mesmo modelos que se declaram 'não censurados' redirecionam discretamente a linguagem, desviando-a das palavras que as frases realmente intencionam. Não há recusa ou aviso explícito; a probabilidade de certas palavras é simplesmente alterada em algumas instâncias. Este mecanismo pode ser utilizado para moldar o que bilhões de usuários leem, sem que eles percebam.

A Microsoft planeja suspender temporariamente os novos registros de contas individuais no GitHub Copilot. O custo semanal de operação do serviço dobrou desde o início do ano. A Microsoft pretende apertar os limites de taxa para contas individuais e empresariais, além de remover o acesso a determinados modelos para assinaturas mais baratas.

Chronicle, disponível para usuários do ChatGPT Pro no macOS, aprimora o Codex ao utilizar o contexto da tela para construir memória. Isso permite que o Codex compreenda o trabalho em andamento com menos necessidade de reafirmação de contexto. A ferramenta armazena memórias em markdown não criptografadas diretamente no dispositivo e exige permissões de Gravação de Tela e Acessibilidade do macOS. É crucial estar ciente dos riscos de prompt injection advindos do conteúdo da tela, sendo recomendado pausar o Chronicle durante trabalhos sensíveis para evitar a captura indesejada de contexto.

Os EUA estão no processo de uma expansão sem precedentes da infraestrutura de IA. O Stargate é um empreendimento de US$ 500 bilhões que envolve a OpenAI, Oracle e SoftBank. O projeto de infraestrutura de IA possui sete locais nos EUA que atualmente apresentam desenvolvimento ativo. Eles somam atualmente mais de 9 gigawatts de capacidade planejada, o suficiente para alimentar o equivalente a 20 milhões de GPUs Nvidia H100 – a quantidade total de compute de IA no mundo ao final de 2025. Esta publicação analisa cada um dos locais e como estão sendo desenvolvidos atualmente.

O Kimi K2.6, da Moonshot AI, foi lançado no Kimi Chat e via APIs, oferecendo capacidades robustas para tarefas de codificação e agentic nos modos de chat e agente em kimi.com, com seus pesos disponíveis no Hugging Face. A linha inclui o K2.6 Instant para respostas rápidas, o K2.6 Thinking para raciocínio complexo, o K2.6 Agent para tarefas de documentos e web, e o K2.6 Agent Swarm para processamento em larga escala. A Moonshot AI afirma que o Kimi K2.6 alcança as maiores pontuações em benchmarks de código aberto, superando concorrentes como GPT-5.4 e Claude Opus 4.6 em testes como SWE-bench Multilingual e BrowseComp.