As recentes questões de segurança do OpenClaw ressaltam um problema maior nos ecossistemas de agentes, que surgem como novas superfícies de ataque. Nesses contextos, skills maliciosas podem explorar combinações entre agentes, tools e marketplaces. As salvaguardas atuais, como prompts, são inadequadas para conter essas ameaças. Para gerenciar os riscos, os agentes precisam de sandboxing, credenciais com escopo bem definido, tools restritas e um logging apropriado. ️

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2347 notícias
Um exemplo de como um agente pode ser utilizado para editar partes de um software, de forma semelhante a uma wiki .
O crescimento exponencial da IA é impulsionado pela superação de diversos gargalos, e a LPU da Groq representa o próximo avanço.
Agentes de IA conseguem lidar com tarefas de complexidade crescente. Contudo, para alcançar metas mais ambiciosas, é essencial que consigam decompor problemas de forma significativa em subcomponentes gerenciáveis e delegar sua conclusão com segurança a outros agentes de IA e humanos . Este estudo propõe uma estrutura adaptativa para a delegação inteligente de IA. A estrutura apresentada é aplicável a delegadores e delegados, tanto humanos quanto de IA, em redes de delegação complexas .
Embora os CEOs da OpenAI e da Anthropic afirmem que a IA em nível humano está muito próxima, os modelos Transformer possuem limitações fundamentais. Apesar de serem muito poderosos e terem nos ensinado bastante sobre o que é a inteligência geral, superar esses problemas exigirá pesquisas que podem levar décadas. Os avanços que tornaram os GPTs modernos possíveis foram descobertos gradualmente ao longo de várias décadas, e cada descoberta trouxe consigo novas questões, mais complexas e nuançadas.
A OpenAI introduziu um Modo Lockdown opcional para workflows de maior risco, visando aprimorar a segurança de sistemas. Além disso, a empresa adicionou rótulos de “Risco Elevado” para identificar capacidades no ChatGPT, ChatGPT Atlas e Codex que podem aumentar a exposição a ataques de prompt injection, oferecendo maior visibilidade sobre potenciais vulnerabilidades. ️
Anthropic e OpenAI revelaram novos "modos rápidos" para inference de LLM, oferecendo aprimoramentos de desempenho distintos. A OpenAI alcança velocidades de mais de 1.000 tokens por segundo usando chips Cerebras, mas isso se baseia em um modelo menos capaz. Por outro lado, o modo rápido da Anthropic suporta modelos reais com até 2.5x mais velocidade, através de inference com low-batch-size. ️ Apesar do feito técnico da OpenAI, a utilidade de uma inference mais rápida, porém menos capaz, permanece em debate, com foco maior na exploração do potencial dos chips Cerebras pela OpenAI.
A Manus IA lançou um Agente 24/7 via Telegram, mas enfrentou suspensão imediata e sem explicação.
O criador do OpenClaw integrará a equipe da OpenAI com o objetivo de desenvolver agentes acessíveis e garantir que o OpenClaw permaneça aberto e independente dentro de uma nova fundação. O suporte da OpenAI oferecerá acesso a modelos e recursos de ponta, alinhando-se à visão do criador de tornar essas ferramentas amplamente utilizáveis. A comunidade do OpenClaw se beneficiará de uma estrutura de apoio que estimula a inovação e a propriedade dos dados.
O Grok Build da xAI planeja introduzir os recursos Parallel Agents e Arena Mode, expandindo suas capacidades de um assistente de codificação para uma IDE completa. ️ O Parallel Agents permitirá que até oito agentes de codificação trabalhem simultaneamente, enquanto o Arena Mode facilitará a competição entre agentes para determinar o melhor resultado. A atualização também trará uma nova UI que se assemelha a uma IDE baseada em navegador, suporte a ditado e uma integração não funcional com GitHub. O Grok 4.20 é esperado em breve.
PersonaPlex é um modelo conversacional de fala para fala em tempo real que realiza simultaneamente a compreensão e a geração de fala por streaming. Ele opera com áudio contínuo e é capaz de prever tokens de texto e tokens de áudio de forma auto-regressiva para produzir suas respostas faladas. O design do PersonaPlex permite que o modelo atualize seu estado interno com base na fala contínua dos usuários, enquanto ainda gera áudio de saída fluente, suportando assim conversas altamente interativas. O modelo está pronto para uso comercial. ️
Para que os 'Quartos Chineses' e seus operadores funcionem de forma eficaz, eles precisarão se assemelhar muito a um cérebro.
A IA não está eliminando a expertise; ela está mudando o gargalo da produção para a avaliação. Qualquer um pode agora gerar resultados "aceitáveis" rapidamente, mas o verdadeiro julgamento, o reconhecimento de padrões e o conhecimento de domínio continuam sendo escassos. Profissionais que combinam expertise aprofundada com fluência em IA multiplicam seu impacto, enquanto aqueles que dependem apenas de prompting ou ignoram a IA ficam para trás.
O Cursor expandiu o acesso à sua prévia de pesquisa de agentes de longa duração para usuários Ultra, Teams e Enterprise. O custom harness permitiu que os agentes completassem tarefas de codificação mais longas e complexas, gerando pull requests maiores com taxas de merge comparáveis às de outros agentes.
Mooncake adiciona uma camada vital de virtualização de memória ao stack de IA de código aberto.
O Seedance 2.0 é um modelo multimodal de geração de vídeo por IA que processa simultaneamente imagens, vídeos, áudio e texto para criar vídeos curtos com efeitos sonoros. Este avanço demonstra uma capacidade notável na síntese de conteúdo multimídia, abrindo novas possibilidades para a criação de vídeos automatizada e dinâmica.
A Simile arrecadou US$ 100 milhões para desenvolver ferramentas de IA focadas na previsão do comportamento humano, incluindo preferências de produtos de consumo.
A MiniMax lançou duas novas variantes de seu modelo de linguagem M2.5. Embora seja supostamente open source, os pesos e o código ainda não foram publicados, e a empresa também não indicou o tipo exato de licença ou seus termos. Estes modelos reduzem o custo de inference em até 95%, enquanto entregam um desempenho que rivaliza com modelos de ponta. Eles podem ser acessados através da API da MiniMax e das APIs de seus parceiros.
A Anthropic captou US$ 30 bilhões em financiamento Série G, atingindo uma avaliação pós-investimento de US$ 380 bilhões. A rodada foi liderada por GIC e Coatue, contando com ampla participação institucional.
O Google lançou uma grande atualização para o Gemini 3 Deep Think, seu modo de raciocínio especializado, expandindo o acesso para assinantes Ultra e usuários selecionados da API. Esta melhoria foi desenvolvida em colaboração com pesquisadores para lidar de forma mais eficaz com problemas científicos e de engenharia em aberto, especialmente aqueles que envolvem dados desorganizados ou incompletos.





