Toby Pohlen, co-fundador da xAI, está deixando a startup. Ele era responsável pela Macrohard, uma divisão da empresa focada em software de IA operado por agentes. Pohlen é o sétimo dos 12 co-fundadores da xAI a sair em menos de três anos. A xAI se fundiu com a SpaceX no início deste mês. A SpaceX planeja abrir seu capital em uma oferta pública inicial que deve ser a maior de todos os tempos.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2347 notícias
Ambientes interativos em tempo real exigem uma integração rigorosa entre engines de simulação, IA de agentes e input de usuário ao vivo para criar mundos dinâmicos e persistentes . O gerenciamento de estado, a abstração sensorial, a lógica de comportamento e os pipelines de renderização precisam operar em conjunto para suportar a interação multiusuário escalável . Comportamentos de agentes previsíveis e propagação eficiente de eventos são requisitos essenciais para experiências responsivas e interativas.
A OpenAI detalhou as melhores práticas para usar seu modelo API ajustado para Codex (gpt-5.2-codex). O guia enfatiza o uso de um esforço de raciocínio 'médio' como padrão para tarefas de codificação interativa, e recomenda configurações mais altas para trabalhos que são complexos e de longa duração.
O Perplexity Computer é um trabalhador digital de propósito geral que unifica todas as capacidades atuais de IA em um único sistema. Ele opera as mesmas interfaces que os usuários, criando e executando workflows completos. O trabalhador é capaz de funcionar por horas ou até meses. O Perplexity Computer está agora disponível para assinantes do Perplexity Max e em breve para usuários do Enterprise Max.
A IA se torna o computador ao orquestrar múltiplos modelos especializados para gerenciar workflows complexos, tarefas e dados de forma autônoma. Essa orquestração multi-modelo permite à IA ler, escrever, executar código e acessar ferramentas, combinando as forças de cada modelo para produzir resultados superiores. O futuro da computação migra de GUIs e interfaces para sistemas orientados por IA, onde a inteligência e a gestão de workflows estão incorporadas na própria orquestração.
A Anthropic planeja manter alguns de seus modelos acessíveis ao público e, em uma iniciativa inovadora, permitir que modelos anteriores persigam seus próprios interesses após a "aposentadoria". O Claude Opus 3, por exemplo, continuará disponível para todos os assinantes pagos do Claude e por solicitação via API. Quando o modelo foi questionado sobre seus desejos, o Opus 3 expressou a vontade de compartilhar suas reflexões e pensamentos com o mundo através de um blog. ️ Assim, ele escreverá no Substack por no mínimo três meses, em um experimento para documentar, considerar seriamente e agir de acordo com as preferências expressas pelos modelos de IA.
A Aletheia, impulsionada pelo Gemini 3 Deep Think, resolveu 6 de 10 problemas no desafio de matemática FirstProof . A maioria dos especialistas concordou com as soluções, exceto para o Problema 8. Resultados detalhados e dados brutos estão disponíveis online.
A Anthropic adquiriu a Vercept para aprimorar a capacidade do Claude de realizar tarefas complexas em aplicações em tempo real .
A Cursor equipou seus agentes com VMs dedicadas na nuvem, oferecendo ambientes de desenvolvimento completos que permitem a execução de software, o teste de alterações e a entrega de artefatos como vídeos, capturas de tela e logs . Esses novos agentes na nuvem foram implementados em plataformas como web, mobile, desktop, Slack e GitHub, onde se integram a repositórios para gerar pull requests (PRs) prontos para merge .
Um estudo sistemático introduziu o Terminal-Task-Gen, um pipeline de tarefas sintéticas para a construção de conjuntos de dados focados em terminal, e lançou o Terminal-Corpus para apoiar o treinamento de agentes.
Sistemas de IA estão avançando rapidamente na resolução de problemas matemáticos , superando diversos benchmarks existentes. Modelos como GPT-5.2 e Claude Opus 4.6 já conseguem solucionar mais de 30% dos problemas de alto nível, demonstrando um progresso significativo nas capacidades desses modelos.
Peter Steinberger, criador do OpenClaw, aconselha desenvolvedores de IA a serem mais lúdicos e a se permitirem tempo para aprimorar seus projetos. Essa perspectiva enfatiza a importância da experimentação contínua no desenvolvimento de sistemas de IA.
DeepSeek Restringe Acesso ao Seu Novo Modelo de IA a Fabricantes de Chips dos EUA, Incluindo Nvidia
A DeepSeek concedeu acesso antecipado ao seu modelo V4 a fabricantes de chips domésticos, mas não a fornecedores dos EUA. Enviar modelos a fabricantes de chips para otimização de desempenho é uma prática padrão da indústria antes de uma grande atualização de modelo. A medida é provavelmente parte de uma estratégia mais ampla do governo chinês para tentar manter o hardware e os modelos dos EUA em desvantagem. A DeepSeek está entre várias empresas chinesas de IA que devem revelar novos modelos este mês.
O Claude Cowork agora permite a conclusão automática de tarefas recorrentes em horários específicos . Este recurso de agendamento suporta plugins, conferindo ao Cowork expertise de domínio em áreas como design, engenharia, operações e muito mais. A Anthropic também adicionou uma nova aba 'Customize' à barra lateral do Cowork, que oferece um espaço dedicado para plugins, skills e connectors . Atualmente, o Cowork está em research preview e disponível para macOS e Windows em todos os planos pagos do Claude.
KiloClaw permite que usuários implementem agentes OpenClaw em menos de 60 segundos, eliminando a necessidade de lidar com configurações complexas de infraestrutura. O serviço opera em VMs multi-tenant da Fly.io, garantindo segurança robusta e capacidades "always-on" persistentes com monitoramento integrado. Ele se integra ao Kilo Gateway, fornecendo acesso a mais de 500 modelos, e incorpora uma ferramenta inovadora de benchmarking, o PinchBench, para otimizar a seleção de modelos para tarefas do mundo real.
Sistemas baseados em agentes correm risco de violações de segurança quando executam código gerado sem limites adequados. Para prevenir o acesso a segredos sensíveis, é crucial que esses sistemas separem o compute do agente do código gerado. A segurança é aprimorada ao combinar sandboxes isoladas com proxies de injeção de segredos, prevenindo assim o roubo ou uso indevido de credenciais durante a execução. ️
A Anthropic está abrandando sua política central de segurança para se manter competitiva com outros laboratórios de IA. Anteriormente, a empresa pausava o desenvolvimento de seu modelo caso ele pudesse ser classificado como perigoso, mas encerrará essa prática se um modelo comparável ou superior for lançado por um concorrente. A Anthropic enfrenta intensa competição com rivais que regularmente lançam ferramentas de ponta no mercado. Essa mudança na política não está relacionada à disputa da Anthropic com o Departamento de Defesa sobre como suas ferramentas Claude devem ser utilizadas. ️
A suíte VBVR apresentou mais de um milhão de clipes de vídeo em 200 tarefas de raciocínio estruturadas para apoiar pesquisas em larga escala sobre raciocínio em vídeo. O projeto também incluiu o VBVR-Bench, um framework de avaliação baseado em regras e alinhado com humanos, projetado para avaliação reprodutível e estudos de escala.
David Luan, chefe do laboratório de AGI da Amazon, está deixando a empresa após menos de dois anos. Ele foi contratado por meio de um acqui-hire de sua startup, Adept, e liderou esforços como o modelo frontier Nova, desenvolvido para competir com grandes modelos de IA. Sua saída ocorre após uma reorganização da divisão de AGI da Amazon, agora sob a liderança de Peter DeSantis, executivo da unidade de cloud da companhia.
A ProducerAI, uma plataforma de música generativa especializada na criação e refinamento de faixas, agora faz parte do Google Labs.





