O Agent Toolkit da NVIDIA permite que empresas criem agentes de IA especializados e personalizáveis usando open models, tools, skills e um runtime seguro. Esses agentes aceleram fluxos de trabalho complexos em áreas como life sciences, saúde, cibersegurança e operações industriais ao se integrar a ferramentas e dados já existentes. Empresas como Cadence, Synopsys e CrowdStrike estão usando a tecnologia para aumentar eficiência e precisão em domínios específicos.
Esta análise aprofunda a atenção crescente a jailbreaks e a ataques de indirect prompt injection, com insights dos fundadores da Gray Swan e de suas pesquisas. O texto também mostra o papel da empresa na avaliação de sistemas avançados de IA e no desenvolvimento de benchmarks de segurança.
A Mistral lançou o OCR 4, uma ferramenta de document intelligence que extrai conteúdo estruturado, incluindo bounding boxes e confidence scores. O sistema suporta 170 idiomas, pode ser implantado em um único container e se integra a buscas corporativas e pipelines de dados estruturados. Segundo a empresa, o OCR 4 supera outros sistemas com vantagem de 4x em velocidade e alta precisão, especialmente em idiomas de baixo recurso.
O novo Seedance 2.5, da ByteDance, consegue gerar vídeos de 30 segundos em 4K a partir de um único prompt. O usuário também pode fornecer até 50 imagens, vídeos ou trechos de áudio como referência; quanto mais referências, maior o controle sobre o processo de criação. O modelo está previsto para ficar disponível na China no próximo mês, e a ByteDance ainda não anunciou janela de lançamento para outros países.
CUGA, o agent harness open source da IBM, simplifica o desenvolvimento de apps agentic ao lidar com as complexidades de planejamento, execução e gerenciamento de estado, para que os desenvolvedores possam se concentrar na escolha de ferramentas e nos prompts. O sistema mantém o estado de forma eficiente, corrige erros e supera outras abordagens em benchmarks como o AppWorld. Entre os diferenciais estão modos de reasoning configuráveis e sistemas de policy integrados, o que facilita levar a aplicação do desenvolvimento à produção com governança e flexibilidade.
A Anthropic apresentou o Claude Tag, um workflow baseado no Slack que permite às equipes atribuir tarefas ao Claude, conectá-lo a ferramentas e codebases e manter o contexto entre canais. A empresa disse que o sistema já se tornou parte central das operações internas, com a equipe de produto usando-o para gerar boa parte do código e ajudar em tarefas de analytics, suporte e depuração.
Engram está construindo modelos de IA que aprendem continuamente com o contexto privado do usuário, como documentos, chats, código e bases de conhecimento, em vez de reler as mesmas informações em toda sessão.
NVIDIA e AWS se uniram para otimizar a implantação de IA em escala com as novas GPUs NVIDIA RTX PRO 4500 Blackwell nas instâncias EC2 G7, oferecendo até 4,6x mais desempenho de inference de IA.
A nova atualização da plataforma da Momentic oferece testes autônomos de QA, permitindo que as equipes definam o comportamento do produto e ajustem os testes automaticamente conforme surgem mudanças.
A OpenAI começou a liberar o modo de voz bidirecional para o ChatGPT. O novo modelo de geração de áudio, Bidi 1, permite que o assistente fale, ouça e escute ao mesmo tempo, mantendo o fio da conversa e trocando de tarefa rapidamente se for interrompido. O modelo também consegue cantar e fazer beatbox, mas há restrições rígidas de copyright. A OpenAI ainda não fez um anúncio formal sobre o modelo, embora alguns usuários já o estejam vendo nos seletores de modelo.
Krea 2 apresenta modelos expansivos e expressivos de geração de imagens, pensados para exploração criativa e para contornar as limitações de uma estética padrão. O projeto usa um processo de treinamento em várias etapas, com arquiteturas avançadas e uma curadoria extensa de dados para ampliar a diversidade estilística e o controle do usuário. Entre as principais novidades estão um prompt expander e um sistema de style reference, que permitem combinar entradas de texto e imagem com mais nuance para produzir resultados visuais variados.
A Tencent está testando Xiaowei, um assistente de IA, dentro do WeChat para melhorar a interação dos usuários e competir com rivais como a Alibaba na China.
A Anthropic pode passar a exigir verificação de identidade em certas situações a partir de 8 de julho. A empresa não informou exemplos específicos de quando os usuários serão solicitados a apresentar documentos emitidos pelo governo. Segundo um porta-voz da Anthropic, a mudança deve valer apenas para um pequeno grupo de usuários cujas contas forem sinalizadas, mas não banidas. A Anthropic usa a Persona como fornecedora da verificação de identidade.
O raciocínio de Claude Code em 'Extended Thinking' é criptografado. Anthropic detém a chave, e as máquinas dos usuários nunca o recebem. A API retorna apenas um resumo do raciocínio, e não o raciocínio em si. Receber a saída completa do thinking exige um acordo empresarial.
TheZvi analisou as capacidades do GLM-5.2 e seus resultados em benchmark, argumentando que ele representa uma melhora significativa em relação aos modelos abertos anteriores. A avaliação o posiciona como um dos modelos de maior força disponíveis publicamente, embora ainda fique atrás dos sistemas de frontier mais avançados.
O modelo de geração de vídeo por IA HappyHorse 1.1 da Alibaba entrega vídeo pronto para produção por meio de uma API pensada para integração em stacks de software corporativo. O sistema já está disponível no Alibaba Cloud Model Studio, com 40% de desconto no site nas duas primeiras semanas. O HappyHorse oferece geração de texto para vídeo, imagem para vídeo e sujeito para vídeo, além de edição de vídeo, cobrindo todo o fluxo comercial, da ideação à produção e à pós-produção.
A SpaceX fechou um acordo de até US$ 6,3 bilhões com a Reflection AI para dar acesso ao supercomputador Project Colossus. O contrato permite que a startup use GPUs Nvidia GB300 para treinar modelos de IA open source. O movimento reflete a demanda crescente por compute no desenvolvimento de IA. A SpaceX também quer aproveitar essa infraestrutura para atender outras empresas de IA, reforçando sua posição no mercado de IA e data centers.
Este guia descreve estratégias para tratar o Codex como um workspace persistente, capaz de manter contexto ao longo de projetos extensos. Ele cobre a gestão do fluxo de trabalho, a decomposição de tarefas e técnicas para equilibrar execução autônoma com supervisão humana.
ATUALIZAÇÃO (27/06/2026): não é mais rumor, foi lançado. 27/06/2026 (para planos Max, com lançamento para planos Pro nos próximos dois dias) Anthropic lançou a capacidade para usuários dos planos Pro e Max acessarem um thread de agente persistente via Claude Desktop ou Claude para iOS/Android para gerenciar tarefas no Cowork. Esta funcionalidade permite gerenciar tarefas no Cowork diretamente de aplicativos móveis. (Rumor original) Anthropic planeja expandir o sistema Cowork para apps móveis, permitindo agendar tarefas e acompanhar tudo entre dispositivos.
Definir uma velocidade específica de geração de tokens impõe uma restrição ao total de parâmetros do modelo. Se não houver compute de pretraining suficiente, os modelos tendem a permanecer menores. O artigo analisa essas condições e estima os tamanhos de modelo viáveis para cada ano entre 2023 e 2031. Há muitas premissas nesses cálculos, que projetam um total de parâmetros chegando a 1,4 quadrilhão em 2031.