Engram está construindo modelos de IA que aprendem continuamente com o contexto privado do usuário, como documentos, chats, código e bases de conhecimento, em vez de reler as mesmas informações em toda sessão.

CEVIU IA
Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados
2317 notícias

Krea 2 apresenta modelos expansivos e expressivos de geração de imagens, pensados para exploração criativa e para contornar as limitações de uma estética padrão. O projeto usa um processo de treinamento em várias etapas, com arquiteturas avançadas e uma curadoria extensa de dados para ampliar a diversidade estilística e o controle do usuário. Entre as principais novidades estão um prompt expander e um sistema de style reference, que permitem combinar entradas de texto e imagem com mais nuance para produzir resultados visuais variados.

Modelos de linguagem grandes modernos usam role tags tanto como arquitetura de segurança quanto como apoio cognitivo. Prompt injections exploram uma falha na forma como os modelos de IA percebem papéis. Para LLMs, tudo chega pelo mesmo canal, como uma longa sopa de tokens, então eles não conseguem distinguir entre os próprios pensamentos e a fala. Até que os modelos de IA alcancem uma percepção genuína de papéis, a defesa contra injection continuará sendo um jogo interminável de tapa-e-esconde.

O Agent Toolkit da NVIDIA permite que empresas criem agentes de IA especializados e personalizáveis usando open models, tools, skills e um runtime seguro. Esses agentes aceleram fluxos de trabalho complexos em áreas como life sciences, saúde, cibersegurança e operações industriais ao se integrar a ferramentas e dados já existentes. Empresas como Cadence, Synopsys e CrowdStrike estão usando a tecnologia para aumentar eficiência e precisão em domínios específicos.

Esta análise aprofunda a atenção crescente a jailbreaks e a ataques de indirect prompt injection, com insights dos fundadores da Gray Swan e de suas pesquisas. O texto também mostra o papel da empresa na avaliação de sistemas avançados de IA e no desenvolvimento de benchmarks de segurança.

A Mistral lançou o OCR 4, uma ferramenta de document intelligence que extrai conteúdo estruturado, incluindo bounding boxes e confidence scores. O sistema suporta 170 idiomas, pode ser implantado em um único container e se integra a buscas corporativas e pipelines de dados estruturados. Segundo a empresa, o OCR 4 supera outros sistemas com vantagem de 4x em velocidade e alta precisão, especialmente em idiomas de baixo recurso.

A Anthropic apresentou o Claude Tag, um workflow baseado no Slack que permite às equipes atribuir tarefas ao Claude, conectá-lo a ferramentas e codebases e manter o contexto entre canais. A empresa disse que o sistema já se tornou parte central das operações internas, com a equipe de produto usando-o para gerar boa parte do código e ajudar em tarefas de analytics, suporte e depuração.
NVIDIA e AWS se uniram para otimizar a implantação de IA em escala com as novas GPUs NVIDIA RTX PRO 4500 Blackwell nas instâncias EC2 G7, oferecendo até 4,6x mais desempenho de inference de IA.

CUGA, o agent harness open source da IBM, simplifica o desenvolvimento de apps agentic ao lidar com as complexidades de planejamento, execução e gerenciamento de estado, para que os desenvolvedores possam se concentrar na escolha de ferramentas e nos prompts. O sistema mantém o estado de forma eficiente, corrige erros e supera outras abordagens em benchmarks como o AppWorld. Entre os diferenciais estão modos de reasoning configuráveis e sistemas de policy integrados, o que facilita levar a aplicação do desenvolvimento à produção com governança e flexibilidade.

A Anthropic pode passar a exigir verificação de identidade em certas situações a partir de 8 de julho. A empresa não informou exemplos específicos de quando os usuários serão solicitados a apresentar documentos emitidos pelo governo. Segundo um porta-voz da Anthropic, a mudança deve valer apenas para um pequeno grupo de usuários cujas contas forem sinalizadas, mas não banidas. A Anthropic usa a Persona como fornecedora da verificação de identidade.

A OpenAI lançou uma versão atualizada do plugin Codex Security, colocou o GPT-5.5-Cyber em liberação limitada, criou o Daybreak Cyber Partner Program e apresentou a iniciativa open source Patch the Planet. O Daybreak é descrito como uma stack defensiva de cibersegurança para a era da IA, e a OpenAI está promovendo esse conjunto por meio de parceiros, em vez de oferecer acesso amplo e direto ao modelo, com a ideia de integrar o GPT-5.5 com Trusted Access for Cyber a produtos e serviços de segurança já existentes.

A Tencent está testando Xiaowei, um assistente de IA, dentro do WeChat para melhorar a interação dos usuários e competir com rivais como a Alibaba na China.

ATUALIZAÇÃO (27/06/2026): não é mais rumor, foi lançado. 27/06/2026 (para planos Max, com lançamento para planos Pro nos próximos dois dias) Anthropic lançou a capacidade para usuários dos planos Pro e Max acessarem um thread de agente persistente via Claude Desktop ou Claude para iOS/Android para gerenciar tarefas no Cowork. Esta funcionalidade permite gerenciar tarefas no Cowork diretamente de aplicativos móveis. (Rumor original) Anthropic planeja expandir o sistema Cowork para apps móveis, permitindo agendar tarefas e acompanhar tudo entre dispositivos.
Definir uma velocidade específica de geração de tokens impõe uma restrição ao total de parâmetros do modelo. Se não houver compute de pretraining suficiente, os modelos tendem a permanecer menores. O artigo analisa essas condições e estima os tamanhos de modelo viáveis para cada ano entre 2023 e 2031. Há muitas premissas nesses cálculos, que projetam um total de parâmetros chegando a 1,4 quadrilhão em 2031.

A Anthropic retirou seu modelo Mythos, enquanto o autor do artigo desenvolveu modelos agentic menores, chamados de "knowledge agents", para se aproximar do desempenho de modelos frontier maiores. Esses agentes ampliam a IA ao injetar conhecimento específico e relevante, e funcionam bem até com modelos menores como o Qwen 3.6 27B. A metodologia envolve embedding, estruturação de dados e múltiplas passagens de busca, conseguindo melhorar LLMs para consultas especializadas e dados proprietários.
Este guia descreve estratégias para tratar o Codex como um workspace persistente, capaz de manter contexto ao longo de projetos extensos. Ele cobre a gestão do fluxo de trabalho, a decomposição de tarefas e técnicas para equilibrar execução autônoma com supervisão humana.

A SpaceX fechou um acordo de até US$ 6,3 bilhões com a Reflection AI para dar acesso ao supercomputador Project Colossus. O contrato permite que a startup use GPUs Nvidia GB300 para treinar modelos de IA open source. O movimento reflete a demanda crescente por compute no desenvolvimento de IA. A SpaceX também quer aproveitar essa infraestrutura para atender outras empresas de IA, reforçando sua posição no mercado de IA e data centers.
Loop engineering muda o desenvolvimento de IA de prompts manuais para agentes projetados como sistemas autônomos que decidem no que trabalhar, executam tarefas, verificam resultados e melhoram com o tempo. O loop básico do agente é simples, mas os problemas difíceis estão em definir condições confiáveis de parada, evitar a degradação do contexto, criar ferramentas adequadas para agentes e construir mecanismos de verificação capazes de julgar o sucesso de forma independente.
O modelo de geração de vídeo por IA HappyHorse 1.1 da Alibaba entrega vídeo pronto para produção por meio de uma API pensada para integração em stacks de software corporativo. O sistema já está disponível no Alibaba Cloud Model Studio, com 40% de desconto no site nas duas primeiras semanas. O HappyHorse oferece geração de texto para vídeo, imagem para vídeo e sujeito para vídeo, além de edição de vídeo, cobrindo todo o fluxo comercial, da ideação à produção e à pós-produção.
O raciocínio de Claude Code em 'Extended Thinking' é criptografado. Anthropic detém a chave, e as máquinas dos usuários nunca o recebem. A API retorna apenas um resumo do raciocínio, e não o raciocínio em si. Receber a saída completa do thinking exige um acordo empresarial.





