O Replit anunciou a integração nativa do modelo de IA Claude, permitindo que desenvolvedores alternem com agilidade entre prototipagem, design e codificação dentro do ambiente. A integração traz suporte a prompts avançados, geração de código contextualizado e revisão automática, tudo sem sair da plataforma. A novidade está disponível para todos os planos, incluindo o gratuito, e reforça a aposta da Replit em IA como co-piloto integrado ao ciclo completo de desenvolvimento.
O Cursor revelou um novo modelo de IA projetado do zero para impulsionar o desenvolvimento de software agentic, muito além de autocomplete e pair programming. Treinado em uma infraestrutura com mais de 100.000 GPUs, o modelo conta com mais de 1,5 trilhão de parâmetros e oferece capacidades cognitivas avançadas, capazes de planejar, executar e iterar tarefas de engenharia de software de forma autônoma. O lançamento está previsto para as próximas semanas.
A Mistral AI vai lançar um novo modelo de IA ainda este verão, com programa de early access aberto em julho para parceiros estratégicos em pesquisa, governo e indústria. O anúncio reforça a aceleração da empresa francesa na corrida global por modelos avançados, e sinaliza movimentos concretos rumo à expansão comercial e institucional na Europa e além. Detalhes técnicos do modelo ainda não foram divulgados.
Um experimento comparou o Kimi K2.7 Code e o Claude Fable 5 na criação de 12 landing pages cada. O modelo da Moonshot se mostrou 16 vezes mais econômico, com redução de 94% nos custos operacionais frente ao Claude Fable 5, destaque para eficiência em tarefas práticas de desenvolvimento web com IA.
Uma nova análise testou 26 combinações entre Claude 4.6/4.7 e GPT-5.4/5.5, com variações em tamanho de contexto e esforço de raciocínio, para avaliar detecção de vulnerabilidades (como as discutidas no post da Mythos). Resultados confirmam tendências anteriores: modelos como Opus 4.6, GPT 5.4, Gemini 3.1-pro-preview, Deepseek R1-0528 e Qwen 3.6-plus falharam em identificar falhas sem pistas explícitas. Aumentar o esforço computacional ou usar versões mais recentes não garante maior eficácia em triagem de segurança.
Apresentação do LifeSciBench, um benchmark criado e revisado por especialistas para avaliar como sistemas de IA lidam com tarefas e decisões de pesquisa em ciências da vida no mundo real.
O MolmoMotion é um modelo focado na previsão de movimentos 3D orientada por comandos em linguagem natural.
Noam Shazeer, um dos coautores do histórico artigo 'Attention Is All You Need' (2017), marco fundacional dos modelos de linguagem modernos, deixou o Google para se juntar à OpenAI. Na gigante de buscas, ele também foi responsável por avanços práticos como a melhoria da correção ortográfica nas buscas e o desenvolvimento do algoritmo central do AdSense. Sua saída reforça a intensa migração de talentos-chave entre os principais players globais de IA.
A NVIDIA lançou o XR AI, plataforma em beta público que permite desenvolver agentes de IA integrados a óculos de AR, headsets XR e dispositivos de realidade estendida. A solução oferece base reutilizável para conectar hardware XR a serviços de IA acelerados por GPU, na nuvem, data centers, estações de trabalho ou edge, e inclui biblioteca open source para construção desses agentes. Eles processam visão do usuário, interpretam intenções via texto ou comandos, acionam ferramentas corporativas e respondem em tempo real dentro da sessão XR.
O GitHub detalha como o Copilot está maximizando o aproveitamento de cada sessão para garantir que os créditos sejam utilizados de forma mais eficiente em tarefas úteis.
O Agents SDK agora é um runtime sobre o qual qualquer framework de agentes pode ser construído. A Cloudflare abriu os primitivos do Agents SDK, com o Flue sendo o primeiro framework a utilizá-lo, além de disponibilizar agents diretamente no dashboard.
Pesquisadores utilizaram um reasoning model da OpenAI para auxiliar no diagnóstico de doenças raras, identificando 18 novos diagnósticos em casos anteriormente não solucionados.
O artigo analisa alternativas ao LoRA e avalia se é possível superar a técnica de fine-tuning mais utilizada atualmente.
O artigo explora abordagens para avaliar a capacidade de modelos agentic utilizando ecossistemas de ferramentas personalizados, abordando os desafios técnicos de realizar benchmarks que reflitam comportamentos autônomos em ambientes controlados.
A AWS introduziu a busca web no Amazon Bedrock AgentCore, uma ferramenta totalmente gerenciada que permite aos agentes basear suas respostas em conhecimento da web atual e referenciado, sem qualquer egress de dados do ambiente AWS seguro do cliente. Com isso, o foco pode ser direcionado ao desenvolvimento dos agentes, eliminando a necessidade de adicionar manualmente a funcionalidade de busca ou gerenciar a infraestrutura correspondente.
A Cloudflare One stack é uma biblioteca de habilidades que fornece aos agentes de IA o conhecimento necessário para planejar, realizar o deploy e gerenciar um ambiente Zero Trust, sem a necessidade de chamadas de migração.
A OpenAI e a Molecule.one demonstraram como uma IA química quase autônoma, utilizando o GPT-5.4, aprimorou uma reação essencial para a fabricação de medicamentos, avançando a pesquisa em química medicinal.
Pesquisa publicada na revista Nature demonstra que nosso sistema de IA conversacional alcança resultados equivalentes aos de médicos de atenção primária no manejo de doenças complexas.
A Hugging Face apresentou uma nova funcionalidade focada em permitir que agentes realizem a descoberta de recursos de forma autônoma.
A Anthropic pausou, às vésperas de sua entrada em vigor, a mudança de precificação que separaria o uso do Claude Agent SDK do consumo padrão do Claude. Agora, as chamadas via SDK continuarão sendo cobradas conforme as taxas atuais de API, sem tarifação distinta por tokens. A empresa explicou que está revisando seus planos de pricing para alinhar melhor a estrutura com as necessidades reais dos desenvolvedores que constroem agentes autônomos a partir das assinaturas do Claude.