Recentemente, a Nature publicou dois artigos descrevendo sistemas de IA projetados para auxiliar cientistas no desenvolvimento e teste de hipóteses. O Co-Scientist do Google foi desenvolvido para manter os cientistas no controle, exigindo que eles apliquem regularmente seu discernimento para direcionar o sistema. Já o sistema da FutureHouse consegue avaliar dados biológicos de classes específicas de experimentos. Ambos os modelos são criados para processar vastas quantidades de informações, gerando hipóteses geralmente diretas, como a eficácia de um medicamento para uma condição específica.
CEVIU News
As melhores notícias de tecnologia, curadas diariamente para quem vive tech.
16161 notícias encontradas
O Scheduled Tasks 2.0 aprimora a automação ao permitir que as tarefas sejam executadas com contexto, garantindo a continuidade dos fluxos de trabalho em diferentes projetos e aplicativos.
Este post apresenta um padrão detalhado para a construção de bases de conhecimento pessoais utilizando Large Language Models (LLMs).
A Anthropic adquiriu a startup de ferramentas para desenvolvedores Stainless, cuja plataforma de automação de SDK era amplamente utilizada por empresas de IA, incluindo OpenAI, Google e Cloudflare.
A xAI lançou o recurso "Skills" para o seu modelo Grok, que permite aos usuários ensinarem funções específicas uma única vez. Grok então retém e aplica esse aprendizado em interações futuras, abrangendo plataformas web, iOS e Android.
O Lovable agora permite que os usuários criem 'skills', que são instruções baseadas em markdown e totalmente reutilizáveis. Este recurso visa eliminar a necessidade de explicações repetitivas, otimizando o fluxo de trabalho ao encapsular comandos e procedimentos comuns em módulos facilmente acessíveis.
O processo de Elon Musk contra Sam Altman e a OpenAI foi indeferido. Um júri decidiu que Musk esperou tempo demais para entrar com a ação judicial. Musk afirma que planeja recorrer.
Os primeiros CPUs Nvidia Vera chegaram recentemente à Anthropic, OpenAI, SpaceXAI e Oracle. A entrega foi feita pessoalmente por Ian Buck, vice-presidente de Hyperscale e High-Performance Computing da Nvidia. O Vera apresenta 88 núcleos Olympus personalizados projetados pela Nvidia, largura de banda de memória de 1,2 TB/s e um desempenho por núcleo 50% mais rápido. Ele atua como processador host para o Vera Rubin NVL72, que se conecta a um par de GPUs Rubin via NVLink-C2C de segunda geração da Nvidia.
O NVIDIA Cosmos Predict 2.5, capaz de gerar vídeos a partir de texto, está sendo adaptado para tarefas específicas como manipulação robótica. Isso é feito usando LoRA/DoRA para injetar adaptadores treináveis, minimizando o uso de memória. Esses métodos permitem um fine-tuning eficiente em uma única GPU, evitando o "esquecimento catastrófico" enquanto geram trajetórias sintéticas rapidamente. O fine-tuning com LoRA e DoRA melhora significativamente a qualidade do vídeo, com LoRA sendo mais adequado para condições de memória restrita e DoRA preferível para lidar com instabilidade de treinamento.
Modelos de linguagem (LMs) demonstram mudanças imprevisíveis entre repetição de padrões e exibição de inteligência adaptativa durante o pré-treinamento, um fenômeno chamado "mode-hopping". Esse comportamento não pode ser corrigido por técnicas de otimização padrão e se manifesta como uma competição pela capacidade do modelo, influenciada pelos dados de cada janela de treinamento. Pesquisadores propõem aproveitar essas dinâmicas para selecionar melhor os checkpoints de pré-treinamento, organizar dados para stable generalization e avaliar métricas que prevejam o comportamento dos LMs.
A avaliação de LLMs mudou de benchmarks estáticos para sistemas de agentes mais dinâmicos e realistas. Uma avaliação eficaz agora exige 'harnesses' realistas para testar agentes em ambientes complexos e por longos períodos. Isso é crucial, pois os agentes estão assumindo papéis de alta responsabilidade, como programação e medicina, o que requer medição rigorosa de desempenho e avaliação orientada a resultados.
A censura política implementada no Qwen3.5-9B reside em um pequeno circuito nos pesos do modelo, que pode ser lido e desativado. O conhecimento factual já está presente no pré-treinamento, e o comportamento de censura é sobreposto a esses fatos. O modelo não perde o conhecimento, mas aprende a contorná-lo.
A Cursor lançou o Composer 2.5, uma versão atualizada de seu agente de codificação. Este agente foi treinado utilizando uma combinação de aprendizado por reforço direcionado, dados sintéticos e novas técnicas de treinamento distribuído, visando otimizar sua performance.
O Qwen3.7 Preview já está disponível na Arena para capacidades de Texto e Visão. O modelo Qwen3.7 Max Preview alcançou a 13ª posição geral na Text Arena, enquanto o Qwen3.7 Plus Preview se classificou como o 16º na Vision Arena.
O grupo ShinyHunters afirma ter roubado mais de 600.000 registros do Salesforce da 7-Eleven, incluindo dados pessoais e corporativos, após negociações de resgate fracassadas. O grupo acessou sistemas que armazenavam documentos de solicitação de franqueados em 8 de abril. A 7-Eleven está notificando os indivíduos afetados, mas o número total de vítimas ainda é desconhecido.
O Grafana confirmou uma violação de dados em 18 de maio, após o grupo Coinbase Cartel listar a empresa em 15 de maio, alegando ter roubado informações.
A Mozilla submeteu um parecer argumentando que o governo do Reino Unido está visando as VPNs em vez de corrigir seus sistemas falhos de verificação de idade. O uso de VPNs disparou após a entrada em vigor do Online Safety Act, levando autoridades e o Children's Commissioner a sugerir a limitação do acesso. A Mozilla afirma que a maioria das crianças contorna as verificações com datas de nascimento falsas ou contas emprestadas, e que exigir identificação antes de usar ferramentas de privacidade anula o propósito delas.
A Sansec revelou uma falha não autenticada (sem CVE) no plugin FunnelKit Funnel Builder para WordPress, antes da versão 3.15.0.3, que afeta mais de 40.000 lojas WooCommerce. Um endpoint de checkout exposto publicamente falhou em verificar permissões do chamador ou restringir métodos internos invocáveis, permitindo que atacantes inserissem JavaScript controlado em na configuração global de "External Scripts" do plugin. Isso injeta um falso carregador do Google Tag Manager em cada checkout, que abre um WebSocket para wss://protect-wss[.]com/ws para recuperar um skimmer de cartão personalizado, exfiltrando PANs, CVVs e endereços de cobrança.
Plataformas de bug bounty estão sobrecarregadas com relatórios gerados por IA, dificultando a distinção entre pesquisadores habilidosos e submissões automatizadas de baixa qualidade. Um pesquisador experiente, classificado em primeiro lugar no programa Uber por uma década, submeteu um vazamento de PII em massa em 24 de abril, mas a primeira resposta humana levou 12 dias, em vez do prazo usual de 1 a 3 dias. As plataformas tratam colaboradores de longa data da mesma forma que novatos que usam agentes de IA. Consequentemente, pesquisadores talentosos estão evitando as plataformas, preferindo programas privados ou pesquisas não remuneradas, pois os tempos de resposta, que antes motivavam, agora desestimulam.
Atacantes enviaram cartas físicas com a marca Ledger, assinadas em nome de Charles Guillemet, exigindo uma atualização de "Resistência Quântica" até um prazo e direcionando os destinatários via QR code para um site de phishing que coleta frases semente de recuperação de 24 palavras.
