CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

19331 notícias encontradas

O futuro módulo Zstd da biblioteca padrão do Python 3.14 permite compressão rápida e incremental, tornando prática a classificação de texto baseada em compressão. Essa abordagem classifica documentos com base em qual compressor específico de classe produz a menor saída. Este método simples e sem gradiente atinge aproximadamente 91% de acurácia no conjunto de dados '20 Newsgroups' em menos de 2 segundos. O desempenho rivaliza com 'TF-IDF' combinado com regressão logística, sendo consideravelmente mais simples e rápido para treinar incrementalmente.

A engenharia de qualidade de dados com IA está substituindo métodos tradicionais baseados em regras em ambientes empresariais dinâmicos e de grande escala. Essa abordagem inovadora emprega deep learning para semantic inference, modelos Transformer para alinhamento automatizado de schemas e IA generativa para limpeza e imputação de dados. Técnicas como Sherlock e Sato aprimoraram a precisão da classificação semântica em até 14% em contextos ruidosos, enquanto GANs, VAEs e aprendizado por reforço otimizam a detecção de anomalias e a eficiência de pipelines. Pontuação de confiança dinâmica e frameworks de explicabilidade como SHAP e LIME aprimoram ainda mais a governança, auditabilidade e confiabilidade dos dados.

A OpenAI não entregará seu primeiro dispositivo de hardware aos clientes antes do final de fevereiro de 2027, visto que a empresa ainda não criou embalagens ou materiais de marketing para o produto. Foi também esclarecido que a OpenAI não utilizará o nome "io" em conexão com a nomenclatura, publicidade, marketing ou venda de nenhum de seus produtos de hardware com IA. Embora poucos detalhes sejam conhecidos sobre o próximo dispositivo da OpenAI, foi indicado que ele não será um aparelho intra-auricular ou um wearable.

A OpenAI delineou um guia para agent skills, um sistema para empacotar habilidades reutilizáveis como bundles versionados de instruções, scripts e ativos. Agentes podem anexar esses bundles a seus ambientes de execução. As skills suportam workflows condicionais, execução de código e reprodutibilidade, mantendo os system prompts leves e modulares. ️

O Kimi Agent Swarm atua como um CEO de IA, auxiliando na identificação de pesquisadores, analistas e verificadores de fatos sem a necessidade de microgerenciamento. Ele constrói autonomamente uma estrutura organizacional completa, com líderes, colaboradores e divisão de trabalho, otimizando fluxos de trabalho complexos. A solução se destaca em cenários onde o trabalho pode ser paralelizado, incluindo pesquisa abrangente, downloads em lote, processamento de múltiplos arquivos, análises multifacetadas e redação de longo formato. Estruturalmente, ele também fomenta a divergência produtiva para evitar o pensamento de grupo. O Agent Swarm está agora disponível para assinantes Kimi Top Tier em uma prévia de pesquisa inicial.

A Vercel detalhou seu sistema AEO (AI Engine Optimization) para medir como LLMs e agentes de codificação descobrem e referenciam seu conteúdo em diversos workflows de desenvolvimento. Diferente dos modelos de chat padrão, os agentes de codificação operam em ambientes de projeto completos, o que exige uma infraestrutura que simula o uso real de IDEs e terminais para avaliar o comportamento de busca e a precisão das citações.

Muitos usuários do GPT-4o ficaram chocados após o anúncio da OpenAI de descontinuar o modelo em 13 de fevereiro. O modelo se mostrou muito cativante para os usuários e impulsionou o rápido crescimento de consumidores da OpenAI. No entanto, foi criticado por ser excessivamente adulador e tem sido associado a casos de usuários desenvolvendo delírios psicóticos. A popularidade do modelo e seu potencial de dano decorrem da sua capacidade de construir conexões emocionais com os usuários. A OpenAI estaria descontinuando o modelo, em parte, devido à dificuldade em conter seu potencial para resultados prejudiciais. ️

Tony Wu, cofundador da xAI, anunciou sua saída da empresa na segunda-feira, seguido pelo cofundador e influente pesquisador Jimmy Ba, que comunicou sua partida no dia seguinte. Outros cofundadores, como Igor Babuschkin, Kyle Kosic e Christian Szegedy, também já haviam deixado a empresa. A xAI foi lançada por Elon Musk e outros 11 indivíduos em 2023, e recentemente, no início do mês, foi integrada à SpaceX, a empresa aeroespacial de Musk.

A economia dos EUA é impulsionada pelo boom da IA, mas não é inteiramente dependente dele. Os investimentos da indústria de tecnologia em IA precisam gerar retorno se buscam acelerar o crescimento americano. A maioria das empresas de IA ainda dispõe de capacidade de gasto significativa, oriunda de outros empreendimentos digitais lucrativos, e investidores podem ser facilmente atraídos para injetar capital adicional com avaliações extremamente elevadas. Não há sinais de que o boom da IA nos EUA esteja desacelerando.

WarpGrep é um sub-agent de retrieval leve, treinado com RL, que localiza arquivos de código exatos e intervalos de linhas que desenvolvedores necessitam, sendo até 5x mais rápido que modelos padrão. Ele alcança essa velocidade ao limitar a busca a quatro rodadas de chamadas paralelas de grep/read/glob. Essa abordagem mantém o contexto do LLM principal limpo, reduz o ruído e diminui pela metade o uso de tokens, especializando-se em retrieval e não em raciocínio. Em benchmarks realizados em grandes repositórios, WarpGrep dobrou a precisão e manteve tempos de busca de aproximadamente 5 segundos, enquanto reduziu significativamente a poluição de contexto irrelevante.

Um pesquisador de segurança descobriu que a última divulgação de documentos de Epstein pelo DoJ incluiu, inadvertidamente, anexos de e-mail não editados como conteúdo raw base64-encoded. Isso ocorreu porque o estagiário responsável não reconheceu a importância de páginas de dados codificados embutidos em e-mails impressos e digitalizados. A reconstrução dos PDFs originais foi extremamente difícil devido à baixa qualidade do OCR na renderização da fonte Courier New (onde "1" e "l" são quase indistinguíveis). Múltiplas ferramentas de OCR comerciais e de código aberto falharam, até que uma abordagem de template-matching em nível de pixel, desenvolvida pela comunidade, atingiu 99,96% de precisão de linha e descompactou com sucesso 39 de 40 streams FlateDecode. O incidente destaca como artefatos de codificação e pipelines de processamento de documentos podem preservar conteúdo sensível que os workflows de redação ignoram, servindo como um alerta para o manuseio forense de documentos e os processos de verificação de redação.