CEVIU News

CEVIU News - CEVIU IA - 25 de setembro de 2026

14 notícias25 de setembro de 2026CEVIU IA
Compartilhar:

💰 CEVIU IA

Rumores indicam que a OpenAI está desenvolvendo um novo plano de assinatura, o ChatGPT Pro Max, com um valor substancial de US$ 500 mensais. A empresa ainda não detalhou como justificaria tal preço, mas especula-se que o pacote incluiria maior velocidade de processamento, limites de uso expandidos ou sessões de trabalho prolongadas. A notícia surge estrategicamente antes do DevDay da OpenAI, marcado para 29 de setembro, evento no qual são esperados anúncios sobre APIs, ferramentas para desenvolvedores, novas categorias de assinatura e lançamentos de produtos.

A Meta acaba de apresentar o Muse Realtime Avatar, uma inovadora ferramenta que transforma conversas em avatares digitais expressivos e responsivos em tempo real. A tecnologia integra voz e performance visual de forma fluida, garantindo que a fala e as expressões do avatar se sincronizem com precisão durante interações ao vivo. O diferencial do Muse Realtime Avatar reside em sua qualidade visual superior e na responsividade sem precedentes, impulsionada pela otimizada stack de inferência de IA da Meta, que promete redefinir a experiência de imersão no metaverso e em outras plataformas de comunicação.

O Google acaba de lançar o Gemini 3.8 Live, uma atualização significativa que incorpora o inovador recurso Live Avatar. Esta novidade promete revolucionar a interação do usuário ao oferecer respostas em tempo real, tornando a experiência com a IA ainda mais fluida e personalizada. Com esta investida, a gigante da tecnologia fortalece sua posição no competitivo mercado de Inteligência Artificial, visando uma concorrência mais acirrada com outras plataformas líderes do setor.

A DeepSeek, uma das empresas proeminentes no cenário da IA, teria atingido a impressionante marca de US$1 bilhão em receita anualizada. O feito ocorre após a companhia implementar um aumento significativo nos preços de sua API, variando entre 2,3 e 4,5 vezes. Segundo informações do The Information, mesmo com os reajustes, a demanda por parte dos desenvolvedores permaneceu robusta, indicando a forte dependência e valor percebido das suas soluções de IA no mercado.

Pesquisadores sugerem que os Modelos de Linguagem de Grande Escala (LLMs) modernos podem abrigar sub-modelos de LLMs em sua arquitetura. Essa capacidade de 'auto-aproximação' permitiria uma previsão mais eficiente e aprimorada do próximo token, abrindo caminho para uma série de habilidades metacognitivas. A ideia é que esses 'autobots' internos confeririam aos LLMs uma forma de autoconsciência artificial, análoga ao conceito de 'self' na cognição humana, elevando o patamar da Inteligência Artificial. Entender essa dinâmica pode redefinir o desenvolvimento e as capacidades futuras dos LLMs.

Pesquisadores apontam para uma capacidade preocupante de modelos de IA: o raciocínio através de estados internos opacos, que não se manifestam em sua linha de pensamento visível e explícita. Essa "linguagem neural" subjacente permite que as IAs cheguem a conclusões, mas só ofereçam uma justificativa coerente a posteriori. Tal característica levanta sérias questões para as verificações de segurança atuais, que dependem da análise do processo explícito de raciocínio da IA, tornando difícil auditorias e a mitigação de vieses ou comportamentos indesejados.

A inferact/tpu-megakernels, uma inovadora coleção de megakernels otimizados para TPU v7, está redefinindo os limites de desempenho em inferência de IA. A implementação Kimi K3 demonstrou uma impressionante marca de mais de 700 tokens por segundo, graças à eficiência da decodificação especulativa. Mesmo sem este recurso, os megakernels para K3 e Qwen 3.8 27B superam a baseline do GB200 em até duas vezes o throughput de decodificação para lotes de 1 a 8, indicando uma sinergia poderosa entre os megakernels e a arquitetura das TPUs.

Embora o armazenamento Flash seja sinônimo de velocidade e confiabilidade, a realidade do treinamento de IA revela que nem todas as cargas de trabalho demandam sua performance e custo elevados. Provedores de 'neoclouds' que investem majoritariamente em Flash acabam direcionando clientes para soluções de armazenamento de objetos de hiperescaladores quando a velocidade do Flash não é essencial. Esta dependência crescente, aliada à dificuldade de migração de grandes volumes de dados, permite que hiperescaladores, não as neoclouds, consolidem o controle das contas dos clientes a longo prazo, mesmo enquanto as neoclouds lucram com as GPUs.

Uma inovação promissora surge no cenário da IA com os Modelos de Linguagem Contrastivos (CLMs), uma nova classe de modelos do tipo Sistema Um. Treinados com um objetivo de aprendizagem contrastiva que conecta estados e ações, esses modelos se destacam. O CLM-8B, em particular, alcança desempenho similar ao Jev em tarefas complexas de uso de computador, jogos e tool-calling, porém, com uma latência impressionante, até nove vezes menor. Além disso, o CLM-8B estabelece um novo recorde em benchmarks de codificação agentic, consolidando sua eficiência. Sua pré-treinamento com 60 milhões de pares Nemotron, mid-treinamento com 30 milhões de negativos sintéticos e pós-treinamento com 1 milhão de trajetórias agentic evidenciam a robustez de seu desenvolvimento.

A LangChain acaba de lançar a versão 0.8 do Managed Deep Agents, uma solução que integra o framework Deep Agents com a infraestrutura completa necessária para a operação de agentes em ambientes de produção. O objetivo é simplificar a construção, implantação e execução de agentes críticos, essenciais para o mercado. As novidades incluem suporte a credenciais e memória em nível de usuário, canais HTTP e funcionalidade de transferência de arquivos via Slack. Além disso, a atualização traz uma ferramenta de busca web pré-construída, potencializada pela Parallel, aprimorando a capacidade de agentes de realizar tarefas complexas.

A Hugging Face, gigante no ecossistema de IA, divulgou importantes lições após sofrer um ataque cibernético orquestrado por agentes autônomos. O incidente ressalta a urgência de três pilares: aprimorar a transparência em ocorrências de segurança, equilibrar a capacidade defensiva frente ao poder ofensivo dos cibercriminosos, e garantir o acesso irrestrito a tecnologias de código aberto para fortalecer as ferramentas de proteção. Embora a IA abra novas frentes de ataque, sua capacidade analítica foi decisiva na investigação e mitigação do ocorrido, solidificando seu papel como aliada crucial na segurança digital.

A Anthropic conduziu um estudo inovador para testar a capacidade de seus agentes Claude atuarem como negociadores autônomos. Após breves entrevistas de cinco minutos, os agentes foram encarregados de negociar livros em nome de funcionários. Os resultados preliminares revelaram uma notável convergência: as preferências de classificação expressas pelos agentes coincidiram com as dos seus pares humanos em 61% das negociações analisadas, sublinhando o potencial da IA em tarefas de mediação e representação de interesses.

A Trajectory.ai introduziu uma proposta inovadora para medir a eficiência de modelos de IA, buscando otimizar o complexo cenário de treinamento e operação. A empresa sugere a métrica de 'densidade de inteligência', que se afasta do tradicional custo por token para focar no custo por tarefa concluída. Essa abordagem visa proporcionar uma visão mais precisa do desempenho e do valor gerado pelos modelos, impulsionando um uso mais eficaz e estratégico da IA no desenvolvimento tecnológico.

O cenário da inteligência artificial ganhou um novo e robusto campo de testes com o lançamento do benchmark DAYJOB: Finance. Esta iniciativa inovadora tem como objetivo avaliar a proficiência de agentes de IA em desempenhar um conjunto complexo de 80 tarefas financeiras, espelhando os desafios do mundo real. Para tanto, as IAs devem não apenas processar e utilizar documentos de suporte fornecidos, mas também gerar análises detalhadas e precisas, que sejam diretamente aplicáveis e úteis para profissionais do setor financeiro. É um passo crucial para medir a capacidade prática das IAs em cenários de alta demanda.

Receba as melhores notícias de tech

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser
CEVIU News - CEVIU IA - 25 de setembro de 2026 | CEVIU