CEVIU Logo

CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

819 notícias encontradas

Os World Models estão impulsionando a IA ao simular complexidades do mundo real através de redes neurais condicionadas à ação, possibilitando previsão e planejamento eficientes. Abordagens generativas e latentes para World Models estão gerando avanços em diversas aplicações, da robótica à direção autônoma, aproveitando vastos datasets, como clipes de jogos, para aproximar a tomada de decisões humanas. Grandes investimentos de líderes da indústria, incluindo empresas como General Intuition e World Labs, ressaltam o potencial significativo e a rápida evolução dos World Models para alcançar a inteligência geral.

A OpenAI anunciou a aquisição da Astral com o objetivo de integrar o popular tooling de Python ao Codex e, assim, expandir suas capacidades de desenvolvimento de software assistido por IA. Essa movimentação estratégica visa aprimorar as ferramentas existentes e impulsionar a inovação no desenvolvimento de aplicações com assistência de IA.

O MiMo-V2-Pro da Xiaomi é um modelo de fundação de 1 trilhão de parâmetros, com desempenho que se aproxima dos modelos da OpenAI e Anthropic, mas por uma fração do custo. O modelo emprega uma arquitetura esparsa que ativa apenas 42 bilhões de parâmetros em cada "forward pass", e incorpora uma camada de "Multi-Token Prediction" que permite antecipar e gerar múltiplos tokens simultaneamente, reduzindo drasticamente a latência necessária para o "thinking". Atualmente, o modelo está disponível apenas através da API proprietária da Xiaomi. A empresa planeja lançar uma variante open source do modelo.

A IA pode revolucionar o atendimento ao cliente, oferecendo experiências personalizadas, escaláveis e semelhantes a serviços de concierge para todos os consumidores, preenchendo a lacuna entre os serviços de luxo e o suporte ao cliente em massa. A Decagon, uma plataforma líder de IA, aprimora o atendimento ao cliente, resolvendo mais de 80% das consultas de forma autônoma, aumentando a satisfação e reduzindo drasticamente os custos. Se bem-sucedido, este modelo transforma a interação com o cliente em um relacionamento contínuo e proativo, alterando fundamentalmente a forma como as empresas se relacionam com os consumidores globalmente.

O modelo M2.7 da MiniMax agora está publicamente disponível via MiniMax Agent e a Plataforma de API MiniMax. Ele suporta fluxos de trabalho complexos em engenharia de software, produtividade de escritório e ambientes de pesquisa, oferecendo capacidades como depuração autônoma e research agent harnesses. Este lançamento da MiniMax sinaliza uma mudança em direção a modelos que participam de sua própria evolução.

A Stripe anunciou suporte para LLMs programáveis, permitindo que empresas criem experiências de pagamento personalizadas. Este recurso possibilita a integração de modelos de IA nos processos de pagamento para interações de usuário aprimoradas. O objetivo é otimizar e personalizar a jornada de pagamento para os usuários, oferecendo novas formas de interação e customização.

O GPT 5.4 traz um aumento considerável na usabilidade e na sua capacidade de agir como agente. Este é o primeiro agente da OpenAI que de fato transmite a sensação de poder executar muitas tarefas diversas. O seguimento de instruções do modelo é preciso, e ele simplesmente faz o que lhe é dito. O GPT 5.4 provavelmente atrairá o coordenador principal que deseja desencadear um exército de IA em tarefas distribuídas.

O Unsloth Studio é uma UI web no-code para treinar, executar e exportar modelos abertos. ️ Ele permite que os usuários rodem modelos GGUF e safe tensor localmente em Mac, Windows e Linux, além de executar e treinar modelos de texto, visão, áudio TTS e embedding. O estúdio pode, ainda, criar automaticamente conjuntos de dados a partir de arquivos PDF, CSV, JSON, DOCX e TXT. Um tutorial em vídeo sobre como começar a usar o Unsloth Studio está disponível.

A Google DeepMind lançou um artigo que detalha uma taxonomia cognitiva para medir o progresso da IA em direção à AGI, identificando 10 habilidades cognitivas essenciais como percepção, aprendizado e raciocínio. O estudo propõe um protocolo de avaliação de três estágios que compara o desempenho da IA a benchmarks humanos . Além disso, um hackathon no Kaggle, com um prêmio de US$ 200.000, convida pesquisadores a desenvolver avaliações para cinco habilidades ainda pouco exploradas, utilizando a nova plataforma Community Benchmarks .

A estrutura interna da Anthropic trata as "skills" de IA como pastas funcionais, contendo scripts e assets, em vez de texto estático, utilizando o sistema de arquivos para engenharia de contexto. Nove categorias principais foram identificadas, com verificação de produto e seções de "Gotchas" consideradas os componentes de maior alavancagem para aprimorar a confiabilidade da saída. Essa mudança para a "progressive disclosure" permite que os agentes busquem dados específicos e "runbooks" apenas quando necessário, reduzindo o ruído de contexto e as taxas de erro.

O Aristotle Agent é um matemático autônomo capaz de resolver e formalizar os problemas de pesquisa matemática mais desafiadores do mundo. Ele é totalmente agentic e pode produzir código com qualidade de repositório, realizando provas e formalizações autonomamente por até 24 horas sem intervenção humana. A ferramenta já está disponível gratuitamente via web, CLI e API.

A OpenAI lançou os modelos GPT-5.4 mini e nano, versões menores projetadas para cargas de trabalho de alto volume com maior velocidade e menor custo. O GPT-5.4 mini apresenta melhorias substanciais em relação ao GPT-5 mini e se aproxima do modelo GPT-5.4 maior em alguns benchmarks, enquanto o GPT-5.4 nano é focado em tarefas mais leves, como classificação, extração e ranqueamento.

O Mistral Forge é uma plataforma destinada a empresas e governos para a criação de modelos de IA personalizados, treinados do zero com seus próprios dados. ️ A empresa o posiciona como uma alternativa mais controlada ao fine-tuning e RAG, oferecendo suporte para treinamento específico de domínio, reinforcement learning e menor dependência de provedores de modelos terceirizados.