CEVIU IA
Todas as notícias

CEVIU IA

Lançamentos, inovações e pesquisas para profissionais de IA, machine learning e ciência de dados

2347 notícias

A AWS está implementando sistemas Cerebras CS-3 para oferecer a inferência de IA mais rápida do setor via AWS Bedrock, utilizando LLMs de código aberto e os modelos Nova da Amazon. Essa colaboração introduz uma arquitetura desagregada, que combina o AWS Trainium para a fase de prefill com o Cerebras WSE para o decode, resultando em um aumento de 5x no throughput de tokens. Essa configuração otimiza o desempenho de inferência de alta velocidade ao empregar hardware especializado de forma eficiente para cada etapa computacional.

O engenheiro de dados de Sydney, Paul Conyngham, utilizou ChatGPT, modelagem de proteínas AlphaFold e um sequenciamento genômico de US$ 3.000 do tumor de sua cadela Rosie para produzir uma fórmula de mRNA de meia página. Essa fórmula foi então transformada em uma vacina física pelo RNA Institute da UNSW em menos de dois meses. Após a primeira injeção em dezembro de 2025, um dos tumores de Rosie encolheu 75%, marcando a primeira vacina personalizada contra o câncer já desenvolvida para um cão. O processo espelha os ensaios clínicos em humanos de Moderna e Merck. Pesquisadores da UNSW agora questionam por que essa abordagem não está sendo aplicada de forma mais ampla a pacientes com câncer.

AMI Labs e World Labs levantaram mais de US$ 1 bilhão com base em 'world models', um conceito que, na realidade, abrange cinco abordagens distintas no campo da IA: JEPA, spatial intelligence, learned simulation, physical AI infrastructure e active inference. Essa diversidade reflete a complexidade da modelagem de mundos. O resultado mais notável do estudo é o V-JEPA 2, que alcançou planejamento robótico zero-shot após ser treinado com apenas 62 horas de dados específicos de domínio. Cada uma dessas abordagens busca solucionar um subproblema específico, e a expectativa é que as fronteiras entre elas se tornem rapidamente indistintas.

A ferramenta de design do Google, Stitch, que será renomeada, está se transformando em um workspace 3D com colaborações impulsionadas por IA, superando o modelo de tela plana. Entre as melhorias, destacam-se controles de voz e um agente conversacional integrado.Adicionalmente, o Stitch permitirá a geração de aplicações React funcionais diretamente a partir dos designs. Esses avanços posicionam a ferramenta como uma solução abrangente, do conceito à produção, com provável destaque no Google I/O 2026.

A Axiom levantou uma rodada Série A de US$ 200 milhões, com uma avaliação de US$ 1,6 bilhão, liderada pela Menlo Ventures, um ano após sua fundação e com aproximadamente 20 funcionários. O objetivo é construir o que chama de Verified AI : sistemas que produzem resultados formalmente verificados na linguagem de programação Lean, onde cada etapa de raciocínio pode ser verificada por máquina e erros são detectados de forma determinística, em vez de estatística. A empresa inicialmente treinou em provas matemáticas e depois transferiu essa habilidade para a verificação de código , uma técnica que permite provar não apenas que o código gera saídas corretas, mas também que não criará superfícies de ataque inesperadas.

Uma única ferramenta `run(command="...")` com comandos estilo Unix tem se mostrado superior a um catálogo de chamadas de função tipadas. Essa abordagem baseia-se na decisão de design que o Unix tomou há 50 anos, de tratar tudo como um text stream. De forma similar, modelos de linguagem grandes adotaram uma premissa quase idêntica ao transformar tudo em tokens. O sistema baseado em texto que o Unix utiliza se encaixa naturalmente nos modelos de linguagem grandes, permitindo que atuem como terminal operators mais rapidamente do que qualquer humano. Desenvolvedores podem simplesmente pegar o que o Unix provou ao longo do último meio século e integrá-lo diretamente à IA.

O modelo Avocado da Meta superou o modelo anterior da empresa e o Google Gemini 2.5 de março, mas não apresentou o mesmo desempenho robusto contra os modelos líderes do Google, OpenAI e Anthropic. Diante disso, a empresa optou por adiar o lançamento do modelo para, no mínimo, maio. Especialistas avaliam que a Meta ainda possui tempo para alcançar seus rivais, considerando que o lançamento do Llama 4 no ano passado não atendeu às expectativas.

Uma versão beta do Imagine with Claude está sendo lançada no Claude Chat. Essa funcionalidade permite criar gráficos, diagramas e outras visualizações personalizadas, com a capacidade de ajustar e modificar essas criações à medida que a conversa se desenvolve. A funcionalidade virá ativada por padrão, e Claude decidirá quando gerar um visual. Os usuários também podem solicitar um visual diretamente. O artigo inclui vídeos que demonstram exemplos dessas visualizações.

Historicamente, o comércio tem se aproximado de um mercado de vendedores, onde os consumidores veem principalmente o que as plataformas escolhem destacar. No entanto, os agentes de IA irão gradualmente transferir esse poder para o comprador. Em vez de navegar pela camada de incentivos de mercado e plataforma, a IA permitirá que os consumidores acessem diretamente o melhor produto para suas necessidades. Essa dinâmica pode ser mais impactante no comércio B2B, que tem sido historicamente opaco, fragmentado e dependente de relacionamentos.

A IA Institucional pode gerar muito mais valor do que a IA Individual, ao redesenhar as organizações em conjunto com a tecnologia. Ao contrário da IA Individual, que impulsiona a produtividade com pouco impacto no valor da empresa, a IA Institucional foca na coordenação, na identificação de sinais em dados, na neutralização de vieses e na escala de receita. Organizações bem-sucedidas serão aquelas que integram a IA como um componente fundamental, de forma similar à mudança industrial para linhas de montagem elétricas.

Slate é um agente frontier que utiliza um ambiente de código para orquestração de swarm. Ele pode orquestrar e resolver tarefas programaticamente, executando um grande número de subagentes. Slate suporta uma variedade de modelos e seleciona automaticamente o modelo adequado para cada tarefa. O sistema emprega engenharia de contexto inovadora e maximiza o cache para reduzir custos.

A IA fez a transição de uma co-inteligência para uma era de gerenciamento de IA, com sistemas como o Claude Code completando tarefas complexas de forma autônoma. Melhorias exponenciais nas capacidades da IA têm impulsionado métodos de trabalho radicais, a exemplo da Software Factory movida por IA da StrongDM, e provocado mudanças significativas no mercado e no emprego.

A Cursor emprega um processo híbrido de avaliação, online e offline, para garantir que sua compreensão da qualidade dos modelos esteja alinhada com as atividades reais dos desenvolvedores ‍. A parte offline utiliza o CursorBench, um conjunto de avaliação interno baseado em sessões reais da equipe de engenharia da Cursor. Ele mede múltiplas dimensões do desempenho do agente, incluindo a correção da colusão, a qualidade do código, a eficiência e o comportamento de interação. A parte online envolve uma análise controlada sobre o tráfego em tempo real , que identifica regressões que os conjuntos offline podem não detectar. Juntos, esses componentes mantêm a percepção da Cursor sobre a qualidade do modelo firmemente enraizada no ambiente de produção, mesmo com a evolução dos fluxos de trabalho .

A ByteDance está montando poder computacional com chips de IA de ponta da Nvidia fora da China. A empresa está colaborando com a Aolani Cloud, uma companhia do Sudeste Asiático, em planos para utilizar cerca de 500 sistemas computacionais Nvidia Blackwell na Malásia . O hardware envolvido é avaliado em mais de US$ 2,5 bilhões . A ByteDance planeja usar essa capacidade computacional para suas atividades de pesquisa e desenvolvimento em IA fora do território chinês.

Outras categorias