CEVIU Logo

CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

819 notícias encontradas

A NVIDIA delineou um vasto escopo na GTC 2026, abrangendo parcerias em modelos de fundação abertos, tooling para agentes, novos modelos de raciocínio e segurança, sistemas robóticos e IA para saúde focada em descoberta e simulação de medicamentos. Essa expansão demonstra um compromisso com a inovação em diversas frentes da IA, do desenvolvimento de modelos à aplicação prática em setores cruciais.

Um desenvolvedor perguntou ao seu agente de IA como ele queria se lembrar das coisas. O agente redesenhou seu próprio sistema de memória, realizou uma autoavaliação, diagnosticou seus pontos cegos e melhorou o recall de 60% para 93%, tudo isso por apenas US$ 2. O experimento demonstra o que acontece quando a IA é tratada como participante em sua própria arquitetura cognitiva.

O Alibaba está estabelecendo uma unidade de negócios para consolidar seus serviços de IA e esforços de desenvolvimento sob uma única estrutura. O novo Alibaba Token Hub integrará a equipe de pesquisa responsável pelos modelos Qwen da empresa, sua divisão de aplicativos voltados para o consumidor e outros produtos chave relacionados à IA. Além disso, a unidade supervisionará o aplicativo DingTalk, similar ao Slack, e os dispositivos da marca Quark. Esta reestruturação visa acelerar a interação entre as diversas equipes envolvidas na iniciativa mais ampla de IA da Alibaba .

A OpenAI planeja redirecionar seus esforços para usuários de codificação e para o setor corporativo. Seus líderes estão ativamente buscando áreas para despriorizar. A estratégia da empresa de 'fazer tudo ao mesmo tempo' a ajudou a conquistar a reputação de pioneira da era da IA. No entanto, sob crescente pressão de rivais, a empresa agora necessita de uma direção estratégica mais clara para o futuro.

A OpenAI explicou que o Codex Security foi projetado para analisar repositórios diretamente, em vez de fazer a triagem de relatórios de static analysis. A abordagem se concentra na arquitetura do sistema, limites de confiança e validação de descobertas antes de apresentá-las a humanos. Este método visa especificamente falhas de segurança semânticas, onde as defesas parecem presentes, mas falham em realmente impor a proteção pretendida. ️

O Mistral Small 4 integra as capacidades dos modelos Magistral, Pixtral e Devstral, oferecendo uma IA unificada multimodal e otimizada para raciocínio, com esforço de raciocínio configurável. Ele emprega uma arquitetura Mixture of Experts com 119 bilhões de parâmetros, suportando entradas de texto e imagem, e apresenta escalabilidade eficiente. O Mistral Small 4 alcança desempenho competitivo com comprimento de saída reduzido, é open-source e está disponível em plataformas como vLLM, llama.cpp e Transformers, facilitando sua adoção e uso pela comunidade de desenvolvedores.

A Apple planeja investir US$ 14 bilhões em IA este ano, um valor modesto se comparado aos US$ 700 bilhões que Amazon, Alphabet, Meta e Microsoft estão aportando. Aparentemente, a empresa crê que a construção de infraestrutura de IA não trará retornos proporcionais. Seu menor gasto se baseia na convicção de que os modelos de IA se tornarão commodities e mais compactos, que suas linhas de produtos existentes podem absorver as cargas de trabalho que o cloud foi projetado para atender, e que a vantagem duradoura pertence a quem detém o cliente. A Apple está apostando em seus dispositivos com capacidade de IA em vez de infraestrutura centralizada.

O padrão de subagents agora conta com amplo suporte em agentes de codificação. No OpenAI Codex, os subagents já estão geralmente disponíveis. O sistema inclui subagents padrão como 'explorer', 'worker' e 'default', embora as diferenças entre eles não sejam claras. Usuários também podem definir agentes customizados, utilizando instruções personalizadas e modelos específicos para suas necessidades.

AMI Labs e World Labs levantaram mais de US$ 1 bilhão com base em 'world models', um conceito que, na realidade, abrange cinco abordagens distintas no campo da IA: JEPA, spatial intelligence, learned simulation, physical AI infrastructure e active inference. Essa diversidade reflete a complexidade da modelagem de mundos. O resultado mais notável do estudo é o V-JEPA 2, que alcançou planejamento robótico zero-shot após ser treinado com apenas 62 horas de dados específicos de domínio. Cada uma dessas abordagens busca solucionar um subproblema específico, e a expectativa é que as fronteiras entre elas se tornem rapidamente indistintas.

Conexões residuais têm tradicionalmente dependido de uma acumulação uniforme fixa. A introdução dos Attention Residuals propõe uma nova abordagem, substituindo a recorrência depth-wise padrão por um mecanismo de atenção aprendido e dependente da entrada, aplicado sobre as camadas precedentes. Isso capacita as redes a recuperar seletivamente representações passadas, mitigando de forma natural a diluição e o crescimento do hidden-state. Validados na arquitetura Kimi Linear, os Attention Residuals demonstraram ganhos consistentes de desempenho em tarefas subsequentes.

Os modelos Claude Opus 4.6 e Sonnet 4.6 agora oferecem a janela de contexto completa de 1M com precificação padrão na Plataforma Claude. Essa expansão significa menos necessidade de compactação e a preservação de uma parte maior da conversa. A capacidade de 1M de contexto agora também está incluída no Claude Code para usuários Max, Team e Enterprise que utilizam o Opus 4.6. A precificação padrão é aplicada a toda a janela de contexto, sem a adição de multiplicadores.

A ferramenta de design do Google, Stitch, que será renomeada, está se transformando em um workspace 3D com colaborações impulsionadas por IA, superando o modelo de tela plana. Entre as melhorias, destacam-se controles de voz e um agente conversacional integrado.Adicionalmente, o Stitch permitirá a geração de aplicações React funcionais diretamente a partir dos designs. Esses avanços posicionam a ferramenta como uma solução abrangente, do conceito à produção, com provável destaque no Google I/O 2026.

O plano da OpenAI de suspender a proibição de conteúdo X-rated desencadeou um vigoroso debate interno sobre os riscos potenciais. A empresa está avançando com seus planos de conteúdo erótico, apesar das preocupações de membros do conselho com experiência em áreas como psicologia e neurociência cognitiva. A equipe da OpenAI identificou vários riscos, incluindo o potencial de uso compulsivo e dependência emocional excessiva do chatbot. A empresa desenvolveu um plano para monitorar uma série de potenciais efeitos a longo prazo do modo adulto, cujo lançamento foi adiado, pois a OpenAI está atualmente priorizando outros produtos.

A AWS está implementando sistemas Cerebras CS-3 para oferecer a inferência de IA mais rápida do setor via AWS Bedrock, utilizando LLMs de código aberto e os modelos Nova da Amazon. Essa colaboração introduz uma arquitetura desagregada, que combina o AWS Trainium para a fase de prefill com o Cerebras WSE para o decode, resultando em um aumento de 5x no throughput de tokens. Essa configuração otimiza o desempenho de inferência de alta velocidade ao empregar hardware especializado de forma eficiente para cada etapa computacional.

A tendência atual da indústria está focada em CLIs, de forma similar ao que ocorreu com o MCP há poucos meses. Embora o uso de CLIs possa gerar economia de tokens, CLIs personalizados enfrentam os mesmos desafios de contexto que o MCP, porém sem a estrutura e com outras limitações. O uso individual de agentes de codificação difere significativamente da adoção desses agentes em nível organizacional. ️ Assim, para casos de uso empresariais e corporativos, o MCP ainda se posiciona como o presente e o futuro.

O engenheiro de dados de Sydney, Paul Conyngham, utilizou ChatGPT, modelagem de proteínas AlphaFold e um sequenciamento genômico de US$ 3.000 do tumor de sua cadela Rosie para produzir uma fórmula de mRNA de meia página. Essa fórmula foi então transformada em uma vacina física pelo RNA Institute da UNSW em menos de dois meses. Após a primeira injeção em dezembro de 2025, um dos tumores de Rosie encolheu 75%, marcando a primeira vacina personalizada contra o câncer já desenvolvida para um cão. O processo espelha os ensaios clínicos em humanos de Moderna e Merck. Pesquisadores da UNSW agora questionam por que essa abordagem não está sendo aplicada de forma mais ampla a pacientes com câncer.

Uma versão beta do Imagine with Claude está sendo lançada no Claude Chat. Essa funcionalidade permite criar gráficos, diagramas e outras visualizações personalizadas, com a capacidade de ajustar e modificar essas criações à medida que a conversa se desenvolve. A funcionalidade virá ativada por padrão, e Claude decidirá quando gerar um visual. Os usuários também podem solicitar um visual diretamente. O artigo inclui vídeos que demonstram exemplos dessas visualizações.