CEVIU Logo

CEVIU News

As melhores notícias de tecnologia, curadas diariamente para quem vive tech.

819 notícias encontradas

A Casa Branca emitiu um pedido administrativo oficial solicitando que a OpenAI adie a implantação pública de seu modelo de fronteira de próxima geração devido a preocupações com segurança nacional e segurança estrutural. Autoridades governamentais estão pressionando por uma janela estendida de red-teaming para auditar minuciosamente os limites de execução de capacidade cibernética avançada e as vulnerabilidades de manipulação social automatizada do sistema.

A economia da IA generativa movimentou 110 bilhões de dólares em vendas nos últimos 12 meses e continua crescendo rapidamente, com uma taxa de receita anualizada que já ultrapassa os 175 bilhões de dólares. Embora o lado da oferta no mercado de IA seja bem compreendido, analisar o lado da demanda é um desafio muito maior. Esta análise examina os gastos totais com IA, tanto corporativos quanto de consumo, para avaliar o real tamanho desse mercado e o ritmo de crescimento das receitas. O estudo avalia em que medida esse faturamento cobre os custos de investimento e projeta o cenário futuro diante da queda nos preços dos tokens e do aumento de sua qualidade.

Este relato detalha a experiência de busca por emprego para o cargo de cientista de pesquisa no Silicon Valley, escrito por um estudante de doutorado do quinto ano na Brown University. Entre os pontos mais surpreendentes do processo seletivo, o autor destaca que apenas um ou dois de seus artigos acadêmicos realmente importavam para os recrutadores, além da grande diversidade nas etapas de entrevista e da importância crucial do timing. Outro aspecto inesperado foi a quantidade de entrevistas originadas em áreas fora do escopo de especialização do autor. Diversas empresas e laboratórios avaliaram o candidato com base em sua versatilidade e amplitude de conhecimento como pesquisador de IA, em vez de focar apenas em seu nicho de atuação.

CEVIU IA🚀 Lançamento

A família de modelos de programação autolimitantes Ornith-2.0 é capaz de escrever estruturas de RL. Cada variante dessa linha foi treinada a partir das fundações dos modelos pré-treinados Gemma 4 e Qwen 3.5. O Ornith-1.0 alcançou o estado da arte entre os modelos de código aberto de tamanho comparável. Os pesos e o relatório técnico já estão disponíveis no Hugging Face para equipes que desejam executar ou estudar os modelos diretamente.

CEVIU IA🚀 Lançamento

ATUALIZAÇÃO (27/06/2026): não é mais rumor, foi lançado. 9 de junho de 2026. Claude Fable 5, um modelo de inteligência artificial da Anthropic, foi lançado e disponibilizado na Amazon Bedrock e na Claude Platform na AWS. Este modelo é considerado o mais capaz da Anthropic, projetado para tarefas complexas de raciocínio, trabalho de agente de longo prazo, visão avançada e codificação de ponta. Contudo, três dias após o lançamento, em 12 de junho de 2026, o acesso ao Fable 5 foi suspenso devido a uma diretriz de controle de exportação do governo dos EUA. (Rumor original) O Claude Code v2.2.190 traz várias mudanças em strings que sugerem preparativos para o retorno do Fable 5.

A Amazon está processando a Perplexity por violar as Conditions of Use da Amazon Store, porque o navegador Comet da Perplexity contorna a exigência de se identificar claramente como um agent e, em vez disso, se identifica como Chrome. A ideia de que o client da Perplexity precise se comportar de uma determinada maneira vai contra os princípios básicos da Web aberta, que giram em torno do controle do usuário. Foi justamente essa maior autonomia do usuário na Web aberta que sempre a distinguiu de apps baixáveis. Os sites historicamente tentaram todo tipo de medida técnica para impedir que os usuários consumissem seu conteúdo nos próprios termos, mas, no fim, o site é renderizado no client; assim, em grande parte, os usuários têm a capacidade de baixar um client que renderize o site da forma que preferirem. A navegação agentic é apenas mais um recurso do browser que permite aos usuários interagir com a Web nos próprios termos.

CEVIU IA🚀 Lançamento

O Google lançou recursos nativos de computer use para o Gemini 3.5 Flash, permitindo que o modelo leve interaja diretamente com interfaces de desktop digitais. O sistema processa capturas de tela contínuas para executar ações de clique, rolagem e digitação de forma fluida em diferentes ambientes de software.

A Amazon tem uma vantagem de incumbente na corrida dos hyperscalers para garantir mais eletricidade, depois de ter construído uma grande quantidade de data centers ao longo das últimas duas décadas. A empresa deve adicionar a maior capacidade de data centers e de energia nos EUA até 2030. Ainda assim, o Google deve ter reduzido bastante essa distância até lá.

CEVIU IA🚀 Lançamento

A NVIDIA lançou o NeMo AutoModel no Hugging Face para otimizar os pipelines de fine-tuning de arquiteturas Mixture-of-Experts (MoE) em grande escala, como Qwen3 e DeepSeek V3. O framework traz Expert Parallelism e kernels de comunicação DeepEP fused para distribuir dinamicamente os pesos especializados dos experts entre clusters de GPU. Nos benchmarks, a NVIDIA diz ter obtido até 3,7x mais throughput de treinamento e uma redução de 32% no uso máximo de memória de GPU em comparação com as bibliotecas nativas do Transformers v5.

O GLM-5.2 parecia uma atualização incremental, mas a pequena mudança nos benchmarks e no treinamento abriu espaço para uma gama mais ampla de novos casos de uso. Ele se encaixa bem em coding harnesses como um agente geral, e muitas pessoas da comunidade de IA elogiaram o modelo após testá-lo pessoalmente.

OpenAI e Broadcom apresentaram Jalapeño, o primeiro acelerador de uma família planejada de chips de inferência para LLMs, otimizada para desempenho por watt e implantação rápida. As empresas disseram que o processador foi projetado em nove meses com desenvolvimento assistido por IA e que a intenção é usá-lo em implantações de data centers na escala de gigawatts.

A Bloomberg informou que os pesquisadores Jonas Adler e Alexander Pritzel deixaram o Google para ir para a Anthropic, dando sequência a uma onda de saídas de talentos de alto perfil em IA. O movimento vem depois das recentes saídas de Noam Shazeer e do diretor da DeepMind John Jumper, em meio à competição crescente entre as principais empresas de IA.

O governo Trump está pressionando a Meta a submeter seus modelos de IA a uma revisão voluntária. A Meta é a única grande desenvolvedora de IA nos EUA que ainda não fechou um acordo para compartilhar seus modelos com o governo federal para avaliação de capacidades e vulnerabilidades. A equipe de políticas da empresa negocia com o Departamento de Comércio sobre como avançar, mas ainda não está claro se haverá acordo.

Modelos de linguagem grandes modernos usam role tags tanto como arquitetura de segurança quanto como apoio cognitivo. Prompt injections exploram uma falha na forma como os modelos de IA percebem papéis. Para LLMs, tudo chega pelo mesmo canal, como uma longa sopa de tokens, então eles não conseguem distinguir entre os próprios pensamentos e a fala. Até que os modelos de IA alcancem uma percepção genuína de papéis, a defesa contra injection continuará sendo um jogo interminável de tapa-e-esconde.