Voltar
Pesquisadores identificam origem e censura do modelo anônimo Ox Alpha via fingerprinting comportamental

Fingerprinting Comportamental Revela Origem e Censura de Modelo de IA 'Ox Alpha'

Aprofundamento CEVIU

Aprofundamento

A CTGT desvendou a verdadeira identidade do misterioso modelo de IA Ox Alpha, hospedado no OpenRouter, atribuindo-o à família GLM-5.x da chinesa Zhipu. Esta revelação é um marco importante na transparência de modelos de IA, especialmente considerando a postura anônima inicial do Ox Alpha, que foi noticiada pelo CEVIU News em 25 de agosto de 2026. A equipe da CTGT utilizou uma combinação de fingerprinting comportamental e análise de infraestrutura. Eles detectaram códigos de erro Z.AI, um limite de temperatura de 1.0 e tokenizers idênticos aos usados nos modelos da Zhipu. Isso demonstra a crescente sofisticação em desvendar a origem de LLMs, ecoando a proposta do "Model Genome", ferramenta discutida pelo CEVIU News em 10 de agosto de 2026, que busca identificar o "DNA" de modelos de linguagem.

O ponto mais sensível da descoberta é a política de censura do Ox Alpha. A análise detalhada revelou um sistema de blacklist específico e direcionado: enquanto o modelo responde a questões geopolíticas sensíveis como Xinjiang e Taiwan de forma similar a modelos ocidentais, ele bloqueia estritamente tópicos de relevância doméstica chinesa. Exemplos incluem a remoção dos limites de mandato de 2018 e informações sobre Xi Jinping. Essa abordagem seletiva se alinha com nossa cobertura de 20 de maio de 2026 sobre o Qwen3.5-9B, que mostrou como a censura política pode residir em "circuitos detectáveis" dentro dos pesos de um LLM, indicando que essas restrições são intencionais e implementadas de forma granular.

O que mudou

A principal mudança é a revelação da identidade do Ox Alpha e a exposição de sua política de censura. O CEVIU News noticiou em 25 de agosto de 2026 o surgimento do "Ox Alpha: Novo Modelo de IA Anônimo Processa 26 Trilhões de Tokens e Agita o Mercado", destacando o mistério em torno de seus criadores. Agora, a pesquisa da CTGT desvendou esse anonimato. O CEVIU News informou em 27 de agosto de 2026, na matéria "Ox Alpha: Z.ai revela o poder de sua nova IA para desenvolvedores", a confirmação oficial da origem do modelo na família GLM-5.x da Zhipu. O que era uma especulação ou informação oculta, agora é fato validado, com um comportamento de censura direcionada que antes era imperceptível.

Por que isso importa

Saber a origem e as políticas internas de um modelo de IA, incluindo seus mecanismos de censura, é fundamental para a governança e o uso responsável da tecnologia. Modelos com agendas ocultas ou vieses deliberados podem distorcer informações, manipular percepções e impactar a segurança cibernética e a geopolítica. A capacidade de "fingerprintar" esses modelos, como a CTGT demonstrou com a LineageEval, eleva a barra para a transparência na indústria de IA. Isso permite que empresas e governos avaliem os riscos de segurança, éticos e regulatórios antes de implantar tais tecnologias em aplicações críticas, protegendo a integridade dos dados e das decisões.

Linha do tempo

  1. Pesquisa revela circuito de censura política nos pesos do LLM Qwen3.5-9B.

  2. Ferramenta Model Genome surge para identificar origens e "DNA" de LLMs.

  3. Pesquisadores utilizam sondagens refinadas para decifrar processos de treinamento de modelos Claude e GPT.

  4. Novo modelo de IA anônimo, Ox Alpha, processa trilhões de tokens e agita o mercado.

  5. Pesquisadores da CTGT desvendam a origem e a política de censura do modelo Ox Alpha.

  6. Z.ai revela oficialmente que Ox Alpha é a mais recente criação da família GLM-5.x.

Perguntas frequentes

O que é fingerprinting comportamental em LLMs?

É uma técnica para identificar a origem ou características intrínsecas de um modelo de IA analisando seu comportamento e traços internos. Isso pode incluir como ele processa dados, seus códigos de erro específicos, limites operacionais ou a estrutura única de seu tokenizer, mesmo quando a identidade do desenvolvedor é mantida em sigilo.

O que é a ferramenta LineageEval e qual seu papel na descoberta?

LineageEval é uma ferramenta desenvolvida pela CTGT para medir a censura política em modelos de linguagem. Ela utiliza pares de perguntas sensíveis para avaliar a disposição do modelo em responder. No caso do Ox Alpha, a LineageEval foi crucial para mapear o perfil de censura direcionada do modelo, evidenciando seu comportamento bimodal em tópicos específicos.

Por que a censura do Ox Alpha é considerada peculiar?

A censura do Ox Alpha é peculiar porque é altamente seletiva. O modelo responde a questões geopolíticas sensíveis, como Xinjiang e Taiwan, de forma semelhante a modelos ocidentais. No entanto, ele bloqueia estritamente tópicos de relevância doméstica chinesa, como a remoção dos limites de mandato de 2018 ou informações sobre Xi Jinping. Isso sugere a implementação de uma blacklist de tópicos muito específica.

Qual a importância de saber a origem de um modelo de IA?

Conhecer a origem de um modelo de IA é vital para entender seus potenciais vieses, políticas de alinhamento e implicações de segurança. Sem essa informação, usuários podem empregar modelos com agendas ocultas, riscos de privacidade ou capacidades de censura desconhecidas, impactando a confiabilidade e a ética das aplicações.

Fontes

Avalie este artigo:
Categoria
CEVIU Segurança da Informação
Publicado
27 de agosto de 2026
Editoria
CEVIU Segurança da Informação

Quer receber mais sobre CEVIU Segurança da Informação?

Conteúdo curado diariamente, direto no seu e-mail.

Conteúdo curado diariamenteDiversas categoriasCancele quando quiser