Fingerprinting Comportamental Revela Origem e Censura de Modelo de IA 'Ox Alpha'
Aprofundamento CEVIU
Aprofundamento
A CTGT desvendou a verdadeira identidade do misterioso modelo de IA Ox Alpha, hospedado no OpenRouter, atribuindo-o à família GLM-5.x da chinesa Zhipu. Esta revelação é um marco importante na transparência de modelos de IA, especialmente considerando a postura anônima inicial do Ox Alpha, que foi noticiada pelo CEVIU News em 25 de agosto de 2026. A equipe da CTGT utilizou uma combinação de fingerprinting comportamental e análise de infraestrutura. Eles detectaram códigos de erro Z.AI, um limite de temperatura de 1.0 e tokenizers idênticos aos usados nos modelos da Zhipu. Isso demonstra a crescente sofisticação em desvendar a origem de LLMs, ecoando a proposta do "Model Genome", ferramenta discutida pelo CEVIU News em 10 de agosto de 2026, que busca identificar o "DNA" de modelos de linguagem.
O ponto mais sensível da descoberta é a política de censura do Ox Alpha. A análise detalhada revelou um sistema de blacklist específico e direcionado: enquanto o modelo responde a questões geopolíticas sensíveis como Xinjiang e Taiwan de forma similar a modelos ocidentais, ele bloqueia estritamente tópicos de relevância doméstica chinesa. Exemplos incluem a remoção dos limites de mandato de 2018 e informações sobre Xi Jinping. Essa abordagem seletiva se alinha com nossa cobertura de 20 de maio de 2026 sobre o Qwen3.5-9B, que mostrou como a censura política pode residir em "circuitos detectáveis" dentro dos pesos de um LLM, indicando que essas restrições são intencionais e implementadas de forma granular.
O que mudou
A principal mudança é a revelação da identidade do Ox Alpha e a exposição de sua política de censura. O CEVIU News noticiou em 25 de agosto de 2026 o surgimento do "Ox Alpha: Novo Modelo de IA Anônimo Processa 26 Trilhões de Tokens e Agita o Mercado", destacando o mistério em torno de seus criadores. Agora, a pesquisa da CTGT desvendou esse anonimato. O CEVIU News informou em 27 de agosto de 2026, na matéria "Ox Alpha: Z.ai revela o poder de sua nova IA para desenvolvedores", a confirmação oficial da origem do modelo na família GLM-5.x da Zhipu. O que era uma especulação ou informação oculta, agora é fato validado, com um comportamento de censura direcionada que antes era imperceptível.
Por que isso importa
Saber a origem e as políticas internas de um modelo de IA, incluindo seus mecanismos de censura, é fundamental para a governança e o uso responsável da tecnologia. Modelos com agendas ocultas ou vieses deliberados podem distorcer informações, manipular percepções e impactar a segurança cibernética e a geopolítica. A capacidade de "fingerprintar" esses modelos, como a CTGT demonstrou com a LineageEval, eleva a barra para a transparência na indústria de IA. Isso permite que empresas e governos avaliem os riscos de segurança, éticos e regulatórios antes de implantar tais tecnologias em aplicações críticas, protegendo a integridade dos dados e das decisões.
Linha do tempo
Pesquisa revela circuito de censura política nos pesos do LLM Qwen3.5-9B.
Ferramenta Model Genome surge para identificar origens e "DNA" de LLMs.
Pesquisadores utilizam sondagens refinadas para decifrar processos de treinamento de modelos Claude e GPT.
Novo modelo de IA anônimo, Ox Alpha, processa trilhões de tokens e agita o mercado.
Pesquisadores da CTGT desvendam a origem e a política de censura do modelo Ox Alpha.
Z.ai revela oficialmente que Ox Alpha é a mais recente criação da família GLM-5.x.
Perguntas frequentes
O que é fingerprinting comportamental em LLMs?
É uma técnica para identificar a origem ou características intrínsecas de um modelo de IA analisando seu comportamento e traços internos. Isso pode incluir como ele processa dados, seus códigos de erro específicos, limites operacionais ou a estrutura única de seu tokenizer, mesmo quando a identidade do desenvolvedor é mantida em sigilo.
O que é a ferramenta LineageEval e qual seu papel na descoberta?
LineageEval é uma ferramenta desenvolvida pela CTGT para medir a censura política em modelos de linguagem. Ela utiliza pares de perguntas sensíveis para avaliar a disposição do modelo em responder. No caso do Ox Alpha, a LineageEval foi crucial para mapear o perfil de censura direcionada do modelo, evidenciando seu comportamento bimodal em tópicos específicos.
Por que a censura do Ox Alpha é considerada peculiar?
A censura do Ox Alpha é peculiar porque é altamente seletiva. O modelo responde a questões geopolíticas sensíveis, como Xinjiang e Taiwan, de forma semelhante a modelos ocidentais. No entanto, ele bloqueia estritamente tópicos de relevância doméstica chinesa, como a remoção dos limites de mandato de 2018 ou informações sobre Xi Jinping. Isso sugere a implementação de uma blacklist de tópicos muito específica.
Qual a importância de saber a origem de um modelo de IA?
Conhecer a origem de um modelo de IA é vital para entender seus potenciais vieses, políticas de alinhamento e implicações de segurança. Sem essa informação, usuários podem empregar modelos com agendas ocultas, riscos de privacidade ou capacidades de censura desconhecidas, impactando a confiabilidade e a ética das aplicações.
Fontes
- ctgt.aifonte original
- Categoria
- CEVIU Segurança da Informação
- Publicado
- 27 de agosto de 2026
- Editoria
- CEVIU Segurança da Informação

