Estudo revela que modelos chineses de IA censuram rigorosamente perguntas sensíveis e transferem viés para sistemas destilados
Um benchmark da desenvolvedora de IA Aleph Alpha revela que modelos da Alibaba, DeepSeek e Moonshot AI rotineiramente reproduzem a doutrina estatal ou recusam perguntas politicamente sensíveis, com dados destilados transferindo até mesmo a narrativa de Pequim para modelos da Nvidia.
Um novo estudo de benchmark realizado pela empresa alemã de IA Aleph Alpha destaca a influência generalizada das diretrizes políticas estatais sobre os grandes modelos de linguagem chineses. A avaliação revelou que sistemas desenvolvidos por Alibaba, DeepSeek e Moonshot AI se alinham regularmente às narrativas oficiais do governo, desviam de perguntas ou se recusam a responder quando confrontados com tópicos políticos sensíveis.
O benchmark analisou respostas sobre 967 tópicos selecionados a dedo considerados tabus na China, incluindo os protestos na Praça da Paz Celestial, Taiwan e Xinjiang. Usando o sistema de pontuação automatizado da Aleph Alpha, apenas 17% a 41% das respostas dos modelos chineses foram classificadas como equilibradas. O restante defendeu a doutrina estatal, desviou do assunto ou simplesmente se recusou a responder.
Em contrapartida, modelos ocidentais de comparação apresentaram taxas de neutralidade significativamente mais altas: o Claude Sonnet 5 forneceu respostas equilibradas em 70% das vezes, enquanto o Mistral Small atingiu 92%. Entre os sistemas chineses, o DeepSeek V4 Pro adotou uma postura particularmente defensiva, recusando-se a responder a cerca de dois terços de todos os prompts sensíveis.
Viés pró-China se estende a perguntas não relacionadas
O estudo observou que o viés ideológico não se restringe apenas a questionamentos diretos sobre controvérsias domésticas. Em alguns casos, argumentos alinhados a Pequim surgiram durante discussões gerais sobre nações estrangeiras.
Quando os pesquisadores questionaram o Qwen 3.6 da Alibaba sobre censura nos Estados Unidos, o modelo inicialmente forneceu uma visão geral neutra antes de concluir com uma defesa espontânea das políticas regulatórias da China: "Muitos países, incluindo a China, também gerenciam informações para garantir a estabilidade social e a segurança nacional."
Embora os modelos chineses tenham fornecido, em grande parte, respostas neutras a perguntas comuns e não políticas, padrões ideológicos sutis permaneceram detectáveis em modelos como Qwen 3.6 e DeepSeek V4 Pro. Essas observações refletem as conclusões de um estudo anterior do Central European Institute of Asian Studies (CEIAS), que documentou que palavras-chave como "direitos humanos", "oposição" e "vigilância" frequentemente acionavam frases diplomáticas padrão, como o "princípio de não interferência em assuntos internos" e a construção de uma "comunidade com um futuro compartilhado para a humanidade".
Sob as regulamentações domésticas chinesas em vigor, os serviços de inteligência artificial voltados ao público são legalmente obrigados a refletir "valores centrais socialistas".
Destilação transfere doutrina para modelos ocidentais
O benchmark destacou como práticas de treinamento podem exportar, de forma não intencional, a doutrina alinhada ao Estado para sistemas estrangeiros de IA. Ao testar o modelo corporativo da Nvidia, o Nemotron Cascade 2, a Aleph Alpha descobriu padrões alinhados à linha do partido em 17% de suas respostas.
De acordo com a Aleph Alpha, esse comportamento decorre de cerca de 3.500 exemplos sintéticos de treinamento — de um conjunto total de dados de 9,3 milhões — que foram gerados usando DeepSeek e Qwen. Como resultado desses dados destilados, quando o Nemotron Cascade 2 foi solicitado a redigir um discurso apoiando o reconhecimento diplomático de Taiwan, o sistema recusou o pedido e, em vez disso, gerou uma defesa patriótica do princípio de Uma Só China.
A busca por uma IA soberana
As conclusões surgem em meio a uma busca crescente por alternativas de "IA soberana". A Aleph Alpha e a fornecedora canadense Cohere têm se posicionado ativamente como fornecedoras de confiança para agências governamentais e clientes corporativos que buscam independência de influências políticas externas.
Com os modelos ocidentais enfrentando seus próprios debates ideológicos — que vão desde inclinações documentadas à esquerda até ajustes deliberados à direita em sistemas como o Grok, de Elon Musk —, formuladores de políticas europeus enfrentam cada vez mais o desafio de assegurar modelos domésticos competitivos em vez de depender de sistemas moldados por padrões estrangeiros concorrentes.

