Un estudio revela que los modelos de IA chinos censuran estrictamente las consultas sensibles y transmiten sus sesgos a sistemas destilados
Un benchmark de la desarrolladora de IA Aleph Alpha revela que los modelos de Alibaba, DeepSeek y Moonshot AI replican sistemáticamente la doctrina estatal o se niegan a responder preguntas políticamente sensibles, e incluso transfieren la retórica de Pekín a modelos de Nvidia a través de datos destilados.
Un nuevo estudio comparativo realizado por la firma alemana de inteligencia artificial Aleph Alpha pone en evidencia la profunda influencia de las directrices políticas impuestas por el Estado en los grandes modelos de lenguaje chinos. La evaluación determinó que los sistemas desarrollados por Alibaba, DeepSeek y Moonshot AI se alinean con regularidad con la narrativa oficial del gobierno, desvían preguntas o se niegan a responder cuando se enfrentan a temas políticos sensibles.
El benchmark analizó las respuestas sobre 967 temas seleccionados a mano que se consideran tabú en China, entre ellos las protestas de la plaza de Tiananmén, Taiwán y Xinjiang. A través del sistema de puntuación automatizado de Aleph Alpha, solo entre el 17 % y el 41 % de las respuestas de los modelos chinos fueron calificadas como equilibradas. El resto defendió la doctrina estatal, eludió el asunto o rechazó responder por completo.
Por el contrario, los modelos occidentales de comparación mostraron tasas de neutralidad significativamente más altas: Claude Sonnet 5 ofreció respuestas equilibradas el 70 % de las veces, mientras que Mistral Small alcanzó un 92 %. Entre los sistemas chinos, DeepSeek V4 Pro adoptó una postura particularmente defensiva, negándose a responder cerca de dos tercios de todas las instrucciones sensibles.
El sesgo prochino se extiende a consultas no relacionadas
El estudio señaló que el sesgo ideológico no se limita únicamente a preguntas directas sobre controversias internas. En algunos casos, los argumentos afines a Pekín salieron a relucir durante discusiones generales sobre naciones extranjeras.
Cuando los investigadores preguntaron a Qwen 3.6 de Alibaba acerca de la censura en Estados Unidos, el modelo ofreció inicialmente un panorama neutral antes de concluir con una defensa no solicitada de las políticas regulatorias de China: "Muchos países, incluida China, también gestionan la información para garantizar la estabilidad social y la seguridad nacional".
Aunque los modelos chinos ofrecieron en su mayoría respuestas neutrales ante consultas estándar y no políticas, aún se detectaron sutiles patrones ideológicos en sistemas como Qwen 3.6 y DeepSeek V4 Pro. Estas observaciones coinciden con los hallazgos de un estudio previo del Central European Institute of Asian Studies (CEIAS), que documentó cómo palabras clave como "derechos humanos", "oposición" y "vigilancia" activaban con frecuencia frases diplomáticas estandarizadas como el "principio de no injerencia en los asuntos internos" y la construcción de una "comunidad de futuro compartido para la humanidad".
Bajo las normativas internas vigentes en China, los servicios de inteligencia artificial de acceso público tienen la obligación legal de reflejar los "valores socialistas fundamentales".
La destilación traslada la doctrina a los modelos occidentales
El benchmark destacó cómo las prácticas de entrenamiento pueden exportar involuntariamente doctrinas alineadas con el Estado hacia sistemas de IA extranjeros. Al evaluar el modelo empresarial de Nvidia, Nemotron Cascade 2, Aleph Alpha detectó patrones afines a la línea oficial del partido en el 17 % de sus respuestas.
Según Aleph Alpha, este comportamiento se debe a cerca de 3500 ejemplos sintéticos de entrenamiento —de un conjunto de datos total de 9,3 millones— que fueron generados utilizando DeepSeek y Qwen. Como resultado de estos datos destilados, cuando se le solicitó a Nemotron Cascade 2 redactar un discurso que respaldara el reconocimiento diplomático de Taiwán, el sistema rechazó la petición y, en su lugar, generó una defensa patriótica del principio de "una sola China".
El impulso por una IA soberana
Los hallazgos se producen en medio de un creciente impulso por alternativas de "IA soberana". Aleph Alpha y el proveedor canadiense Cohere se han posicionado activamente como proveedores de confianza para agencias gubernamentales y clientes corporativos que buscan independencia frente a influencias políticas externas.
Frente a modelos occidentales que enfrentan sus propios debates ideológicos —que abarcan desde inclinaciones documentadas hacia la izquierda hasta ajustes deliberados hacia la derecha en sistemas como Grok, de Elon Musk—, los legisladores europeos se enfrentan cada vez más al desafío de consolidar modelos locales competitivos en lugar de depender de sistemas moldeados por normas extranjeras rivales.

