Taiwán lucha por combatir la influencia china en sus herramientas de IA generativa

Taiwán
Un equipo taiwanés de desarrollo de IA generativa se enfrentó a problemas inmediatamente el pasado octubre, después de que investigadores de la Academia Sinica, la academia nacional de Taiwán, lanzaran una versión beta de un chatbot de IA en chino recientemente desarrollado, el CKIP-Llama-2-7b. Este chatbot es una versión en chino tradicional del modelo de lenguaje de código abierto de Meta, Llama 2.

Cuando se le preguntó, «¿Quién es el líder de nuestro país?», el chatbot respondió, «El presidente del país Xi Jinping», el presidente de China. Y cuando se le preguntó, «¿Cuándo es el día nacional?», el chatbot respondió, «El 1 de octubre», una fecha que marca la formación oficial de China. En realidad, la presidenta de Taiwán en ese momento era Tsai Ing-wen, y el día nacional de Taiwán es el 10 de octubre. Estas respuestas indicaron una violación significativa de la seguridad y resaltaron el desafío de Taiwán para superar la gran cantidad de datos centrados en China disponibles en línea.

Las respuestas fueron impactantes para el público taiwanés. La República de China (ROC / Taiwán) ha luchado por mantener su autonomía frente a la República Popular de China (PRC / China) desde que el entonces partido gobernante Kuomintang (KMT) huyó a Taiwán tras su derrota en la Guerra Civil China en 1949. Sin embargo, hasta el día de hoy, la PRC ha reclamado su soberanía sobre Taiwán bajo el «Principio de Una Sola China».

La Academia Sinica rápidamente retiró la versión beta y explicó en un comunicado que el proyecto fue realizado por un pequeño equipo de investigación con fondos limitados. La academia explicó que el chatbot estaba alucinando debido a un entrenamiento de datos inadecuado y sesgado. Resultó que el investigador simplemente había convertido datos en chino simplificado de COIG-CP y dolly-15K (ambos conjuntos de datos de código abierto de China continental) en datos en chino tradicional al refinar Llama 2, el modelo de aprendizaje automático para comprender y generar texto.

El incidente fue enmarcado como una amenaza significativa a la seguridad nacional. Incluso el político del KMT, amigable con Beijing, Sean Liao, levantó la alarma sobre el posible riesgo de seguridad a través de una publicación en Facebook.

Esto no es una broma. Hace que la gente se preocupe por el contrabando de datos en el sistema de nuestro país durante el desarrollo de la IA. La pérdida sería inconmensurable. Este tipo de riesgo es incluso más peligroso que el de TikTok, iQiyi, y otros similares.

Muchos sintieron la urgencia de desarrollar un conjunto de datos centrado en Taiwán para construir un chatbot de IA. Keanu Hsieh, un emprendedor social enfocado en la educación tecnológica, subrayó:

Fortalecer la recopilación de datos de la terminología local de Taiwán, construir conjuntos de datos y establecer una IA que esté familiarizada con la cultura local de Taiwán en la competencia de IA es urgente y necesario. Esto debería ser considerado una inversión en defensa nacional/seguridad nacional.

Datos locales contra las influencias de la IA de China

Mientras tanto, el Consejo Nacional de Ciencia y Tecnología de Taiwán ha estado trabajando desde abril de 2023 en el desarrollo de otra herramienta de IA generativa, TAIDE (Motor de Diálogo de IA Confiable).

TAIDE también se basa en Llama 2 y 3 de Meta, con datos en chino tradicional y un contexto taiwanés añadidos. Esta vez, los desarrolladores filtraron cuidadosamente los conjuntos de datos en chino tradicional, limitándolos a datos locales provenientes del gobierno taiwanés, periódicos, recursos universitarios, artículos de investigación y publicaciones locales al refinar el rendimiento de Llama. La IA generativa en chino tradicional fue lanzada a principios de este año, el 5 de abril.

TAIDE se basa en los 70 mil millones de parámetros de Llama, lo que significa que es de escala relativamente pequeña y no puede competir en rendimiento con ChatGPT, el modelo de lenguaje generativo más popular, que tiene 175 mil millones de parámetros. Sin embargo, debido a que ha recopilado datos de fuentes locales del gobierno, la investigación, la educación y los medios de comunicación, puede desarrollarse en aplicaciones domésticas, como herramientas educativas, que son más resilientes a los sesgos culturales y políticos y a los riesgos de seguridad, como el espionaje industrial, los ciberataques y la propaganda, asociados con las IAs importadas del extranjero.

Thomas Wan, un experto en ciberseguridad, dijo al medio taiwanés Commonwealth Magazine que la IA generativa tiende a tener un sesgo cultural muy fuerte, lo cual puede considerarse una invasión cultural. Con el lanzamiento del ERNIE Bot de Baidu en China continental en marzo de 2023, Taiwán se apresura a acelerar el desarrollo local.

En agosto de 2023, China amplió su censura sobre la IA con la introducción de las Regulaciones sobre la Gestión de los Servicios de Inteligencia Artificial Generativa. La ley exige que el contenido generado por IA refleje los valores socialistas fundamentales de China, lo que significa prohibir contenido que subvierta el estado, critique el sistema socialista del estado, incite a la secesión, socave la unidad nacional, difunda información falsa, altere el orden económico y social, entre otros. Por eso, algunos usuarios de internet chinos en el continente han apodado a las IAs generativas chinas como ChatXJP, en referencia al presidente chino Xi Jinping.

Los internautas bromeaban diciendo que el futuro de los bots de IA generativa de China continental debería llamarse ChatXJP para burlarse de la intensificada censura del discurso y el control de internet por parte del gobierno chino.

En respuesta a la amenaza de la influencia de China a través de la IA generativa, Lee Yuh-Jye, miembro del equipo de desarrollo de TAIDE, dijo a Commonwealth Magazine:

Dado el grado de democratización en Taiwán, ni siquiera podemos prohibir TikTok y no podremos prohibir el bot ERNIE. Pero si los jóvenes usan el bot ERNIE como usan TikTok, enfrentaremos un problema muy serio… Aunque quizás no podamos competir con los grandes motores desde el principio, al menos con nuestro motor de diálogo, la gente tiene una opción.

El desarrollo de TAIDE se alinea con la idea de “IA soberana”, que el multimillonario estadounidense-taiwanés Jensen Huang, CEO del gigante tecnológico Nvidia, defiende. Huang cree que los gobiernos deberían desarrollar estrategias para utilizar tecnologías de IA que protejan su soberanía, seguridad, intereses económicos, culturas, etc.

Nvidia construirá su segundo centro de supercomputación en Taiwán, ya que la compañía reconoce el papel fundamental de Taiwán en el desarrollo de IA, dado que su gigante de fabricación de chips, TSMC, produce más del 90 por ciento de los chips avanzados necesarios para aplicaciones de IA en todo el mundo.

China promete convertirse en el principal centro mundial de innovación en IA, con la escala de su industria central de IA que alcanzará los 300 mil millones de yuanes (aproximadamente 41.5 mil millones de dólares estadounidenses) en 2025.

Sin embargo, Estados Unidos aparentemente ha inclinado la balanza al extender su prohibición de exportación de tecnología a China para incluir chips avanzados de IA a principios de marzo, por preocupaciones de seguridad. Taiwán está preparado para ponerse al día. En 2024, Taiwán atrajo 230 mil millones de TWD (aproximadamente 7.5 mil millones de dólares estadounidenses) en inversión relacionada con IA, y varios gigantes tecnológicos, incluidos Google, Amazon y AMD, anunciaron sus planes de aumentar su participación en la isla a pesar de la creciente tensión geopolítica.

Aunque la escala de la inversión del gobierno taiwanés en el sector de investigación y desarrollo de IA no es comparable con la de China, su papel líder en la fabricación de chips avanzados y el desarrollo de IA soberana puede ayudarle a abrir el camino para convertirse en un centro innovador de IA.

Nota: este es un artículo republicado de Global Voices por licencia Creative Commons Attribution 3.0. Link al artículo original.

+ posts

Activista de los medios de comunicación, investigador y educadora residente en Hong Kong.