arstechnica.com
La nueva fuente "ShieldFont" busca proteger el contenido web del raspado de IA
Una nueva herramienta llamada "ShieldFont" ha sido desarrollada para combatir el raspado de datos por parte de sistemas de inteligencia artificial, según se ha anunciado. Esta innovadora fuente tiene como objetivo envenenar los datos de entrenamiento de las IA sin afectar la legibilidad de las páginas web para los usuarios humanos. La iniciativa surge como una respuesta directa a la preocupación creciente sobre cómo las grandes empresas de IA están utilizando el contenido de la web para entrenar sus modelos. "ShieldFont" funciona alterando sutilmente la representación de los caracteres de manera que, aunque visualmente parezcan normales para un ojo humano, los algoritmos de IA los interpreten como datos corruptos o sin sentido. Esto permite que los sitios web protejan su contenido de ser utilizado indiscriminadamente para el entrenamiento de modelos de lenguaje grandes (LLMs). La tecnología busca crear una barrera efectiva contra el acceso no autorizado a la información, sin comprometer la experiencia del usuario. La importancia de esta herramienta radica en su potencial para empoderar a los creadores de contenido y a los propietarios de sitios web, dándoles un control sobre cómo se utilizan sus datos. Al dificultar el raspado, "ShieldFont" podría cambiar las reglas del juego en la batalla por la propiedad intelectual en la era de la IA. Esto podría llevar a un futuro donde los desarrolladores de IA necesiten negociar o licenciar el acceso a datos de entrenamiento, en lugar de simplemente extraerlos de la web.