Cargando...

La Ley de Inteligencia Artificial de la Unión Europea exige a las empresas que ofrecen de sistemas de IA generativa marcar el texto generado por IA con una especie de marca de agua para que este sea identificable en cualquier momento. Y OpenAI, la empresa detrás del popular ChatGPT, ya ha especificado cómo va a llevar a cabo esta medida.

OpenAI desvela cómo va a marcar el texto generado por su IA

La UE está presionando a las empresas propietarias de los grandes modelos de IA para integrar sistemas de procedencia en el contenido. Es decir, una marca de agua que sea legible por máquinas y que pueda identificar que ese texto, o parte de ese texto, ha sido creado mediante IA. Pero esto no será una marca visible por el usuario, algo como una etiqueta que muestre “Generado con IA”; es algo mucho más profundo.

OpenAI ha desarrollado una tecnología llamada textGrain que, según han desvelado, “añade una señal estadística invisible a la selección de palabras del modelo”. Esto quiere decir que cuando ChatGPT tiene que escoger entre varias palabras o fragmentos, textGrain altera levemente esas probabilidades mediante un patrón oculto. Para nosotros el resultado parece totalmente normal, pero gracias a una herramienta específica de OpenAI se puede identificar ese patrón. No se añaden caracteres invisibles, espacios extraños, símbolos ni nada similar. La marca de agua se encuentra en las propias selecciones de palabras del modelo.

ChatGPT está desarrollando una tecnología para identificar textos creados por IA

Aunque la propia OpenAI asegura que la tecnología todavía no puede determinar con fiabilidad quién redactó un texto ni el grado de intervención de la IA. Por ejemplo, la empresa admite que en una evaluación de textos de 400 palabras, reemplazar el 10% de las palabras con sinónimos redujo la detección de aproximadamente el 92% al 66%. Y si se reemplazan el 25% de las palabras, la fiabilidad cae al 17%.

OpenAI también ha querido destacar que, además de los problemas de los falsos positivos y los falsos negativos, una marca de agua “no mide la contribución humana”, “no establece la propiedad ni la responsabilidad”, “no identifica al usuario” y “no verifica la exactitud”. Además, no encontrar una “marca de agua tampoco prueba la autoría humana”.

Sin duda, parece razonable que la Unión Europea quiera que se pueda identificar si un texto ha sido creado por una IA o por una persona, pero no va a ser algo sencillo. Las herramientas de detección son bastante complejas y, como vemos, cambiar algunas palabras altera al compelto los resultados.