Carregant...

La Llei d'intel·ligència artificial de la Unió Europea exigeix a les empreses que ofereixen sistemes d'IA generativa marcar el text generat per IA amb una mena de marca d'aigua perquè aquest sigui identificable en qualsevol moment. I OpenAI, l'empresa darrere del popular ChatGPT, ja ha especificat com durà a terme aquesta mesura.

OpenAI revela com marcarà el text generat per la seva IA

La UE està pressionant les empreses propietàries dels grans models d'IA per integrar sistemes de procedència en el contingut. És a dir, una marca d'aigua que sigui llegible per màquines i que pugui identificar que aquest text, o part d'aquest text, ha estat creat mitjançant IA. Però això no serà una marca visible per l'usuari, una cosa com una etiqueta que mostri "Generat amb IA"; és una cosa molt més profunda.

OpenAI ha desenvolupat una tecnologia anomenada textGrain que, segons han revelat, "afegeix un senyal estadístic invisible a la selecció de paraules del model". Això vol dir que quan ChatGPT ha d'escollir entre diverses paraules o fragments, textGrain altera lleument aquestes probabilitats mitjançant un patró ocult. Per a nosaltres el resultat sembla totalment normal, però gràcies a una eina específica d'OpenAI es pot identificar aquest patró. No s'afegeixen caràcters invisibles, espais estranys, símbols ni res similar. La marca d'aigua es troba en les mateixes seleccions de paraules del model.

ChatGPT està desenvolupant una tecnologia per identificar textos creats per IA

Encara que la mateixa OpenAI assegura que la tecnologia encara no pot determinar amb fiabilitat qui va redactar un text ni el grau d'intervenció de la IA. Per exemple, l'empresa admet que en una avaluació de textos de 400 paraules, reemplaçar el 10% de les paraules amb sinònims va reduir la detecció d'aproximadament el 92% al 66%. I si es reemplacen el 25% de les paraules, la fiabilitat cau al 17%.

OpenAI també ha volgut destacar que, a més dels problemes dels falsos positius i els falsos negatius, una marca d'aigua "no mesura la contribució humana", "no estableix la propietat ni la responsabilitat", "no identifica l'usuari" i "no verifica l'exactitud". A més, no trobar una "marca d'aigua tampoc prova l'autoria humana".

Sens dubte, sembla raonable que la Unió Europea vulgui que es pugui identificar si un text ha estat creat per una IA o per una persona, però no serà una cosa senzilla. Les eines de detecció són bastant complexes i, com veiem, canviar algunes paraules altera completament els resultats.