OpenAI ha decidit adaptar els seus productes a les exigències de la normativa europea sobre intel·ligència artificial. La companyia ha anunciat que té previst incorporar marques d'aigua invisibles en alguns textos generats amb ChatGPT i Codex, una mesura que busca donar compliment a la Llei d'Intel·ligència Artificial de la Unió Europea. Aquesta norma estableix obligacions de transparència per als sistemes d'IA generativa i obliga els proveïdors a identificar els continguts que han estat creats per màquines.

Segons ha explicat l'empresa nord-americana, la marca d'aigua s'incorporarà durant les pròximes setmanes per als usuaris de ChatGPT i Codex, però únicament a la Unió Europea. Aquesta limitació geogràfica respon al fet que la normativa europea és la que exigeix aquest tipus de mecanismes, mentre que en altres territoris no hi ha una obligació equivalent. La firma no ha concretat quins usuaris quedaran exclosos de la mesura ni quins criteris es faran servir per determinar qui és "elegible". A més de l'aplicació a ChatGPT i Codex, OpenAI ha anunciat que els clients de la seva interfície de programació d'aplicacions de tot el món podran activar voluntàriament les marques d'aigua en textos per a determinats models. Aquesta opció permetrà als desenvolupadors que fan servir els models d'OpenAI integrar la marca d'aigua en les seves pròpies aplicacions i serveis.

Tot i això, la funció estarà desactivada per defecte a les aplicacions. La companyia ha pres aquesta decisió perquè siguin els seus clients els qui decideixin com aplicar-la en funció de les seves pròpies "obligacions de transparència". Aquesta flexibilitat respon a la diversitat de casos d'ús i de marcs legals que existeixen en els diferents països on operen els clients d'OpenAI. OpenAI també ha afegit que treballa amb proveïdors de computació al núvol per "posar la marca d'aigua a disposició de les sortides dels models d'OpenAI a les quals s'accedeix mitjançant els seus serveis durant les pròximes setmanes". Aquesta col·laboració amb els proveïdors cloud amplia l'abast de la mesura i permet que la marca d'aigua arribi a un ventall més ampli d'aplicacions.

Com funciona textGrain

La tecnologia que fa servir OpenAI s'anomena textGrain. Segons la descripció de la companyia, incorpora un "senyal estadística invisible" en les eleccions de paraules del model.  Aquest senyal no altera aparentment el rendiment del sistema i queda integrada en el text generat d'una manera que no és perceptible per al lector humà. Posteriorment, un detector pot buscar aquest senyal per avaluar si hi ha una marca d'aigua i, per tant, si el text ha estat generat per un model d'OpenAI. El funcionament d'aquesta tecnologia es basa en el fet que els models de llenguatge trien les paraules segons una distribució de probabilitats. textGrain introdueix petites modificacions en aquesta distribució que, sense afectar la qualitat del text, creen un patró recognoscible. Aquest patró és el que el detector pot identificar quan analitza un text.

OpenAI ha reconegut que la detecció pot cometre errors. Entre les limitacions que ha assenyalat hi ha els falsos positius, és a dir, textos que el detector identifica com a generats per IA quan en realitat no ho són, i els falsos negatius, que són textos generats per IA que el detector no aconsegueix identificar. Aquests errors són inevitables en qualsevol sistema de detecció basat en senyals estadístics. La companyia també ha admès que el sistema funciona pitjor amb textos breus.

Com menys paraules té un text, menys oportunitats hi ha d'incorporar el senyal estadístic i, per tant, més difícil és detectar-la. Aquesta limitació és especialment rellevant en un context en què moltes interaccions amb els models d'IA són curtes, com ara missatges breus o respostes concises. Una altra limitació important és que la marca d'aigua pot debilitar-se si el contingut s'edita, es reescriu o es tradueix. Aquestes operacions alteren les paraules originals i, amb elles, el senyal estadístic que hi havia incorporada. Això significa que un text generat per IA i després modificat pot perdre la marca d'aigua i esdevenir indetectable.

Accés restringit al detector

Per totes aquestes raons, OpenAI ha decidit que el detector estarà disponible només per a "investigadors i organitzacions expertes aprovats". Aquests usuaris poden començar a fer sol·licituds a partir d'aquest dilluns. La restricció de l'accés respon a la necessitat d'evitar usos indeguts del detector i de garantir que les persones que l'utilitzin tinguin els coneixements necessaris per interpretar-ne els resultats. La companyia ha subratllat que la funció de la marca d'aigua és ajudar a avergonyir si el text ha estat generat per un model d'OpenAI, però no indicarà "qui va escriure originalment el text ni qui n'és el propietari", a més d'altres limitacions. Aquesta precisió és important perquè estableix els límits del que la tecnologia pot fer i evita expectatives excessives sobre les seves capacitats.

OpenAI ha subratllat que té previst posar la tecnologia de textGrain a disposició del públic com a codi obert "perquè altres puguin desenvolupar-la". Aquesta decisió permetrà que altres investigadors i desenvolupadors puguin estudiar el funcionament de la tecnologia, modificar-la i crear eines pròpies a partir d'ella. El codi obert també facilita la transparència i permet que la comunitat científica avali els mecanismes que hi ha al darrere. La decisió d'alliberar la tecnologia com a codi obert contrasta amb la restricció d'accés al detector. Mentre que el detector queda reservat a investigadors aprovats, la tecnologia de base queda a disposició de qui vulgui estudiar-la o desenvolupar-la. Aquesta combinació busca equilibrar la transparència amb la necessitat de controlar l'ús d'una eina que pot tenir implicacions sensibles.