El pasado 4 de agosto The Wall Street Journal publicรณ un artรญculo en el que dice que OpenAI ha desarrollado un sistema de marcas de agua, asรญ como una herramienta para detectar textos generados mediante ChatGPT.
Este sistema estarรญa listo desde hace mรกs de un aรฑo, pero la compaรฑรญa parece estar dividida entre los que piensan que es una buena idea, y los que creen que serรญa perjudicial para el propio devenir de ChatGPT.
Por un lado, ayudarรญa a detectar trabajos de estudiantes que intentan engaรฑar al profesor haciรฉndolos pasar como propios, por no hablar de la facilidad para detectar artรญculos en internet generados por IA. Pero la existencia de estas marcas de agua tambiรฉn harรญa que la gente usase mucho menos ChatGPT (alrededor de un 30% segรบn una encuesta realizada por The Wall Street Journal).
OpenAI da su versiรณn de la historia: estรกn trabajando en ello
Pocas horas despuรฉs de la publicaciรณn del artรญculo del Journal, OpenAI ha actualizado con nueva informaciรณn un artรญculo que publicรณ en mayo donde habla de este mismo asunto. Al parecer, ahora mismo estรกn centrados en sistemas para la detecciรณn de contenido audiovisual, pero confirman que tambiรฉn llevan tiempo trabajando en un sistema para detectar el origen IA de sus textos.
Este sistema tendrรญa dos posibles variantes: una serรญa el uso de marcas de agua, tal y como indica The Wall Street Journal. Por lo que han comprobado, el uso de marcas de agua es altamente efectivo contra tรฉcnicas como el parafraseo, pero no funciona tan bien contra tรฉcnicas un poco mรกs complejas como el uso de otra IA para cambiar las palabras del texto, o el uso de traductores.
Parece que el asunto de las marcas de agua no convence del todo a OpenAI, ya que cree que podrรญa โestigmatizarโ a aquellos hablantes no nativos que usan ChatGPT para escribir textos en inglรฉs (algo que tรฉcnicamente serรญa un falso positivo). Segรบn OpenAI, esto generarรญa โun impacto potencialmente desproporcionadoโ.
El sistema mรกs prometedor que tienen ahora mismo serรญa el uso de metadatos para identificar textos generados por IA. Este sistema lo ven con mejores ojos, ya que los metadatos estรกn firmados criptogrรกficamente y por tanto es imposible que haya falsos positivos.
De todas maneras, desde OpenAI dejan claro que si queremos identificar textos generados por IA en internet, esto va a requerir un esfuerzo colectivo por parte de la industria. O dicho de otra manera, tanto las plataformas (redes sociales, webs, periรณdicos, etc.) como los creadores de contenido y resto de intermediarios tendrรกn que estar dispuestos a facilitar estos metadatos con el fin de aumentar la transparencia en lo que respecta al origen del contenido que consumimos online.
Segรบn van avanzando, los modelos de generaciรณn de texto cada vez son mรกs difรญciles de identificar a simple vista, aunque ya existen herramientas como GPTZero que nos ayudan a detectar textos creados mediante aplicaciones como ChatGPT. Eso sรญ, estรก claro que lo ideal serรญa que hubiera un estรกndar en la industria que facilitase este tipo de reconocimientos.




