El pasado lunes, la empresa tecnológica OpenAI, creadora y desarrolladora de ChatGPT, anunció que empezará a incorporar marcas de agua invisibles en algunos textos que sean generados por su propio asistente de Inteligencia Artificial y Codesx. Esto se dará en el marco para poder cumplir con la Ley de Inteligencia Artificial de la Unión Europea. 

La empresa especificó la decisión a través del blog donde explicaron su nuevo enfoque sobre la procedencia del contenido: “Durante las próximas semanas, incorporaremos la marca de agua de texto para usuarios elegibles de ChatGPT y Codex de todos los planes, únicamente en la UE”.

Además, destacaron que a partir de ese lunes, los clientes de su interfaz de programación de aplicaciones (API) de todo el mundo podrán activar de forma voluntaria las marcas de agua en textos para determinados modelos. Esta función estará desactivada por defecto, para que los usuarios puedan decidir cómo aplicarla en función de sus obligaciones de transparencia. 

En este sentido, la empresa dijo que trabaja con proveedores de computación en la nube para "poner la marca de agua a disposición de las salidas de los modelos de OpenAI a las que se accede mediante sus servicios durante las próximas semanas", añadió, según la Agencia EFE.

La tecnología, llamada textGrain, incorpora una "señal estadística invisible" en las elecciones de palabras del modelo, aparentemente sin alterar su rendimiento, y que después un detector puede buscar para evaluar si hay una marca de agua.

OpenAI reconoció que la detección puede cometer errores, como un falso positivo o un falso negativo, que funciona peor con textos breves y que además puede debilitarse si el contenido se edita, reescribe o traduce. Por eso, la empresa decidió que el "detector" estará disponible solo para "investigadores y organizaciones expertas aprobados" que pueden empezar hoy a hacer solicitudes.

La función de la marca de agua es ayudar a averiguar si el texto ha sido generado por un modelo de OpenAI, pero no indicará "quién escribió originalmente el texto ni quién es su propietario", además de otras limitaciones.