OpenAI anunció este lunes que comenzará a incorporar marcas de agua invisibles en algunos textos generados mediante sus productos ChatGPT y Codex, como parte de las medidas que la compañía prepara para cumplir con las disposiciones de transparencia establecidas por la Ley de Inteligencia Artificial de la Unión Europea.
La empresa explicó que durante las próximas semanas la función estará disponible para usuarios elegibles de ChatGPT y Codex, independientemente del plan contratado, aunque inicialmente estará limitada a usuarios ubicados en la Unión Europea.
La tecnología, denominada textGrain, introduce una señal estadística invisible en la selección de palabras que realiza el modelo de inteligencia artificial. Según OpenAI, esta señal no debería alterar el rendimiento del texto y posteriormente puede ser identificada mediante un sistema de detección para determinar si un contenido fue generado por uno de sus modelos.
La compañía también informó que los clientes de su interfaz de programación de aplicaciones (API) en todo el mundo podrán activar voluntariamente las marcas de agua en determinados modelos, esta opción estará deshabilitada por defecto de modo que cada cliente pueda decidir cómo implementarla de acuerdo con sus propias obligaciones de transparencia.
OpenAI indicó además que trabaja con proveedores de servicios de computación en la nube para extender la disponibilidad de esta tecnología a contenidos generados mediante sus modelos a través de esas plataformas durante las próximas semanas.
Sin embargo la empresa reconoció que el sistema de detección tiene limitaciones. Entre ellas se encuentran la posibilidad de generar falsos positivos o falsos negativos, así como un menor nivel de efectividad cuando se analiza un texto muy corto, la marca de agua también puede debilitarse si el contenido es editado, reescrito o traducido.
Debido a estas limitaciones, OpenAI señaló que el detector no estará disponible de manera general para el público, por ahora podrán acceder a él investigadores y organizaciones especializadas que hayan sido aprobados por la compañía.
La marca de agua permitirá identificar si un texto fue generado por un modelo de OpenAI, pero no permitirá determinar quién produjo originalmente el contenido, quién lo editó posteriormente ni quién posee sus derechos.
La compañía señaló que su objetivo es contribuir a la transparencia sobre el origen de los contenidos generados mediante inteligencia artificial, además adelantó que planea publicar textGrain como código abierto, con la intención de que investigadores y desarrolladores puedan estudiarlo y continuar desarrollando la tecnología.