Un nuevo sistema para identificar el origen de textos generados con los modelos de inteligencia artificial de OpenAI, fue presentado por la compañía. Esto conllevará que los escritos que se hagan con ChatGPT y Codex tendrán una marca de agua digital invisible.
Esto será aplicado en los países de la Unión Europea durante las próximas semanas. Una medida que llegará a los usuarios de todos los planes y responde a las exigencias de identificación de contenido generado por IA establecidas por la Ley de IA de la UE.
¿Cómo funciona la marca de agua de OpenAI?
La marca no aparecerá como un símbolo ni podrá ser vista por el usuario. En cambio, modificará de manera estadística la elección de palabras para dejar una señal que un sistema de detección pueda reconocer. OpenAI dijo en una publicación técnica que el método no identifica a la persona que generó el texto ni vincula el contenido con una cuenta, una instrucción o una conversación.
A este nuevo sistema lo bautizaron como «textGrain» y funciona metiendo una señal estadística en las palabras que selecciona el modelo. Un detector puede buscar esos patrones para determinar si un texto contiene la marca de agua de OpenAI.
La compañía comparó su método con otras tecnologías de procedencia de texto y señaló que textGrain igualó o superó el rendimiento de los sistemas que evaluó, incluido SynthID para texto. Eso no significa que pueda identificar cualquier texto generado por sus modelos: la precisión disminuye cuando el contenido es corto, tiene pocas posibilidades de variar su redacción o fue modificado.
En una prueba el detector identificó la marca en cerca del 80 % de los textos de 200 tokens y en aproximadamente el 95 % de los de 400 tokens en contenidos como psicología. Los resultados fueron considerablemente menores en textos matemáticos, donde existe menos libertad para elegir palabras.
La edición también afecta la detección. En textos de 400 tokens, sustituir el 10 % de las palabras por sinónimos redujo la detección de aproximadamente un 92 % al 66 %. Al reemplazar el 25 %, cayó a un 17 %. OpenAI también dijo que la traducción puede dificultar la identificación.
Por esas limitaciones, el detector no será público inicialmente. Investigadores y organizaciones especializadas podrán solicitar acceso y OpenAI evaluará las solicitudes caso por caso. La herramienta indicará si encuentra una marca de agua, pero no mostrará las instrucciones utilizadas ni las conversaciones asociadas al contenido.
La marca tampoco permitirá determinar cuánto participó una persona en la elaboración de un texto. OpenAI explicó que una detección positiva puede indicar que uno de sus sistemas generó o procesó parte del contenido, pero no permite saber cuánto criterio, edición o creatividad humana hubo después.
¿Qué cambia para los usuarios de ChatGPT?
La implementación en la Unión Europea será automática para los usuarios elegibles de ChatGPT y Codex y no tendrá una opción para desactivarla. OpenAI aclaró que no convertirá la marca de agua en una configuración predeterminada para todo el mundo por ahora.
Para los clientes de su API, será distinto. Desde el 5 de octubre podrán activar voluntariamente la marca en determinados modelos desde cualquier parte del mundo, mientras que la función permanecerá desactivada por defecto. OpenAI también trabaja para ofrecerla a través de algunos proveedores de servicios en la nube durante las próximas semanas.








