ChatGPT dejará una marca invisible en sus textos en Europa: qué detecta y qué no
OpenAI activará en las próximas semanas textGrain, una señal estadística escondida en la elección de palabras, para cumplir la ley europea de IA. El detector no será público y la propia empresa admite que basta cambiar palabras para debilitar el rastro.
Por Redacción 2 min de lectura

Si escribes con ChatGPT desde España, dentro de unas semanas tus textos llevarán algo que no puedes ver. OpenAI anunció el 5 de octubre que añadirá una marca de agua invisible a lo que generen ChatGPT y Codex, su herramienta para programar, en la Unión Europea y en todos los planes. No lo hace por gusto: la ley europea de inteligencia artificial obliga a que el texto escrito por una IA pueda ser identificado por una máquina.
Una señal escondida en las palabras
La técnica se llama textGrain. No pega nada al texto: lo que cambia es la elección de palabras del modelo, inclinada lo justo para que, vistas en conjunto, dibujen un patrón estadístico. Quien lee no nota nada; un detector que conozca el patrón, sí. OpenAI afirma que en sus pruebas iguala o supera a otras técnicas, incluida SynthID, la de Google, y que publicará la suya en código abierto.
¿Empeoran las respuestas? Según la compañía, no: en las pruebas con Astra, su modelo más reciente, los resultados con marca y sin ella son prácticamente iguales.
Funciona, pero en condiciones de laboratorio
Las cifras son de la propia OpenAI, y lo mejor de la nota es que no las esconde. Con un 1 % de falsos positivos asumido —uno de cada cien textos sin marca daría positivo—, el detector encuentra la señal en cerca del 95 % de los pasajes de 400 tokens, que vienen a ser unas 300 palabras. Con 200 tokens baja al 80 %. Y en matemáticas, donde hay poco margen para elegir palabras, cae bastante más.
Luego está la edición. Cambiar por sinónimos el 10 % de las palabras deja la detección en el 66 %, desde el 92 %. Cambiar el 25 % la hunde hasta el 17 %. Dicho de otro modo: una pasada rápida de retoques y el rastro casi desaparece.
Por eso el detector no será público. De momento solo podrán pedirlo investigadores y organizaciones expertas, y OpenAI lo concederá caso por caso.
Lo que la marca no dice
La marca no identifica al usuario, ni su cuenta, ni su conversación. No mide cuánto puso la persona y cuánto la máquina. No dice si el texto es verdad. Y que no aparezca tampoco absuelve: un texto corto, editado o traducido puede no dar señal, igual que uno escrito con la IA de otra empresa.
«La ausencia de una marca detectada no demuestra autoría humana», advierte OpenAI.
Nuestra lectura
Nos parece bien que exista y mejor aún que se cuente con sus límites por delante. Lo que nos preocupa es lo que vendrá después: el profesor o el jefe que quiera «pasarle el detector» a un trabajo. Con estas cifras, y con lo fácil que es debilitar el rastro, un positivo o un negativo aislado prueba muy poco. Esto sirve para que plataformas e investigadores estudien el fenómeno a gran escala, no para señalar a una persona concreta.
Fuera de la UE, la marca no se activa por defecto. Quien use los modelos de OpenAI desde la API puede encenderla ya, en cualquier país y en algunos modelos; viene apagada. Los detalles técnicos están en el informe de OpenAI, que la empresa promete ampliar en las próximas semanas.


