OpenAI está añadiendo una marca de agua invisible al texto generado por ChatGPT y al código creado por Codex en toda la Unión Europea, en cumplimiento de la Ley de IA del bloque. La compañía, sin embargo, reconoce que su detector todavía falla con facilidad cuando el contenido se edita.
Cómo funciona textGrain
Según el anuncio de OpenAI, el sistema se llama textGrain y ajusta la elección de palabras del modelo para dejar un patrón estadístico oculto. Un detector aparte analiza los textos en busca de ese patrón.
La empresa explica en su preguntas frecuentes que la marca de agua está en el propio texto y no añade caracteres ocultos, espacios invisibles ni signos de puntuación extraños. OpenAI sostiene que, por eso, los trucos comunes para eliminar caracteres ocultos no funcionan aquí.
En sus pruebas, el detector identificó alrededor del 66% de las respuestas sin editar de unas 150 palabras. Con aproximadamente 300 palabras, la tasa subió hasta el 92%.
La efectividad cae cuando el texto cambia. En muestras de 300 palabras, reemplazar una de cada diez palabras por un sinónimo bajó la detección del 92% al 66%. Si se cambiaba una de cada cuatro palabras, la detección descendía al 17%.
| Prueba | Tasa de detección |
|---|---|
| Sin editar, unas 150 palabras | 66% |
| Sin editar, aproximadamente 300 palabras | 92% |
| 300 palabras, una de cada diez palabras cambiada | 66% |
| 300 palabras, una de cada cuatro palabras cambiada | 17% |
El detector no será público por ahora
OpenAI dice que, por ahora, el detector no estará disponible para el público. En su lugar, está recibiendo solicitudes de investigadores aprobados y organizaciones especializadas.
La empresa añade que un resultado positivo no revela información sobre el usuario, el prompt o la conversación. Un resultado negativo tampoco confirma mucho: los textos cortos, editados o traducidos pueden pasar desapercibidos, igual que el contenido generado por otras IA rivales.
«La ausencia de una marca de agua detectada no prueba la autoría humana», señaló OpenAI.
Fuera de Europa, la marca de agua de ChatGPT está desactivada por defecto. Aun así, los clientes de la API en todo el mundo pueden activarla para ciertos modelos desde los ajustes de su proyecto u organización.
Este despliegue sigue el inicio en agosto en la UE de la aplicación de transparencia de la Ley de IA. En el apartado visual, OpenAI indica que las imágenes y el audio funcionan de forma diferente y que cualquiera puede subir esos archivos a su herramienta pública de verificación para comprobar si tienen la marca de agua SynthID.


