OpenAI confirmó que añadirá una marca de agua invisible en los textos generados por ChatGPT y Codex. La medida arrancará en las próximas semanas dentro de la Unión Europea, de acuerdo con una publicación en su blog sobre la procedencia de textos en la UE.

La decisión busca facilitar la identificación de contenido generado por inteligencia artificial frente a textos escritos por personas. La compañía señaló que el sistema se activará por defecto en los países del Espacio Económico Europeo, en cumplimiento del Reglamento de la IA.

Claves

OpenAI activará una marca invisible en textos de ChatGPT en la UE
  • —La marca de agua se aplicará en ChatGPT y Codex.
  • —Debutará en las próximas semanas dentro de la Unión Europea.
  • —OpenAI dijo que el detector no estará disponible para el público general.

Cómo funcionará la marca invisible

OpenAI explicó que la técnica se llama textGrain y que será invisible al ojo humano. En la práctica, añadirá una señal estadística a las palabras que el modelo elige al escribir, y un detector buscará ese patrón para estimar si un fragmento lleva la firma de la compañía.

OpenAI activará una marca invisible en textos de ChatGPT en la UE

Según la empresa, el sistema no mostrará cambios en el texto final. La marca solo podrá verificarse mediante el detector, que además no compartirá datos del usuario ni el prompt utilizado en ChatGPT.

Qué tan precisa resulta la detección

OpenAI admitió que textGrain iguala o supera a otros métodos que probó, incluido SynthID, pero no es infalible. El detector encontró la marca en 80% de los textos de 200 tokens y en alrededor del 95% de los de 400 en contenidos de psicología.

OpenAI activará una marca invisible en textos de ChatGPT en la UE

En textos de matemáticas y otros en los que hay menor libertad para elegir palabras, los porcentajes de éxito bajaron considerablemente. La detección también cayó cuando los textos fueron editados: al cambiar el 10% de las palabras por sinónimos, pasó de 92% a 66%, y con el 25% de sustitución bajó hasta 17%.

La compañía dijo además que su tecnología no mide cuánto trabajo humano hay en un texto, no identifica a la persona que lo generó y no confirma que lo escrito sea cierto. Si no aparece la marca de agua, eso no significa necesariamente que el contenido sea humano: puede haber sido editado, traducido o provenir de modelos anteriores.

OpenAI añadió que el detector no estará disponible para el público en general y que solo aceptará solicitudes de investigadores y organizaciones expertas. En el caso de los desarrolladores, el marcado ya puede activarse en la API para modelos seleccionados, aunque viene deshabilitado por defecto.

La compañía también dijo que trabaja con sus socios de nube para ofrecer la marca de agua durante las próximas semanas. En paralelo, indicó que su sistema se apoyará en una técnica de lista verde y lista roja, similar a la descrita por otros investigadores en arxiv.