OpenAI empezará a añadir una marca de agua invisible al texto generado por ChatGPT y Codex en la Unión Europea para cumplir con la ley de IA del bloque, informó la empresa en un blog post.

La exigencia europea

Las reglas de transparencia de la ley de IA de la Unión Europea, que entraron en vigor el 2 de agosto, obligan a las compañías de inteligencia artificial a señalar el contenido generado por IA de una forma que otros sistemas puedan identificar. OpenAI dijo que la medida se desplegará en las próximas semanas para usuarios elegibles de ChatGPT y Codex en todos los planes, pero solo en la Unión Europea.

La compañía añadió que los desarrolladores que usan su API en cualquier parte del mundo podrán activarla para modelos seleccionados desde hoy, aunque viene desactivada por defecto. También precisó que no hará de este marcaje un ajuste global al momento del lanzamiento.

Cómo funciona y cuáles son sus límites

La marca no será un símbolo visible, sino un patrón introducido en la elección de palabras del modelo, de modo que el lector no lo perciba, pero un detector sí pueda reconocerlo. Como viaja dentro del propio texto, también se mantiene si el contenido se copia y se pega.

OpenAI señaló que la marca no identifica al usuario y que no observó cambios relevantes en el desempeño de sus modelos al activarla. Junto con el anuncio, publicó un informe técnico sobre su método, llamado textGrain, elaborado con investigadores de la Universidad de Pensilvania y Yale.

La empresa advirtió, además, que la detección puede fallar si el texto es corto, si fue editado en exceso o si se trata de respuestas matemáticas o textos traducidos. En una prueba, sustituir 10% de las palabras por sinónimos redujo la detección de cerca de 92% a 66%.

OpenAI también dijo que la ausencia de marca de agua “no prueba” que un texto haya sido escrito por una persona. Una señal así puede indicar que un sistema de OpenAI generó o procesó parte de un pasaje, pero no cuánto intervino el juicio humano, la edición o la creatividad.

El anuncio llega dos meses después de que Anthropic dijera que marcaría los textos generados por Claude, una decisión aplicada en todo el mundo. OpenAI ya había construido una marca de agua para texto, pero la había retenido por temor a que algunos usuarios migraran a competidores que no la usaran, según The Wall Street Journal.

Anthropic, Google, Meta, Microsoft y OpenAI figuran entre las compañías que se comprometieron a seguir el código de práctica de la Unión Europea sobre contenido generado por IA.