Inteligencia Artificial

OpenAI empieza a marcar con watermark los textos de ChatGPT en la Unión Europea

La empresa aplica la marca invisible en ChatGPT y Codex para cumplir con la ley de IA europea, pero advierte que editar el texto puede borrarla.

Redacción••3 min de lectura
Compartí esta nota:
OpenAI will start watermarking ChatGPT’s text in the EU

OpenAI comenzará a agregar una marca de agua invisible a los textos generados por ChatGPT y Codex en la Unión Europea para cumplir con la ley de inteligencia artificial del bloque, según anunció la compañía este lunes en un comunicado. La medida alcanza a los usuarios de todos los planes en ese territorio y se desplegará en las próximas semanas.

Las reglas de transparencia de la ley de IA europea, que entraron en vigencia el 2 de agosto, obligan a las empresas de inteligencia artificial a marcar el contenido generado por sus sistemas de un modo que otros programas puedan identificar. La norma busca que sea posible distinguir un texto escrito por una persona de uno producido por una máquina.

Los desarrolladores que usan la API de OpenAI en cualquier parte del mundo pueden activar la función para algunos modelos desde ahora, aunque viene desactivada por defecto. La compañía aclaró que no convertirá el marcado de textos en una opción global en este lanzamiento.

La marca no es un símbolo visible: funciona moldeando de manera sutil las elecciones de palabras del modelo y deja un patrón que los lectores no perciben, pero que un detector sí puede reconocer. Como está incorporada en las palabras, viaja con el texto cuando se copia y se pega. OpenAI sostuvo que la marca no identifica al usuario y que no observó cambios relevantes en el rendimiento de sus modelos con la función activada.

Junto con el anuncio, la empresa publicó un informe técnico de su método, llamado textGrain, elaborado con investigadores de la Universidad de Pensilvania y Yale. El documento explica cómo se usa una clave secreta para ordenar las predicciones de la próxima palabra al completar una frase. Al sumar cientos de esas pequeñas intervenciones, el detector puede identificar contenido generado por IA usando solo el texto y la clave.

¿Se puede eliminar la marca editando el texto? Las pruebas de OpenAI sugieren que sí. En un ensayo, reemplazar el 10% de las palabras por sinónimos hizo caer la detección de alrededor del 92% al 66%. La compañía también indicó que los pasajes cortos, las respuestas matemáticas y los textos traducidos son más difíciles de detectar.

“Estas limitaciones contribuyen a nuestra decisión de dar acceso inicial al detector solo a investigadores aprobados y organizaciones expertas, que pueden ayudarnos a evaluar la confiabilidad y los usos responsables”, afirmó la empresa.

OpenAI advirtió además que la ausencia de marca “no prueba autoría humana”. El texto puede ser demasiado corto o estar muy editado, o puede provenir de la IA de otra compañía. “Las marcas de agua pueden indicar que un sistema de OpenAI generó o procesó parte de un pasaje, pero no cuánto juicio, edición o creatividad humana intervinieron”, señaló.

El anuncio llega dos meses después de que Anthropic dijera que marcaría los textos generados por Claude, una medida que aplica en todo el mundo. Esa decisión generó rechazo entre algunos usuarios de Claude, que sostenían que ellos habían aportado “las instrucciones, el contexto y las decisiones” mientras que Claude era solo “la herramienta”.

OpenAI ya había desarrollado antes una marca de agua para textos, pero había postergado su lanzamiento, en parte por el temor de que los usuarios migraran a competidores que no la aplicaran, según informó The Wall Street Journal en 2024.

Anthropic, Google, Meta, Microsoft y OpenAI están entre las compañías que se comprometieron a seguir el código de prácticas de la Unión Europea sobre contenido generado por inteligencia artificial.

Por qué importa

La medida marca un precedente regulatorio: la Unión Europea obliga a identificar el contenido generado por IA y las empresas tecnológicas empiezan a adaptar sus productos. Afecta a usuarios, desarrolladores y a cualquiera que reciba un texto sin saber si lo escribió una persona o una máquina.

Qué sigue

Resta ver cómo responden los usuarios europeos y si la marca se extiende fuera del bloque, sobre todo después del rechazo que generó la decisión similar de Anthropic. También queda pendiente evaluar la confiabilidad de los detectores, que OpenAI por ahora limita a investigadores aprobados.

¿Te gustó esta nota?

Recibí lo más importante del día en tu correo. Sin spam, con opción de baja siempre.

Más en Inteligencia Artificial