ChatGPT y Codex empezarán a incorporar, en las próximas semanas, una marca de agua invisible en los textos que generan, según ha confirmado OpenAI. La medida arranca en Europa, donde la Ley de IA de la Unión Europea exige identificar de forma legible por máquinas el contenido creado por inteligencia artificial, y llega acompañada de un detector con límites que conviene conocer.
La compañía quiere frenar la proliferación de contenido sintético que resulta indistinguible del escrito por una persona. Millones de usuarios recurrimos ya a ChatGPT para redactar informes, correos o trabajos académicos, y a partir de ahora será posible rastrear, con matices importantes, si una máquina intervino en la redacción de un texto.
TextGrain, la marca de agua que OpenAI integra en ChatGPT y Codex
La tecnología se llama textGrain y no tiene nada que ver con las marcas de agua visuales que conocemos en las imágenes. En lugar de un sello o un carácter oculto, añade una señal estadística a las palabras que elige el modelo mientras genera el texto. No se trata de un código insertado en el archivo, sino de patrones en la frecuencia y el orden con que el modelo selecciona determinadas palabras, algo que un lector humano no podría percibir a simple vista.
El detector de OpenAI busca después esa huella para comprobar si un fragmento procede de ChatGPT o de Codex. La compañía asegura que textGrain ha igualado, e incluso superado, el rendimiento de otros métodos que ha probado internamente, aunque reconoce abiertamente que el sistema no es perfecto. Esa validación le permite a OpenAI cuantificar con qué frecuencia acierta su sistema y en qué escenarios pierde precisión, algo que detalla en los apartados siguientes.
Primero Europa: así entra en vigor la marca invisible
El despliegue arrancará en la Unión Europea en las próximas semanas y afectará a todos los usuarios de ChatGPT y Codex en la región, sin distinción de plan de suscripción. No hará falta activar ninguna opción: la marca se aplicará de forma automática a los textos que OpenAI considere elegibles para recibir esta señal, un criterio que la empresa no ha detallado públicamente.
La decisión responde a una obligación legal concreta. La Ley de IA de la Unión Europea exige que los proveedores de inteligencia artificial hagan identificable, de forma legible por máquinas, el contenido generado por sus modelos. Fuera de Europa, en cambio, el marcado no será obligatorio: los clientes de la API podrán activarlo de manera voluntaria en una selección de modelos, según decida cada desarrollador. OpenAI plantea este enfoque regional como una forma de aprender del uso real antes de valorar una expansión a otros mercados, aunque no ha dado fechas para ese siguiente paso.
Los límites del detector: falsos positivos y textos cortos
La propia compañía ha detallado varios escenarios en los que la detección puede fallar o perder fiabilidad, y conviene tenerlos presentes antes de dar por buena cualquier comprobación automática sobre el origen de un texto:
- Falsos positivos y negativos: el detector puede señalar una marca de agua donde no existe, o pasar por alto una que sí está presente.
- Textos cortos: cuanto más breve es el fragmento, más difícil resulta identificar la señal estadística con precisión.
- Ediciones manuales: reescribir el texto generado por la IA puede debilitar la marca hasta el punto de dificultar su detección posterior.
Estas limitaciones no invalidan el sistema, pero sí explican por qué OpenAI insiste en que el resultado del detector debe interpretarse como un indicio estadístico, y no como una prueba concluyente de que un texto fue o no generado por inteligencia artificial. Si manejáis textos generados por IA de forma habitual, conviene recordar que un resultado negativo no garantiza que el contenido sea humano, igual que un resultado positivo tampoco certifica una mala práctica: ambos datos deben valorarse junto con otras señales de contexto antes de sacar una conclusión definitiva sobre el origen de un escrito.
Qué no puede revelar la marca de agua
El alcance de esta herramienta es más limitado de lo que podría parecer a primera vista. El sistema no determina cuánto ha aportado una persona a un texto mixto, ni quién es su propietario o autor original, ni si la información que contiene es correcta.
Por tanto, una detección positiva no equivale a una prueba de plagio ni certifica que el contenido sea fiable: solo indica que el modelo intervino en la redacción. Esta distinción importa especialmente en contextos educativos o periodísticos, donde confundir ambas cosas podría llevar a acusaciones injustas o a una falsa sensación de seguridad sobre la precisión de un texto.
Universidades, editoriales o empresas que valoren usar esta tecnología tendrán que diseñar sus propios protocolos para interpretar el resultado, ya que el detector por sí solo no ofrece un veredicto sobre la autenticidad completa de un documento, sino una señal adicional que debe combinarse con otros criterios de revisión.
Acceso restringido: quién podrá usar el detector
Pese a que la marca de agua llegará a millones de cuentas en Europa, leerla no estará al alcance de cualquiera. OpenAI ha abierto el proceso de solicitud para su detector, pero de momento solo lo concederá a investigadores y organizaciones expertas que ayuden a poner a prueba la tecnología.
Esto deja fuera, al menos por ahora, a profesores, empresas o usuarios particulares que quieran comprobar un texto por su cuenta. La compañía no ha concretado cuándo podría abrir el acceso a un público más amplio, y ha preferido presentar este despliegue europeo como una fase de aprendizaje antes de decidir los siguientes pasos.
El proceso de solicitud permanece abierto mientras avanza el despliegue europeo, lo que permitirá a OpenAI perfeccionar la precisión del detector con datos de uso real antes de plantearse ampliar quién puede acceder a él. Hasta entonces, si queréis comprobar de forma independiente si un texto procede de ChatGPT o Codex, tendréis que recurrir a métodos ajenos a la compañía, con una fiabilidad distinta a la que promete textGrain.
