Uno de los máximos referentes del sector de la IA, Anthropic, ha anunciado que incorporará marcas de agua invisibles en los textos generados por Claude y metadatos de procedencia firmados en los archivos. Todo ello como parte de su respuesta a las exigencias de transparencia de la Ley de Inteligencia Artificial de la Unión Europea.
La medida, explicada en un documento de ayuda de la firma, se aplicará en todo el mundo y llegará también a los modelos ya lanzados durante el periodo de transición que marca la normativa.
El sistema se divide en dos frentes según el tipo de contenido que generemos con la inteligencia artificial. Cuando un modelo compatible con Claude produce texto, la marca queda añadida directamente en la respuesta, de forma imperceptible para quien la lea. Cuando produce un archivo, la identificación llega en forma de metadatos firmados digitalmente.
Anthropic ha precisado que este marcado se aplica a nivel de modelo, por lo que estará presente sin importar qué producto o plataforma de Claude utilicemos para generar el contenido. La compañía ha optado por integrar esta capa de trazabilidad de forma transversal, en lugar de limitarla a una única aplicación o cliente, de modo que cualquier respuesta de texto o archivo generado por sus modelos quede identificada de la misma manera.
Cómo funciona el marcado de texto y los metadatos C2PA en archivos
Según ha detallado la compañía, la marca de agua textual no altera el significado, la calidad ni la legibilidad de la respuesta de Claude. Al formar parte del propio texto, viaja con él al copiarlo y pegarlo en otro sitio, y puede persistir tras algunas ediciones. Anthropic ha optado deliberadamente por no usar la elección o el orden de las palabras como método de identificación, una técnica que Apple habría empleado para detectar filtraciones internas, ya que insiste en que el marcado no altera el sentido del texto.
Para los archivos, la compañía recurre a metadatos de procedencia firmados que siguen el estándar abierto C2PA, un sistema de certificación de origen ya utilizado por otras herramientas de creación de contenido digital para acreditar de dónde procede una imagen, un vídeo o un documento. La empresa ha anunciado que publicará próximamente documentación con detalles sobre cómo detectar estas marcas, tal y como exige la normativa comunitaria.
De momento no hay ejemplos técnicos disponibles que expliquen con precisión el funcionamiento interno del sistema ni su grado de resistencia frente a intentos de eliminación.
Las marcas de agua llegan a toda la oferta de Claude, también fuera de la UE
El compromiso no se limita al mercado europeo, Anthropic ha confirmado que aplicará las marcas allí donde se ofrezca Claude, con independencia del país. Quedan cubiertos la Claude Platform (API), Claude, Claude Code, Claude Pro, Claude Team y Claude Enterprise, además de los proveedores externos que alojan sus modelos, entre ellos AWS, Google Cloud y Microsoft Foundry.
La compañía trabaja además en incorporar esas marcas a los modelos que ya había lanzado, aprovechando el periodo de transición que permite la ley europea antes de exigir el cumplimiento total. Este despliegue llega en un momento de cierto desgaste por parte de la base de usuarios de Claude, por decisiones anteriores como cambios en los precios, problemas de fiabilidad o salvaguardas de seguridad que en ocasiones han complicado tareas legítimas.
Para quienes generan contenido con Claude y prefieren que los clientes no perciban su origen sintético, la nueva trazabilidad añade un factor más a tener en cuenta.
Los usuarios dudan de que las marcas resistan la edición
Entre los usuarios de Claude ha surgido escepticismo sobre si un esquema de marcado basado en texto puede funcionar de forma fiable. Los investigadores ya han demostrado que las marcas de agua aplicadas a imágenes pueden deshacerse, y la propia compañía no ha aportado datos que descarten vulnerabilidades similares en el texto.
Sin documentación técnica detallada sobre el algoritmo, tampoco resulta sencillo valorar hasta qué punto resistiría, por ejemplo, un sistema de reconocimiento óptico de caracteres capaz de extraer el texto y omitir las marcas. En el caso de los archivos, ya existen herramientas de código abierto que permiten eliminar los metadatos C2PA, lo que debilita la utilidad práctica de ese mecanismo.
