Claude incorpora marcas de agua invisibles para cumplir con la normativa europea

  • Anthropic implanta marcas de agua invisibles en los textos generados por Claude.
  • La medida se aplica a nivel global desde el 2 de agosto.
  • El sistema no afecta a la calidad del texto y persiste al copiar y pegar.
  • La detección no es infalible y puede fallar con ediciones o textos cortos.

Marca de agua de Claude

La inteligencia artificial de Anthropic, conocida como Claude, ha dado un paso adelante en la transparencia de sus contenidos. La compañía ha anunciado que todos los modelos lanzados a partir del 2 de agosto incorporarán un sistema de marcado invisible en los textos que generen. Esta medida, que se aplicará de forma global, busca alinearse con las exigencias de la Unión Europea en materia de identificación de contenido sintético.

El objetivo principal es que cualquier texto producido por Claude pueda ser identificado como tal, sin que el usuario note ninguna diferencia en la calidad o legibilidad. La marca de agua no se ve a simple vista, pero permanece incrustada en el texto incluso cuando se copia y pega en otras plataformas. Esta iniciativa responde al Código de Buenas Prácticas sobre Transparencia del Contenido Generado por IA, firmado por más de 190 organizaciones, y a la Ley de IA de la UE, que desde agosto exige el marcado de estos contenidos.

La decisión de Anthropic no es casual. La normativa europea obliga a las empresas de IA a etiquetar los contenidos sintéticos para que los usuarios puedan distinguirlos de los creados por humanos. El artículo 50.2 de la Ley de IA establece que los proveedores deben garantizar que los resultados de sus sistemas estén marcados en un formato legible por máquina. Anthropic, junto a otras grandes tecnológicas como OpenAI, Google, Meta o Microsoft, ha firmado este código de transparencia, aunque empresas como xAI de Elon Musk aún no se han adherido.

La compañía ha explicado que el marcado se realiza de dos formas: para imágenes y gráficos, se utilizan metadatos basados en el estándar C2PA (Coalition for Content Provenance and Authenticity); para textos, se emplea una marca de agua invisible que se integra en el propio proceso de generación. Esta marca no altera el significado ni la calidad de las respuestas, y se transmite junto con el texto cuando se copia, se exporta o se comparte a través de una API.

El sistema se basa en la secuencia de tokens que el modelo genera. En lugar de añadir caracteres ocultos o metadatos visibles, la marca queda codificada en la elección de palabras cuando hay varias opciones igualmente válidas. Por ejemplo, ante la frase «el cielo estaba…», el modelo puede elegir «nublado» o «gris». Con la marca de agua, esa elección no es aleatoria, sino que depende de una clave criptográfica y de las palabras anteriores. Así, quien posea la clave puede determinar estadísticamente si el texto fue generado por Claude.

Este método, que ya se utiliza en otros sistemas como SynthID de Google, no añade coste ni latencia al proceso. La detección de la marca no es infalible: si el texto se edita, se parafrasea, se traduce o se mezcla con otro contenido, la marca puede desaparecer. Además, en fragmentos muy cortos o en código, la señal es más débil. Anthropic reconoce que la ausencia de marca no significa que el contenido no haya sido generado por IA, y que la presencia de una marca tampoco es concluyente sobre la autoría real.

La compañía ha detallado que la marca de agua se aplica a todos los modelos lanzados desde el 2 de agosto, y que los modelos anteriores recibirán la actualización de forma progresiva. La medida es global, no solo para Europa, y afecta a todos los productos de Claude, incluidos la API, Claude Code, Claude Cowork y las plataformas de terceros como la infraestructura de AWS, Google Cloud o Microsoft Foundry. Sin embargo, la detección pública aún no está disponible: Anthropic ha anunciado que en unas semanas publicará una herramienta para que usuarios y terceros puedan verificar si un texto lleva la marca.

Otra limitación importante es que la marca no permite identificar al usuario ni la conversación original. Tampoco distingue si el texto fue creado desde cero o si Claude solo ayudó a corregir, traducir o resumir un contenido previo. Esto ha generado críticas, ya que la normativa europea excluye explícitamente las tareas de edición estándar, pero Anthropic aplica la marca a todos los usos. A pesar de estas imperfecciones, la medida supone un avance en la lucha contra la desinformación y el uso indebido de la IA.

La decisión de Anthropic se enmarca en un movimiento más amplio de la industria. OpenAI, Google, Meta, Microsoft y Mistral también han firmado el Código de Transparencia y están implementando sistemas similares. Sin embargo, la falta de un estándar unificado y las limitaciones técnicas hacen que la detección no sea perfecta. Por ejemplo, hacer una captura de pantalla de una imagen puede eliminar los metadatos C2PA, y reescribir un texto por completo puede borrar la marca de agua.

En el ámbito educativo y profesional, estas herramientas de marcado podrían ser útiles para identificar trabajos generados por IA, pero los expertos advierten que no son una solución definitiva. La propia Anthropic insiste en que la marca no es una prueba de autoría, sino una señal de probabilidad. A medida que la tecnología evolucione, es probable que veamos sistemas más robustos, pero por ahora, la transparencia sigue siendo un reto pendiente.

En definitiva, la incorporación de marcas de agua invisibles en Claude representa un paso importante para cumplir con la regulación europea y ofrecer a los usuarios más información sobre el origen de los contenidos. Aunque el sistema tiene limitaciones, es un avance significativo en la dirección correcta. La comunidad tecnológica estará atenta a la herramienta de detección que Anthropic promete lanzar próximamente, y a cómo otras empresas se adaptan a esta nueva realidad.


Añadir como fuente preferida en Google