Anthropic incorporará una marca de agua de Claude al texto generado por sus nuevos modelos y añadirá metadatos de procedencia firmados a determinados archivos. El cambio responde al Artículo 50 del Reglamento de IA de la UE, aplicable desde el 2 de agosto de 2026, y llevará una exigencia europea a las salidas de Claude en todo el mundo. La cuestión operativa aparece después: cuánto puede decir esa señal sobre el origen de un texto cuando pasa por ediciones, traducciones, repositorios de código o aplicaciones empresariales.
La marca de agua de Claude llegará al modelo
Los modelos de Claude lanzados en la UE a partir del 2 de agosto de 2026 incorporarán marcado legible por máquinas desde su estreno. El alcance incluye Claude, Claude Platform mediante API, Claude Code, Claude Cowork y Claude Tag. La misma marca de texto acompañará las respuestas de modelos compatibles servidos a través de AWS, Google Cloud o Microsoft Foundry. Anthropic aplicará el esquema mundialmente allí donde esos modelos estén disponibles, aunque algunas plataformas o funciones pueden no admitir todos los tipos de marcado.
Los modelos anteriores quedan en otra fase. El régimen europeo concede a los sistemas introducidos en el mercado antes del 2 de agosto un periodo limitado hasta el 2 de diciembre de 2026 para cumplir la obligación de marcado y detección del Artículo 50(2). Anthropic trabaja para extender el soporte a esas versiones, sin concretar un calendario por modelo. El resto de obligaciones del Artículo 50 comenzó a aplicarse el 2 de agosto.
Para empresas que mantienen modelos fijados por motivos de validación, costes o compatibilidad, la diferencia puede crear flujos con niveles distintos de procedencia según la versión utilizada. La migración adquiere así una dimensión de trazabilidad cuando la salida termina publicada, integrada en un producto o incorporada a un proceso sujeto a auditoría.
Texto invisible y C2PA para archivos
Anthropic utilizará dos mecanismos. En texto, describe una marca «imperceptible» integrada directamente en la generación. Según la empresa, forma parte del propio texto, viaja cuando se copia y pega y puede sobrevivir a ciertas modificaciones. La documentación no explica todavía el algoritmo empleado, su tasa de falsos positivos, el volumen mínimo necesario para una detección fiable ni el procedimiento técnico que utilizarán terceros para comprobar la señal. Anthropic anticipa documentación adicional y herramientas de detección.
En archivos compatibles, como SVG, PNG o JPG, Claude añadirá metadatos de procedencia firmados siguiendo C2PA. El estándar permite vincular criptográficamente información sobre el historial de un activo y comprobar la integridad de esas credenciales. Anthropic plantea ese registro como una señal de que un archivo fue procesado por Claude. Sin embargo, conversiones de formato, reexportaciones o capturas de pantalla pueden eliminar los metadatos.
Aplicar el marcado en el nivel del modelo amplía su presencia más allá de la interfaz de Claude y alcanza aplicaciones construidas sobre la API. El Artículo 50(2), sin embargo, contempla excepciones cuando la IA cumple una función auxiliar de edición estándar o no altera sustancialmente los datos de entrada o su semántica. La arquitectura anunciada por Anthropic parece más uniforme que ese mínimo regulatorio en algunos usos, aunque faltan detalles sobre el tratamiento de esos casos.
La detección no equivale a probar autoría
Encontrar una marca de Claude indica que el contenido puede haber sido procesado por el modelo, pero no acredita que Claude sea el autor original. Un texto humano revisado, resumido o traducido con el sistema puede terminar marcado. También puede haber sido editado o mezclado con otro material después de pasar por Claude.
La ausencia de señal tampoco descarta intervención de IA. Anthropic enumera modelos antiguos sin soporte, fragmentos demasiado cortos, paráfrasis intensas, traducciones, combinaciones con otros textos y archivos cuyos metadatos hayan desaparecido. El límite resulta especialmente relevante en software y automatizaciones empresariales, donde una respuesta puede ser reformateada, dividida, mezclada con datos internos o modificada por un desarrollador antes de llegar al repositorio o al usuario final.
La investigación académica lleva años examinando esa fragilidad. «Watermarks in the Sand», presentado en ICML, mostró bajo unas hipótesis definidas que atacantes pueden eliminar distintas marcas generativas sin una degradación importante de la calidad. Google DeepMind reconoce igualmente que SynthID Text puede resistir modificaciones leves, mientras que reescrituras exhaustivas o traducciones reducen mucho la confianza de detección. Ninguno de esos resultados permite extrapolar el comportamiento exacto del sistema de Anthropic, cuyo diseño no se ha publicado, pero sí delimita el reto técnico.
El Artículo 50 amplía la carga de trazabilidad
La norma europea exige que los proveedores de sistemas capaces de generar audio, imagen, vídeo o texto sintético hagan sus salidas detectables mediante un formato legible por máquinas y que las soluciones sean efectivas, interoperables, robustas y fiables hasta donde sea técnicamente posible. El Código de Prácticas sobre transparencia, firmado por Anthropic, ofrece una vía voluntaria de cumplimiento; la obligación jurídica procede del Reglamento. La Comisión y el AI Board han considerado el código una herramienta adecuada.
Las empresas y organizaciones que utilizan estos sistemas afrontan además obligaciones propias.. El Artículo 50 obliga a informar cuando determinados textos generados o manipulados por IA se publican para informar al público sobre asuntos de interés público, aunque prevé una excepción cuando existe revisión humana o control editorial y una persona física o jurídica asume la responsabilidad editorial. Marcado técnico y divulgación visible son, por tanto, obligaciones distintas. Un watermark puede circular dentro de un sistema sin convertirse automáticamente en una etiqueta para el lector.
En compañías que integran modelos generativos en producción, el watermark añade una señal, pero no sustituye la trazabilidad interna. Registrar el modelo, la versión del prompt, la salida original, las transformaciones posteriores y la responsabilidad de aprobación ofrece una cadena de evidencias más completa. Anthropic recuerda además que los desarrolladores deben evaluar de forma independiente qué obligaciones del Artículo 50 afectan a sus propios productos y servicios.
El valor empresarial del sistema dependerá de aspectos que Anthropic aún no ha detallado: cómo se detectará el texto, qué fiabilidad tendrá en contenidos breves, cómo responderá ante transformaciones habituales y qué compatibilidad mantendrá entre modelos y canales. Con el 2 de diciembre como límite para los sistemas anteriores, los equipos tendrán que decidir cuánto confiar en la señal del modelo y qué evidencias conservar por sus propios medios.
