La medida está relacionada con las nuevas exigencias de transparencia de la Unión Europea. Además, la implementación es global, no solamente para usuarios europeos.

Lo importante: ¿qué significa “marca de agua”?

No vas a ver algo como:

“Generado por Claude”
© Claude / Anthropic

No aparece absolutamente nada visible.

Tampoco son caracteres ocultos, metadatos pegados al texto ni un identificador de tu cuenta. Anthropic explica que la marca se produce mediante patrones estadísticos en las elecciones de palabras que hace el modelo.

Por ejemplo, cuando Claude podría elegir entre dos formas igualmente válidas de expresar algo, esas elecciones siguen un patrón que posteriormente puede ser detectado.

Y hay un dato que para mí es el más relevante para quienes usamos IA como herramienta de trabajo: la marca puede sobrevivir al copiar y pegar e incluso a algunas modificaciones del texto.

¿Y si solamente le doy MI texto para corregir?

Acá está la parte polémica.

La marca no necesariamente significa “Claude escribió esto desde cero”. Puede significar que Claude intervino en la generación/procesamiento del texto. Por eso existe preocupación por situaciones del estilo:

“Escribí este mail yo, corregime la ortografía.”

“Mejorame esta publicación que escribí.”

“Traducime este texto.”

“Ordename este párrafo sin cambiar lo que digo.”

Anthropic reconoce que cuanto menor sea la intervención, menos material existe sobre el que incorporar la marca. Pero su enfoque puede abarcar incluso traducciones, resúmenes y ediciones relativamente importantes de textos humanos.

Y justamente por eso hubo bastante revuelo esta semana. Algunos usuarios profesionales incluso dijeron que cancelaron sus suscripciones porque no quieren que textos de trabajo en los que Claude solamente colaboró puedan quedar identificados posteriormente como “procesados por Claude”.

¿Significa que cualquiera podrá detectar que usaste Claude?

No necesariamente.

No es una etiqueta pública visible. Hace falta un sistema capaz de detectar ese patrón. Anthropic está trabajando en una API de detección, y además aclara algo muy importante: encontrar la señal no demuestra de manera concluyente que Claude haya escrito el contenido. Puede haber participado mediante una traducción, resumen o edición.

Además, ya aparecieron desarrolladores afirmando haber encontrado maneras de debilitar/eliminar esas marcas mediante reescritura del texto, lo que demuestra que tampoco es un mecanismo infalible.

Y la pregunta inevitable: ¿ChatGPT va a hacer lo mismo? 

Ahí la situación todavía no está cerrada. La normativa europea afecta también a otros proveedores, incluidos OpenAI y Google, pero cada empresa puede implementar mecanismos de transparencia de manera diferente. De hecho, Google ya utiliza tecnología de watermarking como SynthID en determinados contextos.

“Claude incorporará una firma estadística invisible en el texto generado por sus modelos que permitirá detectar que Claude probablemente intervino en ese contenido.”

Eso es bastante diferente de “cada cosa que le preguntes va a salir con una marca de agua”.

Y hay una discusión MUY interesante detrás de esto: si usamos IA como asistente para pensar, corregir o mejorar algo que nosotros escribimos, ¿debería ese trabajo quedar etiquetado como IA?

Esa es precisamente una de las críticas que está generando la decisión de Anthropic.

¿Ese contenido debería considerarse “generado por IA”?

La línea entre crear con IA y trabajar con ayuda de IA es cada vez más difícil de definir.

Y probablemente esta discusión recién esté empezando.

¿Qué pensás? ¿Te parece bien que los textos generados o modificados con IA puedan ser identificados?