Anthropic confirmó que los futuros modelos de Claude incorporarán un sistema de marcado invisible destinado a determinar qué tan probable es que la inteligencia artificial haya participado en la elaboración de un texto. La tecnología comenzó a aplicarse con los modelos lanzados en la Unión Europea desde el 2 de agosto de 2026 y será implementada a nivel global.
Una señal que no cambia el texto
La compañía explicó que el mecanismo no funciona agregando caracteres, palabras ocultas o información adicional al contenido. En realidad, la señal queda incorporada en la manera en que Claude selecciona determinadas palabras mientras genera una respuesta.
Por ello, un lector no podrá reconocer visualmente si un contenido tiene o no la marca. Tampoco será necesario generar tokens adicionales, por lo que Anthropic asegura que el sistema no incrementará el costo ni tendrá un impacto significativo en la velocidad de generación.
El patrón queda en la elección de palabras
El sistema aprovecha situaciones en las que un modelo puede escoger entre diferentes palabras sin alterar de manera importante el significado de una oración.
En lugar de utilizar únicamente una fuente convencional de aleatoriedad para decidir entre esas alternativas, Claude emplea una clave junto con determinadas palabras anteriores. De esta manera, las elecciones terminan formando un patrón estadístico que posteriormente puede ser analizado.
Quien disponga de la clave puede comprobar si la secuencia encontrada coincide con la que probablemente habría producido Claude y, a partir de ello, calcular la posibilidad de que el sistema haya intervenido.
La tecnología utilizada corresponde a una versión de SynthID-Text, desarrollada por Google DeepMind y presentada en un estudio publicado en Nature en 2024.
No significa que Claude haya escrito todo
Uno de los principales límites del mecanismo es que no permite establecer de manera definitiva quién produjo un texto.
La marca únicamente puede indicar que existe una probabilidad de que Claude haya participado en su elaboración. Por ejemplo, no permite diferenciar entre un contenido creado íntegramente por la IA y otro que originalmente escribió una persona y posteriormente fue editado por Claude.
Tampoco determina la autoría, propiedad o responsabilidad legal sobre el material.
Los textos cortos son más difíciles de detectar
La eficacia del sistema depende de la cantidad de decisiones que el modelo haya podido tomar durante la generación. Cuando un texto es demasiado breve, existen menos elecciones disponibles y, por tanto, menos información para identificar el patrón.
Algo similar ocurre con los contenidos en los que existe una respuesta exacta. En información factual, por ejemplo, modificar una palabra puede introducir un error, por lo que el sistema tiene menos posibilidades de intervenir.
El código también presenta esta limitación debido a que muchas de sus instrucciones deben mantenerse con precisión. En cambio, puede existir cierto margen para aplicar el marcado en elementos como los comentarios incluidos dentro del código.
¿Qué pasa cuando Claude corrige un texto?
El marcado tampoco necesariamente permitirá detectar una intervención de Claude cuando la inteligencia artificial realiza una edición ligera.
Si una persona proporciona un texto y solicita únicamente corregir su gramática y puntuación, la mayoría de las palabras continúan siendo las originales. En consecuencia, puede no existir suficiente material generado por Claude para que el patrón sea identificable.
Una reescritura completa, en cambio, puede eliminar la marca anterior porque prácticamente todas las palabras son reemplazadas.
La razón está en la regulación europea
Anthropic señaló que la decisión responde a la Ley de Inteligencia Artificial de la Unión Europea y al Código de Prácticas sobre Transparencia de Contenido Generado por IA, firmado en julio de 2026 por alrededor de 190 organizaciones.
La compañía decidió aplicar el sistema en todo el mundo debido a que todavía no cuenta con una forma suficientemente duradera de limitarlo exclusivamente a determinados territorios.
Anthropic prepara una herramienta de detección
La empresa anunció que próximamente ofrecerá una API para detectar la marca de agua, aunque todavía trabaja en los detalles de su implementación.
El sistema no estará destinado a identificar al usuario, su organización ni sus conversaciones. La información contenida en la marca se relacionará únicamente con la posible participación de Claude en la generación o procesamiento del contenido.


