Luego de anunciar que su contenido tendrá una marca de agua visible, Claude salió a explicar cómo funcionaá. Y es que Claude genera texto palabra por palabra y, en muchas frases, puede elegir entre varias opciones igualmente naturales. Por ejemplo, al completar una oración sobre el clima, puede resultar igual de adecuado usar “nublado” o “gris”.
El sistema aprovecha esas decisiones de bajo impacto. En vez de seleccionar las palabras mediante una fuente de aleatoriedad normal, utiliza una señal codificada que deja un patrón detectable a lo largo del texto.
No cambia el texto de forma visible
Anthropic afirma que la marca de agua no introduce símbolos ocultos, espacios especiales ni caracteres invisibles. Tampoco requiere tokens adicionales ni modifica deliberadamente el significado, la calidad o la legibilidad de las respuestas.
El resultado debería leerse como cualquier otro texto generado por el modelo. La diferencia solo puede analizarse con una clave capaz de reconocer el patrón estadístico utilizado durante la generación.

Basado en SynthID-Text
La tecnología toma como base SynthID-Text, un método publicado por Google DeepMind. A diferencia de las marcas visibles sobre imágenes, esta solución funciona dentro de las probabilidades que utiliza el modelo al seleccionar palabras.
La marca no identifica a una persona, empresa o conversación específica. Solo permite estimar la probabilidad de que un fragmento haya sido generado, al menos en parte, por Claude.
No funciona igual en todos los textos
El sistema necesita suficientes elecciones de palabras flexibles para dejar una señal confiable. Por eso funciona mejor en textos largos, donde se acumulan muchas decisiones lingüísticas de baja importancia.
Su eficacia disminuye en fragmentos cortos, textos muy factuales, correcciones de escritos realizados por usuarios y código. En esos casos hay menos margen para elegir palabras o símbolos alternativos sin alterar la exactitud del contenido.
No detecta toda la IA
La herramienta de detección no puede determinar si un texto fue escrito por una persona ni identificar automáticamente el contenido producido por otros modelos de inteligencia artificial. Cada empresa podría usar una clave y un método de marcado distintos.
Por tanto, que no se detecte la marca de Claude no demuestra que un texto sea humano. Solo indica que no hay evidencia suficiente de la huella específica que Anthropic incorporó.
Próximo detector
Anthropic planea ofrecer próximamente una API para detectar la marca de agua en textos. Esto permitiría que plataformas, empresas e investigadores revisen documentos y estimen si Claude intervino en su elaboración.
La tecnología no será una solución definitiva contra la desinformación o el fraude, pero puede convertirse en una herramienta adicional de transparencia sobre el origen de contenido generado por inteligencia artificial.

