Seo-Tecnico

Cómo funciona el watermark de Anthropic y por qué se puede derrotar

Anthropic reveló los detalles técnicos de su sistema de watermark basado en SynthID-Text. Explicamos cómo usa la aleatoriedad del LLM, por qué no es detectable a simple vista y bajo qué condiciones se puede eliminar mediante edición.

Publicado el 15 de agosto de 2026, 11:55 hs

Claude marca todo lo que genera: qué significa para marketers y agencias

Anthropic publicó detalles concretos sobre el mecanismo de watermark que utiliza en Claude. La revelación confirma lo que se venía rumoreando sobre sistemas similares como MirrorMark y aclara varios mitos que circulaban en redes.

El watermark no se basa en caracteres Unicode ocultos, en el uso de guiones em o en patrones típicos de escritura de LLMs como "no es esto, es aquello". Tampoco se trata de medir la probabilidad de que un texto sea generado por IA. Lo que busca es un patrón específico en la secuencia de palabras generadas.

Los modelos de lenguaje generan el siguiente token más probable pero incorporan un componente de aleatoriedad. En lugar de elegir siempre la opción con mayor probabilidad, introducen ruido para que la salida sea más natural. El watermark de Anthropic (una evolución de SynthID-Text de Google DeepMind) modifica la fuente de esa aleatoriedad usando una clave secreta y el contexto de las palabras anteriores.

De esta forma, las elecciones siguen siendo aleatorias pero siguen un patrón determinístico que solo es verificable si se posee la clave. Para un lector humano el texto es indistinguible de cualquier otra generación. Solo quien tiene la clave puede validar si la secuencia coincide con lo que el modelo hubiera elegido bajo esa semilla.

Por qué es resistente a detección casual

El sistema pertenece a la familia de watermarks que comenzó con la propuesta de Scott Aaronson en 2022 y que evolucionó notablemente desde la publicación original de SynthID-Text en 2024. Las versiones más recientes, como MirrorMark, distribuyen el watermark a lo largo de todo el texto usando el contexto circundante, lo que lo hace más robusto frente a modificaciones parciales.

Anthropic reconoce explícitamente que el watermark se puede eliminar. Una edición ligera (cambiar algunas palabras o frases) probablemente no sea suficiente para borrarlo por completo. Sin embargo, una reescritura total donde se reemplaza cada palabra sí logra eliminar el patrón. En ese caso, según la propia compañía, ya no se puede considerar que el texto siga siendo el originalmente generado por la IA.

Implicancias para el SEO técnico

Para quienes trabajamos en auditorías técnicas y contenido generado por IA, este anuncio tiene varias lecturas prácticas:

  • Detección de contenido AI: las herramientas que prometen detectar IA solo por patrones lingüísticos o likelihood no podrán identificar este watermark sin la clave privada. Eso limita mucho las soluciones disponibles en el mercado actual.

  • Contenido escalable: si un equipo genera cientos de artículos con Claude y luego los edita sustancialmente, es probable que esté eliminando el watermark sin proponérselo. Esto afecta estrategias de contenido que dependen de trazabilidad.

  • Zero-bit vs multi-bit: SynthID original solo indicaba "watermarked o no". Versiones más nuevas como MirrorMark pueden codificar información adicional (autor, fecha, modelo utilizado). Esto abre puertas a usos más sofisticados de verificación de procedencia.

  • Indexación y calidad: Google ya ha dicho que no penaliza contenido generado por IA siempre que sea útil. El watermark en sí no afecta directamente el crawling ni los Core Web Vitals, pero sí puede ser relevante para sistemas de calidad de contenido a futuro.

Recomendaciones prácticas para webmasters

Si estás usando Claude o cualquier LLM para generar contenido a escala, considera lo siguiente:

  1. Revisa siempre el texto final con edición humana significativa. Una reescritura profunda no solo elimina el watermark sino que suele mejorar la calidad y la originalidad.

  2. No confíes exclusivamente en detectores de IA comerciales. La mayoría no tienen acceso a las claves privadas de Anthropic ni de Google.

  3. Documenta tus procesos internos de generación y edición. Ante eventuales consultas de Google o de terceros, contar con un registro claro de cómo se produjo el contenido sigue siendo la mejor defensa.

  4. Monitorea en Search Console cómo performan las páginas con alto componente de IA editada. Los patrones de engagement y tiempo en página siguen siendo los indicadores más confiables.

El anuncio de Anthropic deja claro que la carrera entre generación de watermark y métodos para evadirlo continúa. Mientras tanto, la mejor práctica sigue siendo la misma de siempre: contenido útil, bien estructurado y técnicamente optimizado para crawling e indexación.

El estado del arte avanza rápido. Lo que hoy es un watermark resistente puede volverse obsoleto en 12 meses. Por eso, en auditorías técnicas recomendamos siempre enfocarse primero en los fundamentos: velocidad, datos estructurados, indexabilidad y experiencia de usuario. El resto son capas adicionales que pueden cambiar con cada actualización de los proveedores de IA.

← Volver al blog