En pocas palabras: Desde el 11 de agosto de 2026, Anthropic marca el texto que genera Claude con un sesgo estadístico en la elección de tokens según una clave secreta —no caracteres invisibles ni metadata—. Es global, obligatoria y sin opción de desactivarla, por el Article 50 de la EU AI Act.
Anthropic empezó a marcar todo el texto que genera Claude a partir del 11 de agosto de 2026. La marca de agua de Claude no es un sesgo estadístico en caracteres invisibles ni metadata pegada al archivo: es un sesgo estadístico en cómo el modelo elige las palabras, y responde al Article 50 de la EU AI Act que entró en vigor el 2 de agosto. Aplica de forma global, sin opción de desactivarla.
La marca de agua de Claude es una técnica de watermarking estadístico que Anthropic incrusta en los textos que generan sus modelos. Funciona sesgando la selección de tokens según una clave secreta, no agregando símbolos ocultos ni etiquetas al documento. Su función es señalar que Claude procesó ese contenido, y es la respuesta de Anthropic al Article 50 de la EU AI Act, vigente desde agosto de 2026.
En 30 segundos
- Qué pasó: desde el 11 de agosto de 2026 Anthropic marca todo el texto y las imágenes que produce Claude, de forma global y obligatoria.
- Cómo: el texto usa una marca estadística (sesgo en la elección de tokens); las imágenes usan el estándar C2PA de credenciales de contenido.
- El detalle incómodo: la marca dice “Claude procesó esto”, no “Claude lo escribió”. Si le pedís que te traduzca o corrija un texto tuyo, queda marcado igual.
- Detección: hace falta un detector con la clave secreta (solo Anthropic la tiene). La API pública prometida todavía no está disponible a agosto de 2026.
- Por qué: el disparador es el Article 50 de la EU AI Act, que obliga a marcar contenido sintético. Los modelos viejos quedan cubiertos de forma progresiva.
Anthropic es una empresa estadounidense de investigación en inteligencia artificial fundada en 2021 por investigadores incluyendo Dario Amodei. Desarrolla modelos de lenguaje grandes como Claude, enfocada en seguridad e interpretabilidad de sistemas de IA.
¿Por qué Anthropic implementó la marca de agua Claude Anthropic desde agosto de 2026?
Por regulación europea. El disparador es el Article 50 de la EU AI Act, que entró en vigor el 2 de agosto de 2026 y obliga a los proveedores de IA a marcar el contenido generado de forma artificial para que sea identificable como tal. Anthropic lo anunció el 11 de agosto y, según el reporte de TechCrunch, la medida aplica a todos los outputs, no solo a los de usuarios europeos.
El detalle que casi nadie leyó bien: aplica global. No es un feature para la UE que vos podés esquivar con una VPN. Si usás Claude desde Buenos Aires, tu texto también sale marcado.
La cobertura arranca por los modelos nuevos y, según the-decoder, los modelos legacy quedan incluidos de forma progresiva. Ojo con esto último: los writers automáticos que ya estaban en producción antes de agosto no traían marca todavía, así que hubo una ventana donde el mismo producto generaba texto marcado y no marcado según el modelo.
¿Cómo funciona la marca de agua estadística de Claude?
La marca viaja en el patrón de palabras, no en el archivo. En cada paso de generación, el modelo divide su vocabulario en dos grupos (llamémoslos tokens “verdes” y “rojos”) usando una clave secreta, y sesga la elección hacia los verdes. Como el sesgo es sutil y depende de la clave, el texto se lee normal, pero un detector con esa misma clave puede medir cuántos tokens verdes hay y calcular la probabilidad de que lo haya escrito Claude. Esto se conecta con lo que analizamos en cómo se compara con Gemini 2.5.
¿Es lo mismo que los caracteres invisibles?
No, y esta confusión es la más común. La marca estadística no mete espacios raros, caracteres Unicode invisibles ni etiquetas HTML. Si abrís el texto y buscás símbolos escondidos, no vas a encontrar nada. La “firma” está en la frecuencia con que aparecen ciertas palabras, algo que solo se detecta corriendo un análisis estadístico sobre el conjunto del texto. Por eso necesitás un mínimo de longitud: los tramos muy cortos quedan exentos porque no hay suficiente material para que la estadística sea confiable.
Para las imágenes es otra historia. Ahí Anthropic usa el estándar C2PA de Content Credentials, que sí incrusta metadata de procedencia en el archivo. Dos técnicas distintas para dos tipos de contenido.
¿La marca de agua persiste al copiar, pegar y editar el texto?
Sobrevive al copiar y pegar, pero se erosiona con la edición fuerte. Como la marca vive en la distribución de tokens y no en el archivo, mover el texto de un lado a otro no la borra. Lo que sí la degrada es reescribir en serio: parafrasear a fondo, traducir a otro idioma o mezclar el texto de Claude con párrafos escritos por vos diluye la señal hasta que el detector deja de estar seguro.
Ponele que le pedís a Claude un borrador de 600 palabras, cambiás la mitad de las oraciones a mano y le sumás dos párrafos propios. Lo más probable es que la marca quede tan débil que el score resulte ambiguo. Según the-decoder, la marca “puede persistir a través de algunas ediciones”, con el énfasis en “algunas”.
Traducido: no es una firma indeleble. Es una probabilidad que baja a medida que el texto se aleja del original.
¿Se puede detectar y remover la marca de agua de Claude?
Detectarla requiere la clave secreta que solo tiene Anthropic, y a agosto de 2026 no hay detector público disponible. La empresa prometió una API de detección, pero todavía no la lanzó. Sin esa herramienta, un docente, un editor o una plataforma no puede verificar por su cuenta si un texto salió de Claude. Y cuando la API exista, no va a devolver un sí/no binario: devuelve un score de probabilidad. Complementá con Claude vs GPT-4O en características.
Acá viene lo bueno (o lo incómodo): removerla es más fácil que detectarla. Como la marca se disuelve con la paráfrasis y la traducción, cualquiera con ganas de borrarla pasa el texto por otro modelo o lo reescribe y listo. La barrera técnica para limpiar la marca es más baja que la barrera para probarla.
¿Eso la hace inútil? No del todo, pero sí frágil justo contra quien más querría evadirla.
El problema de fondo: la marca no prueba que Claude escribió el texto
La marca solo indica que Claude procesó el contenido, no que lo redactó. Y esa diferencia lo cambia todo. Si le pedís a Claude que te corrija la ortografía de un ensayo tuyo, que te traduzca un párrafo o que te resuma un PDF, el output sale marcado igual que si lo hubiera escrito de cero. El detector no distingue entre “Claude es el autor” y “Claude pasó los ojos por acá”.
Pensá en los casos reales: un estudiante que escribe su trabajo y solo lo pasa por Claude para pulir la gramática queda marcado como si hubiera hecho trampa. Un traductor profesional que usa Claude como asistente también. La marca dice “esto tocó un modelo de IA”, que no es lo mismo que “esto lo generó una IA”, y toda la utilidad de un watermark depende de que esa distinción importe. Sobre eso hablamos en GPT-5 y Anthropic lado a lado.
¿Por qué Ben Thompson dice que es “peor de lo que parece”?
Porque genera una falsa sensación de solución. El argumento central de Ben Thompson en Stratechery es filosófico antes que técnico: el watermark parece resolver el problema de identificar la “IA slop”, pero en realidad crea una ilusión sin resolver la pregunta que importa, que es quién escribió de verdad el texto.
Thompson lo calificó de “terrible idea, ante todo por razones filosóficas”. El punto: la marca implica un consentimiento y un control que el usuario no tiene. Es obligatoria, global y sin opt-out. Vos generás un texto, Claude lo firma sin preguntarte, y esa firma queda pegada a algo que quizás escribiste vos y solo mandaste a revisar.
Hay un segundo riesgo del que se habló poco. Si el mundo empieza a asumir que “sin marca = humano” y “con marca = IA”, los falsos negativos se vuelven peligrosos: alcanza con parafrasear para lavar la marca y pasar por humano, mientras el que usó Claude de forma honesta para corregir queda escrachado. La “seguridad” que promete el sistema premia justo al que la esquiva.
Marca de agua: Claude vs ChatGPT vs Gemini
Anthropic quedó como el primero de los grandes en marcar texto de forma global y obligatoria. OpenAI y Google se movieron antes en imágenes que en texto. Este es el estado a agosto de 2026, con la salvedad de que las políticas cambian rápido.
| Proveedor | Marca en texto | Marca en imágenes | Detector público |
|---|---|---|---|
| Claude (Anthropic) | Sí, estadística, global y obligatoria (ago 2026) | Sí, vía C2PA | No todavía (API prometida) |
| Gemini (Google) | SynthID-Text existe; despliegue parcial según reportes | Sí, SynthID en imágenes, audio y video | SynthID con acceso limitado |
| ChatGPT (OpenAI) | Sin watermark de texto público desplegado | Metadata de procedencia C2PA en imágenes | No para texto |
Qué está confirmado y qué no
- Confirmado: Anthropic anunció el watermarking el 11 de agosto de 2026 y aplica a todo el texto e imágenes de Claude, a nivel global.
- Confirmado: el disparador es el Article 50 de la EU AI Act, vigente desde el 2 de agosto de 2026.
- Confirmado: las imágenes usan C2PA; los textos usan marca estadística en tokens; los tramos muy cortos quedan exentos.
- Pendiente: la API pública de detección. Sin ella, nadie fuera de Anthropic puede verificar la marca.
- Pendiente: el calendario exacto de cobertura de los modelos legacy.
- No confirmado: qué tan resistente es la marca ante ediciones combinadas (paráfrasis más traducción más mezcla). No hay verificación independiente todavía.
Errores comunes sobre la marca de agua de Claude
- Creer que son caracteres invisibles: no lo son. La marca de texto es estadística, no un símbolo oculto que podés buscar y borrar con un reemplazo.
- Pensar que prueba autoría: la marca dice que Claude procesó el contenido, no que lo escribió. Corregir o traducir con Claude deja marca igual.
- Asumir que es indeleble: se erosiona con paráfrasis fuerte, traducción o mezcla con texto propio. Persiste al copiar y pegar, no a la reescritura seria.
- Suponer que ya podés detectarla: a agosto de 2026 no hay detector público. La API prometida todavía no salió, así que ningún tercero puede verificar por su cuenta.
- Creer que solo afecta a Europa: aplica global. No depende de tu ubicación ni podés desactivarla.
Preguntas Frecuentes
¿Qué es la marca de agua de Claude?
Es una técnica de watermarking que Anthropic incrusta en los textos e imágenes generados por Claude para señalar que son contenido de IA. En texto es un sesgo estadístico en la elección de palabras según una clave secreta; en imágenes es metadata de procedencia bajo el estándar C2PA. Arrancó el 11 de agosto de 2026. Más contexto en Claude frente a Google.
¿Se puede remover la marca de agua de un texto?
Sí, se degrada con edición fuerte. Parafrasear a fondo, traducir a otro idioma o mezclar el texto con párrafos propios diluye la señal hasta que el detector deja de estar seguro. Copiar y pegar tal cual, en cambio, no la borra porque la marca vive en el patrón de tokens, no en el archivo.
¿La marca de agua prueba que Claude escribió el texto?
No. Solo indica que Claude procesó ese contenido, sin distinguir entre redactarlo desde cero y corregir, traducir o resumir un texto que escribiste vos. Esa es la crítica central: un ensayo humano solo pulido con Claude sale marcado igual que uno generado por completo por la IA.
¿Cómo saber si un texto tiene la marca de Claude?
Por ahora no podés, salvo que seas Anthropic. La detección necesita la clave secreta que solo tiene la empresa, y la API pública prometida todavía no está disponible a agosto de 2026. Cuando salga, devolverá un score de probabilidad, no un veredicto binario de sí o no.
¿Puedo desactivar la marca de agua en Claude?
No. La marca es obligatoria, global y sin opción de opt-out, tanto para usuarios de la app como para quienes consumen la API. Aplica a todos los outputs sin importar el país desde donde uses Claude.
Conclusión
Lo que cambió: desde el 11 de agosto de 2026, todo lo que genera Claude sale con una marca de agua estadística, sin que puedas apagarla. Es un movimiento defensivo frente a la EU AI Act más que una función pensada para vos.
Por qué importa: la marca no prueba autoría, se lava con una reescritura y todavía no tiene detector público. Sirve para que Anthropic cumpla con Bruselas, pero resuelve menos de lo que promete. Si esperabas una forma confiable de saber quién escribió qué, esto no es eso.
Qué hacer con esto: si trabajás con contenido y te importa la trazabilidad, no te apoyes en el watermark como si fuera una firma. Documentá tu proceso, guardá los borradores y tratá la marca como una señal débil, no como una prueba. Y si usás Claude para corregir o traducir texto propio, tené presente que va a quedar marcado igual. Habría que ver cómo evoluciona cuando aparezca la API de detección, pero por ahora conviene tomarlo con pinzas.
Fuentes
- TechCrunch – Anthropic anuncia el watermarking de texto de sus modelos
- Stratechery (Ben Thompson) – por qué la marca es peor de lo que parece
- the-decoder – marca global que puede persistir a algunas ediciones
- The Register – watermarks como concesión a la EU AI Act
- ExplainX – detalle del uso de C2PA en imágenes de Claude



