Anthropic incorpora marcas de agua invisibles al texto generado por Claude para identificar su procedencia

Anthropic ha anunciado una nueva medida para mejorar la transparencia en torno al contenido generado mediante inteligencia artificial: sus modelos Claude comenzarán a incorporar una marca de agua invisible en los textos que generan.

La compañía explica que esta señal oculta estará integrada directamente en el texto y podrá mantenerse incluso cuando el contenido sea copiado y pegado en otros lugares. En determinadas circunstancias, la marca también podría sobrevivir a algunas modificaciones realizadas posteriormente.

La iniciativa forma parte de los compromisos asumidos por Anthropic en el marco del Artículo 50(2) del Código de Prácticas de la Ley de Inteligencia Artificial de la Unión Europea (EU AI Act), que establece medidas relacionadas con la transparencia y la identificación de determinados contenidos generados por IA.

Una marca de agua que el usuario no podrá ver

A diferencia de una marca de agua tradicional, que puede aparecer como un logotipo, texto o elemento visual sobre un documento, el nuevo sistema de Anthropic funcionará de manera invisible.

La señal se incorpora a nivel del modelo, por lo que no dependerá de una aplicación específica o de la interfaz desde la que se utilice Claude. Esto significa que el mecanismo estará presente independientemente de si el usuario interactúa con el chatbot directamente o utiliza determinados servicios basados en los modelos de Anthropic.

La empresa asegura que los usuarios no deberían notar ninguna diferencia en el contenido generado. La marca no modificará el significado, la calidad ni la legibilidad del texto.

Los modelos Claude lanzados a partir del 2 de agosto de 2026 contarán con compatibilidad con este sistema desde su lanzamiento, mientras que la implementación se está extendiendo globalmente en los mercados donde están disponibles los modelos compatibles.

¿Cómo funcionará la marca de agua?

Uno de los objetivos principales es que la señal pueda permanecer asociada al contenido aunque este sea trasladado fuera del entorno original de Claude.

Por ejemplo, un usuario podría generar un texto con Claude, copiarlo y pegarlo en un documento, página web o sistema de gestión de contenidos. Según Anthropic, la marca de agua podría mantenerse en determinadas circunstancias.

Sin embargo, la compañía todavía está desarrollando los mecanismos necesarios para detectar estas marcas y ha advertido que no deben considerarse una prueba absoluta de que un texto fue escrito íntegramente por inteligencia artificial.

Anthropic tiene previsto ofrecer herramientas de detección tanto para usuarios como para terceros en el futuro.

Una marca de agua no demuestra que todo el texto sea generado por IA

Este punto es especialmente importante. Encontrar una marca asociada a Claude no significa necesariamente que todo el contenido haya sido creado por la inteligencia artificial.

Anthropic pone como ejemplo una situación en la que una persona escribe un artículo completamente por su cuenta y posteriormente utiliza Claude para corregir la gramática, traducirlo, resumirlo o modificar su formato.

En ese caso, la versión final podría contener una marca de agua de Claude aunque la idea y el texto original hayan sido creados por una persona.

También puede ocurrir lo contrario. Un contenido generado inicialmente por Claude podría perder la marca detectable después de sufrir modificaciones importantes.

Entre los factores que podrían dificultar la detección se encuentran:

  • Ediciones extensas del contenido.
  • Paráfrasis realizadas posteriormente.
  • Traducciones.
  • Combinación de texto generado por Claude con contenido humano.
  • Utilización de fragmentos extremadamente cortos.
  • Transformaciones importantes del texto original.

Por este motivo, Anthropic considera que una detección positiva debe interpretarse como una señal de que el contenido pudo haber sido procesado por Claude, pero no necesariamente como una demostración de su procedencia completa.

Disponible en diferentes servicios de Claude

El sistema no estará limitado al chatbot principal de Anthropic. La compañía señala que la marca de agua será compatible con diferentes productos y servicios de su ecosistema.

Entre ellos se encuentran Claude, Claude Platform (API), Claude Code, Claude Cowork y Claude Tag.

También se aplicará cuando los modelos compatibles de Claude sean utilizados mediante plataformas de infraestructura en la nube como AWS, Google Cloud y Microsoft Foundry.

Esta integración a nivel de modelo resulta importante porque evita que la función dependa exclusivamente de una determinada aplicación. En teoría, el contenido generado mediante diferentes vías de acceso a los modelos podría incorporar la misma señal.

Anthropic también aplicará tecnología de procedencia a imágenes y archivos

La iniciativa no se limita al texto. Anthropic también está incorporando información de procedencia a determinados formatos de imágenes y archivos.

Para archivos SVG, PNG y JPG, la compañía utilizará metadatos firmados digitalmente basados en el estándar C2PA (Coalition for Content Provenance and Authenticity).

Este sistema puede proporcionar información sobre la procedencia de un archivo y ayudar a determinar si ha sido procesado mediante Claude. Las firmas digitales también permiten comprobar si la información de procedencia ha sido alterada.

La utilización de estándares de procedencia como C2PA está adquiriendo una importancia creciente a medida que las herramientas de inteligencia artificial generativa producen cada vez más imágenes, textos, vídeos y otros contenidos digitales.

Un paso hacia una mayor transparencia de la IA

La decisión de Anthropic llega en un momento en el que resulta cada vez más difícil distinguir entre contenido producido exclusivamente por personas y material generado o modificado mediante sistemas de inteligencia artificial.

Los modelos actuales pueden redactar artículos, resumir documentos, traducir contenidos, corregir textos y transformar información existente en cuestión de segundos. Esto ha generado nuevas necesidades relacionadas con la transparencia y la procedencia del contenido.

Las marcas de agua digitales podrían convertirse en una de las herramientas utilizadas para afrontar este problema.

Sin embargo, su efectividad dependerá de varios factores, especialmente de la capacidad de los sistemas de detección para identificar correctamente las señales y de la resistencia de estas frente a modificaciones posteriores.

No será un detector definitivo de textos escritos con IA

Uno de los aspectos más relevantes del anuncio es que Anthropic no presenta su tecnología como un detector infalible de inteligencia artificial.

Una marca detectada puede indicar que Claude intervino en algún momento del proceso de creación o edición, pero no permite determinar por sí sola qué porcentaje del contenido fue generado por IA.

Esto es particularmente importante para medios de comunicación, instituciones educativas, empresas y plataformas digitales que podrían utilizar herramientas de detección para tomar decisiones sobre la autoría de un contenido.

Un texto puede ser principalmente humano y haber sido revisado por Claude. Del mismo modo, un contenido originalmente generado por Claude puede haber sido modificado posteriormente hasta el punto de que su marca deje de ser detectable.

Por ello, la procedencia del contenido debe analizarse dentro de un contexto más amplio.

¿Qué significa para los usuarios de Claude?

Para los usuarios, el cambio será prácticamente invisible. Anthropic asegura que la marca no alterará la apariencia, el significado ni la calidad del texto.

La principal diferencia estará en la posibilidad futura de analizar el contenido mediante herramientas capaces de detectar la señal.

Esto podría resultar especialmente relevante para organizaciones que necesitan conocer el origen de documentos, publicaciones, materiales educativos o contenidos digitales.

Para desarrolladores y empresas que utilizan la API de Claude, la incorporación a nivel de modelo también significa que la tecnología de procedencia puede formar parte de sus flujos de trabajo sin necesidad de utilizar una interfaz específica de Anthropic.

La procedencia será cada vez más importante

La expansión de la inteligencia artificial generativa está haciendo que la procedencia digital se convierta en un aspecto fundamental del ecosistema tecnológico.

Las marcas de agua invisibles y los metadatos firmados no solucionan por sí solos el problema de identificar contenido generado por IA, pero pueden aportar una capa adicional de información.

En el caso de Anthropic, el nuevo sistema combina dos enfoques: una señal invisible integrada en el texto y mecanismos de procedencia basados en estándares digitales para determinados archivos.

La compañía continuará trabajando en las herramientas necesarias para detectar las marcas y ha indicado que espera ponerlas a disposición de usuarios y terceros en el futuro.

Por ahora, la recomendación más importante es no interpretar la presencia o ausencia de una marca de Claude como una prueba definitiva de autoría humana o artificial. La marca puede aportar información sobre el historial de procesamiento de un contenido, pero no necesariamente contar toda su historia.

Con la implementación de este sistema en los nuevos modelos Claude y su despliegue global, Anthropic se suma así a los esfuerzos de la industria para desarrollar mecanismos de transparencia y trazabilidad en una era en la que la inteligencia artificial forma parte cada vez más habitual de la creación y edición de contenidos digitales.