Desde el 2 de agosto de 2026, todo modelo de Claude lanzado a partir de esa fecha sale de fábrica con una marca invisible tejida en las propias palabras — y Anthropic está retro-adaptando los modelos anteriores para sumarlos durante un período de transición. No es una etiqueta, no es un metadato que se pueda borrar con copiar y pegar: es una alteración estadística en las palabras que el modelo elige, indetectable a simple vista pero medible con la clave correcta. Anthropic la presentó como parte de un sistema más amplio para marcar contenido generado por IA — y la reacción no fue precisamente de aplausos.
Cómo funciona la marca de texto
La técnica se apoya en algo que todo modelo de lenguaje hace en cada paso de generación: elegir la siguiente palabra entre varias opciones que son, en la práctica, equivalentes en significado y calidad. Ahí es donde entra la marca — una clave secreta sesga cuál de esas opciones “empatadas” termina eligiéndose, en un patrón que un lector nunca podría notar leyendo el texto.
Un detector que conoce esa misma clave puede volver a escanear el texto y medir si las elecciones de palabras se desvían del patrón esperado por azar. Con suficiente longitud de texto, esa desviación se vuelve una señal estadísticamente significativa. Según Anthropic, el proceso no cambia el significado, la calidad ni la legibilidad de la respuesta (Claude Help Center).
Lo importante: la marca viaja con el texto. Sobrevive a copiar y pegar entre aplicaciones, y puede persistir incluso después de ediciones moderadas. Lo que sí la degrada o elimina:
- Edición pesada o reescritura sustancial
- Paráfrasis o traducción
- Mezcla con texto escrito por una persona
- Textos muy cortos — emails, encabezados, resúmenes breves suelen quedar por debajo del umbral de longitud necesario para una detección confiable
Metadatos de procedencia para archivos
Para archivos como .svg, .png y .jpg, Anthropic usa un mecanismo distinto: metadatos de procedencia firmados bajo el estándar abierto C2PA (Coalition for Content Provenance and Authenticity). Estos metadatos indican si un archivo fue procesado por Claude y si fue manipulado después — es la misma familia de estándar que ya usan Adobe, Google y Microsoft para marcar contenido generado o editado con IA.
Dónde aplica
- Modelos: los lanzados desde el 2 de agosto de 2026 en adelante ya incluyen soporte desde el día uno. Anthropic está retro-adaptando modelos anteriores durante un período de transición.
- Superficies: Claude Platform (API), Claude.ai, Claude Code, Claude Cowork, Claude Tag, y despliegues vía AWS, Google Cloud y Microsoft Foundry.
- Alcance geográfico: aplica globalmente, no solo donde la regulación lo exige — y sin opción de desactivarlo.
Por qué ahora: el Artículo 50 de la EU AI Act
El detonante es regulatorio. El Código de Transparencia del Artículo 50 de la EU AI Act entró en vigor el 2 de agosto de 2026 y exige a los proveedores de IA generativa marcar sus salidas en formatos legibles por máquina, para que plataformas, reguladores y usuarios finales puedan identificar contenido generado por IA. El incumplimiento puede costar hasta 15 millones de euros o el 3% de la facturación mundial anual de la empresa, lo que sea mayor (TechCrunch).
Anthropic no está sola: Google, Meta, Microsoft, OpenAI y otras se comprometieron a estándares similares. La tendencia ya se extiende más allá de las EU: Suno marca música generada por IA, y Substack se asoció con Pangram para detectar newsletters generadas por IA (TechCrunch).
Lo que la propia Anthropic reconoce como límite
Vale la pena leer la letra chica que la propia empresa publicó:
- Detectar la marca no es concluyente — indica que el contenido pudo haber sido procesado por Claude, no que Claude lo originó de punta a punta.
- La ausencia de marca tampoco prueba que no hubo IA involucrada: se pierde con conversión de formato, edición pesada o plataformas no soportadas.
- La documentación técnica que permitiría a terceros verificar la marca de forma independiente todavía no está publicada — Anthropic solo se comprometió a liberarla (Claude Help Center).
Esa combinación — “no es concluyente” más “sin documentación técnica pública todavía” — es exactamente el punto que más critican los usuarios.
La controversia
La reacción más fuerte no vino de quienes usan Claude para generar texto de punta a punta, sino de abogados, académicos e investigadores que lo usan para editar o pulir escritura que es sustancialmente propia. Su objeción: ahora ese texto puede devolver un “positivo” de detección de IA aunque el contenido intelectual sea enteramente suyo — con el riesgo de una acusación de mal uso en un contexto profesional o académico donde eso tiene consecuencias reales (TechCrunch).
A eso se suma que la política es global y sin opt-out, y que llegó sin la documentación técnica que permitiría auditar de forma independiente qué tan preciso es el sistema. Algunos usuarios reportaron directamente cancelar su suscripción (Forbes).
La conclusión práctica
El watermarking de Claude es, en el fondo, una respuesta regulatoria — no una función que los usuarios pidieron. Funciona razonablemente bien para el caso que la ley busca cubrir (frenar la desinformación masiva generada por IA a gran escala), pero deja una zona gris incómoda para el caso de uso más común entre profesionales: usar IA como editor, no como autor. Mientras Anthropic no publique cómo se puede verificar la marca de forma independiente, la pregunta de “¿cuánta edición hace falta para que desaparezca?” va a seguir sin una respuesta confiable.
Fuentes
- How Claude marks AI-generated content — Claude Help Center
- Anthropic says it will watermark text generated by its AI models — TechCrunch
- Some Claude users are mad that Anthropic’s new watermarks will catch them cheating at their jobs, classes — TechCrunch
- Claude Will Put Invisible Watermarks On AI Text And Images—And The Internet Isn’t Happy — Forbes
- Anthropic’s Claude Adds Invisible Watermarks To AI-Generated Text — Forbes
- Anthropic’s text watermarks signal new front in AI detection — Axios
- Anthropic plans to add an invisible mark to AI text — Fortune
Anderson Ponce
