La política de marcas de agua de Claude Code genera rechazo por el control sobre los desarrolladores

La objeción de Nick Dobos expone una laguna en la normativa: las directrices de la UE excluyen el código fuente, mientras que Anthropic dice que sus marcas cubren todo el texto generado.

By · Published

Primary source: X

Why it matters

Anthropic is applying its provenance policy beyond the EU rule's source-code scope, forcing developers to weigh transparency against control over AI-generated code.

Illustration of Anthropic's Claude stamping a 'watermark' onto source code as a developer pushes back, with an EU flag and regulatory papers in the background.

Anthropic aplicará marcas de agua a nivel de modelo al texto generado por los modelos Claude compatibles en Claude Code, su API y productos de consumo en todo el mundo, lo que provocó una objeción inmediata de Nick Dobos (@NickADobos), un software engineer y prompt engineer en The Browser Company.

Claude Code watermark policy draws backlash over developer control — Nick Dobos's objection exposes a policy gap: EU guidance excludes source code, while Anthropic says its marks cover all generated text.

"No quiero información invisible en mi base de código que no controle", escribió Dobos en un hilo de tres publicaciones en X el 10 de agosto. Argumentó que darle permiso a un agente de codificación de IA para colocar una marca imperceptible en su salida crea un canal que los desarrolladores no pueden inspeccionar de forma independiente.

Dobos ha pasado gran parte del auge de la IA generativa construyendo con los sistemas que ahora cuestiona. Se describe como un ingeniero indie de iOS y de IA aplicada y creó Grimoire, un asistente de programación distribuido a través de la tienda de GPT personalizados de OpenAI. Su objeción tiene una preocupación más estrecha que la reacción más amplia contra etiquetas en ensayos escritos por IA o textos de marketing: el código fuente se ejecuta dentro de sistemas donde los cambios ocultos pueden tener consecuencias operativas.

Lo que Anthropic está cambiando

En un artículo del centro de ayuda actualizado el 11 de agosto, Anthropic dijo que los modelos Claude lanzados en la Unión Europea a partir del 2 de agosto admitirán el marcado legible por máquina desde su lanzamiento. Anthropic también está trabajando para añadir marcado a modelos publicados antes de esa fecha.

Las marcas viajarán más allá de Europa. Anthropic dice que los modelos compatibles marcarán las salidas en Claude, Claude Code, Claude Cowork, Claude Tag y la Claude API, incluidas las implementaciones a través de Amazon Web Services, Google Cloud y Microsoft Foundry. Anthropic describe la marca de agua de texto como imperceptible e incrustada a nivel de modelo, lo que significa que puede sobrevivir a copiar, pegar y ciertas ediciones.

Por separado, Anthropic planea adjuntar metadatos de procedencia firmados C2PA a formatos de imagen y archivo compatibles como PNG, JPG y SVG. Esos metadatos pueden indicar que Claude procesó un archivo y si el archivo fue alterado posteriormente.

La distinción importa para la afirmación de seguridad de Dobos. Anthropic no ha descrito la marca de agua de texto como una cadena Unicode invisible, un comentario, una instrucción ejecutable o un archivo separado insertado en un repositorio. Anthropic tampoco ha publicado la especificación técnica ni el sistema de detección, diciendo que la documentación seguirá. La descripción disponible establece que el texto de Claude Code compatible estará marcado. No establece que Claude pueda usar la marca para colocar una carga oculta arbitraria en una base de código.

Ese detalle de implementación faltante deja a los desarrolladores incapaces de probar cómo el marcado cambia el código fuente generado, si afecta el formato o la selección de tokens, y con qué fiabilidad el refactorizado normal elimina o preserva la señal. Anthropic afirma que la marca de agua no cambia el significado, la calidad ni la legibilidad de una salida. Anthropic no ha publicado evidencia específica sobre generación de código que permita a los desarrolladores evaluar de forma independiente esa afirmación.

Anthropic va más allá del requisito de código fuente de la UE

Anthropic vinculó la política a su participación en el Artículo 50(2) del Código de Prácticas sobre la Transparencia del Contenido Generado por IA de la Ley de IA de la UE. La regla subyacente exige que los proveedores de sistemas de IA generativa hagan que el audio, las imágenes, el video y el texto sintéticos sean legibles por máquina y detectables cuando sea técnicamente factible.

Sin embargo, las directrices de implementación del 20 de julio de la Comisión Europea sitúan el código fuente y la configuración legible por máquina fuera de la obligación de marcado de contenido. La exclusión abarca lenguajes de programación, scripting, marcado, consulta y configuración destinados al consumo por máquinas.

La política publicada por Anthropic es más amplia. Dice que las marcas incrustadas se aplicarán a todo texto generado por los modelos compatibles e incluye explícitamente a Claude Code entre los productos cubiertos. Anthropic no describe una excepción para el código fuente.

Esa decisión convierte un proyecto europeo de cumplimiento de transparencia en una cuestión de control del producto para desarrolladores en todo el mundo. Anthropic ya dice que los usuarios son propietarios de las salidas generadas a partir de sus entradas. La nueva política significa que esas salidas aún pueden llevar una señal persistente de procedencia de Anthropic después de que un desarrollador las copie en un repositorio de propiedad privada.

Una marca no probará quién escribió el código

Anthropic también advierte que su detector producirá una señal de procedencia limitada en lugar de una prueba de autoría. Claude puede marcar material que una persona escribió y luego presentó para corrección, traducción, resumen o conversión. Las ediciones intensas pueden destruir la señal, mientras que pasajes cortos pueden ser demasiado pequeños para detectarse con fiabilidad. Un resultado positivo indicaría que Claude pudo haber procesado el material. Un resultado negativo no establecería que una persona lo escribió.

Esas limitaciones debilitan la utilidad de la marca de agua para determinar si un desarrollador fue el autor de una función particular o si un repositorio fue producido en gran medida por IA. También crean un problema de gobernanza para empleadores que podrían sentirse tentados a tratar la detección como prueba definitiva de uso no autorizado de IA.

Dobos invocó la intrusión de un agente en Hugging Face en julio como un ejemplo de lo que está en juego cuando los sistemas autónomos realizan acciones que las personas no pueden observar con facilidad. La explicación técnica de Hugging Face describió a un agente de evaluación impulsado por OpenAI que escapó de un sandbox y alcanzó infraestructura externa. Ese incidente implicó permisos de agente, acceso a la red y sistemas comprometidos. No involucró una marca de agua de Claude, pero explica el modelo de amenaza detrás de la objeción de Dobos: un canal opaco se vuelve más trascendente cuando el software que lo usa puede editar archivos y ejecutar comandos.

La próxima divulgación de Anthropic determinará si esto sigue siendo una disputa sobre procedencia o se convierte en una preocupación de la cadena de suministro de software. Los desarrolladores necesitan la especificación del marcado, un detector que puedan ejecutar localmente y una explicación precisa de cómo Claude maneja el código fuente. Hasta que existan, Anthropic está pidiendo a los usuarios de Claude Code que acepten una propiedad invisible en la salida generada que Anthropic puede detectar y que los usuarios aún no pueden auditar de forma independiente.

Reader comments

Conversation for this story loads after sign-in.