
Anthropic detallou o funcionamento do sistema de marcado que incorporará nos textos xerados por Claude para cumprir o artigo 50 da Lei de Intelixencia Artificial da Unión Europea. A técnica, baseada nunha variante de SynthID-Text de Google DeepMind, introduce un patrón estatístico imperceptible no proceso de selección das palabras que permite estimar posteriormente se Claude participou na xeración dun texto. Non engade caracteres ocultos, non identifica o usuario nin incrementa o número de tokens xerados.
Os novos modelos de Claude lanzados na UE desde o 2 de agosto de 2026 incorporan esta capacidade desde o primeiro día. Anthropic está aplicando o marcado a nivel de modelo e, por este motivo, a medida funciona nos diferentes produtos e servizos que empregan os modelos compatibles e, polo momento, tamén fóra do mercado europeo. Os modelos anteriores a esa data recibirán progresivamente a función durante os vindeiros meses.
O mecanismo baséase nas decisións que un modelo de linguaxe toma cando existen varias palabras igualmente axeitadas para continuar unha frase. Se, por exemplo, despois de «O tempo hoxe foi frío e…» existen varias opcións naturais, Claude pode escoller entre elas sen que o resultado cambie de maneira relevante. O sistema de marca de auga aproveita estas eleccións de baixo impacto para crear un patrón detectable posteriormente.
A diferenza está na fonte da aleatoriedade utilizada para seleccionar esas palabras. En lugar de empregar un xerador de números aleatorios convencional, Claude utiliza unha chave e parte das palabras anteriores para determinar a selección. O resultado segue sendo indistinguible para o lector dun texto xerado sen marca, pero alguén que dispoña da chave pode analizar a secuencia e calcular a probabilidade de que sexa compatible coa xeración realizada por Claude.
A técnica non forza o modelo a empregar palabras pouco naturais nin altera deliberadamente o vocabulario. Tampouco fai que Claude escolla sempre determinadas palabras. O patrón distribúese entre numerosas decisións independentes e só actúa cando existen alternativas suficientemente equivalentes, polo que non se aplica cando unha resposta concreta é necesaria para manter a precisión.
Anthropic afirma que as probas internas non detectaron efectos apreciables sobre a calidade, a creatividade ou a lexibilidade das respostas. A investigación de Google DeepMind sobre SynthID-Text, que serve de base para o sistema de Claude, tampouco atopou diferenzas estatisticamente significativas nas valoracións de textos xerados con e sen marca de auga.
A aplicación do marcado tampouco debería afectar ao rendemento ou ao prezo do servizo. Como o sistema non require xerar tokens adicionais, Anthropic indica que non incrementa o custo de xeración e que o impacto sobre a velocidade dos modelos é mínimo.
A capacidade de detección estará condicionada pola cantidade de texto dispoñible. Un fragmento longo ofrece máis decisións sobre as que buscar o patrón e permite incrementar a confianza da análise, mentres que textos moi curtos poden non proporcionar suficiente información para determinar se existe unha marca.
A marca tampouco permite establecer que Claude sexa o autor dun texto. O resultado da detección só pode indicar que existe unha determinada probabilidade de que Claude participase na súa elaboración ou procesamento. Non permite saber se o modelo escribiu o contido desde cero, se o revisou ou se simplemente o transformou.
Esta distinción é especialmente relevante na corrección de textos. Se un usuario entrega a Claude un documento escrito por unha persoa e lle pide corrixir unicamente a gramática e a puntuación, a maior parte das palabras proceden do texto orixinal e só unhas poucas son seleccionadas novamente polo modelo. Nese caso pode non haber suficiente material marcado para que a participación de Claude resulte detectable. Pola contra, unha tradución realizada por Claude si contará con máis oportunidades para introducir o patrón, xa que o modelo debe seleccionar practicamente todas as palabras do resultado.
As limitacións son aínda máis evidentes no código. Cando unha saída debe ser exacta, non existe unha elección equivalente que poida utilizarse para introducir a marca sen risco de alterar o resultado. Despois dunha expresión como «2 + 2 =», por exemplo, o seguinte valor debe ser «4», polo que non hai unha alternativa válida sobre a que aplicar o mecanismo. Por este motivo, o código presenta xeralmente unha densidade de marcado inferior á doutros tipos de texto, aínda que pode aparecer en partes con maior liberdade de elección, como os comentarios.
A modificación posterior do contido tamén pode dificultar a detección. Unha edición lixeira pode non eliminar completamente o patrón, mentres que unha reescritura completa pode facelo desaparecer. Neste último caso, ademais, o resultado xa sería substancialmente diferente do texto xerado inicialmente por Claude.
O sistema non incorpora información que permita identificar o usuario, a organización ou a conversa da que procede o texto. A chave utilizada para detectar a marca tampouco contén datos deste tipo, polo que a identificación se limita á posible participación de Claude na elaboración do contido.
Anthropic prepara unha API específica para detectar as marcas de auga dos textos, aínda que os detalles da súa implementación aínda están en desenvolvemento. O obxectivo é que usuarios e terceiros poidan comprobar posteriormente se un fragmento contén un patrón compatible con Claude.
Os ficheiros xerados ou procesados por Claude empregan un mecanismo diferente. En formatos compatibles como PNG, JPG ou SVG, o sistema engade unha credencial de procedencia asinada criptograficamente nos metadatos mediante o estándar aberto C2PA. Estes datos poden ser interpretados por ferramentas compatibles co estándar e indican que Claude participou na creación ou procesamento do ficheiro, sen incluír información persoal sobre o usuario.
O marcado de Anthropic forma parte da aplicación dos compromisos asumidos no Código de Prácticas europeo sobre transparencia do contido xerado mediante intelixencia artificial, asinado en xullo por preto de 190 organizacións. A compañía sinala que outros grandes desenvolvedores de modelos tamén adoptarán os seus propios mecanismos de marcado para cumprir as mesmas obrigas.
O sistema tampouco determina a autoría legal, a propiedade dun contido nin a responsabilidade sobre el. A súa finalidade limítase a achegar unha sinal técnica sobre a posible intervención de Claude na creación ou procesamento dun texto ou ficheiro.

