Anthropic explicó cómo funcionarán las nuevas marcas de agua en los textos generados por Claude y qué tan fáciles serán de detectar. La compañía confirmó que usará el sistema SynthID-Text y que prepara una API para detectar estos contenidos.
Según Anthropic, la marca de agua será invisible para el lector y no modificará la calidad de las respuestas. El sistema aprovechará decisiones de escritura que Claude toma al generar determinados textos.
Anthropic explicó cómo funcionarán las nuevas marcas de agua en los textos generados por Claude
Cómo funcionarán las marcas de agua de Claude
Anthropic explicó que Claude puede generar patrones en sus respuestas al elegir entre palabras que tienen un significado similar. Por ejemplo, puede optar entre términos como “overcast” y “grey”.
Ese patrón será indetectable para el lector, pero podrá ser identificado por quienes tengan una clave específica para comprobarlo.
La compañía aclaró que el watermarking no afectará la calidad de los textos. Para una persona, una respuesta con marca de agua será indistinguible de una que no la tenga.
Cómo funcionarán las marcas de agua de Claude
Qué sistema usará Anthropic para detectar textos de Claude
Anthropic utilizará el sistema SynthID-Text, desarrollado por el equipo de Google DeepMind y presentado en 2024.
Además, la empresa planea lanzar una API de detección de marcas de agua para identificar textos generados por Claude.
Qué sistema usará Anthropic para detectar textos de Claude
Anthropic aclaró que este mecanismo es diferente de los sistemas que analizan patrones de escritura para determinar si un contenido fue creado con IA.
¿Se puede eliminar la marca de agua de un texto generado por Claude?
La compañía reconoció que es posible modificar un texto para ocultar la marca de agua. Sin embargo, una edición ligera probablemente no alcance para eliminarla por completo.
En cambio, una reescritura completa, en la que se reemplacen todas las palabras, sí podría quitarla. Anthropic señaló que, en ese caso, también puede discutirse si el resultado todavía puede considerarse un texto generado por IA.
¿Se puede eliminar la marca de agua de un texto generado por Claude?
Qué pasa si Claude solo corrige o edita un texto escrito por una persona
La posibilidad de detectar una marca de agua dependerá de cuánto texto haya editado Claude y de la extensión del contenido original.
Si la intervención del chatbot fue leve, casi todas las palabras seguirán siendo del autor humano. En ese escenario, habrá muy poco contenido al que la marca de agua pueda asociarse.
Qué pasa si Claude solo corrige o edita un texto escrito por una persona
Cómo funcionará el watermarking de Claude en el código
Los códigos tendrán menos marcas de agua que otros tipos de texto. Esto se debe a que Claude necesita producir código funcional y tiene menos margen para elegir entre distintas opciones igualmente válidas.
Sin embargo, el sistema podría utilizarse cuando exista una elección arbitraria entre determinadas palabras o términos. Un ejemplo son los comentarios dentro del código.
Anthropic aclaró que, por definición, la marca de agua tendrá un efecto negligible sobre el código producido.
Cómo funcionará el watermarking de Claude en el código
Claude no será el único chatbot que tendrá textos con marcas de agua
Anthropic también señaló que Claude no será el único chatbot que incorpore esta tecnología. Según la compañía, otros grandes desarrolladores de modelos firmaron el mismo Código de Prácticas y aplicarán sus propios sistemas.
La medida forma parte de la respuesta de las empresas de inteligencia artificial a las nuevas exigencias de transparencia. Anthropic explicó que su decisión está vinculada con el Código de Transparencia de la Ley de IA de la Unión Europea.