Resumen del contenido central
Anthropic ha añadido una marca invisible a los textos generados por Claude basada en Google SynthID. El principio funciona ajustando sutilmente las probabilidades de selección de palabras durante el proceso de generación, creando patrones estadísticos que solo pueden ser detectados por herramientas especiales. Sin embargo, han aparecido rápidamente herramientas contra estas marcas (como otras tecnologías de revisión automática de textos basadas en IA), capaces de eliminar fácilmente estos patrones. Este enfrentamiento técnico no solo ha revelado la vulnerabilidad de las marcas, sino que también ha planteado una cuestión más profunda: cuando tanto la generación como la modificación del texto tienen como objetivo evitar ser detectadas o dejar rastros, la búsqueda de precisión y estilo en la escritura se ve sometida a los objetivos técnicos.
I. La marca invisible de Claude no es un simple “sello”, sino que guía secretamente la selección de palabras
¿Piensas que una marca es simplemente un símbolo oculto que se añade después de escribir un artículo? No es así. Cada vez que Claude genera una palabra (o un punto y coma, llamado “token”), calcula las probabilidades de varias opciones posibles. Por ejemplo, para la frase “Este película es realmente __”, las opciones “bonita” (40%), “imponente” (20%) y “espectacular” (10%). SynthID aumenta ligeramente las probabilidades de algunas palabras (por ejemplo, elevando “bonita” al 45% y disminuyendo “imponente” al 18%) para que el modelo escoja más probablemente estas opciones.
Pero no obliga al modelo a elegir una palabra en particular, y no existe una lista fija de palabras marcadas. La misma palabra puede ser favorecida o no dependiendo del contexto. Si se analiza una palabra por separado, no se nota nada inusual; solo después de acumular cientos de palabras, las herramientas de detección pueden identificar que la selección de palabras sigue esos patrones estadísticos secretos. Es como si un estudiante siempre eligiera la opción C en los exámenes: no es casualidad, sino que hay una guía oculta.
II. ¿Por qué es tan fácil eliminar las marcas? Porque están demasiado ligadas al texto
Las marcas no se ocultan en los metadatos de los archivos (como la información de captura de imágenes), ni se añaden caracteres invisibles; simplemente están “escritas” en la selección de palabras. Para eliminarlas, basta reemplazar las palabras sin cambiar el significado general: usar sinónimos (“bonita” por “espectacular”), cambiar el tono (de activo a pasivo), o enviar el texto a otra herramienta de revisión automática de IA (como Declaude, diseñada para eliminar el estilo artificial del texto generado por IA). Es como cuando un profesor te pide secretamente que uses ciertas palabras en tu redacción: si quieres evitarlo, simplemente reemplázalas por otras con significado similar, y la “guía” del profesor desaparece. El costo de esta contramedida es muy bajo, por lo que la marca de Claude resultó ser bastante ineficaz desde el principio.
III. Asimetría en el enfrentamiento: los que intentan engañar pueden escapar, mientras que los honestos son marcados
Este juego es injusto para dos tipos de personas:
- Los que intentan engañar: buscan modelos o herramientas que no utilicen marcas y modifican el texto repetidamente hasta que las marcas ya no se detecten.
- Los usuarios normales: pueden no saber que existen estas marcas y, al usar automáticamente a Claude para generar contenido, terminan siendo marcados como si su texto fuera escrito por IA.
Es como en los exámenes: aquellos que intentan engañar encuentran formas de evitar las indicaciones del profesor, mientras que los estudiantes que responden seriamente son identificados por elegir la opción sugerida (como la opción C). Las marcas son más fáciles de detectar precisamente en quienes no intentan ocultar nada.
IV. Lo más preocupante no es el fracaso de la tecnología, sino que la expresión textual está siendo “secuestrada” por ella
Anthropic afirma que las marcas no afectan el significado ni la calidad del texto, pero el problema radica en que al elegir palabras, los modelos tienen en cuenta si estas serán detectadas o no, en lugar de centrarse únicamente en escribir de manera precisa y con estilo. Los usuarios también modifican el texto para evitar las detecciones, ignorando las sutiles diferencias entre las palabras.
Por ejemplo, “Finalmente aceptó” y “Finalmente cedió” tienen significados similares, pero “cedió” implica una sensación de resistencia previa y negociación. Para quienes realmente valoran la escritura, no se pueden reemplazar estas palabras a voluntad. Sin embargo, ahora tanto los modelos como los usuarios usan el argumento del “significado similar” como excusa para hacer cambios. El texto ya no sirve para expresarse con precisión, sino que se ha convertido en una herramienta en este enfrentamiento técnico.
En resumen, la tecnología de marcas de Claude parecía avanzada, pero fue rápidamente contrarrestada. Lo más importante es que ha transformado el texto en un campo de batalla técnica, donde ya no se trata solo de expresar ideas, sino también de dejar o evitar rastros. Esto nos recuerda que, con el desarrollo tecnológico, no debemos olvidar el valor intrínseco del lenguaje: la selección de palabras nunca es cuestión de “que tenga un significado similar”; las palabras en sí mismas forman parte del significado completo.