Anthropic publicó un extenso comunicado en el que explicó, con mayor profundidad, el funcionamiento de las marcas de agua que comenzará a incorporar en los textos generados por Claude, su asistente de inteligencia artificial, como parte de su adaptación a las nuevas exigencias regulatorias de la Unión Europea.
La medida responde a la entrada en vigor, el pasado 2 de agosto, del Artículo 50 de la Ley de Inteligencia Artificial europea, que obliga a los proveedores de sistemas generativos a identificar de forma legible por máquinas todo contenido creado artificialmente. Anthropic, junto con alrededor de 190 organizaciones más, firmó en julio el Código de Prácticas sobre Transparencia de Contenido Generado por IA, comprometiéndose así a implementar este tipo de mecanismos.
Un patrón invisible para el lector, pero detectable con una clave
Según explicó la compañía, cuando Claude enfrenta decisiones de «bajo riesgo» —como elegir entre las palabras «nublado» o «gris» para describir el clima— puede generar un patrón sutil dentro de sus respuestas que resulta imperceptible para cualquier persona, pero que sí puede identificarse mediante una clave específica de detección. Anthropic fue enfática en aclarar que esta tecnología «no afecta la calidad» de las respuestas del modelo y que, para quien lee el texto, una respuesta marcada resulta indistinguible de una que no lo está.
La técnica elegida corresponde a SynthID-Text, un método desarrollado originalmente por el equipo de Google DeepMind y publicado en la revista Nature en octubre de 2024. Además, la empresa anunció que pondrá a disposición una interfaz de programación (API) para que terceros puedan verificar si un texto contiene o no esta marca.
¿Se puede eliminar editando el texto?
Una de las dudas más frecuentes entre los usuarios era si bastaba con editar el contenido para borrar el rastro de la inteligencia artificial. Al respecto, Anthropic señaló que una edición ligera «probablemente no eliminará la marca de agua por completo», mientras que una reescritura total, en la que se sustituya cada palabra, sí lo haría, aunque en ese caso, admitió la propia empresa, resulta discutible si el texto puede seguir considerándose generado por IA.
En el caso del código de programación, la compañía precisó que la marca tendrá un efecto mucho menor, ya que el modelo carece de libertad para elegir entre múltiples soluciones válidas al escribir funciones; sin embargo, sí podría aparecer en elementos más flexibles, como los comentarios dentro del propio código.
Finalmente, Anthropic remarcó que esta medida no será exclusiva de Claude, ya que otras empresas desarrolladoras de modelos de lenguaje que firmaron el mismo código europeo también deberán implementar sus propios sistemas de marcado, y que la aplicación de esta política no se limitará a Europa, sino que regirá a nivel global en plataformas como Claude.ai, la API, Claude Code y Claude Cowork.