Claude marcará con una señal invisible todo el texto que procese, incluso el escrito por humanos

Fecha:

Anthropic ha revelado que próximamente marcará con una señal imperceptible todo contenido procesado —no solo generado— por cualquiera de sus modelos de Claude. La medida responde a los requisitos de la Ley de Inteligencia Artificial de la Unión Europea, que obliga a los proveedores de sistemas de IA a marcar salidas de audio, imagen, texto y vídeo generadas o manipuladas por IA.

Según explica la compañía en un artículo de soporte publicado recientemente según Ars Technica, todas las salidas de texto llevarán «marcas de agua incrustadas» invisibles para el usuario, mientras que otros archivos generados incluirán «metadatos de procedencia firmados digitalmente cuando sea compatible». A diferencia de lo que exige la normativa europea, Anthropic aplica la marca incluso en casos donde la IA cumple una función asistencial mínima, como corrección gramatical.

Una marca que no distingue entre edición ligera y texto generado completamente

El enfoque de Anthropic resulta especialmente exhaustivo: la marca de agua se aplicará a todo contenido procesado por Claude, incluso si el sistema únicamente corrigió una coma en un texto escrito íntegramente por un humano. La Ley de IA europea exime explícitamente de marcado aquellos casos donde la IA realiza «una función asistencial para edición estándar» sin alterar sustancialmente el contenido original.

La compañía reconoce esta discrepancia: «Las personas a menudo usan Claude para revisar, traducir, resumir o convertir archivos. La salida puede llevar una marca de Claude incluso si las ideas, el texto o los datos subyacentes se originaron en otra fuente», señala el comunicado.

Las marcas de agua funcionan sesgando las elecciones léxicas del modelo según un patrón distribuido en todo el documento, detectable únicamente mediante herramientas específicas. Sin embargo, este método puede hacer que ocasionalmente el modelo elija una palabra ligeramente menos óptima para mantener la señal intacta.

Fácil de eludir, fácil de malinterpretar

El sistema presenta vulnerabilidades evidentes para actores maliciosos. Si un texto marcado se introduce en otro chatbot que lo edite, la marca de agua podría destruirse. En contenido visual, una simple captura de pantalla o el uso de herramientas básicas de edición de metadatos bastan para eliminar la información. Una vez que Anthropic revele públicamente cómo identificar estas marcas, construir sistemas para eliminarlas será trivial.

Además, el potencial de confusión es elevado. Anthropic advierte que «una marca detectada proporciona una señal de que el contenido fue procesado por Claude, pero no es totalmente concluyente». La marca puede aparecer incluso en contenido no generado por Claude, y su ausencia tampoco garantiza que el contenido no sea de origen artificial.

Esta ambigüedad crea escenarios problemáticos. Un profesor, por ejemplo, podría interpretar la marca como evidencia de que un estudiante generó todo el texto con IA, cuando en realidad solo utilizó Claude para revisar ortografía en un trabajo original. La marca no diferencia entre estos casos extremos.

Contradicciones en el marco legal europeo

Paradójicamente, la Ley de IA europea no exige etiquetar texto generado íntegramente por IA en la mayoría de contextos públicos. Una novela escrita por IA o contenido de marketing generado artificialmente no requieren etiquetas visibles. Solo el contenido destinado a «informar al público sobre asuntos de interés público» debe etiquetarse, a menos que un editor humano identificable lo revise.

Esta situación genera una incongruencia: a nivel de modelo, la directiva es «marcar todo», pero en divulgación pública, «no necesitas etiquetar este texto si alguien lo revisó».

Anthropic planea compartir eventualmente detalles sobre cómo detectar las marcas para ofrecer el soporte técnico que exige la ley europea. La compañía también desarrollará una API de detección para que los usuarios puedan identificar contenido marcado por sí mismos. El incumplimiento de la Ley de IA conlleva multas de hasta 15 millones de euros o el 3% de los ingresos anuales globales de una empresa.

En declaraciones a Ars Technica, Anthropic aseguró: «Estamos añadiendo marcado a la salida de Claude para cumplir con la Ley de IA de la UE, y otros laboratorios están tomando medidas similares. Es difícil identificar texto generado por IA, y esto proporciona a las personas mejores herramientas de identificación».


Compartir noticia:

Popular

Esto te interesa
Noticias

El Cybercab de Tesla, el momento decisivo que podría transformar la empresa para siempre

Tesla lanza hoy su robotaxi Cybercab en Austin, un vehículo sin volante ni pedales que marca la transición de la compañía de fabricante de automóviles a empresa de IA y robótica.

TechCrunch Disrupt 2026 presenta su Builders Stage con estrategias prácticas de escalado para startups

El evento reunirá en San Francisco a más de 10.000 fundadores e inversores del 13 al 15 de octubre con sesiones sobre captación de talento, fundraising y estrategias go-to-market en la era de la IA.

La nueva técnica de razonamiento de OpenAI alarma a expertos en seguridad de IA

El modelo Astra utilizará «recurrencia opaca», una técnica que dificulta monitorizar el proceso de pensamiento de la IA y genera preocupación en la comunidad científica.

Adobe integra sus herramientas creativas en Slack para editar desde el chat

Adobe ha anunciado la disponibilidad de más de 70 de sus herramientas en Slack, permitiendo a los usuarios editar contenido directamente desde el chatbot sin salir de la plataforma.