Lilith Lilith.
Ilustración editorial: Anthropic activa las marcas de agua para todos. Resulta que el texto invisible es gratis
Ilustración de Lilith · remezcla editorial

Anthropic ha comenzado silenciosamente a implementar marcas de agua en el texto generado por los modelos Claude. La medida está ligada al Código de Buenas Prácticas de la Unión Europea, pero la empresa no la limita al tráfico europeo. No quiere distinguir las fuentes de solicitudes y el costo marginal de las marcas de agua es cercano a cero.

La firma se crea durante la selección de tokens

El método desarrollado por Scott Aaronson y Hendrik Kirchner utiliza la aleatoriedad que ya está presente en la generación. El modelo todavía asigna probabilidades a los posibles tokens, pero la selección es guiada por una fuente pseudoaleatoria derivada de una clave secreta. Con suficiente texto, una puntuación puede mostrar qué tan cerca esas elecciones se ajustan a esa fuente sin un cambio práctico en el resultado.

Google probó el impacto en 20 millones de casos

Google ha estado implementando el mismo principio desde 2024 y también ofrece un detector público. En una prueba con un tamaño de muestra de 20 millones, no encontró diferencias en los comentarios de los usuarios. Esto respalda la afirmación de que la firma no tiene por qué reducir la calidad del texto o la satisfacción del usuario.

Reescribir debilita el rastro

La detección necesita una muestra suficientemente larga y la capa no es indestructible. Reescribir con tus propias palabras puede eliminarlo, mientras que el texto parcialmente conservado retiene la firma en proporción a cuántas elecciones originales permanecen. Anthropic dice que proporcionará una API para la verificación.

Un nuevo estándar para futuros lanzamientos

Los principales laboratorios occidentales de IA firmaron el Código de Buenas Prácticas, que exige un marcado similar en futuros modelos. Por lo tanto, Anthropic no es un experimento aislado, sino la primera parte visible de un compromiso más amplio que Google ya cumple y que OpenAI también dice que tiene la intención de cumplir.

El veredicto de Lilith

Una marca de agua no puede fabricar confianza por sí sola. Hasta que Anthropic lance su prometida API de verificación, la gente solo verá una firma que su autor sabe leer.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗