2026-10-05 · ← Noticias
OpenAI marcará texto en la UE, pero mantendrá privado el detector
OpenAI añadirá durante las próximas semanas un watermark invisible a los textos aptos de ChatGPT y Codex en la UE, mientras que los clientes de la API podrán activarlo voluntariamente en todo el mundo. Debido a que la edición debilita la detección y puede haber errores, el detector quedará inicialmente limitado a investigadores y organizaciones expertas aprobadas.
No se pudo cargar la imagen.
OpenAI responde a las obligaciones de transparencia del artículo 50 del AI Act de la UE. Durante las próximas semanas añadirá un watermark invisible a los textos aptos de ChatGPT y Codex en todos los planes dentro de la UE. No será una opción global por defecto. Los clientes de la API de todo el mundo pueden activarlo para determinados modelos, aunque en la API permanece desactivado de forma predeterminada.
textGrain modifica la elección de palabras, no el aspecto del documento
La tecnología, llamada textGrain, introduce una señal estadística en la selección de palabras durante la generación. Un detector con la misma clave secreta comprueba después si el texto contiene ese patrón. El lector no ve la marca y no se trata de caracteres ocultos ni de metadata que desaparezca al copiar el texto.
OpenAI también ha abierto las solicitudes de acceso al detector. Al principio solo lo recibirán investigadores y organizaciones expertas aprobadas caso por caso. La herramienta indica si detecta un watermark de OpenAI. No identifica al usuario ni revela sus prompts o conversaciones. La empresa también prevé publicar la tecnología como open source.
La norma europea crea una marca sin lector público
Para un usuario de la UE cambia la generación del texto, pero no existe una herramienta pública para comprobarlo. Los desarrolladores de la API tienen la situación inversa: pueden activar la función en todo el mundo, aunque no se enciende por defecto. Esta diferencia separa el cumplimiento dentro de los productos de OpenAI de una opción que cada cliente de la API debe configurar correctamente.
El watermark solo puede indicar que un sistema de OpenAI generó o procesó una parte del texto. No determina la autoría, la aportación humana, la propiedad ni la veracidad del contenido. Un resultado negativo tampoco demuestra que una persona escribiera el texto.
La edición destruye la señal antes que el significado
En pruebas publicadas por OpenAI con una tasa objetivo de false positive del 1 %, la detección alcanzó aproximadamente el 80 % en textos de 200 tokens y el 95 % en textos de 400 tokens dentro de un conjunto de respuestas de psicología. En una prueba de edición sobre 400 tokens, bajó de cerca del 92 % al 66 % tras sustituir por sinónimos el 10 % de las palabras, y al 17 % tras cambiar el 25 %.
Es una limitación seria para escuelas, medios y sistemas de moderación. La traducción, la paráfrasis o una edición normal pueden debilitar la señal, mientras que un false positive puede perjudicar a quien realmente escribió el texto. OpenAI cita el riesgo de omisiones y falsos positivos para justificar que el detector no sea público en el lanzamiento.
Las pruebas independientes decidirán si la marca soporta una disputa
Ahora importan tres señales: cómo resiste textGrain las traducciones y la edición cotidiana, qué organizaciones reciben realmente acceso al detector y si la publicación open source permite reproducir los resultados de la empresa. La marca detectada puede aportar provenance, pero no basta como única prueba en una disputa sobre un estudiante, empleado o autor.
La regulación ha obligado a los proveedores a insertar un rastro legible por máquinas en el texto generado. La práctica deberá demostrar si ese rastro se puede leer con suficiente fiabilidad y equidad como para ser algo más que una casilla marcada en compliance.
El veredicto de Lilith
OpenAI escribirá sobre los textos europeos con tinta invisible y prestará la lupa solo a laboratorios elegidos. Una marca sin un lector fiable y accesible protege mejor el compliance que a la persona acusada de hacer trampas.
Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.
Fuente original ↗ ↗