OpenAI ha anunciado cambios en ChatGPT para cumplir con la Ley de IA de la Unión Europea. La compañía empezará a añadir una marca de agua invisible a los textos de ChatGPT y Codex, después de que Anthropic anunciara un sistema similar para Claude hace un par de semanas.
Una señal invisible entre las palabras que escoge ChatGPT
La clave está en textGrain, una tecnología que introduce una señal estadística en la elección de palabras del modelo, por lo que se traslada al copiar y pegar le texto. Según OpenAI, luego el detector buscará ese patrón para determinar si un fragmento contiene la marca. Para nosotros, el texto mantendrá su aspecto habitual durante la lectura, pero podrá ser detectable.
El despliegue será gradual. ChatGPT y Codex incorporarán la marca en la Unión Europea durante las próximas semanas, mientras que si usamos la API podemos activarla ya, y voluntariamente, en la mayoría de modelos. El movimiento, sin duda, es especialmente interesante tras años de trabajo alrededor de los detectores de texto generado por ChatGPT que no siempre han funcionado como deberían.
Un detector que depende del contexto y que viene con limitaciones
Junto con el nuevo sistema de marcado, OpenAI abrirá el acceso a su detector a investigadores y organizaciones especializadas. La precisión, según OpenAI, cambia mucho según la longitud y el tipo de contenido: en textos de 400 tokens, sustituir un 10% de las palabras por sinónimos reduce la detección del 92% al 66%, mientras que un 25% de cambios la sitúa en el 17%.
Estamos, por tanto, ante una herramienta de procedencia más que una prueba absoluta de autoría. La marca indica que un sistema de OpenAI ha participado en el texto, mientras la identidad del usuario, la propiedad y el grado de intervención humana quedan fuera del análisis.