El texto de ChatGPT en Europa va a llevar una firma invisible
OpenAI anunció el domingo que el texto producido por ChatGPT y Codex dentro de la Unión Europea empezará a llevar una marca oculta. Lo escrito no se ve distinto. El sistema, llamado textGrain, inclina ligeramente qué palabra elige el modelo en cada paso para que el texto terminado contenga un patrón estadístico que un detector con la clave adecuada puede reconocer.
El motivo es el artículo 50 del reglamento europeo de inteligencia artificial, que exige que el contenido generado por máquina sea identificable de forma legible por máquina, con una obligación que se aplica desde el 2 de diciembre. El despliegue alcanzará en las próximas semanas a los usuarios elegibles de todos los planes en la UE. Los desarrolladores de fuera de Europa pueden activar lo mismo a través de la API si lo desean, porque viene desactivado. El detector en sí todavía no se reparte públicamente, solo a investigadores y organizaciones aprobadas.
OpenAI es inusualmente franca sobre lo frágil que es todo esto. Cambie una palabra de cada diez por un sinónimo y la detección cae de alrededor del 92 por ciento al 66. Una de cada cuatro, y baja al 17. Los pasajes cortos cuestan más, las matemáticas son casi imposibles, y traducir o reescribir a fondo un texto puede borrar la marca por completo. La marca de agua, además, no dice nada sobre quién escribió el texto, qué cuenta lo produjo ni de qué iba la conversación.
En la práctica, esto es algo que conviene entender más que hacer. Un profesor, un empleador o un periódico no puede pasar una varita mágica por un documento y obtener una respuesta, y a quien le digan lo contrario le están vendiendo algo. Si usa la aplicación de ChatGPT en Windows, la comprobación de actualizaciones de aplicaciones de Tendvane es lo que la mantiene en silencio en la versión actual mientras llegan cambios como este.