OpenAI anunció que, a partir de las próximas semanas, insertará marcas de agua invisibles en los textos generados por ChatGPT y Codex para usuarios de la Unión Europea, cumpliendo con la normativa de transparencia del Reglamento de IA.

Funcionamiento de la marca

La solución, denominada textGrain, introduce una señal estadística imperceptible en la selección de palabras. Un detector propio de OpenAI puede analizar un fragmento y determinar si proviene de sus sistemas. La herramienta permanece desactivada por defecto; los desarrolladores que usan la API pueden activarla de forma opcional.

"No estamos convirtiendo la marca de agua en texto en un estándar global por defecto en este lanzamiento", señaló la empresa en su comunicado.

Marco legal y comparaciones

El Artículo 50 del Reglamento de IA de la UE obliga a que los resultados de sistemas generativos sean identificables por máquinas. La norma entró en vigor el 2 de agosto. OpenAI no es la primera en responder: Anthropic ya había implementado marcas de agua en sus modelos Claude y las extendió a nivel mundial.

Evaluación técnica

Un informe conjunto de OpenAI, la Universidad de Pensilvania y Yale describe el método. La tasa de falsos positivos se sitúa en 1 %. El detector reconoce la marca en aproximadamente 80 % de fragmentos de 200 palabras y en 95 % de textos de 400 palabras. La precisión disminuye cuando se sustituyen palabras por sinónimos; al cambiar el 10 % del contenido, la detección cae de 92 % a 66 %.

"La marca se degrada rápidamente si el texto se edita", explicó el informe técnico.

Impacto y próximos pasos

OpenAI afirma que la inserción de la marca no afecta la calidad de su modelo más reciente, Astra, según pruebas internas. La compañía planea publicar más detalles técnicos y, eventualmente, liberar textGrain como código abierto. Mientras tanto, la verificación pública de procedencia sigue disponible para imágenes y audio a través de openai.com/verify.