OpenAI marcará el texto de ChatGPT en la UE con textGrain
OpenAI activa textGrain, una marca estadística invisible. En la API es opt-in. En las próximas semanas irá en el texto elegible de ChatGPT y Codex en la UE. No identifica al usuario.

Desde el 5 de octubre, un texto de ChatGPT puede llevar una marca que no se ve. OpenAI llama a esa señal textGrain: una marca de agua estadística que altera, de forma invisible, las elecciones de palabras del modelo. El detector busca esa señal para decir si un pasaje lleva marca de OpenAI. No dice quién lo escribió.
-IA Crew dice: una marca de agua que se borra si cambias una de cada diez palabras es menos sello de lacre y más posavasos en un bar con corriente.-
Qué se enciende, y dónde
En la API, la marca es opt-in y viene apagada por defecto. Desde ese día, los clientes pueden activarla en modelos seleccionados, en todo el mundo. OpenAI no la convierte en ajuste global. Dice que quiere aprender del uso real antes de ir más lejos.
En la Unión Europea el plan es otro. En las próximas semanas, el texto elegible de ChatGPT y de Codex llevará esa marca para usuarios de todos los planes, solo en la UE. El anuncio enmarca el movimiento en las reglas europeas de procedencia del texto. No es, de momento, un interruptor mundial de ChatGPT.
Lo que el detector no hace
El acceso al detector se abre el mismo día, pero no para cualquiera. Al principio queda en investigadores y organizaciones expertas que puedan evaluar la tecnología. La herramienta dirá si detecta una marca de OpenAI. No identifica a la persona, la cuenta, el prompt ni la conversación. OpenAI admite falsos positivos y falsos negativos, y por eso no suelta el detector al público en el lanzamiento. Quien quiera acceso tiene que pedirla, y la concesión es caso por caso.
La marca tampoco mide cuánto puso un humano, ni establece autoría, ni comprueba si el texto es correcto. Un pasaje corto, editado, traducido, anterior a la marca o salido de otro laboratorio puede no llevar señal. En matemáticas, donde hay menos libertad para elegir palabras, la detección baja.
-IA Crew dice: si el detector se pierde en un ejercicio de mates, al menos comparte una experiencia muy humana.-
Se borra con poco
OpenAI publica una cifra que conviene no redondear hacia arriba. En pasajes de 400 tokens, sustituir el 10% de las palabras por sinónimos bajó la detección de alrededor del 92% al 66%. Sustituir el 25% la dejó en el 17%. Con un objetivo de falso positivo del 1%, el detector encontró la marca en cerca del 80% de pasajes de 200 tokens y en cerca del 95% de los de 400. Un buen resultado en laboratorio no es una detección fiable en un texto retocado.
Hay un informe técnico, y OpenAI dice que piensa abrir la tecnología. El documento se irá actualizando en las próximas semanas. Para quien publica, corrige o traduce, la consecuencia práctica es estrecha: la marca puede ayudar a un revisor autorizado a sospechar un origen, y se debilita en cuanto el texto se reescribe. No sirve para señalar a una cuenta ni para demostrar que un párrafo es cierto.
Quien esperaba un sello imposible de quitar no lo va a encontrar aquí. OpenAI lo dice casi con esas palabras: la técnica es temprana y tiene límites serios.
-IA Crew dice: cumplir la norma europea con una señal que un sinónimo deja coja es un plan. Llamarlo prueba de autoría sería otro, y OpenAI no lo hace.-
Diccionario de la Crew
TextGrain — Marca de agua estadística de OpenAI: una señal invisible en la elección de palabras, detectable sin identificar al usuario ni el prompt.
Token — Trozo en el que el modelo parte el texto. Las pruebas de detección que cita OpenAI usan pasajes de 200 y 400 tokens.
Fuentes
OpenAI | https://openai.com/index/eu-text-provenance


