OpenAI empieza a marcar el texto generado en la UE. Una marca de agua es un indicio, no un veredicto
textGrain, de OpenAI, es opcional en la API en todo el mundo y llega a ChatGPT y Codex en la UE. Las propias pruebas de OpenAI muestran por qué la detección no decide la autoría.
Escuche este artículo · 6 min
Narración completa del artículo, generada con IA.

El 5 de octubre, OpenAI explicó cómo cumplirá la exigencia del Reglamento europeo de IA de que el texto generado sea identificable por máquina. La respuesta es una marca de agua estadística llamada textGrain, y lo más útil del anuncio es la lista de lo que una marca de agua no puede decir. Quien esté pensando en conectar un detector a decisiones de recursos humanos, cumplimiento normativo o fraude debería leer esa parte antes que nada.
Qué lanza OpenAI, y dónde
- API, en todo el mundo, opcional. Desde el 5 de octubre, los clientes de la API de cualquier país pueden activar texto con marca de agua en modelos seleccionados. En la API la marca está desactivada por defecto.
- ChatGPT y Codex, solo en la Unión Europea. En las próximas semanas, el texto elegible de los usuarios de todos los planes en la UE saldrá con una marca de agua invisible. OpenAI dice que, a propósito, no la convierte en opción global por defecto en el lanzamiento.
- Detector restringido. Investigadores y organizaciones expertas aprobadas pueden solicitar acceso, que se concede caso por caso. El detector no es público y solo informa de si encuentra una marca de OpenAI, sin identificar al usuario ni revelar los prompts.
- Proveedores de nube, más adelante. OpenAI dice que trabaja con socios de nube para ofrecer la marca en sus modelos consumidos a través de ellos “en las próximas semanas”.
textGrain introduce una señal estadística invisible en la elección de palabras del modelo. OpenAI no observa diferencias relevantes en sus benchmarks con y sin marca en su modelo de frontera actual, afirma que textGrain igualó o superó a otras técnicas probadas, incluido SynthID para texto, y prevé publicar el código.
Qué dicen los números de la propia OpenAI
Con un objetivo de falsos positivos del 1%, el detector encontró la marca en cerca del 80% de los fragmentos de 200 tokens y en cerca del 95% de los de 400 tokens, en contenido como respuestas de psicología. En matemáticas, donde la elección de palabras es más rígida, la tasa fue mucho menor. La edición pesa más todavía: sustituir el 10% de las palabras por sinónimos en fragmentos de 400 tokens redujo la detección de cerca del 92% al 66%; sustituir el 25%, al 17%.
Y luego viene la lista que importa. La marca de agua no mide cuánto aportó una persona. No establece titularidad ni responsabilidad. No identifica al usuario. No verifica la exactitud. Y no encontrar la marca no demuestra autoría humana: el texto puede ser corto, editado, traducido, o proceder de otro modelo o de otra empresa.
Qué puede y qué no puede decir una detección
- ¿Generó parte de esto un modelo de OpenAI?
- ¿Cuánto aportó una persona?
- ¿Quién lo escribió o lo envió?
- ¿De quién es, quién responde?
- ¿Es correcto?
- Sin marca: ¿es humano?
Una señal probabilística, como muchoNecesita otra evidencia
Qué cambia para los equipos
En España, la obligación ya es real. El artículo 50 del Reglamento de IA es exigible desde el 2 de agosto de 2026, con un plazo hasta el 2 de diciembre de 2026 para los sistemas que ya estaban en el mercado, según el resumen de Baker Botts. Si su empresa ofrece una función de IA generativa a usuarios en la UE, el deber de marcar el texto puede recaer en ella como proveedora de ese sistema, y la AESIA es la autoridad española que supervisará el cumplimiento. Activar la marca en la API es una forma de conseguir una señal legible por máquina; la decisión es por producto, con asesoría jurídica, y conviene documentarla.
El ChatGPT de su plantilla también llevará marca. Los empleados en España que redactan con ChatGPT o Codex producirán, en las próximas semanas, texto con una señal invisible. No cambia lo que pueden hacer con él, pero sí conviene que comunicación, legal y compras sepan que existe antes de que alguien la descubra en una disputa.
En Latinoamérica la situación es otra. El despliegue en ChatGPT y Codex es solo europeo. Una empresa mexicana, colombiana o chilena solo tiene la opción de la API, y la obligación del artículo 50 le afecta únicamente si ofrece su sistema a usuarios en la UE. No conviene trasladar el marco europeo como si fuera local.
Su flujo de contenido puede borrar la marca. Los procesos editan, traducen, resumen y encajan el texto en plantillas. Cada paso debilita la señal. Si la marca importa para un producto, hay que comprobarla en la salida real del sistema, y hoy ni siquiera se puede hacer porque el detector está restringido. Razón de más para llevar registros propios: quién pidió qué, qué modelo y versión respondió, qué plantilla y qué ediciones humanas siguieron. Ese registro responde a lo que la marca no responde.
Un detector nunca decide sobre una persona. Con un 1% de falsos positivos, una revisión de 100.000 documentos señala unos mil que ningún modelo marcó, y deja pasar texto de IA editado. En una investigación interna o una disputa con un proveedor, el resultado es una evidencia para un revisor humano. Una decisión basada solo en el detector choca además con el artículo 22 del RGPD sobre decisiones automatizadas. Es la misma regla que defendimos en nuestro análisis de los controles que generan evidencia: la evidencia alimenta la decisión, no la sustituye.
Qué hacer ahora
- Inventaríe los productos que generan texto para usuarios en la UE y analice con el área jurídica si su empresa es proveedora a efectos del artículo 50.
- Decida la marca de la API producto a producto y documente el motivo.
- Pruebe dónde su flujo transforma el texto antes de confiar en cualquier marca.
- Refuerce sus registros de procedencia: petición, modelo y versión, plantilla, ediciones humanas.
- Prohíba por política las decisiones automáticas basadas en detección en recursos humanos, proveedores y fraude.
- Pregunte a su proveedor de nube cuándo llegará la marca a los modelos de OpenAI en su plataforma.
En resumen
OpenAI ha sido inusualmente franca: la marca de agua en texto es una señal débil y probabilística, que se degrada al editar y no dice quién escribió, cuánto ni si es verdad. Actívela donde la ley lo pide, lleve mejores registros que la propia marca y no deje que su presencia o su ausencia decidan nada sobre una persona.