OpenAI anuncio el lunes 5 de octubre de 2026, desde su sitio oficial y para usuarios de la Union Europea, que empezara a incorporar una marca de agua invisible en textos elegibles generados por ChatGPT y Codex, como respuesta directa a las obligaciones de transparencia de la Ley de IA europea y mediante un sistema tecnico llamado textGrain, que altera de forma estadistica la seleccion de palabras sin mostrar una etiqueta visible al lector.
La decision convierte una exigencia regulatoria en una prueba a gran escala para una pregunta incomoda: si es posible identificar textos producidos por maquinas sin degradar su utilidad ni crear falsas acusaciones. OpenAI explico en su anuncio oficial que los clientes de API en todo el mundo ya pueden activar la marca de agua en modelos seleccionados, mientras que en ChatGPT y Codex el despliegue europeo llegara durante las proximas semanas.
Una marca invisible para cumplir con Bruselas
El encuadre europeo es central. El Articulo 50 de la Ley de IA exige que los proveedores de sistemas generativos marquen los contenidos sinteticos en formato legible por maquina y que esos contenidos puedan detectarse como artificiales, en la medida en que sea tecnicamente viable. La norma distingue esa obligacion de marcado de los deberes de divulgacion que pueden recaer sobre ciertos editores o usuarios.
OpenAI intenta cubrir esa primera capa. textGrain no imprime una advertencia ni agrega metadatos visibles. Segun el reporte tecnico, el sistema introduce una senal estadistica en la forma en que el modelo escoge tokens, usando aleatoriedad secreta y conservando, en promedio, la distribucion de palabras esperada. El texto se lee igual para una persona, pero un detector autorizado podria buscar el patron.
We're expanding our approach to content provenance to include text in response to EU regulatory requirements, while recognizing the significant limitations of current text watermarking technology.
Our tools already help verify whether an image or audio file was created with our…
— OpenAI (@OpenAI) 5 de octubre de 2026
Traduccion: OpenAI dice que ampliara su enfoque de procedencia al texto por requisitos regulatorios de la UE, pero reconoce limites importantes en la tecnologia actual de marcas de agua.
La tecnologia llega con limites reconocidos
La compania fue inusualmente explicita sobre los puntos debiles. En sus evaluaciones, la deteccion mejora cuando el pasaje es mas largo, pero cae cuando el texto es breve, tecnico o tiene poca libertad de redaccion. Con una tasa objetivo de falsos positivos del 1%, el detector encontro la marca en cerca del 80% de pasajes de 200 tokens y alrededor del 95% de pasajes de 400 tokens en temas como psicologia. En matematicas, el rendimiento fue menor.
El dato mas sensible esta en la edicion posterior. En pruebas con pasajes de 400 tokens, reemplazar el 10% de las palabras con sinonimos redujo la deteccion de cerca del 92% al 66%; reemplazar el 25% la llevo al 17%. Ese resultado explica por que OpenAI no abrira el detector al publico general de inmediato. La empresa recibira solicitudes de investigadores y organizaciones expertas, una restriccion que busca evitar usos abusivos, pero tambien limita la verificacion independiente.
Un precedente para toda la industria
El movimiento no ocurre aislado. Google ya habia usado SynthID para senales invisibles en contenidos generados, y Anthropic tambien ha descrito mecanismos de marcado para cumplir con las reglas europeas. La diferencia ahora es el tamano de ChatGPT y Codex: si la marca de agua se normaliza en productos masivos, el debate entrara en flujos reales de trabajo, desde codigo hasta tareas escolares y comunicacion corporativa.
Para empresas que operan en Europa, la medida aporta una ruta de cumplimiento, pero no reemplaza politicas internas claras. Una marca invisible puede indicar origen probable; no prueba si un texto es correcto, si fue revisado por una persona o si fue publicado con responsabilidad editorial. OpenAI subraya esa diferencia en su documentacion de senales de procedencia, donde advierte que estas marcas no garantizan exactitud ni contexto.
La UE esta empujando a los laboratorios a construir infraestructura de trazabilidad antes de que exista un consenso tecnico definitivo. OpenAI, al aceptar el mandato pero limitar el acceso al detector, envia una senal doble: cumplira con Bruselas, pero no presenta la marca de agua como una prueba infalible. Esa tension probablemente definira la siguiente etapa de la IA generativa: no solo producir contenido, sino dejar rastros tecnicos sobre como fue producido.