Actualidad IA · Contenido e IA

OpenAI empezará a marcar el texto que ChatGPT genera en la UE: qué dice esa marca y quién puede leerla

OpenAI anunció el 5 de octubre que marcará el texto de ChatGPT y Codex en la UE con una marca de agua invisible. Qué señala, qué no prueba y quién la lee.

Equipo editorial de PotencIAPublicado el
Logo oficial de OpenAI: un nudo de seis lazos entrelazados que forman una flor hexagonal con un hueco en el centro, dibujado en negro, centrado y a pequeño tamaño sobre un fondo liso casi blanco, sin texto ni ningún otro elemento.

OpenAI anunció el 5 de octubre de 2026 que en las próximas semanas añadirá una marca de agua invisible al texto que generan ChatGPT y Codex en la Unión Europea, y solo en la Unión Europea. Te toca si escribes con ChatGPT desde España. La consecuencia principal no es la que parece: la marca va a existir, pero el detector que la lee no es público, así que nadie podrá pasar tu texto por él.

La fuente de esta pieza es la entrada Our approach to EU text provenance rules, que OpenAI fecha el 5 de octubre de 2026 en la categoría «Safety». Desde España se sirve en inglés, así que las citas de esa página son traducción propia y el original va entre comillas cuando la literalidad importa. Al final está declarado cómo se ha leído cada fuente.

Qué ha anunciado OpenAI exactamente

Tres cosas con tres calendarios distintos, y conviene no mezclarlas.

  1. En la API, desde el 5 de octubre. Los clientes de la API de todo el mundo pueden activar la marca de agua en el texto de determinados modelos. OpenAI escribe que «la marca de agua en el texto seguirá desactivada por defecto en la API». Es una casilla que hay que ir a marcar.
  2. En ChatGPT y Codex, en las próximas semanas y solo en la UE. OpenAI dice que introducirá la marca de agua «para los usuarios elegibles de ChatGPT y Codex de todos los planes, únicamente en la UE», y añade que «no vamos a convertir la marca de agua en el texto en un comportamiento global por defecto en el lanzamiento».
  3. El detector, por solicitud. Las peticiones de acceso se abren el mismo día, pero el acceso se concede caso por caso y se limita, en palabras de OpenAI, a «investigadores y organizaciones expertas aprobadas». No es una herramienta pública.

El motivo declarado es el Reglamento de IA. El artículo 50, apartado 2, obliga a los proveedores de sistemas de IA que generan contenido sintético de audio, imagen, vídeo o texto a velar «por que los resultados de salida del sistema de IA estén marcados en un formato legible por máquina y que sea posible detectar que han sido generados o manipulados de manera artificial». Esa es la obligación de OpenAI, no la tuya; la diferencia entre las dos es el apartado más importante de este artículo.

La fecha también está cerrada: el Reglamento (UE) 2024/1689 es aplicable con carácter general desde el 2 de agosto de 2026 según su artículo 113, y el capítulo que contiene el artículo 50 no está entre las excepciones de ese artículo. La Comisión Europea lo confirma en la ficha del Código de buenas prácticas sobre la transparencia del contenido generado por IA, donde escribe que las obligaciones del artículo 50 son «aplicables desde el 2 de agosto de 2026» y que la adhesión al código es voluntaria mientras que los requisitos del artículo son obligaciones legales.

Qué es textGrain y cuánto acierta

La tecnología se llama textGrain y no toca el texto: toca cómo se elige cada palabra. El informe técnico, firmado el 5 de octubre de 2026 por autores de OpenAI, la Universidad de Pensilvania y Yale, describe un método que «acopla la generación de tokens a una aleatoriedad con clave» y gasta una parte medida de la entropía del muestreo a cambio de dejar señal. En la práctica: el modelo sigue escribiendo bien, pero sus decisiones de vocabulario llevan dentro un patrón estadístico.

OpenAI publica sus propias cifras de acierto, y son la parte más honesta del anuncio. Con una tasa objetivo de falsos positivos del 1 %:

  • En pasajes de 200 tokens, el detector encontró la marca en torno al 80 % de las veces; en pasajes de 400 tokens, en torno al 95 %. Los números son de contenido «como psicología».
  • En contenido «como matemáticas», donde hay menos margen para elegir palabras, la detección baja «sustancialmente».
  • Editar destruye la señal rápido. En pasajes de 400 tokens, sustituir el 10 % de las palabras por sinónimos bajó la detección del 92 % al 66 %. Sustituir el 25 % la dejó en el 17 %.

Sobre la calidad del texto, OpenAI dice que en los parámetros con los que evalúa Astra, su modelo más avanzado, «no vemos diferencias de rendimiento significativas con y sin marca de agua». Su tabla da, por ejemplo, 49,57 puntos sin marca frente a 49,76 con marca en el índice de inteligencia de Artificial Analysis, y un 94,44 % frente a un 93,94 % en GPQA Diamond. Son cifras publicadas por el fabricante sobre sus propios modelos, no una medición independiente.

Lo que la marca no dice, con las palabras de OpenAI

Este apartado está casi entero en el anuncio, y es el que conviene leer dos veces antes de sacar conclusiones de un texto ajeno. OpenAI enumera cinco límites:

  • No mide la aportación humana. Puede indicar que un sistema de OpenAI generó o procesó parte de un pasaje, «pero no cuánto juicio, edición o creatividad humana se puso en él».
  • No establece la propiedad ni la responsabilidad. No determina de quién es el texto, si su uso fue lícito, si había que revelarlo ni quién responde por él.
  • No identifica al usuario. No asocia el texto a una persona, una organización, una cuenta, un prompt ni una conversación.
  • No verifica la exactitud. No dice si un pasaje es cierto, engañoso, dañino o si está en el contexto correcto.
  • La ausencia de marca no prueba autoría humana. El texto puede ser demasiado corto, estar editado o traducido, venir de un modelo no compatible, ser anterior a la marca de agua, o haberlo escrito la herramienta de otra empresa.

Ese último punto es el que desmonta el uso que más se le va a querer dar: la marca sirve, como mucho, para confirmar; no sirve para descartar.

Qué cambia para un negocio en España

Poco en lo inmediato, y nada en lo que te obliga la ley. Pero hay un detalle que sí es nuevo y que no está dicho en el anuncio con estas palabras.

El mismo modelo va a marcar o no marcar según por dónde entres. Si redactas la descripción de un servicio en chatgpt.com desde España, ese texto llevará marca cuando termine el despliegue. Si el mismo texto lo genera una herramienta construida sobre la API de OpenAI —un asistente propio, un plugin de tu gestor de contenidos, un flujo de automatización— no la llevará, porque en la API la marca está desactivada por defecto y la decide quien montó la herramienta. Mismo modelo, mismas frases, señal de procedencia distinta. Es una lectura nuestra de los dos párrafos del anuncio, no una advertencia de OpenAI.

Y nadie puede leer la marca. Hoy no existe la posibilidad de que un cliente, un competidor o un proveedor pase tu página por el detector de OpenAI, porque el acceso se concede caso por caso a investigadores y organizaciones expertas. La herramienta pública de OpenAI, openai.com/verify, sigue siendo de imagen y audio: la documentación de la API de procedencia de contenido solo lista dos señales, Credenciales de contenido C2PA para imágenes y SynthID para imágenes y audio, y dice que para comprobar texto «hay que solicitar acceso» y que la verificación de texto «está disponible actualmente solo para organizaciones aprobadas, incluidas instituciones académicas y de investigación en IA».

Qué no cambia

Tu obligación legal es otro apartado del mismo artículo. A un negocio que publica no le aplica el artículo 50.2, que es el del proveedor del modelo, sino el 50.4, que obliga a divulgar el uso de IA en textos publicados «con el fin de informar al público sobre asuntos de interés público» y exceptúa los que han pasado revisión humana con un responsable editorial detrás. Eso ya estaba en vigor antes de este anuncio y no se mueve. Lo tenemos desarrollado, con las directrices de la Comisión y los siete controles que pasa un borrador, en contenido escrito con IA: qué controles necesita antes de publicarse.

La marca de agua no es una etiqueta. Es una señal legible por máquina dentro del texto. No aparece nada en tu página, no se añade ningún aviso y no sustituye a la divulgación que el artículo 50.4 exige cuando toca.

No cambia nada en cómo Google trata el contenido hecho con IA. El anuncio es de OpenAI y habla de procedencia; no hay ninguna fuente de Google en esta noticia ni ningún motivo para suponer que una marca de agua de OpenAI entre en su valoración.

No hay nada que pagar. Ni la marca en ChatGPT ni la casilla de la API llevan precio en el anuncio.

Y el precedente ya lo conocías. Las imágenes de ChatGPT salen con metadatos C2PA y marca SynthID desde hace meses, y eso sí tiene una herramienta pública de verificación. Lo contamos cuando OpenAI renovó el generador: qué marca llevan incrustada las imágenes con IA y de quién son.

Qué debería hacer una pyme ahora

Tres cosas, y ninguna cuesta dinero.

  1. No compres un detector de IA por esta noticia. La marca de agua de OpenAI no la lee ninguna herramienta comercial, y el propio OpenAI advierte de que la ausencia de marca no prueba autoría humana. Cualquier producto que te prometa decirte si un texto lo escribió una IA no está leyendo esta señal.
  2. Si tienes un asistente o una automatización sobre la API, decide la casilla a conciencia. Está desactivada. Activarla tiene sentido si tu sector o tu cliente te piden demostrar procedencia; no tenerla activada no te incumple nada hoy. Si la herramienta la mantiene un proveedor, es una pregunta razonable para la próxima revisión.
  3. Revisa quién firma la responsabilidad editorial de tu blog. Es el control que importa de verdad y el que te exceptúa del artículo 50.4 cuando publicas sobre asuntos de interés público. Normalmente ya existe: suele ser el aviso legal de la web.

Análisis de PotencIA

Nuestra lectura es que esto es cumplimiento, no transparencia. Una marca que existe en el texto pero que solo puede leer quien tiene la llave no cambia la confianza de nadie: cambia el expediente de OpenAI ante la Comisión Europea. Y lo decimos sin reproche, porque el Reglamento pide exactamente eso —marcado legible por máquina «en la medida en que sea técnicamente viable»—, no una etiqueta visible para el lector.

Hay un detalle del informe técnico que explica por qué esto no va a convertirse pronto en una herramienta de detección general. El resumen dice que «el detector solo necesita el texto generado y la clave secreta». La clave es de OpenAI. El anuncio promete publicar la tecnología en código abierto «para que otros puedan construir sobre ella», y las dos frases son compatibles: con el método abierto, cualquiera podrá poner su propia marca de agua en su propio modelo, y seguir sin poder leer la de OpenAI. Esa es nuestra interpretación de las dos fuentes, no una declaración de OpenAI.

La consecuencia práctica para quien publica es casi un alivio, y conviene decirla sin adornos: el riesgo que esta noticia no crea es el de que te «pillen». Los números de edición lo enseñan sin querer —cambiar una palabra de cada diez deja la detección en dos tercios—, y es tentador leerlos al revés, como una medida de cuánto ha tocado un humano el texto. OpenAI cierra esa puerta por escrito: la marca «no mide la aportación humana». Así que el criterio no se mueve del sitio donde ya estaba. Lo que sostiene una página no es de dónde salió el borrador, sino si alguien con nombre comprobó los datos, las fuentes y las fechas antes de publicarla, y si responde cuando algo está mal. En nuestro trabajo de contenido eso es un paso del proceso, no una declaración: así está planteado en nuestros planes y alcance de SEO.

Donde sí vigilaríamos es en el acceso al detector. El día que OpenAI lo abra —y dice que lo revisará «a medida que la tecnología, las normas y la evidencia evolucionen»— cambia el escenario para los sectores donde la autoría se audita: oposiciones, educación, peritajes, medios. Para la web de una clínica o de un instalador, seguirá sin cambiar nada.

Cómo se ha verificado esto

El barrido de fuentes primarias se hizo el 6 de octubre de 2026 a las 10:12 CEST, con ventana de 24 horas. El anuncio se leyó ese día en openai.com/index/eu-text-provenance con un navegador real en modo headless, porque las páginas de openai.com/index/ devuelven un error 403 a la lectura automatizada; el volcado se comprobó para descartar que fuera un desafío de Cloudflare en lugar de la página. La fecha se contrastó con el canal RSS oficial de noticias de OpenAI, que fecha la entrada el 5 de octubre de 2026 a las 15:00 GMT. Desde España la página se sirve en inglés, así que todas sus citas son traducción propia.

El informe técnico de textGrain se descargó del CDN de OpenAI y se leyó como texto; lleva fecha del 5 de octubre de 2026 y el subtítulo «Technical report accompanying OpenAI's October 5th blog post». Las cifras de detección y de parámetros de evaluación son las del anuncio y están atribuidas a OpenAI, que las presenta como evaluaciones propias; no hay medición independiente y nosotros no hemos reproducido ninguna.

Las citas del Reglamento de IA son de la versión española del Diario Oficial, leída el 6 de octubre en EUR-Lex (CELEX 32024R1689): el artículo 50, apartados 2 y 4, y el artículo 113. La ficha del código de buenas prácticas se leyó el mismo día en digital-strategy.ec.europa.eu, en inglés, y su cita es traducción propia. El límite de la verificación de texto se comprobó en la versión Markdown de la guía de procedencia de contenido de developers.openai.com, leída el 6 de octubre; en esa misma fecha, las rutas de documentación que cabría esperar para la marca de agua de texto en la API devolvían 404, de modo que la casilla de activación está anunciada en el blog y todavía no documentada en la referencia pública de la API. El artículo de ayuda de OpenAI sobre señales de procedencia se consultó también el 6 de octubre: se sirve traducido automáticamente al español, avisa de ello, y sigue describiendo el texto como un objetivo futuro, con la tabla de señales limitada a imagen y audio.

La lectura sobre la clave secreta, la asimetría entre ChatGPT y la API, y el análisis final son criterio propio de PotencIA y están marcados como tales en el texto. La revisión humana de esta pieza es posterior a su publicación.