Lo que OpenAI activa

OpenAI anunció el lunes que en las próximas semanas añadirá una marca de agua invisible al texto generado por ChatGPT y Codex en la Unión Europea, en todos los planes. Desde ese mismo día, los clientes de la API en cualquier parte del mundo pueden activarla para modelos seleccionados. En la API permanece desactivada por defecto, y la empresa señaló que “no convertirá la marca de agua de texto en un valor predeterminado global en el lanzamiento”.

El detonante es el Reglamento de IA de la UE, que obliga a los proveedores de IA generativa a hacer identificable el texto generado por máquina de forma legible por máquinas. OpenAI también abre solicitudes de acceso a su detector, que concederá caso por caso a investigadores y organizaciones expertas aprobadas, conforme al Código de Buenas Prácticas europeo. No estará disponible al público.

textGrain, y qué le hace al modelo

La tecnología se llama textGrain y funciona añadiendo una señal estadística invisible a las elecciones de palabras del modelo. OpenAI afirmó que textGrain igualó o superó a los demás enfoques que probó, incluido SynthID para texto de Google, y que planea publicar la tecnología en código abierto.

El teclado de un portátil fotografiado de cerca sobre un escritorio
La marca añade una señal estadística a la elección de palabras. Fotografía ilustrativa. Christian Naccarato · pexels · Pexels License

La empresa publicó resultados de referencia para Astra con y sin la marca y no halló diferencias relevantes: 49,57 frente a 49,76 puntos en el Artificial Analysis Intelligence Index, 94,44% frente a 93,94% en GPQA Diamond y 53,90% frente a 56,06% en Terminal-Bench 4.0. Son cifras de OpenAI sobre su propio modelo.

Los números que debilitan la idea

Lo más interesante de la publicación es con qué franqueza expone los límites. Con una tasa objetivo de falsos positivos del 1%, OpenAI indicó que su detector halló la marca en torno al 80% de los pasajes de 200 tokens y alrededor del 95% de los de 400 tokens en contenidos como psicología. En matemáticas, donde la elección de palabras está más constreñida, la detección fue sustancialmente menor.

La edición la degrada más rápido. En una evaluación de pasajes de 400 tokens, sustituir el 10% de las palabras por sinónimos redujo la detección de cerca del 92% al 66%. Sustituir el 25% la dejó en el 17%. Ese es el dato que conviene retener: una reescritura ligera derrota la marca.

Banderas de la Unión Europea ondeando frente a un edificio
La exigencia procede del Reglamento de IA de la UE. Fotografía ilustrativa. Christian Wasserfallen · pexels · Pexels License

OpenAI es explícita: una detección no mide la aportación humana, no establece propiedad ni responsabilidad, no identifica al usuario y no verifica la exactitud; y la ausencia de marca no prueba que lo escribiera una persona, porque el texto puede ser demasiado corto, estar editado, traducido, proceder de un modelo no compatible o de herramientas de otra empresa.

Qué vigilar

La compañía ya aplica Content Credentials a las imágenes compatibles, cumple con C2PA e incrusta marcas SynthID en imágenes y audio compatibles, con herramientas públicas de verificación para ambos. El texto es la parte que se resiste al método, porque es la parte que la gente reescribe. Lo próximo a seguir es el informe técnico actualizado, la publicación en código abierto y si el acceso al detector se amplía más allá de la lista aprobada.