OpenAI pondrá una marca de agua invisible en los textos y códigos creados con IA

La compañía comenzará a implementar textGrain en contenidos generados con ChatGPT, Codex y su API.

OpenAI permitirá que los usuarios activen la opción de marca de agua según su conveniencia

OpenAI permitirá que los usuarios activen la opción de marca de agua según su conveniencia Crédito: Shutterstock

OpenAI anunció que comenzará a incorporar una marca de agua invisible en el texto y el código generados por sus modelos de inteligencia artificial. La medida, bautizada como textGrain, llega semanas después de que Anthropic pusiera en marcha un sistema similar para las nuevas versiones de Claude y apunta a reforzar la trazabilidad del contenido sintético sin alterar la lectura ni el funcionamiento del código.

OpenAI implementará marcas de agua en textos y código generados con IA

La inteligencia artificial generativa acaba de sumar una nueva capa de identificación. OpenAI confirmó que incorporará una marca de agua estadística e invisible en determinados contenidos producidos con sus modelos, incluidos los resultados de ChatGPT, Codex y algunas opciones disponibles mediante API.

La tecnología se llama textGrain y no funcionará como la clásica marca visible sobre una imagen. No habrá una etiqueta al final de un artículo, una frase añadida al texto ni caracteres ocultos que alguien pueda localizar al copiar y pegar el contenido. La señal quedará integrada en la manera en la que el modelo escoge palabras o tokens entre varias alternativas válidas.

En la práctica, la herramienta modifica de forma muy sutil las decisiones probabilísticas de la IA. Si un modelo puede expresar la misma idea con distintas palabras sin que cambie el sentido de la frase, el sistema favorece ciertas elecciones lingüísticas que, en conjunto, forman un patrón detectable con una herramienta especializada. Para quien lee el contenido, el resultado debería verse igual que cualquier otro texto generado normalmente por IA.

OpenAI comenzará el despliegue en las próximas semanas para los textos elegibles creados con ChatGPT y Codex dentro de la Unión Europea. La empresa explicó que esta primera fase responde a las nuevas exigencias de transparencia contempladas por la Ley de IA de la UE, que obliga a los proveedores a adoptar mecanismos para identificar contenido sintético.

Para los desarrolladores, la novedad tiene un alcance más amplio. Los clientes de la API de OpenAI en cualquier región podrán habilitar la marca de agua en modelos seleccionados. La función llegará desactivada de fábrica, por lo que cada usuario o empresa podrá decidir si la activa según sus obligaciones de transparencia, su producto o el contexto en el que utilice el modelo.

Ese detalle es relevante. OpenAI no está convirtiendo el marcado de texto en una condición universal para todos los usos de sus modelos. Al menos durante el lanzamiento inicial, el sistema se presentará como una opción configurable para los clientes de API y tendrá una aplicación regional específica para los productos de consumo en la Unión Europea.

Para qué sirve la marca de agua de OpenAI y qué no puede demostrar

La función de textGrain busca aportar una señal de procedencia técnica. En otras palabras, puede ayudar a identificar que un sistema de OpenAI generó o procesó parte de un contenido, siempre que exista una cantidad suficiente de texto para analizar y que la marca no haya sido eliminada mediante una reescritura profunda.

Eso no convierte a la marca de agua en un detector definitivo de IA ni en un sello de confianza editorial. OpenAI ha sido clara respecto a sus límites, un punto especialmente importante en un momento en el que los detectores automáticos se usan en escuelas, medios, empresas y plataformas digitales.

La marca de agua no podrá verificar si una afirmación es verdadera, falsa, precisa o engañosa. Un texto con señal de OpenAI puede contener datos correctos, errores, invenciones o una mezcla de todo ello. La tecnología identifica una posible intervención del modelo, no la calidad de la información.

Tampoco podrá establecer quién es el propietario del contenido. Que un artículo, un fragmento de código o una descripción de producto contenga una señal de textGrain no resolverá los debates sobre derechos de autor, titularidad, licencias o responsabilidad legal. La procedencia técnica y la propiedad intelectual siguen siendo asuntos distintos.

El sistema tampoco permitirá saber quién utilizó ChatGPT, Codex o la API para crear el material. No identificará a una persona concreta, una empresa, una cuenta, una conversación o un equipo de redacción. La señal está diseñada para apuntar al posible uso de un sistema de OpenAI, no para rastrear al usuario detrás del prompt.

Hay otra limitación clave para quienes trabajan con textos híbridos. La marca de agua no medirá cuánto aportó una persona a la pieza final. No podrá decir si un humano escribió el 10%, el 50% o el 90% de un artículo, ni distinguir con precisión entre un borrador generado por IA que fue revisado a fondo y un texto humano al que se le aplicaron pequeños retoques automáticos.

Un periodista puede investigar, entrevistar fuentes, contrastar datos, escribir una versión inicial y pedirle a un modelo que sugiera un titular. Un desarrollador puede crear la arquitectura de una aplicación y usar IA para documentar una función. En ambos escenarios, una posible marca no describiría el verdadero reparto de trabajo creativo, editorial o técnico.

OpenAI y Anthropic aceleran la identificación del contenido creado por IA

La iniciativa de OpenAI aparece poco después de que Anthropic detallara su propio sistema de marcas de agua para Claude. La compañía detrás de Claude señaló que sus futuros modelos incorporarán una señal imperceptible para el lector, basada en decisiones de palabras que pueden analizarse con una clave de detección.

Anthropic aplica el marcado a los nuevos modelos para cumplir con las reglas europeas de transparencia y explica que su tecnología solo puede estimar la probabilidad de que Claude haya participado en la creación de un texto. No puede confirmar que un contenido haya sido escrito enteramente por Claude, ni probar que haya sido redactado por una persona, ni identificar la intervención de otra IA distinta.

La comparación entre ambos anuncios deja una diferencia práctica importante. Claude avanza con una implementación global en sus modelos nuevos, mientras que OpenAI ha optado por un despliegue más gradual. En el caso de OpenAI, la API ofrecerá un control opcional desde el inicio y ChatGPT junto a Codex incorporarán el marcado en la Unión Europea para las salidas elegibles.

El código representa uno de los terrenos más complejos para estas tecnologías. Una marca de agua lingüística necesita margen para escoger entre alternativas similares, algo frecuente en una explicación, un comentario dentro de un archivo o una descripción de una función. Sin embargo, muchas partes de un programa requieren una sintaxis exacta. Cambiar un token puede romper una ejecución, provocar un error o alterar el comportamiento de una aplicación.

Anthropic ha explicado que el marcado es menor en el código precisamente por esa falta de flexibilidad. Puede aparecer en zonas donde existen varias opciones válidas, como comentarios o formulaciones descriptivas, aunque su impacto sobre el código funcional debería ser mínimo.

Para editores, empresas, educadores y desarrolladores, estas marcas de agua prometen una herramienta más dentro del kit de transparencia. No son un veredicto sobre la calidad de un texto, no certifican una autoría y no sustituyen la verificación humana. Su función real es más concreta y también más útil si se entiende bien: aportar una pista técnica sobre la posible participación de un modelo de IA en un contenido digital.

Sigue leyendo:
• YouTube lanza tecnología para detectar deepfakes y las celebridades serán las primeras beneficiadas
• Todo lo que escriba Claude ahora tiene una huella secreta, y nadie puede verla a simple vista
• Adiós a los deepfakes: gigantes tecnológicos se unen para desarrollar un detector que no puede ser engañado

En esta nota

Inteligencia artificial
Contenido Patrocinado