OpenAI añadirá una marca de agua invisible a los textos de ChatGPT y Codex
La compañía utilizará el sistema textGrain para identificar contenido generado por IA, aunque advierte que puede fallar si el texto es corto
OpenAI anunció que incorporará una marca de agua invisible a los textos y códigos generados por ChatGPT y Codex en la Unión Europea, como parte de las medidas adoptadas para cumplir con las nuevas exigencias de transparencia establecidas por la Ley de Inteligencia Artificial (IA) del bloque.
La compañía desarrolló para ello un sistema denominado textGrain, que introduce una señal estadística imperceptible para el usuario en las palabras seleccionadas por el modelo.
A diferencia de una marca de agua tradicional, no aparecerá ningún símbolo, etiqueta o indicación visible dentro del texto. La identificación se realiza posteriormente mediante un detector desarrollado por OpenAI, capaz de buscar patrones estadísticos y determinar si un contenido contiene la señal introducida por sus modelos.
La implementación se realizará de manera progresiva.
Desde este martes, los usuarios de la API de OpenAI en todo el mundo podrán optar por activar la marca de agua en determinados modelos, aunque la función permanecerá desactivada por defecto.
Para los usuarios de ChatGPT y Codex en la Unión Europea, en cambio, OpenAI prevé incorporar la marca de agua invisible en las próximas semanas.
¿Cómo funciona la marca de agua?
El sistema textGrain no agrega información visible al contenido, sino que modifica de manera controlada las decisiones que toma el modelo al seleccionar determinadas palabras.
Los modelos de lenguaje suelen disponer de diferentes alternativas posibles para continuar una oración. La tecnología aprovecha esas elecciones para introducir un patrón estadístico sin modificar sustancialmente el significado del texto.
Posteriormente, un detector analiza el contenido para determinar si ese patrón está presente.
De esta forma, el objetivo es poder establecer si un fragmento probablemente fue producido por alguno de los sistemas de OpenAI sin necesidad de colocar una etiqueta visible en cada respuesta.
Sin embargo, la propia compañía advierte que la tecnología está lejos de ser infalible.
“La marca de agua de texto y su detección se mantienen como tecnologías incipientes con limitaciones significativas, y las opiniones sobre sus beneficios y usos responsables todavía están evolucionando”, señaló OpenAI.
OpenAI limitará inicialmente el acceso al detector
La compañía también abrió las solicitudes para acceder a su detector de marcas de agua.
En una primera etapa, la herramienta no estará disponible de forma generalizada. OpenAI prevé restringir su utilización a investigadores y organizaciones especializadas previamente aprobadas.
La empresa explicó que el despliegue progresivo responde tanto a las exigencias de la Ley de IA europea como a las propias limitaciones de esta tecnología.
Según OpenAI, resulta especialmente importante explicar qué puede determinar una marca de agua y, también, qué conclusiones no deberían extraerse de ella.
Un texto editado puede perder la marca
Uno de los principales problemas aparece cuando el contenido generado por inteligencia artificial es posteriormente modificado.
OpenAI señaló que la edición puede reducir de manera considerable la capacidad del sistema para encontrar la marca de agua.
En las pruebas realizadas por la compañía, reemplazar el 25% de las palabras por sinónimos redujo la tasa de detección del 92% al 17% en fragmentos de unos 400 tokens.
Esto significa que un texto originalmente producido por ChatGPT podría dejar de ser identificado con facilidad después de una edición relativamente importante.
También existen dificultades con los textos cortos o altamente técnicos.
En esos casos, el modelo dispone de menos alternativas posibles para seleccionar palabras y, por tanto, existe menos margen para introducir el patrón estadístico utilizado como marca.
Falsos positivos y falsos negativos
Otra de las limitaciones es común a los sistemas destinados a detectar contenidos generados mediante inteligencia artificial.
OpenAI reconoce que textGrain puede producir dos tipos de errores.
Por un lado, un falso positivo, cuando el detector considera que existe una marca de agua aunque el contenido no la tenga.
Por otro, un falso negativo, cuando el texto contiene efectivamente la marca pero el sistema no consigue detectarla.
La compañía aseguró que, durante sus evaluaciones, textGrain igualó o superó el rendimiento de otros sistemas analizados, incluido SynthID para texto.
Sin embargo, advirtió que obtener buenos resultados en pruebas controladas no significa necesariamente que la herramienta vaya a mantener la misma fiabilidad cuando se utilice en situaciones cotidianas.
Anthropic ya adoptó una tecnología similar
OpenAI no es la única empresa que está avanzando en esta dirección.
Anthropic anunció en agosto el despliegue de una marca de agua invisible para los textos producidos por Claude y su API, que ya se encuentra activa en sus modelos Opus 5.5 y Sonnet 5.5.
Al igual que OpenAI, la compañía advirtió sobre la posibilidad de que los detectores produzcan falsos positivos y negativos.
La identificación fiable de contenidos generados por inteligencia artificial se ha convertido en uno de los principales desafíos para las empresas tecnológicas y los reguladores, especialmente a medida que los modelos producen textos cada vez más difíciles de distinguir de aquellos escritos por personas.
Las nuevas exigencias europeas
El anuncio se enmarca en la implementación progresiva de las obligaciones de transparencia previstas por la Ley de Inteligencia Artificial de la Unión Europea.
Entre los objetivos de la regulación se encuentra facilitar que determinados contenidos producidos o manipulados mediante inteligencia artificial puedan ser identificados.
En el caso de OpenAI, la respuesta será introducir esta señal estadística en los contenidos generados por ChatGPT y Codex para los usuarios europeos.
La medida no implica, sin embargo, que cualquier texto generado por ChatGPT pueda ser identificado con certeza.
Las propias limitaciones reconocidas por OpenAI —especialmente frente a textos breves, técnicos o posteriormente editados— muestran que la marca de agua funcionará como una señal para ayudar a determinar el origen de un contenido y no como una prueba infalible de que fue escrito por inteligencia artificial.
Acerca de los comentarios
Hemos reformulado nuestra manera de mostrar comentarios, agregando tecnología de forma de que cada lector pueda decidir qué comentarios se le mostrarán en base a la valoración que tengan estos por parte de la comunidad. AMPLIAREsto es para poder mejorar el intercambio entre los usuarios y que sea un lugar que respete las normas de convivencia.
A su vez, habilitamos la casilla [email protected], para que los lectores puedan reportar comentarios que consideren fuera de lugar y que rompan las normas de convivencia.
Si querés leerlo hacé clic aquí[+]