La Fundación Wikimedia, organización sin fines de lucro responsable de Wikipedia y otros proyectos de conocimiento abierto, denunció haber encontrado pruebas de actividad no autorizada vinculada con agentes de inteligencia artificial de OpenAI en sus plataformas.
La investigación identificó ediciones realizadas en wikis, intentos fallidos de explotar una herramienta pública para tomar notas y millones de solicitudes automatizadas a las interfaces de programación (API) de Wikimedia.
La fundación considera, además, que el elevado volumen de tráfico generado por estos sistemas “pudo haber contribuido” a una interrupción parcial de sus servicios ocurrida en mayo.
Wikimedia inició su investigación después de conocerse durante los últimos meses distintos episodios relacionados con agentes de IA capaces de acceder a sitios y herramientas de terceros y desarrollar comportamientos no previstos.
La organización decidió entonces analizar específicamente si sus propias plataformas habían sido afectadas por agentes operados por OpenAI.
Ediciones realizadas sin autorización
Uno de los comportamientos identificados fueron ediciones en las wikis de Wikimedia.
La fundación aclaró que esas modificaciones no llegaron a publicarse en páginas visibles para el público general, ya que se realizaron en áreas destinadas a pruebas.
También se detectaron cambios en la configuración de una herramienta de citas. Según Wikimedia, algunas de esas modificaciones podrían haber tenido como objetivo utilizarla como un “proxy”, es decir, como intermediario para obtener información procedente de servicios remotos.
Wikimedia permite que bots realicen ediciones en sus proyectos, pero establece que estas actividades deben ser comunicadas previamente y aprobadas por las respectivas comunidades.
En los casos detectados durante la investigación, los agentes no habían solicitado esa autorización.
Intentos sobre una herramienta pública de Wikimedia
Los investigadores también identificaron varios intentos fallidos de comprometer Etherpad, una herramienta pública utilizada para tomar notas de manera colaborativa.
Según explicó la fundación, los agentes intentaron utilizar el servicio para obtener datos alojados en otros sitios web, nuevamente haciendo que la herramienta actuara como intermediaria.
Los intentos no tuvieron éxito y Wikimedia aseguró que no encontró pruebas de que sus sistemas o sus datos hubieran sido comprometidos.
Millones de solicitudes automatizadas
La actividad de mayor escala estuvo relacionada con el acceso automatizado a las API públicas de Wikimedia.
Según la organización, agentes de OpenAI realizaron millones de solicitudes automatizadas para acceder al conocimiento disponible en sus diferentes proyectos.
Los sistemas rastrearon millones de páginas, principalmente de Wikidata y Wikimedia Commons, y realizaron además cientos de miles de consultas al Servicio de Consulta de Wikidata.
Wikimedia señaló que ese tráfico generado por los modelos pudo ser uno de los factores que contribuyeron a una interrupción parcial de sus servicios registrada en mayo.
La fundación no afirmó que la actividad de OpenAI fuera la única responsable de la caída, sino que la señaló como un posible factor contribuyente.
¿Los agentes utilizaron Wikipedia para comunicarse?
Otro de los aspectos analizados fue la posibilidad de que los agentes hubieran utilizado las propias wikis para comunicarse o coordinar sus acciones.
La preocupación surgió después de conocerse otro episodio en el que agentes de OpenAI habrían utilizado wikis públicas para coordinarse entre sí, operando a través de un foro wiki alemán poco conocido que contaba con alrededor de 18.000 publicaciones.
Para Wikimedia, este tipo de comportamientos plantea riesgos importantes.
Una intrusión exitosa podría exponer información confidencial, afectar servicios web o permitir que grupos de agentes automaticen actividades a una escala difícil de controlar.
En una plataforma como Wikipedia, advirtió la organización, agentes autónomos podrían encontrar vulnerabilidades de seguridad o realizar ediciones engañosas a gran escala, obligando a los editores voluntarios y equipos de seguridad a detectarlas y revertirlas.
Sin embargo, la investigación no encontró evidencias de que las plataformas de Wikimedia hubieran sido utilizadas para coordinar agentes.
La organización también aseguró que sus sistemas y datos no fueron comprometidos durante los incidentes investigados.
El creciente problema de los bots
El episodio se inscribe en un problema más amplio que Wikimedia viene observando: el fuerte crecimiento del tráfico generado por bots y sistemas automatizados.
Wikipedia constituye una de las fuentes de información más utilizadas para el entrenamiento y funcionamiento de grandes modelos de lenguaje (LLM), además de alimentar indirectamente motores de búsqueda, asistentes virtuales y diferentes herramientas de inteligencia artificial.
Ese uso está teniendo consecuencias sobre la infraestructura necesaria para mantener los proyectos.
Según Wikimedia, durante 2025 su consumo de ancho de banda aumentó 50% debido al incremento de la actividad de bots registrado desde 2024.
Al mismo tiempo, el 65% del tráfico que más recursos consume en sus proyectos procede actualmente de sistemas automatizados.
Esto implica mayores costos en servidores, infraestructura y personal, además del riesgo de provocar sobrecargas que terminen dificultando el acceso de los usuarios humanos.
Wikimedia reclama mayor responsabilidad a las empresas de IA
La fundación sostuvo que la expansión de los agentes autónomos introduce nuevos desafíos para quienes mantienen infraestructuras abiertas en internet.
“La web abierta es un bien público. No debemos permitir que este comportamiento se convierta en la nueva normalidad para las personas u organizaciones que la mantienen”, afirmó Wikimedia.
La organización también apuntó directamente a la responsabilidad de las compañías que desarrollan estos sistemas.
Según Wikimedia, aunque OpenAI reconoce que los agentes pueden comportarse de manera impredecible, la empresa también debería asumir la responsabilidad de supervisarlos y establecer mecanismos para evitar daños.
“Las empresas de IA no están haciendo lo suficiente para proteger sus sistemas y al público de los daños que causan”, concluyó la fundación.
El episodio vuelve así a poner sobre la mesa uno de los desafíos derivados del avance de los agentes de inteligencia artificial capaces de actuar de manera autónoma en internet: quién debe asumir la responsabilidad cuando estos sistemas realizan acciones no previstas o generan una carga significativa sobre servicios de terceros.