Wikimedia Foundation ha denunciado haber encontrado pruebas de actividad no autorizada vinculada a agentes de inteligencia artificial (IA) de OpenAI en sus plataformas, incluyendo ediciones en sus wikis, intentos fallidos de explotar su herramienta pública para tomar notas Etherpad y un alto volumen de tráfico que "pudo haber contribuido" a una caída parcial de sus servicios que tuvo lugar en mayo.
La organización sin fines de lucro que alberga Wikipedia ha asegurado que, tras los incidentes registrados durante los últimos meses, con agentes de IA que muestran comportamientos desalineados y acceden a sitios web y de terceros de forma no autorizada, decidió llevar a cabo una investigación propia para determinar si los sitios web de Wikimedia se habían visto afectados por algún incidente de este tipo.
En este sentido, se han centrado específicamente en los agentes operados por la compañía dirigida por Sam Altman y, tras la investigación, Wikimedia ha confirmado haber detectado actividad de estos agentes de OpenAI no autorizados en sus plataformas.
Como ha compartido en un comunicado en su blog, entre estas actividades no autorizadas, han identificado ediciones en wikis de Wikimedia. No obstante, estas ediciones no se publicaron en páginas visibles para el público general, porque eran ediciones en áreas de prueba de la wiki.
Igualmente, los agentes también llevaron a cabo algunas ediciones en la configuración de una herramienta de citas que, según han indicado, podrían ser ediciones maliciosas pensadas para usar esta herramienta como un 'proxy' para obtener datos de servicios remotos.
Teniendo todo ello en cuenta, Wikimedia ha matizado que sus políticas permiten que los bots editen, pero estas ediciones deben ser previamente comunicadas y aprobadas por la comunidad. En estos casos, ha afirmado que los agentes no solicitaron ninguna aprobación.
Otra de las actividades no autorizadas halladas en la investigación fue que los agentes de OpenAI realizaron varios intentos fallidos de comprometer su herramienta pública para tomar notas, Etherpad. Según ha explicado, los agentes intentaron, sin éxito, utilizar esta herramienta para obtener datos de otros sitios web actuando como 'proxy'.
Finalmente, Wikimedia ha denunciado que los agentes de OpenAI realizaron "millones de solicitudes automatizadas" a sus APIS públicas, con la intención de acceder al conocimiento de los proyectos de la plataforma.
Así, según han podido comprobar, rastrearon millones de páginas, principalmente sus proyectos Wikidata y Wikimedia Commons, y realizaron "cientos de miles de consultas" de datos al Servicio de Consulta de Wikidata. Como resultado, la fundación ha considerado este tráfico generado con los modelos como un factor que "pudo haber contribuido" a una interrupción parcial de sus servicios ocurrida en mayo de este año.
Sus sistemas no se utilizaron para la coordinación de sus agentes
Otro de los aspectos que ha investigado Wikimedia es si los agentes de OpenAI utilizaron sus wikis para comunicarse en sus actividades no autorizadas. Concretamente, la organización se ha referido al caso en el que agentes de OpenAI utilizaron wikis públicas coordinarse entre sí, operando en un foro wiki alemán poco conocido con alrededor de 18.000 publicaciones.
Esta preocupación se debe a que, según ha explicado, este tipo de intrusiones exitosas "pueden exponer datos confidenciales o interrumpir los servicios web de los que dependen los usuarios", mientras que grupos de agentes "pueden intentar ataques a una escala difícil de gestionar para los defensores".
"En un sitio como Wikipedia, los agentes podrían encontrar y explotar vulnerabilidades de seguridad o realizar ediciones engañosas a gran escala", ha alertado la fundación, al tiempo que ha señalado que los editores voluntarios y los equipos de seguridad "deben detectar y revertir esta actividad".
Sin embargo, Wikimedia ha asegurado no haber encontrado evidencia de que sus sistemas se utilizasen para la coordinación entre agentes. Además, ha negado que sus sistemas o datos se viesen comprometidos por este tipo de incidentes.
A pesar de ello, la fundación ha compartido su preocupación por "lo que pudo haber ocurrido", así como por la dificultad y el esfuerzo que requiere investigar estas actividades de IA en sus plataformas en general.
Retos de los agentes
Como organización tecnológica que aloja algunas de las plataformas de conocimiento abierto más grandes del mundo, Wikimedia ha denunciado el impacto que pueden tener de los agentes de IA maliciosos. "La web abierta es un bien público. No debemos permitir que este comportamiento se convierta en la nueva normalidad para las personas u organizaciones que la mantienen", ha sentenciado al respecto.
Cabe recordar que, tal y como ha señalado la fundación, Wikipedia es uno de los conjuntos de datos "de mayor calidad" utilizados para entrenar modelos de lenguaje a gran escala (LLM), y su conocimiento "constituye la base de la información en internet", impulsando chatbots de IA, motores de búsqueda y asistentes de voz, entre otras cuestiones.
Así, la fundación ha puesto sobre la mesa cómo el creciente tráfico de bots y la actividad de los agentes están teniendo un impacto real en sus proyectos y en la infraestructura. Tanto es así que en 2025, el consumo de ancho de banda había aumentado un 50 por ciento debido al incremento de la actividad de los bots en sus sitios web desde 2024. Al mismo tiempo, el 65 por ciento del tráfico que más recursos consume en sus proyectos proviene de bots.
Todo ello se traduce en un incremento de costes en los servidores y el personal, además de poder ocasionar bloqueos a los visitantes al sobrecargar los sistemas.
Por tanto, Wikimedia ha señalado que, si bien OpenAI admite que sus agentes se comportan de forma impredecible, también "debe reconocer su responsabilidad de supervisar y prevenir estos riesgos". "Las empresas de IA no están haciendo lo suficiente para proteger sus sistemas y al público de los daños que causan", ha concluido la fundación.
Europa Press