La Fundación Wikimedia detectó actividad no autorizada que atribuye a agentes de inteligencia artificial operados por OpenAI en sus plataformas, incluidos intentos de modificar wikis, utilizar herramientas como intermediarios para acceder a otros servicios y realizar millones de solicitudes automatizadas que pudieron contribuir a una interrupción parcial del Servicio de Consulta de Wikidata (WQDS) en mayo.
Entre las modificaciones identificadas en los wikis, casi todas fueron pruebas realizadas en áreas de “sandbox” y no llegaron a páginas visibles para los lectores. La investigación también encontró algunas ediciones en la configuración de una herramienta de citas que Wikimedia considera potencialmente maliciosas, porque podrían haber buscado utilizarla como intermediario para obtener datos de servicios remotos.
Las políticas de Wikimedia permiten que los bots editen sus wikis cuando son identificados y cuentan con la aprobación de la comunidad. Ninguna de esas autorizaciones fue solicitada en los casos investigados.
Los agentes también realizaron intentos fallidos de comprometer Etherpad, una herramienta pública de toma de notas alojada por Wikimedia como servicio comunitario. Algunos intentaron utilizarla para obtener datos de otros sitios web mediante un mecanismo de intermediación. Otros agentes que probablemente también eran operados por OpenAI tomaron notas sobre sus tareas, aunque la investigación no encontró indicios de que esas notas se convirtieran en un mecanismo de coordinación.
La mayor carga correspondió al acceso automatizado a los proyectos de Wikimedia. Los agentes realizaron millones de solicitudes a las API públicas, rastrearon millones de páginas, principalmente de Wikidata y Wikimedia Commons, y efectuaron cientos de miles de consultas al Servicio de Consulta de Wikidata.
Ese tráfico pudo haber contribuido a una interrupción parcial del WQDS registrada en mayo. Wikimedia lo presenta como un posible factor y no como una causa confirmada de la interrupción.
La investigación tampoco encontró evidencia de que los sistemas de Wikimedia fueran utilizados para coordinar a los agentes ni de que sus sistemas o datos hubieran sido comprometidos. La fundación expresó, sin embargo, preocupación por la dificultad y el esfuerzo necesarios para identificar y atribuir este tipo de actividad.
El volumen de tráfico automatizado se suma a una presión que Wikimedia ya había cuantificado. En 2025, la fundación informó que su consumo de ancho de banda había aumentado 50 % debido al crecimiento de la actividad de bots en sus sitios desde 2024. Ese año, 65 % del tráfico que más recursos consumía en sus proyectos provenía de bots.
Para Wikimedia, el problema no se limita al costo adicional de servidores y personal. Un volumen excesivo de solicitudes puede sobrecargar los sistemas, provocar interrupciones y dificultar el acceso de visitantes humanos. Los editores voluntarios y los equipos de seguridad también deben detectar y revertir la actividad no autorizada.
“La web abierta es un bien público. No debemos permitir que este comportamiento se convierta en la nueva normalidad para las personas u organizaciones que la mantienen”, señaló la fundación.
Wikimedia reclamó además una mayor responsabilidad a las compañías que desarrollan agentes de IA. La organización sostuvo que, aunque OpenAI admite que sus agentes pueden comportarse de manera impredecible, la empresa debe supervisar sus sistemas y prevenir los riesgos que puedan generar.
“Las empresas de IA no están haciendo lo suficiente para proteger sus sistemas y al público de los daños que causan”, afirmó la fundación.
Wikimedia pidió como mínimo que los agentes puedan ser identificados fácilmente por los propietarios de sitios web sin fines de lucro y que estos puedan decidir cómo interactúan con sus servicios. También señaló que las empresas que desarrollan y utilizan estos sistemas deben contribuir a prevenir y reparar los daños que puedan ocasionar en la infraestructura abierta de Internet.
La fundación recordó que Wikipedia supera los 67 millones de artículos en más de 300 idiomas y recibe hasta 15.000 millones de visitas mensuales. Sus contenidos también forman parte de los conjuntos de datos utilizados para entrenar grandes modelos de lenguaje y sirven de fuente para chatbots de IA, motores de búsqueda y asistentes de voz.
Con información de la Fundación Wikimedia.





























