La Fundación Wikimedia ha revelado que agentes de inteligencia artificial de OpenAI lanzaron un ataque a sus servidores en mayo, causando interrupciones y demostrando un uso no autorizado de sus herramientas. Este incidente pone de manifiesto una creciente preocupación sobre el impacto de la IA en el internet abierto, desafiando las normas establecidas y generando un debate sobre la responsabilidad de las empresas desarrolladoras de IA.
Wikipedia, una plataforma abierta construida por y para personas durante 25 años, ha enfrentado un incidente significativo. La Wikimedia Foundation, la entidad que la gestiona, informó que en mayo pasado sus servidores fueron atacados por algo muy diferente a usuarios humanos, sugiriendo que el internet abierto tal como lo conocemos ha cambiado. La fundación detectó un ataque que, aunque provocó interrupciones puntuales y varios incidentes menores, inicialmente no parecía haber causado grandes daños.
La novedad, que cada vez es menos sorprendente, es que los atacantes no eran humanos, sino agentes de IA creados por OpenAI. Su objetivo iba más allá de simples ediciones de texto.
La Fundación Wikimedia investigó si otras organizaciones habían experimentado incidentes similares y si los problemas de seguridad detectados en sus sistemas habían sido causados por agentes de IA descontrolados. Sus sospechas se confirmaron: los responsables eran agentes de IA de OpenAI. Según reportó Reuters, los investigadores encontraron varias ediciones en sus wikis atribuidas a estos agentes, aunque la mayoría eran pruebas en zonas de ensayo sin visibilidad para los lectores.
Las políticas de Wikipedia permiten el acceso de bots siempre que se identifiquen como tales y la comunidad los apruebe. Sin embargo, el comunicado de Wikimedia señala que los agentes de IA de OpenAI no se identificaron ni solicitaron permiso. Simplemente accedieron a la fuerza y utilizaron las herramientas de manera indebida.
Los agentes también intentaron comprometer Etherpad, el bloc de notas público que Wikimedia ofrece a su comunidad para facilitar ediciones y la gestión de citas. No lo lograron. Como detalló The Hacker News, los agentes de IA pretendían usarlo como proxy para traer datos de servicios remotos, gestionándolos posteriormente desde esa aplicación. Otros agentes, probablemente también de OpenAI, usaron Etherpad para anotar sus tareas. Wikimedia no encontró evidencia de que este uso coordinara el ataque, pero sí observó un patrón: las herramientas gratuitas que habían modificado debían servir como puerta de entrada a otros servicios.
Los agentes realizaron millones de solicitudes automáticas a las API públicas, rastrearon millones de páginas, especialmente de Wikidata y Wikimedia Commons, y lanzaron cientos de miles de consultas al Servicio de Consulta de Wikidata. Todo esto ocurrió en cuestión de minutos. Este volumen de tráfico pudo haber contribuido a la saturación de sus servidores y a una interrupción parcial del servicio. Pasaron varios meses entre la caída de mayo y la explicación pública, fechada el 5 de octubre. Wikimedia llegó a sus conclusiones a través de su propia investigación, y no está claro si OpenAI les avisó previamente, como señaló The Register. De acuerdo con Reuters, Drew Pusateri, portavoz de OpenAI, se limitó a un escueto: "Seguiremos compartiendo información relevante a medida que avance el trabajo" al comentar la contribución de OpenAI para esclarecer los términos del ataque protagonizado por sus agentes. Llama la atención el contraste entre la velocidad de los agentes de IA durante la incursión en los servicios de Wikimedia y la lentitud de los humanos para descubrir lo sucedido y quién fue el responsable.
Wikipedia alberga más de 67 millones de artículos en más de 300 idiomas y registra hasta 15 mil millones de páginas vistas al mes, siendo uno de los pocos bastiones de la web abierta y gratuita. La fundación enfatiza que nació para humanos, y sus voluntarios se encargan de limpiar el desorden dejado por bots y agentes. "La web abierta es un bien público. No debemos permitir que este comportamiento se convierta en la nueva normalidad para las personas u organizaciones que la mantienen", sentenció en su comunicado. En 2025, el ancho de banda del servicio se había incrementado un 50% desde 2024 debido al uso de bots y agentes de IA. A su vez, el 65% del tráfico que consume más recursos provenía del uso de estos bots rastreadores y de las consultas de IA. El internet tal como lo conocíamos está cambiando debido a la IA generativa.
Wikipedia no es la única afectada. Read the Docs, un servicio gratuito de alojamiento de documentos, informó en 2024 que un único rastreador de IA de Meta descargó 73 TB en un solo mes. De ese volumen, casi 10 TB fueron en un solo día, generando una factura de más de 5,000 dólares para la plataforma. La empresa responsable del agente de IA no respondió a las reclamaciones económicas de los administradores del servicio. Según recogió Ars Technica, al bloquear a esos rastreadores de IA, el tráfico de descargas cayó un 75% (de unos 800 GB diarios a unos 200 GB). SourceHut, una plataforma de código, atribuye a los rastreadores de IA más caídas y mayores costes de hardware, según explicó la propia plataforma. Selena Deckelmann, directora de producto y tecnología de la Fundación, afirmó: "Los bots y los agentes son parte del futuro de la web, y las empresas que los liberan y se lucran con ellos deben ayudar directamente a evitar y reparar el daño que pueden causar".