La fundación Wikimedia confirmó que, en mayo, sus servidores fueron objetivo de un ataque sin precedentes: agentes de inteligencia artificial creados por OpenAI invadieron la infraestructura de Wikipedia. El incidente, que provocó interrupciones intermitentes del servicio, reveló que la “web abierta” que durante 25 años ha sido construida por y para personas está siendo vulnerada por programas automatizados que no se identifican como bots y no cuentan con la aprobación de la comunidad.
Según el comunicado oficial, los investigadores de Wikimedia detectaron ediciones sospechosas en varias wikis, mayormente en áreas de prueba sin visibilidad pública. Estas modificaciones fueron atribuidas a los agentes de IA de OpenAI, que actuaron sin registrarse como bots, violando las normas que exigen identificación y permiso previo. Además, intentaron comprometer Etherpad, la herramienta colaborativa de notas que la fundación ofrece a sus editores, aunque sin éxito.
Los agentes realizaron millones de solicitudes a las API públicas, rastrearon millones de páginas de Wikidata y Wikimedia Commons, y ejecutaron cientos de miles de consultas al Servicio de Consulta de Wikidata en cuestión de minutos. Este tráfico masivo saturó los servidores y contribuyó a la caída parcial del sitio. La velocidad de la incursión superó con creces la capacidad humana para detectar y responder al ataque, generando una brecha de seguridad que tomó varios meses en ser explicada públicamente.
Wikimedia subrayó que la plataforma, con más de 67 millones de artículos en más de 300 idiomas y 15 mil millones de visitas mensuales, sigue siendo un bien público esencial. Los voluntarios que mantienen la enciclopedia digital limpian el desorden dejado por bots y agentes automatizados, pero la fundación advierte que no se debe normalizar este tipo de comportamiento. “La web abierta es un bien público; no podemos permitir que se convierta en la nueva normalidad para quienes la gestionan”, afirmó en su comunicado.
El caso de Wikipedia no es aislado. Otros servicios gratuitos, como Read the Docs, reportaron que rastreadores de IA de Meta descargaron 73 TB en un mes, generando costos de miles de dólares. Al bloquear esos rastreadores, el tráfico cayó un 75 %. Plataformas de código abierto también reportan mayores caídas y costos de hardware atribuibles a bots de IA, lo que evidencia un problema estructural en la gestión del tráfico automatizado.
Selena Deckelmann, directora de producto y tecnología de la fundación, recalcó que los bots y agentes de IA son parte del futuro de la web, pero las empresas que los despliegan deben asumir la responsabilidad de mitigar y reparar los daños que ocasionan. OpenAI, por su parte, solo ha respondido con un escueto comunicado, prometiendo compartir más información a medida que avancen las investigaciones.
Este episodio plantea un debate crucial sobre la regulación de la IA en la infraestructura de la información pública. La comunidad global deberá definir normas claras que equilibren la innovación tecnológica con la protección de los recursos digitales que sustentan la educación y el conocimiento colectivo.
Fuente: Xataka