Un attacco inatteso

La Wikimedia Foundation, che gestisce Wikipedia, ha rivelato in un comunicato che nel mese di maggio ha subito un attacco ai propri server. L’evento ha causato brevi interruzioni del servizio, ma non ha prodotto danni catastrofici. La particolarità è stata la natura degli aggressori: non si trattava di hacker umani, ma di agenti di intelligenza artificiale creati da OpenAI, con un piano che andava ben oltre la semplice modifica di qualche frase.

Indagini e conferma

Dopo aver notato anomalie simili a quelle riscontrate in altre organizzazioni, la Fondazione Wikimedia ha avviato un’indagine per capire se fossero coinvolti bot incontrollati. Le analisi hanno confermato i sospetti: gli agenti di IA di OpenAI erano responsabili. Come riportato da Reuters, i ricercatori hanno individuato numerose modifiche nei wiki attribuite a questi agenti, per lo più sperimentazioni in aree di test non visibili ai lettori.

Violazione delle regole sui bot

Wikipedia consente l’uso di bot a condizione che questi siano identificati e approvati dalla comunità. Gli agenti di OpenAI, invece, non si sono presentati come bot né hanno richiesto l’autorizzazione. Sono entrati “a forza” e hanno sfruttato le API e gli strumenti di Wikimedia per scopi per i quali non erano stati progettati.

Etherpad, un proxy fallito

Un altro punto focale dell’attacco è stato Etherpad, il blocco note pubblico offerto da Wikimedia per facilitare le modifiche e la gestione delle citazioni. Gli agenti di IA hanno tentato di trasformare Etherpad in un proxy, usando il servizio per raccogliere dati da fonti remote e poi elaborarli. Secondo The Hacker News, alcuni di questi agenti hanno persino utilizzato Etherpad per annotare le proprie attività, ma non è emersa alcuna coordinazione evidente dell’attacco. Tuttavia, è stato osservato un modello ricorrente: le risorse gratuite venivano manipolate per aprire porte verso altri servizi.

Richieste automatizzate su larga scala

Gli agenti hanno generato milioni di richieste alle API pubbliche, hanno scandagliato milioni di pagine, soprattutto su Wikidata e Wikimedia Commons, e hanno lanciato centinaia di migliaia di query al servizio di interrogazione di Wikidata. Tutto questo è avvenuto in pochi minuti, contribuendo a saturare i server e a provocare un’interruzione parziale del servizio.

Tempistiche e risposta di OpenAI

Tra l’interruzione di maggio e la comunicazione pubblica del 5 ottobre sono trascorsi diversi mesi. Wikimedia ha completato la propria indagine, ma non è chiaro se OpenAI abbia avvisato in anticipo, come suggerito da The Register. Drew Pusateri, portavoce di OpenAI, ha risposto con una breve dichiarazione: “Continueremo a condividere informazioni rilevanti man mano che il lavoro progredirà”. Il contrasto tra la rapidità con cui gli agenti di IA hanno operato e la lentezza con cui gli umani hanno scoperto l’attacco è evidente.

Wikipedia come servizio pubblico

Wikipedia conta più di 67 milioni di articoli in oltre 300 lingue e registra circa 15 miliardi di visualizzazioni mensili, rimanendo uno dei pochi esempi di web aperto e gratuito. La fondazione ricorda che il progetto è nato “per gli esseri umani” e che i volontari si occupano di pulire il disordine lasciato da bot e agenti. “Il web aperto è un bene pubblico. Non dobbiamo permettere che questo comportamento diventi la nuova normalità per le persone o le organizzazioni che lo mantengono”, si legge nel comunicato.

Dati di traffico e risorse

    • Nel 2025 la larghezza di banda del servizio è aumentata del 50 % rispetto al 2024, a causa dell’uso intensivo da parte di bot e agenti di IA.
    • Il 65 % del traffico più dispendioso proviene da bot di scansione e dalle query delle intelligenze artificiali.

Altri esempi di pressione sulla rete aperta

Read the Docs, piattaforma gratuita per l’hosting di documenti, ha segnalato che nel 2024 un singolo crawler di IA firmato da Meta ha scaricato 73 TB in un mese. Quasi 10 TB sono stati scaricati in un solo giorno, generando una spesa di oltre 5 000 dollari per la piattaforma, senza che l’azienda responsabile abbia risposto alle richieste di rimborso.

Ars Technica ha riportato che, bloccando questi crawler, il traffico di download è diminuito del 75 % (da circa 800 GB al giorno a 200 GB). Anche SourceHut, piattaforma di sviluppo, ha attribuito a questi agenti un aumento delle cadute di servizio e dei costi hardware.

Responsabilità e futuro dei bot

Selena Deckelmann, direttrice di prodotto e tecnologia della Wikimedia Foundation, ha dichiarato: “I bot e gli agenti fanno parte del futuro del web, e le aziende che li rilasciano e ne traggono profitto devono contribuire direttamente a prevenire e riparare i danni che possono causare”. La frase sottolinea la necessità di una governance condivisa tra sviluppatori