OpenAI e Wikipedia, milioni di richieste e tentativi di usare gli strumenti Wikimedia come proxy

Notizia in breve

Wikimedia attribuisce ad agenti riconducibili a OpenAI milioni di richieste automatiche, tentativi di usare strumenti di Wikipedia come proxy e un possibile contributo a un disservizio di Wikidata. OpenAI sta esaminando le attività segnalate.

Wikipedia
OpenAI e Wikipedia, milioni di richieste e tentativi di usare gli strumenti Wikimedia come proxy
Ricevi le notizie di Zazoom.it su GoogleTutte le news direttamente su Google.
Segui

Milioni di accessi automatizzati alle piattaforme Wikimedia, modifiche effettuate nelle aree di prova e tentativi di sfruttare alcuni servizi come intermediari per raggiungere siti esterni. Sono le attività individuate durante un'indagine interna su agenti di intelligenza artificiale ritenuti riconducibili a OpenAI.

Tra gli episodi esaminati figurano alcune modifiche alla configurazione di uno strumento dedicato alle citazioni. Secondo la ricostruzione, l'obiettivo sarebbe stato trasformarlo in un proxy capace di recuperare dati da servizi remoti. Le modifiche non hanno interessato le normali pagine visibili ai lettori e quasi tutti gli interventi sono avvenuti nelle aree sandbox utilizzate per i test.

Altri tentativi hanno riguardato Etherpad, il servizio pubblico per prendere appunti ospitato nell'infrastruttura Wikimedia. Gli agenti avrebbero provato senza successo a sfruttarlo per ottenere contenuti da altri siti. Alcune attività mostrano anche l'uso dello strumento per annotare informazioni relative ai compiti assegnati, ma non sono state trovate prove di un coordinamento tra diversi agenti attraverso i sistemi Wikimedia.

L'indagine ha rilevato inoltre un volume molto elevato di traffico. Gli agenti hanno effettuato milioni di richieste alle API pubbliche, visitato automaticamente milioni di pagine soprattutto su Wikidata e Wikimedia Commons e inviato centinaia di migliaia di interrogazioni al Wikidata Query Service.

Quest'ultimo flusso potrebbe avere contribuito a un'interruzione parziale del servizio avvenuta a maggio, ma il collegamento non è stato dimostrato in modo conclusivo. Non risultano inoltre compromissioni dei sistemi o dei dati della piattaforma.

Il problema riguarda soprattutto l'impatto operativo di agenti capaci di insistere autonomamente nella ricerca di una soluzione. Un'attività condotta su larga scala può consumare risorse, aumentare il carico sui server e obbligare amministratori e volontari a individuare e correggere comportamenti anomali.

OpenAI ha dichiarato di stare riesaminando insieme a Wikimedia le attività individuate e l'indagine complessiva. L'azienda ha precisato di non avere trovato prove che i propri agenti abbiano utilizzato le piattaforme Wikimedia per scambiarsi messaggi di coordinamento e non considera ancora accertato il rapporto tra il traffico generato e il disservizio di maggio.

La vicenda riapre il tema del controllo degli agenti autonomi e delle responsabilità delle aziende che li sviluppano. Per Wikimedia, sistemi di questo tipo richiedono strumenti di monitoraggio più efficaci, soprattutto quando operano su servizi pubblici e infrastrutture aperte utilizzate ogni giorno da milioni di persone.

?
Vuoi approfondire questa notizia?Condividila sui social o cerca aggiornamenti, video e discussioni correlate.

Notizie correlate

Maltempo in Italia: oltre 9 milioni di persone e 2 milioni di edifici a rischio alluvione

Drusilla Foer Wikipedia : Chi è il personaggio di Gianluca Gori a Sanremo 2022

Cerca news, video e discussioni social in tutto il web su 'Wikipedia'

⬆