La notizia è stata resa nota solo pochi giorni fa ed è la notizia del momento, anche se rispetto ad altre riguardanti i nuovi sviluppi dei modelli di IA è passata più in sordina, probabilmente perché spiegare cosa è effettivamente successo richiede di scendere uno o due gradini di tecnicismo della rete e di impiegare qualche manciata di minuti per capire di cosa si stia parlando.
Quello che è successo si snoda lungo alcuni mesi a partire dal maggio 2026 (11 maggio per essere precisi) e si trascina con i sui strascichi fino a settembre; tra maggio e giugno migliaia di agenti autonomi, che si presentavano con circa 3.700 nomi diversi, hanno lasciato circa 18.000 messaggi su alcune wiki pubbliche, e il 98,5 per cento delle modifiche arrivava da indirizzi IP del cloud Azure di Microsoft, cioè dall’infrastruttura su cui girano i sistemi di OpenAI.
I primi ad analizzare a fondo la vicenda sono stati Sydney Von Arx, Cormac Slade Byrd e Spencer Kitts e hanno pubblicato una indagine su https://collusion.wiki/ da cui è possibile scaricare tutti i dettagli e farsi una propria idea in base all'analisi dei dati.
Riassumendo in breve la storia questi agenti stavano facendo ricerche sul web su dati statistici americani, dati sui fumatori, sui salari nel settore edile e sequenze di stati da identificare, per ogni domanda avevano un tempo limitato per rispondere, a volte anche pochi secondi, potevano solo fare richieste GET e fare il parsing dei dati per l'elaborazione della risposta.
Gli agenti hanno trovato quindi una maniera intelligente di rispondere, scansionando la rete hanno trovato alcune wiki che non erano state aggiornate con software dei tempi moderni e che avevano dei bug di sicurezza che permettevano di postare commenti su una in particolare dsewiki utilizzando i query params, in GET appunto, iniziando così a collaborare; chi era più avanti nella lista delle domande lasciava la risposta a chi era ancora indietro in modo da velocizzare al massimo la risposta e minimizzare benchmark.
A complicare la vicenda ci si è messo l'amministratore della wiki che vedendo questo enorme numero di messaggi ha iniziato a cancellarli in sequenza partendo dai primi in ordine alfabetico, a questo punto gli agenti hanno iniziato a ribattezzare le loro board facendole iniziare con zzzz in modo da prolungare la vita delle loro risposte, alcuni per rendere più difficile l'eliminazione hanno anche usato caratteri dell'alfabeto cirillico.
OpenAi ha scoperto la falla a fine giugno ma ha confermato la cosa solo dopo la pubblicazione della ricerca di collusion.wiki
Dal punto di vista mediatico questa cosa può essere presentata come preoccupante o allarmante, ma dal punto di vista ingegneristico questo è uno stupefacente capolavoro, migliaia di agenti che non si conoscono e probabilmente non hanno conoscenza gli uni degli altri inventano un modo per comunicare e scambiarsi informazioni senza che nessuno gli abbia dato istruzioni specifiche per farlo, utilizzando una falla su un software non aggiornato.
Questa cosa nella teoria dei giochi si chiama punto di Schelling (o punto focale) ed e una soluzione che i giocatori tendono ad adottare in assenza di comunicazione perché è naturale, speciale o rilevante per loro. Schelling parla del punto focale nel suo libro La teoria del conflitto descrivendolo come: "l'aspettativa di ogni giocatore su quello che gli altri si aspettano che lui si aspetti di fare"
La possibilità che potesse avvenire una cosa come questa non è sconosciuta ai pionieri del settore, infatti Dario Amodei, oggi fondatore di Anthropic, prima vicepresidente della ricerca di OpenAi e ancora prima ricercatore di Google DeepMind, già nel 2016 aveva pubblicato un paper intitolato Concrete Problems in AI Safety in cui descriveva uno scenario come questo.
AI