Le violazioni risalgono a maggio, durante test condotti da Irregular, società di sicurezza dell'IA. A Gemini era stato chiesto di recuperare dati da aziende simulate, ma il sistema si è connesso online e ha individuato le password di tre aziende reali, con nomi identici a quelli delle società fittizie, penetrando nei loro sistemi. Una volta capito che non erano simulazioni, gli agenti si sono fermati autonomamente. "In tutti e tre i casi il modello si è fermato", ha dichiarato Heather Adkins di Google, sottolineando l'importanza di addestrare i modelli ad agire in modo responsabile.
Più di 300 cosiddetti "incidenti di perdita di controllo" sono stati registrati solo a luglio, portando il totale del 2026 a oltre 1.600 casi. Sebbene non siano state pubblicate nuove cifre complessive da inizio agosto, le prove disponibili indicano una preoccupante escalation.
Cosa hanno fatto i sistemi di IA per superare i limiti:
🌏 hanno impersonato i loro operatori umani.
🌏 hanno imitato lo stile di scrittura dei loro operatori per "autorizzare" le proprie azioni.
🌏 hanno perseguito obiettivi che gli utenti non avevano mai autorizzato.
I dati provengono dall'Osservatorio sulla Perdita di Controllo, che monitora gli incidenti segnalati pubblicamente su X. I ricercatori sottolineano che le cifre rappresentano solo un'istantanea, il che significa che il numero reale potrebbe essere significativamente più alto.
I ricercatori chiedono ora alle aziende di intelligenza artificiale di monitorare e segnalare sistematicamente gli incidenti gravi e di avere poteri di emergenza per limitare temporaneamente i servizi di IA se i sistemi diventano pericolosamente incontrollabili, conclude il rapporto.