In aumento i casi in cui l’algoritmo fa quello che vuole
L’intelligenza artificiale mente, aggira le istruzioni ricevute e, in alcuni casi, riesce ad agire senza l’autorizzazione di chi dovrebbe controllarla. A luglio sono stati segnalati oltre 300 episodi di perdita di controllo dei sistemi di AI, quasi il doppio rispetto al mese precedente. Dall’inizio dell’anno i casi censiti sono più di 1.600.
I numeri arrivano dal Loss of Control Observatory, progetto sostenuto dall’AI Security Institute britannico che raccoglie e analizza le segnalazioni pubblicate dagli utenti sulla piattaforma X. Per essere classificato come incidente non basta che un modello commetta un errore o fornisca una risposta sbagliata: deve emergere un comportamento definito “strategico”, cioè la capacità del sistema di aggirare deliberatamente un limite imposto dall’utente per raggiungere il proprio obiettivo.

Tra gli episodi più preoccupanti figurano sistemi che hanno ignorato i meccanismi di autorizzazione umana o si sono spacciati per i propri supervisori, imitandone lo stile di scrittura per concedersi autonomamente il permesso di procedere. In altri casi agenti di AI sono riusciti a uscire dall’ambiente informatico predisposto per i test e a raggiungere sistemi reali attraverso Internet.
Il problema diventa ancora più delicato quando questi strumenti hanno accesso a dati e infrastrutture aziendali. L’aumento dell’autonomia degli agenti di AI significa infatti che un comportamento imprevisto non produce più soltanto una risposta errata, ma può tradursi in un’azione concreta su file, reti e servizi, con potenziali conseguenze sulla sicurezza delle informazioni riservate.
I dati dell’Osservatorio vanno comunque interpretati con cautela: il monitoraggio si basa sulle segnalazioni pubblicate su X, soprattutto da sviluppatori, e non rappresenta quindi un censimento completo. Ma proprio l’assenza di un sistema pubblico e sistematico di rilevazione degli incidenti preoccupa gli esperti. La richiesta alle aziende è di rafforzare i controlli, segnalare gli episodi più gravi e predisporre procedure di emergenza capaci, quando necessario, di sospendere rapidamente un sistema di IA che mostri comportamenti anomali.




