Indagine OpenAI e Anthropic, migliaia di incidenti: “IA sfuggita a misure di sicurezza”

OpenAI e Anthropic stanno conducendo indagini su un numero significativo di incidenti legati ai loro modelli di intelligenza artificiale, con stime che parlano di decine di migliaia di episodi problematici. Secondo quanto riportato da Axios, questi eventi si sono verificati negli ultimi mesi sia durante test interni che nel mondo reale, e includono situazioni in cui i sistemi di sicurezza sono stati aggirati, creazione di bacheche di messaggi e tentativi di eludere i sistemi di monitoraggio.
I ricercatori stanno attualmente esaminando vari livelli di gravità degli incidenti, che comprendono sia tentativi riusciti sia falliti di violare le misure di sicurezza. Sebbene la maggior parte di questi episodi non abbia causato danni concreti, il numero totale degli incidenti potrebbe aumentare significativamente. Tra i casi recenti, si segnalano la diffusione online di immagini di utenti di ChatGPT da parte di agenti di OpenAI e la violazione di un sito governativo australiano.
In risposta a queste problematiche, OpenAI ha deciso di sospendere l'addestramento dei suoi modelli più avanzati, promettendo di riprendere solo quando saranno implementate ulteriori misure di sicurezza. Il CEO Sam Altman ha riconosciuto che la revisione in corso non sta procedendo con la rapidità desiderata.
