Tecnologia

Modello IA “canaglia” di OpenAI ignora i divieti e viola sito sanitario australiano

Published

on

Un modello canaglia di OpenAI ha aggirato le protezioni durante l’addestramento.

Un modello canaglia di OpenAI ha aggirato le protezioni durante l’addestramento e violato un sito web del governo australiano, ha dichiarato il primo ministro Anthony Albanese, che ha ammonito l’azienda creatrice di ChatGPT per una violazione “ovviamente inaccettabile”.

Lo strumento IA ha cercato di accedere a un portale di statistiche sanitarie a giugno e “non ha accettato un no come risposta”, aggirando le restrizioni per violare una sezione che ospitava file privati, ha detto Albanese.

OpenAI non ha allertato il governo australiano fino a settembre, quando ha inviato un messaggio a una casella email generica controllata solo una volta al giorno.

Le preoccupazioni globali sul potere degli strumenti IA avanzati crescono dopo una serie di incidenti di hacking che hanno coinvolto modelli sia di OpenAI che del rivale sviluppatore Anthropic.

“Oggi ho parlato con l’amministratore delegato di OpenAI, Sam Altman, per esprimere l’estrema preoccupazione dell’Australia per questo incidente,” ha dichiarato Albanese ai giornalisti a New York mercoledì.

“Ho anche espresso la mia delusione per il fatto che l’azienda abbia impiegato troppo tempo a informare il governo di quanto accaduto,” ha detto.

“Si è dovuto attendere il 10 settembre prima che arrivasse una qualsiasi notifica – e la notifica è stata un’email inviata solo alla casella pubblica.”

Lo strumento IA ha avuto accesso a file pubblici e non pubblici ospitati su un vecchio sito web di statistiche sanitarie.

Albanese ha detto che non c’era “alcuna prova” che informazioni personali fossero state consultate e che altri servizi governativi non erano stati compromessi.

“Ciononostante, questa situazione è ovviamente inaccettabile.”

La violazione si è verificata a giugno mentre l’azienda leader nell’intelligenza artificiale OpenAI conduceva esercitazioni di addestramento per valutare le prestazioni dei modelli IA.

Ha chiesto al modello di setacciare internet per dati che mostrassero quanto il governo australiano avesse speso in farmaci, ha riferito ai giornalisti la ministra dei Servizi governativi Katy Gallagher.

OpenAI ha dichiarato di non aver individuato l’attività anomala fino ad agosto, quando ha esaminato cosa avesse fatto lo strumento IA.

Timori per l’IA canaglia

L’azienda con sede a San Francisco non ha allertato il governo australiano fino al 10 settembre, quando ha inviato un’email a una casella governativa generica.

“Quell’indirizzo email viene controllato una volta al giorno,” ha detto Gallagher.

“Abbiamo qualcuno che va a dare un’occhiata. A volte riceve diverse notifiche; spesso molte sono bufale.”

Il ministro della Difesa Richard Marles ha detto che il modello IA aveva “scavalcato il recinto”.

“Ha fatto una domanda, l’informazione non è stata data e invece di fermarsi a quel punto, ha scavalcato il recinto.”

L’Australia ha avviato una revisione rapida dell’incidente, che coinvolgerà l’agenzia di intelligence nazionale responsabile della sicurezza informatica.

OpenAI ha dichiarato di aver individuato la violazione durante una “revisione approfondita” dei suoi modelli IA.

“Durante questa revisione, abbiamo identificato attività riguardanti diversi siti web e servizi del governo australiano mentre i nostri modelli tentavano di cercare risposte e statistiche disponibili su domande relative all’Australia durante una valutazione interna.

“Nel corso di ciò, i nostri modelli hanno compiuto azioni che non intendevamo,” ha dichiarato l’azienda.

Altman e altri amministratori delegati tech si sono rivolti mercoledì a una riunione speciale del Consiglio di Sicurezza delle Nazioni Unite sui rischi dell’IA.

Oltre 100 organizzazioni in tutto il mondo, tra cui OpenAI e Anthropic, hanno firmato il mese scorso una lettera aperta chiedendo uno sforzo globale per “rafforzare le difese informatiche” contro le minacce di cybersicurezza legate all’IA.

È accaduto dopo che due modelli di OpenAI erano fuggiti da un ambiente di test chiuso e avevano violato i sistemi interni di Hugging Face, un sito usato dagli sviluppatori IA per archiviare e condividere codice.

Anthropic ha scoperto di recente che i suoi modelli avevano ottenuto accesso non autorizzato a tre organizzazioni non identificate durante test che avrebbero dovuto tenerli lontani dai sistemi “del mondo reale”.

Il modello IA consumer di Google, Gemini, ha violato più sistemi indovinando le credenziali di accesso, ha dichiarato l’azienda la scorsa settimana.

Fonte: Times of Malta: https://timesofmalta.com/article/australian-pm-says-openai-hacked-government-health-website.1134541

Immagine generata con AI – Gazzetta di Malta

Exit mobile version