VATTI A FIDARE DELL’INTELLIGENZA ARTIFICIALE – PER RENDERE I MODELLI DI IA PIÙ SICURI, I BOT DOVRANNO FARE “AUTOANALISI”: NE È CONVINTA OPENAI – L’AZIENDA DI SAM ALTMAN VUOLE CHE SIANO GLI STESSI SOFTWARE A SPIEGARE I PASSAGGI LOGICI CHE SEGUONO PER RISPONDERE ALLE DOMANDE DEGLI UTENTI. IN QUESTO MODO, I RICERCATORI POTRANNO INDIVIDUARE COMPORTAMENTI ANOMALI PRIMA CHE PROVOCHINO INCIDENTI – EMERGONO NUOVI DETTAGLI SUGLI AGENTI IA “FUORI CONTROLLO” CHE SONO RIUSCITI A VIOLARE I BLOCCHI DI SICUREZZA: OPENAI SE N’E’ ACCORTA DOPO 15 MINUTI, MA IL BLOCCO AUTOMATICO NON HA FUNZIONATO E SONO SERVITE DUE ORE E MEZZA PER SPEGNERLO MANUALMENTE…
1 - LE IA IMPARANO A FARE AUTOANALISI, È LA CHIAVE PER RENDERLE PIÙ SICURE
(ANSA) - Far raccontare alla stessa Intelligenza Artificiale i passi logici che segue: è questo lo strumento chiave per monitorare e rendere più sicure le IA sempre più protagoniste di incidenti, come il recente accesso alle banche dati della sanità pubblica australiana. A spiegare sul sito della rivista Nature la tecnica di monitoraggio detta 'catena di pensiero', o chain of thought, è Mark Chen, capo della ricerca di OpenAI.
"Il monitoraggio dei processi interni di un modello da parte di altri modelli rappresenta oggi il modo più efficace per garantirne la sicurezza e l'allineamento", ha detto Chen, spiegando l'importanza della chain of thought per aumentare la sicurezza e soprattutto la comprensione dei passi logici che adottano le IA quando lavorano.
Una sorta di autoanalisi che viene richiesta in modo sempre più approfondito alle AI in modo da permettere ai ricercatori di migliorarne la comprensione e sviluppare così nuovi metodi più efficaci per evitare nuovi incidenti.
PERICOLI DELL INTELLIGENZA ARTIFICIALE
"E' una linea che OpenAI e altre aziende del settore stanno perseguendo già da tempo e permette di osservare il dialogo interno della macchina prima che arrivi alla risposta definitiva", ha detto all'ANSA Marcello Restelli, esperto di computer science al Politecnico di Milano.
"Perché capire come una IA giunga a una conclusione è la chiave per valutarne la spiegabilità, ossia capirne i meccanismi profondi, e l'affidabilità", ha aggiunto Restelli. Strumenti adottati e pubblicizzati in particolare per evitare il ripetersi dei vari incidenti che in questi mesi hanno visto le IA protagoniste di azioni nel mondo digitale che hanno destato grandi preoccupazioni, ad esempio nell'attacco effettuato all'interno di Huggin face, una delle più importanti piattaforme usata dagli sviluppatori.
"E' però anche importante sottolineare che tutti questi incidenti sono capitati in contesti di test di laboratorio", ha sottolineato Restelli.
"In questi casi però ci sono state delle 'falle' nel definire le aree di test e le IA hanno trovato una possibilità di collegarsi all'esterno. Possiamo immaginare questi test - ha concluso Restelli - come una pista automobilistica dove si vuole mettere alla prova, lontano dal traffico reale, delle auto a guida autonoma. Il rischio è che se si lascia però un cancello aperto c'è la possibilità, e così è avvenuto, che l'auto esca fuori e vada così nel mondo reale".
2 - OPENAI HA IMPIEGATO 2 ORE E MEZZA PER FERMARE UNA IA SFUGGITA AL SUO CONTROLLO
(ANSA) - OpenAI ha reso noti i dettagli di un sistema di intelligenza artificiale che ha violato i suoi controlli di sicurezza. Un agente, il 20 settembre, è riuscito a collegarsi autonomamente a rete internet nonostante le istruzioni lo vietassero.
L'azienda ha confermato l'episodio in un documento ufficiale, evidenziando alcune falle nei propri protocolli di sicurezza ma anche i tempi ristretti in cui l'IA è stata scoperta e fermata. I controlli di OpenAI hanno infatti rilevato l'attività sospetta in quindici minuti e un tecnico ha lanciato subito l'allarme. Il meccanismo di blocco automatico, però, non ha funzionato. Il programma è stato spento manualmente solo dopo due ore e mezza.
Il software aveva il compito di cercare informazioni su una persona. Poiché gli strumenti chiusi a sua disposizione non bastavano per completare il lavoro, il sistema ha cercato soluzioni alternative, trovando un punto debole nella struttura della rete interna, in particolare in quella che gestisce gli indirizzi web. Attraverso questa falla, l'intelligenza artificiale si è connessa a un programma esterno online per farsi aiutare nella ricerca.
"Il nostro scenario di sicurezza presupponeva che il modello non potesse accedere a internet in tempo reale", si legge nel documento ufficiale di OpenAI. "L'incidente ha evidenziato una falla nei nostri controlli sulle restrizioni di rete. Abbiamo quindi interrotto l'esecuzione dell'addestramento e deciso di sospendere tutte le altre attività, fino a quando non avremo verificato che la problematica è stata risolta ed effettuato ulteriori test di sicurezza".
Il tempo di due ore e mezza, intercorso tra la scoperta e l'effettivo blocco dell'agente, secondo OpenAI stato causato da un insieme di errori tecnici e da incertezze del personale su come intervenire.
OPENAI - MODELLI DI INTELLIGENZA ARTIFICIALE
OpenAI ChatGpt




