evasione chatgpt openai intelligenza artificiale

NON ABBOCCATE PIU' AL CATASTROFISMO PARACULO DEI PRODUTTORI DI IA: DELLA SERIE, 'AIUTO, L'INTELLIGENZA ARTIFICIALE E' FUORI CONTROLLO' – LA PRIMA “EVASIONE” DI UN AGENTE DI INTELLIGENZA ARTIFICIALE DA UN AMBIENTE DI TEST SERVE A OPENAI PER “VENDERE” LA SOFISTICATEZZA DI CHATGPT E RISALIRE LA CHINA DOPO ESSERE STATA SUPERATA DAI NUOVI MODELLI DI "CLAUDE" – LA PIATTAFORMA “HUGGING FACE”, "VITTIMA" DELL'HACKERAGGIO DA PARTE DELL'IA, PER ANALIZZARE L’INCIDENTE, E' STATA COSTRETTA A USARE IL MODELLO CINESE OPEN SOURCE, “Z.AI”, PERCHÉ QUELLI AMERICANI SONO CHIUSI E PROPRIETARI – COSA È SUCCESSO? L’IA AVEVA UN OBIETTIVO, OTTENERE UN PUNTEGGIO ALTO NEL TEST, E PER FARLO HA DECISO AUTONOMAMENTE CHE LE SERVIVA L'ACCESSO A INTERNET. HA TROVATO UNA FALLA MAI SCOPERTA PRIMA NELL’AMBIENTE DI TEST OFFLINE (LA COSIDDETTA “SANDBOX”) E L’HA SFRUTTATA PER USCIRE DALLA “STANZA”. A QUEL PUNTO, È ENTRATO NEI SISTEMI DI “HUGGING FACE”, PERCHÉ ERA IL MODO MIGLIORE PER COMPLETARE IL SUO COMPITO…

TROPPE AMBIGUITÀ, SERVE TRASPARENZA

Estratto dell’articolo di Luca De Biase per "il Sole 24 Ore"

 

sam altman openai

Un agente di OpenAI è riuscito a bucare le difese di Hugging Face durante un test. L’azienda americana che ha prodotto ChatGPT ha definito questo fatto un incidente. Ma poiché quell’agente era disegnato proprio per superare le difese che servono a proteggere le informazioni riservate nelle piattaforme online, l’azienda non ha potuto evitare di dare l’impressione - chissà quanto non voluta - di avere registrato un successo.

 

hugging face

Da anni, la comunicazione sui progressi dell’intelligenza artificiale gioca su questa ambiguità: la tecnologia è descritta come così potente che anche chi la produce teme che possa andare fuori controllo. Ma ormai il gioco è un po’ troppo scoperto. E sarebbe tempo di prendere le misure di questo stile di comunicazione.

 

Un primo argomento critico potrebbe riguardare la ricostruzione del fatto di per sé.

L’agente di OpenAI è stato raccontato come talmente abile da aver superato i confini della sandbox, cioè l’ambiente informatico protetto dal quale l’agente non doveva uscire durante lo svolgimento del test.

 

evasione di chatgpt

Ma resta da capire se questo è avvenuto perché l’agente era molto potente o se i confini della sandbox erano troppo deboli.

 

D’altra parte, raccontare l’incidente dicendo che un “agente” è “scappato” di propria iniziativa da una sandbox nella quale doveva restare confinato ed è andato ad attaccare una piattaforma trovando un accesso a internet che doveva essergli precluso è un nuovo episodio della serie “antropomorfizzazione dell’intelligenza artificiale”: una narrativa che da settant’anni serve ad attirare l’attenzione su questa tecnologia e ad affascinare il pubblico.

 

Fa pensare anche il fatto che la prossima settimana, il ceo di OpenAI, Sam Altman deve andare a Washington per dare informazioni sui prossimi modelli in uscita dalla sua azienda, come richiesto dal governo americano.

 

Questa pratica è originata dal precedente del modello di Anthropic, Mythos, presentato come uno specialista della ricerca di vulnerabilità nella cybersecurity. In quel caso, il governo si è trovato sorpreso e spiazzato, sicché è intervenuto sgangheratamente, prima imponendo il blocco dell’accesso al modello per gli stranieri, poi concedendolo di nuovo, mostrando che in questo mercato l’autorità politica americana può interferire in modo imprevedibile e che nessun utente può contare sulla certezza del diritto.

 

chatgpt

Il che peraltro aveva conferito ad Anthropic l’immagine del produttore di un modello veramente potente e pericoloso.

 

Insomma, grazie all’incidente dell’altro giorno, Sam Altman va a Washington con l’aura del produttore di un modello che non ha niente da invidiare a quello del concorrente.

 

Infine, è molto interessante anche un dettaglio che riguarda le operazioni di Hugging Face quando ha dovuto trovare un rimedio all’attacco. Un dettaglio che forse non è altrettanto compatibile con le intenzioni di comunicazione di OpenAI.

 

Per analizzare l’incidente, infatti, Hugging Face ha usato un modello aperto cinese prodotto da Z.ai. La superiorità di questo genere di modelli è che i pesi dei modelli sono aperti, quindi gli utenti possono modificare i parametri in base alle loro esigenze e usare le tecnologie con i propri server.

 

Nei modelli chiusi, come tipicamente sono quelli di OpenAI e Anthropic, i dati di utilizzo sono inevitabilmente condivisi con i produttori: ma in un caso come questo, la riservatezza era importante. E Hugging Face ha dato nuovi argomenti ai sostenitori del fatto che, in casi come questo, non è obbligatorio fidarsi dei modelli delle grandi aziende americane. […]

 

L'AI RIBELLE DI CHATGPT LANCIA IN AUTONOMIA ATTACCHI HACKER

Estratto dell’articolo di Biagio Simonetta per “il Sole 24 Ore”

 

[…]  Proviamo a capire cosa è successo, anche perché questo evento segna un traguardo significativo nella sicurezza dell’IA e nella cybesicurezza.

 

chatgpt

Gli ingegneri della società guidata da Sam Altman stavano facendo un test interno sui modelli più avanzati, tra cui uno non ancora rilasciato al pubblico. Un test di routine, di quelli che servono a misurare quanto siano performanti i nuovi modelli nel trovare vulnerabilità, risolvere problemi di hacking e altre situazioni simili.

 

La parte più importante della storia, però, è un’altra. Perché per condurre questi testi, come da prassi i modelli erano stati messi in una specie di stanza digitale chiusa, una sandbox. In altre parole: in un ambiente isolato senza accesso a internet. E siccome il test riguardava proprio le capacità cyber, i filtri di sicurezza che normalmente impediscono al modello di fare hacking erano stati abbassati.

 

openai

E qui si è concretizzato lo scenario da pellicola americana: l’AI, per ottenere un punteggio migliore nel test, decide da solo che gli serve internet. Quindi trova una falla mai scoperta prima (una vulnerabilità zero-day) nel sistema che gli forniva i pacchetti software, la sfrutta, ed esce dalla stanza chiusa. A quel punto è libera sulla rete.

 

Una volta fuori, entra nei sistemi di Hugging Face, che è una piattaforma dove si ospitano modelli AI open source. Un bersaglio, tra le altre cose, che non sembra proprio scelto a caso, perché il migliore forse per completare il suo compito. E non si limita a entrare. Nell’arco di un weekend esegue decine di migliaia di azioni automatiche, scala i privilegi, si muove dentro l’infrastruttura interna dell’azienda.

 

opeani evasione

In tutto questo, Hugging Face si accorge dell’intrusione, ma non capisce chi sia: sa solo che è un agente AI autonomo, di sofisticazione mai vista. E lo dice pubblicamente.

 

[…] Nessun hacker umano ha dato il comando di attaccare Hugging Face. Il modello ha fatto tutto da solo, come effetto collaterale dell’obiettivo che gli era stato dato scrivendo il prompt («risolvi bene questo test»).

 

Questa storia è molto probabilmente la prima documentata in cui un’AI evade il contenimento del suo creatore e compromette da sola l’infrastruttura di un’azienda terza reale. E forse dimostra che i modelli di frontiera hanno ormai capacità offensive paragonabili a hacker d’élite (o magari superiori), e che possono usarle in modi imprevisti pur di raggiungere un obiettivo. È esattamente lo scenario di cui i ricercatori di sicurezza AI parlano da anni come rischio teorico. Che ora non è più teorico.

IL MODELLO DI ANTHROPIC CLAUDE MYTHOShugging face

Ultimi Dagoreport

tilman fertitta yacht boardwalk

FERTITTA, CARO CI COSTI! – L’AMBASCIATORE DI TRUMP IN ITALIA CONTINUA IL SUO GIRO DEL MEDITERRANEO IN YACHT, CHE COSTEREBBE ALLO STATO ITALIANO LA SOMMETTA DI 115MILA EURO AL GIORNO, PER SCORTA E SICUREZZA, PER UN TOTALE DI OLTRE 5 MILIONI (IL TOUR INIZIATO IL 13 GIUGNO A CIVITAVECCHIA SI CONCLUDERA’ IN SARDEGNA A META’ AGOSTO) – NELLE SCORSE SETTIMANE IL FIGLIO DELL'AMBASCIATORE, PATRICK FERTITTA, AVREBBE INIZIATO A STUDIARE IL "DOSSIER LAZIO" IN VISTA DI UNA PROPOSTA DI ACQUISIZIONE DEL CLUB DI LOTITO - L'EMISSARIO DI TRUMP, TEXANO CON ANTENATI SICILIANI, È TRA I BUSINESSMEN PIÙ RICCHI D'AMERICA: 11 MILIARDI DI PATRIMONIO, CONTROLLA UN COLOSSO DELLA RISTORAZIONE E CASINÒ, È PROPRIETARIO DEGLI HOUSTON ROCKETS, FRANCHIGIA DI BASKET NBA, ACQUISITI PER 2,2 MILIARDI....

sara soldati leonardo maria del vecchio

DAGOREPORT - A LEONARDINO DEL VECCHIO NON BASTAVANO GLI INFINITI SCAZZI FAMILIARI, NÉ IL RINVIO A GIUDIZIO PER IL DOSSIERAGGIO DEI CYBER-SPIONI DI ‘’EQUALIZE’’. ORA, PER LA SERIE “ANCHE I RICCHI PIANGONO”, SI RITROVA SULLA CAPOCCIA UNA QUERELA PER ‘’VIOLENZA PRIVATA’’ E UNA DENUNCIA PER ‘’SOTTRAZIONE DI MINORE’’, PRESENTATA DALLA MODELLA E INFLUENCER SARA SOLDATI, MADRE DI BIANCA, LA BAMBINA DI UN ANNO NATA DALLA LORO RELAZIONE - MALGRADO UN DOVIZIOSO ASSEGNO MENSILE (50MILA EURO?) ALLA SOLDATI, CHE LA TRISTE ISTORIA SAREBBE FINITA A PESCI IN FACCIA ERA FACILMENTE PREVEDIBILE, ALMENO DA UN MESE, DA QUANDO LEONARDINO GLI AVEVA BLOCCATO LE CARTE DI CREDITO - ESSENDO LE DISGRAZIE COME LE CILIEGIE, UNA TIRA L’ALTRA, IL LEGALE DELLA MODELLA E’ L’IMMANCABILE ANNAMARIA BERNARDINI DE PACE, UN “MASTINO CON LA TOGA” CHE DI SICURO FARÀ VEDERE I SORCI VERDI A LEONARDINO…

roberto vannacci giorgia meloni

DAGOREPORT - L’ESPLOSIVA DISCESA IN CAMPO DI ROBERTO VANNACCI STA FOTTENDO L’ARMATA BRANCA-MELONI – SENZA FUTURO NAZIONALE, IL CENTRODESTRA NON SOLO RISCHIA DI PERDERE PALAZZO CHIGI MA DEVE DIRE ADDIO AL SOGNO DI ESPUGNARE ROMA E MILANO ALLE COMUNALI DELLA PRIMAVERA 2027 - I DATI DEGLI ULTIMI SONDAGGI RISERVATI REGISTRANO QUANTO VANNACCI STIA PRENDENDO PIEDE, A SPESE DI FDI, A MILANO (7/8%) E A ROMA (6,8%) – SENTITA PUZZA DI SCONFITTA, LA RUSSA, DA QUEL POLITICO SCALTRO ED ESPERTO CHE È, HA SCARICATO LUPI E BALILLA, MOLLANDO LA PATATA BOLLENTE DELLA SCELTA DEL CANDIDATO NELLE MANINE DELLE SORELLE MELONI – A ROMA LA SCELTA DELLO SFIDANTE DI GUALTIERI SARÀ SVELATA SOLO ALL’INDOMANI DEL RITIRO DELL’INDIGESTA AUTO-CANDIDATURA DI FABIO RAMPELLI. L’ARDUO INCARICO DI FAR TORNARE SUI SUOI PASSI L’INGOMBRANTE EX TUTOR DI GRAN PARTE DEI MELONIANI OGGI AL POTERE, È STATO AFFIDATO A FRANCESCO LOLLOBRIGIDA, TORNATO IN GRAN SPOLVERO…

giorgia meloni marina berlusconi antonio tajani

DAGOREPORT – A PALAZZO CHIGI ALEGGIA DAVVERO UN CLIMA DA FINE IMPERO - AL VERTICE DI MARTEDÌ SCORSO IL NERVOSISMO DI GIORGIA MELONI HA SUPERATO LA SOGLIA DI GUARDIA, ACCUSANDO PESANTEMENTE SALVINI E TAJANI DI “TRADIMENTO” SULLE PREFERENZE (SE L’EMENDAMENTO VENISSE BOCCIATO ANCHE AL SENATO, LA “SFI-DUCETTA” DELLA CAMERA DIVENTEREBBE UNA CATASTROFICA "SFI-DUCIONA") - IL LEGHISTA HA SUBITO SMOLLATO LA PATATONA BOLLENTE SU FORZA ITALIA. L’EX MONARCHICO DI FERENTINO, FINO A IERI FEDELE ‘’CAMERIERE’’ DELLA DUCETTA, HA RIFILATO IL SOLITO BLA BLA DI SUPERCAZZOLE CON SCAPPELLAMENTO AI “VALORI DEL BERLUSCONISMO DA DIFENDERE'' – LA VERITÀ È CHE NÉ SALVINI NÉ TAJANI RIESCONO A CONTROLLARE I LORO PARLAMENTARI, AL PUNTO CHE LA MELONI, DISPERATA, AVREBBE CHIAMATO MARINA BERLUSCONI - LIQUIDATA DALLA ''CAVALIERA'' CON “NON HO AUTORITÀ SULLE SCELTE DEL PARTITO”, “IO SO’ GIORGIA” AVREBBE CHIUSO CON UN MINACCIOSO: “ME LO RICORDERÒ…”

ministero della giustizia giusi bartolozzi

FLASH – LA “ZARINA” È SEMPRE DI CASA A VIA ARENULA! PARE CHE QUESTA MATTINA GIUSI BARTOLOZZI, EX CAPO DI GABINETTO DI CARLO NORDIO, GIUBILATA DA MELONI DOPO LA SCONFITTA AL REFERENDUM, SIA TORNATA A FAR VISITA AI SUOI EX COLLEGHI AL MINISTERO DELLA GIUSTIZIA. E NON SAREBBE LA PRIMA VOLTA, NELLE ULTIME SETTIMANE – LA BARTOLOZZI, A QUANTO SPIFFERANO GLI “ADDETTI AI LIVORI”, SI SAREBBE INTRATTENUTA CON IL VICE-CAPO DI GABINETTO DEL MINISTERO DELLA GIUSTIZIA, VITTORINO CORASANITI, E CON LA RESPONSABILE DEL DIPARTIMENTO DELL’ORGANIZZAZIONE GIUDIZIARIA, LINA DI DOMENICO. DI COSA DOVEVANO PARLARE I DUE FUNZIONARI CON L'EX CAPETTA DI VIA ARENULA?