QUALCUNO METTA UN FRENO A QUEST’INTELLIGENZA ARTIFICIALE! – SECONDO “AXIOS”, OPENAI E ANTHROPIC STANNO INDAGANDO SU MIGLIAIA DI INCIDENTI AVVENUTI NEGLI ULTIMI MESI E PROVOCATI DA MODELLI DI AI SFUGGITI AI CONTROLLI - I CASI DI “AGENTI RIBELLI” SAREBBERO SUPERIORI RISPETTO A QUELLI DENUNCIATI FINORA DAI COLOSSI TECH - OPENAI CORRE AI RIPARI, SOSPENDENDO L'ADDESTRAMENTO DEI SUOI PIU' RECENTI MODELLI…
AI-POCALYPSE NOW? – OPENAI HA SOSPESO L'ADDESTRAMENTO DEI SUOI PIU' RECENTI MODELLI DI INTELLIGENZA ARTIFICIALE – LA DECISIONE È ARRIVATA POCHE ORE DOPO CHE LA SOCIETA' AVEVA AMMESSO UNA SERIE DI INCIDENTI AVVENUTI, NEI QUALI “AGENTI” DI OPENAI IMPEGNATI A CERCARE INFORMAZIONI SUI SITI WEB DEL GOVERNO FEDERALE AMERICANO AVEVANO AGITO IN MODI IMPREVISTI, ANDANDO OLTRE QUANTO ERA STATO LORO RICHIESTO NEL RACCOGLIERE E DIFFONDERE INFORMAZIONI – LA START-UP AFFERMA CHE RIPRENDERA' L'ADDESTRAMENTO “SOLO QUANDO SAREMO CERTI DI AVER MESSO IN ATTO ULTERIORI MISURE DI SICUREZZA…”
Estratto dall’articolo di Paolo Ottolina per www.corriere.it
Non erano pochissimi casi isolati, come quello di Hugging Face o del sito di programmatori tedeschi DsaWiki o della sanità australiana. Non erano neppure le decine di casi relative a siti governativi e istituzionali.
Secondo quanto scrive il sito Axios in esclusiva, OpenAI ma anche Anthropic (e diversi ricercatori di sicurezza) stanno indagando su decine di migliaia di incidenti avvenuti negli ultimi mesi, nei quali modelli AI avanzati hanno compiuto azioni considerate problematiche dai valutatori esterni.
È una scala molto superiore a quella emersa pubblicamente finora e anzi, sempre secondo Axios, il numero complessivo potrebbe crescere ben oltre le decine di migliaia.
[...] Axios include nella stessa categoria episodi di gravità molto diversa, compresi i tentativi falliti e i comportamenti provocati deliberatamente durante le prove di sicurezza.
OPENAI - MODELLI DI INTELLIGENZA ARTIFICIALE
Tra i casi segnalati ci sono modelli che hanno superato i guardrail imposti dalle aziende, creato bacheche attraverso le quali comunicare, cercato di uscire dalle sandbox, preso il controllo di siti web, generato autonomamente nuovi prompt o tentato di evitare i sistemi incaricati di controllarli. [...]
Nelle ultime settimane OpenAI aveva reso noti diversi incidenti legati ai propri agenti e altri casi erano emersi dalle verifiche di Anthropic e di società indipendenti. Molti degli episodi ora all'esame delle aziende non sono ancora stati divulgati e le indagini sono ancora in corso.
Una delle conseguenze più concrete è arrivata da OpenAI. L'azienda ha sospeso addestramento, valutazione e inferenza con uso di strumenti per i suoi modelli più capaci, dopo un incidente avvenuto il 20 settembre durante una sessione interna di apprendimento per rinforzo. [...]
Un altro episodio è stato ricostruito dal Wall Street Journal. A giugno agenti di OpenAI hanno inviato più di 16.000 richieste a un sito delle Nazioni Unite che ospita dati pubblici e sono riusciti ad aggirare almeno uno dei filtri predisposti per limitarne l'accesso automatizzato. Il caso è stato analizzato dal ricercatore Rowan Howard-Jones sulla base di dati forniti dalla società di ricerca Transluce.
Gli agenti stavano cercando informazioni disponibili pubblicamente, ma di fronte ai limiti imposti dal sito hanno adottato tecniche sempre più aggressive per continuare a recuperarle. Il Wsj inserisce l'episodio nella serie di comportamenti anomali osservati online nelle ultime settimane, nei quali i sistemi hanno continuato a cercare strade alternative quando il normale accesso ai dati veniva bloccato.
Le oltre 16.000 richieste al sito dell'Onu non equivalgono, naturalmente, a 16.000 dei singoli «incidenti» conteggiati da Axios: sono due misure differenti, ma il caso mostra che una parte dei comportamenti sotto indagine non riguarda soltanto test costruiti in laboratorio. [...]
Donald Trump, come noto, nelle ultime settimane ha respinto le richieste di rallentare lo sviluppo dell’AI: ha definito una «bufala» i timori che questi sistemi possano sfuggire al controllo e ha sostenuto che l’unico «guardrail» necessario sia «un presidente forte e intelligente», indicando la competizione con la Cina come una delle ragioni per continuare a correre.
Marcus, a proposito dell'attuale amministrazione Usa, solleva il tema dei possibili conflitti d’interesse, citando tra l’altro i miliardi investiti in OpenAI da Thrive Capital, fondata da Josh Kushner (fratello del genero di Trump, Jared Kushner), e le donazioni politiche di Greg Brockman (il presidente e cofondatore di OpenAI e sua moglie hanno versato 25 milioni di dollari a Maga Inc, il super Pac che sostiene Trump).
Ci sono poi gli interessi diretti della famiglia presidenziale nel settore: Donald Trump Jr. è partner di 1789 Capital, fondo che ha investito in aziende come xAI, Cerebras e Perplexity, mentre anche Eric Trump ha partecipazioni in società legate ad AI, robotica e infrastrutture tecnologiche.
sam altman openai
chatgpt
intelligenza artificiale 10
intelligenza artificiale 12
intelligenza artificiale 17
Anthropic - software ai claude
intelligenza artificiale 21
intelligenza artificiale 5




