intelligenza artificiale errori errore

LA POTENZA È NULLA SENZA IL CONTROLLO: LE INTELLIGENZE ARTIFICIALI ANALIZZANO SEMPRE PIÙ DATI MA FANNO ANCHE PIÙ ERRORI – I BOT SI BASANO SU SISTEMI MATEMATICI COMPLESSI CHE PERÒ NON POSSONO DETERMINARE COSA SIA VERO E COSA SIA FALSO. A VOLTE INVENTANO LE COSE: UN FENOMENO CHE I RICERCATORI CHIAMANO “ALLUCINAZIONI” E CHE INVECE CHE DIMINUIRE STA AUMENTANDO. NEI TEST DELLE AI PIÙ RECENTI HA RAGGIUNTO IL 79%...

Traduzione di un estratto dell'articolo di Cade Metz e Karen Weise per il “New York Times”

 

intelligenza artificiale nel lavoro

Il mese scorso, un bot dotato di intelligenza artificiale utilizzato per l’assistenza tecnica di Cursor — un promettente strumento per programmatori — ha avvisato diversi clienti di un presunto cambiamento nella politica aziendale: da quel momento, secondo il bot, sarebbe stato vietato usare Cursor su più di un computer.

 

In numerosi post indignati pubblicati sui forum online, i clienti si sono lamentati. Alcuni hanno cancellato i propri account Cursor. E la rabbia è aumentata quando si sono accorti della verità: il cambiamento di politica non esisteva.

 

«Non abbiamo alcuna politica del genere. Naturalmente siete liberi di usare Cursor su più dispositivi», ha scritto su Reddit il CEO e cofondatore dell’azienda, Michael Truell. «Purtroppo si è trattato di una risposta errata da parte di un bot AI per il supporto di primo livello.»

 

chatgpt - giornalismo

A più di due anni dall’arrivo di ChatGPT, aziende tecnologiche, impiegati e semplici consumatori stanno utilizzando bot dotati di intelligenza artificiale per un numero sempre maggiore di compiti. Tuttavia, non esiste ancora un modo per garantire che questi sistemi producano informazioni accurate.

 

Le tecnologie più recenti e avanzate — i cosiddetti sistemi di ragionamento sviluppati da aziende come OpenAI, Google e la start-up cinese DeepSeek — stanno generando più errori, non meno. Sebbene le loro capacità matematiche siano notevolmente migliorate, la loro padronanza dei fatti è diventata più instabile. Il motivo non è ancora del tutto chiaro.

 

cento uomini contro un gorilla immagine generata dall intelligenza artificiale

I bot AI odierni si basano su sistemi matematici complessi che apprendono le proprie competenze analizzando enormi quantità di dati digitali. Non sono in grado — e non possono esserlo — di determinare cosa sia vero e cosa sia falso. A volte, semplicemente, si inventano le cose: un fenomeno che alcuni ricercatori nel campo dell’intelligenza artificiale chiamano «allucinazioni». In un test, i tassi di allucinazione dei sistemi AI più recenti hanno raggiunto il 79%.

 

Questi sistemi utilizzano probabilità matematiche per indovinare la risposta più probabile, non seguono un insieme rigoroso di regole definite da ingegneri umani. Di conseguenza, commettono inevitabilmente un certo numero di errori. «Nonostante tutti i nostri sforzi, continueranno sempre ad allucinare», ha dichiarato Amr Awadallah, CEO della start-up Vectara — che sviluppa strumenti AI per le aziende — ed ex dirigente di Google. «Questo non scomparirà mai.»

 

CHATGPT 3

Da diversi anni, questo fenomeno solleva preoccupazioni sulla affidabilità di tali sistemi. Sebbene siano utili in alcune situazioni — come scrivere tesine, riassumere documenti di lavoro e generare codice informatico — i loro errori possono causare problemi.

 

I bot dotati di intelligenza artificiale associati ai motori di ricerca come Google e Bing a volte producono risultati talmente errati da risultare ridicoli. Se gli si chiede una buona maratona sulla costa occidentale, potrebbero suggerire una gara a Philadelphia. Se devono fornire il numero di nuclei familiari in Illinois, potrebbero citare una fonte che non include affatto quell’informazione.

 

Tali allucinazioni potrebbero non rappresentare un problema per molti utenti, ma diventano una questione seria per chi utilizza queste tecnologie per documenti legali, informazioni mediche o dati aziendali sensibili.

 

intelligenza artificiale PSICOTERAPIA

«Si finisce per passare molto tempo a cercare di capire quali risposte siano effettivamente fondate e quali no», ha affermato Pratik Verma, cofondatore e CEO di Okahu, un’azienda che aiuta le imprese a gestire il problema delle allucinazioni. «Se non si affrontano correttamente questi errori, si annulla di fatto il valore dei sistemi di intelligenza artificiale, che dovrebbero servire proprio ad automatizzare le attività.»

 

[…]

 

Da oltre due anni, aziende come OpenAI e Google hanno costantemente migliorato i loro sistemi di intelligenza artificiale, riducendo la frequenza di questi errori. Tuttavia, con l’introduzione dei nuovi sistemi di ragionamento, gli errori stanno aumentando. Secondo i test condotti dalla stessa OpenAI, le versioni più recenti dei suoi sistemi producono allucinazioni con una frequenza maggiore rispetto al sistema precedente.

 

risposte senza senso date da chatgpt 5

La società ha rilevato che o3 — il suo sistema più potente — ha generato allucinazioni nel 33% dei casi durante il test benchmark PersonQA, che consiste nel rispondere a domande su personaggi pubblici. Si tratta di un tasso più che doppio rispetto a quello del sistema di ragionamento precedente, chiamato o1. Il nuovo sistema o4-mini ha mostrato un tasso di allucinazioni ancora più elevato: 48%.

 

In un altro test denominato SimpleQA, che prevede domande più generiche, i tassi di allucinazione di o3 e o4-mini sono saliti rispettivamente al 51% e al 79%. Il sistema precedente, o1, aveva un tasso del 44%.

 

In un documento che descrive questi test, OpenAI ha affermato che è necessaria ulteriore ricerca per comprendere le cause di questi risultati. Poiché i sistemi di intelligenza artificiale apprendono da una quantità di dati superiore a quella che un essere umano può comprendere, i tecnologi fanno fatica a spiegare perché tali sistemi si comportino in un certo modo.

 

CHATGPT - ROBOT PER RACCOGLIERE I POMODORI

[…] I test condotti da aziende indipendenti e da ricercatori indicano che i tassi di allucinazione stanno aumentando anche per i modelli di ragionamento sviluppati da società come Google e DeepSeek.

 

[…]

 

Nell’ultimo anno e mezzo, aziende come OpenAI e Google sono riuscite a ridurre tali percentuali all’1-2%. Altre, come la start-up Anthropic di San Francisco, si sono mantenute intorno al 4%. Tuttavia, i tassi di allucinazione in questo test sono tornati a salire con l’arrivo dei modelli di ragionamento. Il sistema R1 di DeepSeek ha allucinato nel 14,3% dei casi. Il modello o3 di OpenAI è salito al 6,8%.

 

[…]

 

intelligenza artificiale nel lavoro

Per anni, aziende come OpenAI si sono basate su un concetto semplice: più dati internet venivano forniti ai loro sistemi di IA, migliori sarebbero stati i risultati. Ma ormai hanno esaurito quasi tutti i testi in inglese disponibili online, e ciò le ha costrette a trovare nuovi modi per migliorare i loro chatbot.

 

Per questo, molte aziende stanno facendo sempre più affidamento su una tecnica nota come “apprendimento per rinforzo”. Con questo metodo, un sistema può apprendere comportamenti attraverso il metodo del tentativo e dell’errore. La tecnica funziona bene in alcuni ambiti, come la matematica e la programmazione informatica, ma si sta rivelando carente in altri.

 

risposte senza senso date da chatgpt 6

[…]

 

Un’altra questione è che i modelli di ragionamento sono progettati per “pensare” ai problemi complessi prima di fornire una risposta. Ma cercando di affrontare un problema passo dopo passo, rischiano di generare errori a ogni passaggio. Gli errori si sommano via via che il sistema “pensa” più a lungo.

 

I bot più recenti mostrano agli utenti ciascun passaggio del processo, il che significa che gli utenti possono anche vedere ogni singolo errore. I ricercatori hanno inoltre scoperto che, in molti casi, i passaggi visualizzati da un bot non hanno alcuna relazione con la risposta finale fornita.

 

«Ciò che il sistema dice di pensare non è necessariamente ciò che realmente pensa», ha affermato Aryo Pradipta Gema, ricercatore di intelligenza artificiale presso l’Università di Edimburgo e borsista presso Anthropic.

CHATGPT risposte senza senso date da chatgpt 4

Ultimi Dagoreport

giorgia meloni ignazio la russa antonio tajani fabio rampelli roberto occhiuto marina berlusconi cirielli

DAGOREPORT – IN QUELLA POLVERIERA CHE E' DIVENTATA L'ARMATA BRANCA-MELONI, LA MICCIA E' COLLEGATA A DUE EVENTI: L’ELEZIONE SUPPLETTIVA IN CALABRIA E IL VOTO A SCRUTINIO SEGRETO ALLA CAMERA SULLA LEGGE ELETTORALE (SPUNTERANNO FRANCO-TIRATORI TRA COLORO CHE SANNO DI NON ESSERE RICANDIDATI NEL 2027? CHE DECIDERANNO LE DONNE DI FORZA ITALIA INVEPERITE PER LA MANCATA ALTERNANZA DI GENERE?) – IL CASO CALABRESE, CON IL CANDIDATO DI VANNACCI CHE RUBA VOTI A FORZA ITALIA E RISCHIA DI FAR VINCERE IL PD, PUO’ ESSERE L’OCCASIONE CHE TAJANI ASPETTAVA DA TEMPO: REGOLARE I CONTI CON IL GOVERNATORE OCCHIUTO, SUO NEMICO INTERNO, SU CUI RICADREBBE LA COLPA DELLA SCONFITTA DI FABIO ROSCIOLI, TESORIERE DI LADY BERLUSCONI – SE LA FAIDA TRA GLI AZZURRI È PALESE, IN FDI DEVONO GESTIRE I MALUMORI DEI “RAS” LOCALI. A MILANO LA RUSSA NON DIGERISCE LA PROPOSTA DI CANDIDARE A SINDACO L’AZZURRO PEREGO, NOME NON SGRADITO A VIA DELLA SCROFA - IN CAMPANIA C’È LA ROGNA DEL VISPO CIRIELLI, L'EX COLONNELLO DI GIORGIA CHE INVOCA DI IMBARCARE VANNACCI NELLA COALIZIONE - NEL LAZIO IL MENTORE DELLE SORELLE MELONI, FABIO RAMPELLI, NON SOLO SI E' AUTOCANDIDATO A SINDACO DI ROMA IN BARBA AL PARTITO, MA SCALPITA PER PIAZZARE I SUOI "GABBIANI" NELLE PROSSIME LISTE ELETTORALI - STENDIAMO UN "PELO PIETOSO" SUL'ALTRO ALLEATO, LA LEGA SPROFONDATA AL 4,5% CON SALVINI APPESO A CIO' CHE POTRA' SUCCEDERE DOMENICA PROSSIMA SUL PRATONE DI PONTIDA...

roberto vannacci elly schlein giorgia meloni legge elettorale ballottaggio

DAGOREPORT! LA NUOVA LEGGE ELETTORALE È INCOSTITUZIONALE? MONTA IL DIBATTITO CON 160 COSTITUZIONALISTI CHE ANDRANNO AVANTI CON I RICORSI ALLA CORTE COSTITUZIONALE - LA SCOMMESSA DELLA MELONI: UNA VOLTA APPROVATA LA LEGGE, ANDARE AL VOTO A MAGGIO PER EVITARE IL GIUDIZIO DI INCOSTITUZIONALITA' DELLA CONSULTA – LA PROTESTA DEL CIVICO ONORATO SULLE FIRME RICHIESTE PER PRESENTARE LE LISTE (6MILA PER OGNI COLLEGIO): UNA NORMA CHE IN REALTA’ FA COMODO A FORZA ITALIA E NOI MODERATI IN FUNZIONE ANTI-ONORATO MA ANCHE ALLA SINISTRA, CHE SI METTEREBBE AL RIPARO DALLE NUOVE CREATURE POLITICHE (TIPO GRILLO) – VANNACCI AL 99% NON DOVREBBE AVER BISOGNO DI RACCOGLIERE LE 6MILA FIRME - L’ABNORME PREMIO DI MAGGIORANZA PER CHI ARRIVA AL 42%: NON NE PARLA NESSUNO NEL PD PERCHE’ FA COMODO ANCHE A SCHLEIN…

elly schlein giuseppe conte dario franceschini

DAGOREPORT - CONTRORDINE, COMPAGNI, LE PRIMARIE SI FARANNO INDIPENDENTEMENTE DALLA LEGGE ELETTORALE! CONTE HA DATO UN AUT AUT AGLI ALLEATI DEL CAMPO LARGO METTENDO I GAZEBO COME “CONDICIO SINE QUA NON” PER ESSERE NELL'ALLEANZA CON IL PD – MA LE PRIMARIE, OLTRE A ESSERE DIVISIVE, SONO UN GRAN CASINO SUL FRONTE REGOLAMENTARE: SARANNO APERTE O CHIUSE? CI SARA’ IL VOTO ONLINE? E PREVEDERANNO UN BALLOTTAGGIO? - PER ELLY, CHE TREMA PERCHÉ CONTE CON LA POSIZIONE SULL’UCRAINA DRENA VOTI AL PD SCESO AL 20%, I GAZEBO SONO DIVENTATI UN PROBLEMA ANCHE ALL’INTERNO DEL PARTITO (AL PUNTO CHE NON HA POTUTO CONCEDERE L’ENDORSEMENT A MARIO CALABRESI, CANDIDATOSI A SINDACO DI MILANO, PERCHÉ HA PAURA DI PERDERE I VOTI DI PIERFRANCESCO MAJORINO). COSI’ PER BLINDARSI E’ COSTRETTA A STRINGERE ACCORDI CON RENZI, FRANCESCHINI E ALTRI CAPATAZ DEM. MA NON ERA LEI CHE DICEVA “NON VOGLIAMO PIÙ CAPIBASTONE E CACICCHI?”

giorgia meloni tommaso longobardi giovanbattista fazzolari gian marco chiocci filini

DAGOREPORT - COME MAI GIORGIA MELONI HA FATTO “ROTOLARE LA TESTA” DEL SUO STRATEGA SOCIAL, TOMMASO LONGOBARDI? A POCHI MESI DALLE ELEZIONI, CON I SONDAGGI CHE DANNO IL CAMPO LARGO IN VANTAGGIO E VANNACCI CHE SCIPPA CONSENSI A DESTRA, LA DUCETTA SI È ACCORTA CHE LA PROPAGANDA DI PALAZZO CHIGI NON FUNZIONA PIÙ – LONGOBARDI ERA GIÀ FINITO NEL MIRINO DEL “CERCHIO TRAGICO” DELLA SORA GIORGIA DOPO LA DISFATTA AL REFERENDUM SULLA GIUSTIZIA, DOVE ERANO STATI DECISIVI I VOTI DEGLI ELETTORI PIÙ GIOVANI PER IL “NO” – ORA LA DUCETTA VUOLE UNA SVOLTA NELLA COMUNICAZIONE DEL GOVERNO E RICICCIA L’IDEA DI ASSOLDARE COME PORTAVOCE IL DIRETTORE DEL TG1, GIAN MARCO CHIOCCI. PICCOLO PARTICOLARE: CHIOCCI, FIN TROPPO AUTONOMO ED ESPERTO, SAREBBE UN “ACQUISTO” INDIGESTO PER FAZZOLARI E FILINI, IL DUO CHE GESTISCE LA MACCHINA COMUNICATIVA DI FDI – SI VOCIFERA CHE PALAZZO CHIGI PENSI A GINO ZAVALANI, VOLTO DI ESPERIA, PER RILANCIARE I SOCIAL – LA PRECISAZIONE DI ZAVALANI

giorgia meloni antonio tajani maurizio lupi alessandro onorato giuseppe conte matteo renzi roberto vannacci ignazio la russa

DAGOREPORT! - GIORGIA MELONI HA PAURA DI TORNARE ALLE URNE E VUOLE UNA NUOVA LEGGE ELETTORALE CHE AZZOPPI GLI AVVERSARI, A PARTIRE DALL’EMENDAMENTO “AMMAZZA-CESPUGLI” SULLA RACCOLTA DELLE FIRME - IL BLITZ E' UTILE A TAJANI, CESA E LUPI PER FERMARE ONORATO CHE POTREBBE ROSICCHIARE VOTI A FORZA ITALIA, UDC E NOI MODERATI - L'APPOGGIO DI CONTE ALL'ASSESSORE DI ROMA SEMBRA UN "BACIO DELLA MORTE": "PROGETTO CIVICO" STA DIVENTANDO "PROGETTO PEPPINIELLO"? - GLI OCCHI DEGLI ADDETTI AI LAVORI SULLE ELEZIONI SUPPLETIVE DI REGGIO CALABRIA PER IL SEGGIO ALLA CAMERA: VUOI VEDERE CHE IL CANDIDATO DI VANNACCI TOGLIERA' VOTI AL CENTRODESTRA E FARA' VINCERE IL PD?

vecchione renzi ranucci sgrena mancini draghi conte gabrielli carlo parolisi

TRA LE PIEGHE DELL’AFFAIRE LAVITOLA-RANUCCI, RICICCIA UNO DEI TANTI MISTERI ALL’ITALIANA: IL FAMOSO SERVIZIO DI ‘’REPORT’’ DEL MAGGIO 2021 SULL’INCONTRO IN AUTOGRILL TRA MATTEO RENZI E MARCO MANCINI, UNO DELLE FIGURE PIÙ CONTROVERSE DELL’INTELLIGENCE ITALIANA - ALL’ORIGINE DEL RENDEZ-VOUS AUTOSTRADALE, FORSE C’ENTRA DI PIÙ IL FATTO CHE STAVA CADENDO IL SECONDO GOVERNO CONTE, A CAUSA DEL RITIRO DALL'ESECUTIVO DI ITALIA VIVA. QUALCUNO DEVE AVER SCOMMESSO SULLE DOTI AFFABULATORIE DI NEGOZIATORE DI MANCINI PER CONVINCERE RENZI A TROVARE UNA QUADRA PER MANTENERE IN PIEDI CONTE – UNA VOLTA CHE LA MISSIONE E' ANDATA A VUOTO, PERCHE' RANUCCI MANDO' IN ONDA IL SERVIZIO RENZI-MANCINI BEN CINQUE MESI DOPO LA SEPOLTURA DEL GOVERNO CONTE II? A CHI GIOVAVA? - BEN SAPENDO DI QUANTO MANCINI SIA DETESTATO DAI SUOI COLLEGHI, RENZI DEFINI' LO SCOOP UN "REGOLAMENTO DI CONTI INTERNO AI SERVIZI SEGRETI" – GLI ''ADDETTI AI LIVORI'' AGGIUNGONO ALTRE DUE IPOTESI: CHI PARTENDO DAL BURRASCOSO RAPPORTO TRA RENZI E RANUCCI, CHI CONSIDERANDO LA VOGLIA DI CONTE DI REGOLARE I CONTI CON COLUI CHE SI VANTA DI AVERLO SLOGGIATO DA PALAZZO CHIGI E DI AVER CONVINTO DRAGHI A PRENDERE IL SUO POSTO…