Anche ChatGPT ci farà capire se un testo è stato scritto dall’intelligenza artificiale

Immagine
OpenAI ha appena annunciato l’introduzione di una nuova filigrana testuale che permetterà di identificare i contenuti generati dall’IA. La novità rappresenta un adeguamento alle normative europee in fatto di trasparenza e riconoscibilità, tuttavia capire con assoluta certezza se un articolo o un saggio sia stato scritto da una macchina resta ancora piuttosto complesso.

Anche OpenAI si prepara a introdurre una filigrana invisibile per segnalare i testi generati dall'intelligenza artificiale. La novità verrà applicata sicuramente in Unione Europea, dove lo scorso 2 agosto sono entrate in vigore le nuove regole dell'AI ACT sulla riconoscibilità dei contenuti generati dall'IA. Con questa mossa, l'azienda di Sam Altman consentirà ai vari detector di individuare più facilmente i contenuti sintetici senza la necessità di inserire simboli o elementi visibili all'interno del testo. La filigrana sarà introdotta nelle prossime settimane per gli utenti idonei di ChatGPT e Codex, indipendentemente dal piano utilizzato. Per gli sviluppatori che utilizzano l'API di OpenAI, la funzione è invece disponibile già da subito su alcuni modelli, ma deve comunque essere attivata manualmente.

L'azienda di Sam Altman si accoda dunque alle scelte di Anthropic e Google, le quali avevano già integrato un simile watermark nei testi e nelle immagini generate dai loro modelli.

Come funziona la filigrana textGrain di OpenAI

I modelli non aggiungono elementi nascosti o una firma grafica al documento, ma intervengono direttamente sulla scelta delle parole effettuata dal modello durante la generazione. La tecnologia, descritta nel rapporto tecnico di OpenAI e denominata textGrain, utilizza una chiave segreta per ordinare le possibili parole successive e orientare le scelte del modello. In pratica è tutta una questione statistica. Per il lettore (o per chi genera il contenuto), il testo appare del tutto normale, senza particolari forme o scelte stilistiche. Nel risultato finale, però, la sequenza delle centinaia di parole che lo compongono definisce uno schema. Un rilevatore che conosce la chiave di tale schema può quindi stabilire se il testo ricalca le scelte tipiche del modello IA. Essendo incorporato nelle parole, tale segnale che denuncia l'origine sintetica rimane presente anche quando il contenuto viene semplicemente copiato e incollato. OpenAI ha però affermato che il sistema non consente di identificare l'utente che ha generato il contenuto.

Uno strumento utile, ma non infallibile

La nuova tecnologia punta a rispettare le norme europee sopracitate in fatto di trasparenza e riconoscibilità dell'IA, tuttavia non rappresenta un metodo definitivo per stabilire l'origine di un testo. Secondo quanto riporta il sito Tech Crunch, gli stessi test condotti da OpenAI mostrano che la filigrana può essere indebolita attraverso modifiche relativamente limitate. In una prova, la sostituzione del 10% delle parole con sinonimi ha fatto scendere il rilevamento dal 92% al 66%. Anche testi molto brevi, soluzioni di problemi matematici e contenuti tradotti risultano più difficili da classificare. Per questo OpenAI prevede inizialmente di limitare l'accesso al rilevatore a ricercatori e organizzazioni specializzate, con l'obiettivo di valutarne affidabilità e utilizzo responsabile.

Ad ogni modo, individuare con certezza se un testo sia stato generato da una macchina resta, almeno per ora, un compito molto complesso. Al di là dell'attendibilità dei diversi detector disponibili online, nessuno dei quali può garantire risultati accurati al 100%, esiste infatti un problema di fondo. Lo stile di scrittura umano può facilmente sovrapporsi alle scelte linguistiche di un'intelligenza artificiale. I modelli, del resto, vengono addestrati su milioni di testi scritti da persone e hanno quindi imparato a riprodurne strutture, lessico e modalità espressive. È proprio questa sovrapposizione a rendere difficile distinguere con certezza un testo scritto da un essere umano da uno generato dall'AI. È un argomento che su Fanpage.it abbiamo discusso con Raffaele Gaito, divulgatore e creator convinto che la caccia ai testi generati dall'IA sia un falso problema. Vi lasciamo qui l'articolo.

Non solo, come sottolineato dalla stessa OpenAI, anche l'eventuale assenza della filigrana non dimostra comunque con assoluta certezza che un testo sia stato scritto da una persona in carne e ossa. Il segnale potrebbe non essere rilevabile perché il contenuto è troppo breve, è stato modificato in modo sostanziale oppure è stato prodotto da un sistema di intelligenza artificiale diverso. Allo stesso modo, la presenza della filigrana può indicare che un sistema OpenAI ha generato o elaborato una parte del contenuto, ma non permette di stabilire quanta attività umana sia intervenuta nella stesura, nella revisione o nella creatività finale.

autopromo immagine
Più che un giornale
Il media che racconta il tempo in cui viviamo con occhi moderni
api url views