OpenAI si prepara a introdurre una filigrana digitale invisibile nei testi generati da ChatGPT e Codex per gli utenti dell’Unione Europea, con l’obbiettivo di adeguarsi ai nuovi requisiti di trasparenza previsti dall’AI Act europeo. La novità arriverà nelle prossime settimane e riguarderà gli output idonei, indipendentemente dal piano utilizzato.

L’azienda ha spiegato che la decisione nasce dalla necessità di rendere il testo generato dall’intelligenza artificiale identificabile in un formato leggibile dalle macchine, come richiesto dalla normativa europea. Al tempo stesso, OpenAI sottolinea che le attuali tecnologie di filigranatura e rilevamento presentano ancora diversi limiti e che, proprio per questo, l’implementazione sarà inizialmente circoscritta all’Europa.

Segui TuttoTech.net su Google Discover

Come funziona la filigrana di OpenAI

La tecnologia utilizzata da OpenAI si chiama textGrain e inserisce un segnale statistico invisibile nelle scelte delle parole effettuate dal modello. Un apposito rilevatore può successivamente analizzare un testo e verificare la presenza di questo segnale, senza però poter risalire all’utente, all’account, alla conversazione o ai messaggi che hanno prodotto il contenuto.

Secondo le valutazioni condivise dall’azienda, textGrain ha raggiunto prestazioni pari o superiori rispetto ad altri sistemi testati, tra cui SynthID per il testo; OpenAI precisa però che i risultati ottenuti in condizioni controllate non garantiscono necessariamente la stessa affidabilità nell’utilizzo quotidiano.

Il limite emerge soprattutto quando il testo è breve oppure quando lascia poca libertà nella scelta delle parole. Con un tasso di falsi positivi dell’1%, il sistema ha rilevato la filigrana in circa l’80% dei passaggi da 200 token e in circa il 95% di quelli da 400 token nel caso di contenuti di psicologia. Le prestazioni risultano invece sensibilmente inferiori con contenuti come quelli matematici, dove la possibilità di modificare la scelta delle parole è più limitata.

Anche la modifica successiva del testo può indebolire il segnale, nei test condotti sui passaggi da 400 token, la sostituzione del 10% delle parole con sinonimi ha fatto scendere il rilevamento da circa il 92% al 66%, mentre sostituendo il 25% delle parole il dato è sceso al 17%.

Nonostante l’introduzione della filigrana, OpenAI non ha rilevato differenze significative nelle prestazioni del proprio modello di punta Astra nei benchmark utilizzati per le valutazioni, confrontando i risultati con e senza watermarking.

Un aspetto particolarmente importante riguarda ciò che la filigrana non permette di stabilire, la sua presenza può indicare che un sistema OpenAI ha generato o elaborato una parte del testo, ma non permette di determinare quanto sia stato importante il contributo umano attraverso editing, creatività o capacità decisionale.

Allo stesso modo, il segnale non stabilisce chi possieda il contenuto, se il suo utilizzo sia stato lecito oppure chi debba essere considerato responsabile del testo. Non consente inoltre di identificare l’utente o collegare il contenuto a uno specifico account, messaggio o conversazione.

Anche l’assenza di una filigrana rilevata non dimostra automaticamente che un testo sia stato scritto da una persona, un contenuto generato da OpenAI potrebbe infatti essere troppo breve, essere stato modificato o tradotto, oppure provenire da un modello non supportato dalla tecnologia di rilevamento.

Per questo motivo, OpenAI non renderà inizialmente pubblico il proprio rilevatore, l’accesso sarà riservato a ricercatori e organizzazioni di esperti approvati, che potranno contribuire alla valutazione e al miglioramento della tecnologia.

Per gli utenti europei, invece, la filigrana invisibile sarà aggiunta nelle prossime settimane ai testi idonei generati con ChatGPT e Codex. A livello globale, la tecnologia resterà per ora disattivata di default, mentre i clienti API potranno scegliere di abilitarla per determinati modelli. OpenAI prevede inoltre di rendere textGrain open source, così da permettere ad altri soggetti di studiarlo e svilupparlo ulteriormente.

La società considera questa iniziativa parte di un approccio più ampio alla provenienza dei contenuti generati dall’intelligenza artificiale, che comprende già sistemi per immagini e audio e che, come sempre, dovrà continuare a evolversi insieme alla tecnologia, agli standard e alle nuove esigenze normative.