Se usate ChatGPT dall’Europa, nelle prossime settimane i testi prodotti porteranno una sorta di watermark che non sarà mai visibile. L’annuncio arriva da OpenAI, che ha illustrato come intende adeguarsi alle norme europee sulla provenienza dei contenuti. Alla base c’è l’AI Act, che richiede ai fornitori di rendere identificabili da una macchina i testi generati. Ma in pratica, come opera questa filigrana invisibile?
Sommario
Cosa cambia per ChatGPT e Codex
L’adozione sarà progressiva. Nel corso delle prossime settimane OpenAI inserirà la filigrana nei testi idonei generati da ChatGPT e Codex. La misura riguarda gli utenti dell’Unione Europea, qualunque sia il piano utilizzato. Al debutto, però, fuori dall’Europa la filigrana non verrà impostata come opzione predefinita.
Diverso il caso delle API. Dal 5 ottobre, data dell’annuncio, i clienti di tutto il mondo possono abilitare la filigrana su alcuni modelli. Anche qui la scelta resta disattivata di default. Ogni cliente deciderà se integrarla nei propri obblighi di trasparenza. OpenAI sta inoltre collaborando con i partner cloud per ampliare la disponibilità nelle prossime settimane.
Come funziona textGrain
La tecnologia si chiama textGrain. Il sistema introduce un segnale statistico invisibile nelle selezioni lessicali del modello. Il rilevatore va a cercare quel segnale per stabilire se un passaggio contiene una filigrana di OpenAI. Stando ai test interni dell’azienda, il metodo ha pareggiato o superato gli altri approcci valutati, incluso SynthID per il testo. OpenAI afferma anche che la tecnologia sarà resa open source.
In condizioni ideali il sistema dà buoni risultati, ma l’uso reale è tutt’altra cosa. È la stessa azienda a riconoscerlo.
I limiti: testi brevi e modifiche
I dati aiutano a inquadrare il problema. Con un tasso di falsi positivi fissato all’1%, il rilevatore ha riconosciuto la filigrana in circa l’80% dei testi da 200 token. Salendo a 400 token, si arriva a circa il 95%. Si tratta di contenuti come quelli di psicologia. Con la matematica, invece, le prestazioni diminuiscono molto, perché lo spazio di scelta delle parole è più ristretto.
Anche le modifiche incidono parecchio. Su brani da 400 token, sostituire il 10% delle parole con sinonimi abbassa il rilevamento da circa il 92% a circa il 66%. Se le parole cambiate diventano il 25%, si scende al 17%. In sintesi, riscrivere un testo riduce in modo marcato la forza del segnale.
Per questo il rilevatore non sarà pubblico. Al momento l’accesso è limitato a ricercatori e organizzazioni esperte già approvati, che possono presentare domanda da subito. Le richieste verranno esaminate singolarmente, in conformità con il codice di condotta europeo sui contenuti generati dall’IA. Lo strumento indicherà soltanto se rileva una filigrana di OpenAI. Non rivelerà l’identità dell’utente e non mostrerà prompt né conversazioni.
La qualità dei testi cambia?
Una domanda naturale è se la filigrana peggiori le risposte. Per OpenAI, no. L’azienda ha messo a confronto Astra, il suo più recente modello di punta, con e senza filigrana. Non risultano differenze rilevanti.
Nell’Artificial Analysis Intelligence Index si passa da 49,57 a 49,76 punti. Su GPQA Diamond si scende dal 94,44% al 93,94%. Su BrowseComp il valore va dall’87,92% all’87,35%. Si tratta comunque di prove eseguite dalla stessa azienda.
Cosa non dice una filigrana
OpenAI sottolinea che questo segnale dice poco. Non misura quanta componente umana ci sia in un testo. Non determina a chi appartenga né di chi sia la responsabilità. Non identifica chi lo abbia generato e non verifica la veridicità del contenuto.
Soprattutto, il fatto che la filigrana manchi non dimostra che un testo sia stato scritto da una persona. Il brano può essere troppo breve, alterato o tradotto. Può provenire da un altro modello, oppure essere antecedente all’introduzione della filigrana.
Immagini e audio: strumenti già pubblici
Per immagini e audio il quadro è diverso. OpenAI utilizza già le Content Credentials, è allineata allo standard C2PA e integra filigrane invisibili SynthID. Gli strumenti di verifica, tra cui openai.com/verify e la Content Provenance API, restano disponibili a chiunque.
Un passo utile, ma incompleto
Di certo questa scelta va nella direzione della trasparenza richiesta dall’Europa. Tuttavia una filigrana che si indebolisce con pochi ritocchi non può rappresentare l’unica linea di difesa. La stessa OpenAI parla infatti di un approccio stratificato e di una tecnologia ancora immatura.
Rimane poi un problema concreto. Senza un rilevatore pubblico, per il momento l’utente comune non potrà controllare nulla. Resta da vedere come si muoveranno le altre aziende e in che modo evolveranno gli standard.






