OpenAI introdurrà una filigrana invisibile nei testi generati da ChatGPT e Codex destinati agli utenti dell’Unione Europea.
La misura, annunciata nella giornata di ieri, arriva nell’ambito degli obblighi di trasparenza previsti dall’AI Act europeo e punta a rendere riconoscibili i contenuti prodotti dai sistemi di Intelligenza Artificiale senza modificare il testo in modo visibile. La tecnologia non aggiunge simboli o marcatori grafici: interviene invece sulla scelta delle parole, creando uno schema rilevabile da strumenti specifici.
OpenAI afferma che il sistema non permette di identificare l’utente e che l’attivazione non ha prodotto cambiamenti significativi nelle prestazioni dei modelli. La novità riguarda esclusivamente l’Unione Europea nella fase iniziale.
Come funziona la nuova filigrana di OpenAI
La filigrana sarà introdotta nelle prossime settimane per gli utenti idonei di ChatGPT e Codex, indipendentemente dal piano utilizzato.
Per gli sviluppatori che impiegano l’API di OpenAI, la funzione può invece essere attivata da subito su alcuni modelli, ma rimane disabilitata per impostazione predefinita e non diventa un’impostazione globale.
La scelta tecnica è descritta nel rapporto dedicato a textGrain, pubblicato insieme all’annuncio. Il metodo utilizza una chiave segreta per influenzare la selezione delle parole successive durante la generazione. L’effetto cumulativo consente a un rilevatore di individuare il modello statistico presente nel testo. Poiché il segnale è incorporato nelle parole, rimane associato al contenuto anche dopo un’operazione di copia e incolla.
La rilevazione, tuttavia, non è infallibile. Nei test di OpenAI, la sostituzione del 10% delle parole con sinonimi ha ridotto la capacità di riconoscimento dal 92% al 66%. Anche testi molto brevi, risposte matematiche e contenuti tradotti risultano più difficili da classificare. Per questo l’azienda limiterà inizialmente l’accesso al rilevatore a ricercatori approvati e organizzazioni specializzate, così da valutarne affidabilità e impieghi responsabili. OpenAI precisa inoltre che l’assenza della filigrana non dimostra che un testo sia stato scritto da una persona: il segnale può mancare dopo modifiche consistenti, quando il contenuto è troppo breve oppure se il testo proviene da un altro sistema di AI.
La filigrana entra nel quadro dell’AI Act
La decisione si inserisce in un quadro normativo più ampio. Le regole sulla trasparenza dell’AI Act sono entrate in vigore il 2 agosto e richiedono che i contenuti generati dall’AI possano essere riconosciuti da altri sistemi.
OpenAI non è l’unica azienda ad adottare questa strada: Anthropic ha già annunciato un watermark per i testi prodotti da Claude, applicata a livello mondiale. Nel frattempo, Anthropic, Google, Meta e Microsoft hanno aderito al codice di buone pratiche dell’Unione Europea sui contenuti generati dall’AI. La scelta di OpenAI segna quindi un passaggio dalla sperimentazione tecnica all’applicazione concreta delle regole europee, ma lascia aperta la questione dell’affidabilità dei rilevatori quando il testo viene modificato o rielaborato.
Per OpenAI, il nuovo sistema introduce dunque un livello aggiuntivo di tracciabilità che non dipende da un elemento grafico facilmente eliminabile. La sua efficacia pratica dovrà però essere valutata soprattutto nei casi in cui il contenuto viene riscritto, tradotto o integrato con interventi umani.