Da ieri chiunque può controllare se un’immagine, un video o un file audio è stato generato con l’intelligenza artificiale di Google. L’azienda ha aperto al pubblico SynthID Detector, lo strumento che cerca le filigrane invisibili inserite dai suoi modelli. Due giorni prima OpenAI aveva annunciato che marchierà anche i testi scritti da ChatGPT per gli utenti dell’Unione europea, per rispettare le regole comunitarie.
Come funziona SynthID Detector
Il portale si trova su synthid.com e accetta file JPG, PNG, MP4 e MP3. Riconosce i contenuti creati con Gemini, Veo e Lyria e quelli dei partner che usano la stessa tecnologia per immagini e video, tra cui OpenAI, Nvidia e Kakao. Google dice che presto si aggiungerà anche Apple. La verifica è già integrata in Google Search, nell’app Gemini e in Chrome, dove arriva un milione di richieste al giorno. Secondo l’azienda, le immagini e i video marchiati con SynthID sono oltre 180 miliardi.
SynthID Detector, però, riconosce solo le filigrane SynthID. Un contenuto creato con un modello che usa un altro sistema, o nessuno, non verrà segnalato. Gli strumenti degli altri fornitori hanno lo stesso problema e di solito verificano solo i propri marchi.
OpenAI e i testi di ChatGPT in Europa
Per il testo OpenAI usa un sistema proprio, textGrain, che inserisce un segnale statistico invisibile nella scelta delle parole. Nelle prossime settimane l’azienda lo attiverà per chi usa ChatGPT e Codex nell’Unione europea. Per le API la filigrana sarà facoltativa in tutto il mondo, anche attraverso partner cloud come Microsoft Azure. Anthropic ha fatto una scelta diversa: la filigrana sui testi di Claude è obbligatoria ovunque, comunque si acceda al modello. OpenAI ha annunciato che pubblicherà textGrain come open source.
Quanto è affidabile la filigrana sul testo
I dati diffusi da OpenAI mostrano che il riconoscimento dipende dalla lunghezza del brano e dall’argomento. Con una soglia di falsi positivi dell’1%, il rilevatore ha trovato la filigrana nel 95% circa dei passaggi da 400 token su temi di psicologia e nell’80% circa di quelli da 200 token. Sui testi di matematica, dove il modello ha meno libertà nella scelta delle parole, i risultati sono stati molto più bassi.
Basta ritoccare il testo per abbassare il rilevamento. Se sostituisci con sinonimi il 10% delle parole di un passaggio da 400 token, la percentuale scende da circa il 92% al 66%. Cambiando un quarto delle parole si arriva al 17%. OpenAI precisa che una filigrana trovata non dice chi ha scritto il testo, quanto lo ha rivisto una persona o se è corretto. Non trovarla, d’altra parte, non dimostra che l’autore sia umano: il brano può essere troppo corto, tradotto, modificato o prodotto da un modello che il rilevatore non conosce.
Chi potrà usare il rilevatore di OpenAI
Per ora l’accesso è riservato a ricercatori e organizzazioni specializzate, che devono fare domanda con un modulo. OpenAI valuta ogni richiesta caso per caso nel quadro del codice di buone pratiche europeo. Il rilevatore risponde solo se ha trovato una filigrana OpenAI e non mostra dati sugli utenti, sui prompt o sulle conversazioni. L’azienda giustifica la stretta con il rischio di errori in entrambe le direzioni e dice che allargherà l’accesso quando i risultati potranno essere interpretati in modo responsabile, senza indicare una data. Anche Anthropic concede la sua API di rilevamento in modo selettivo. Per immagini e audio restano pubblici gli strumenti di OpenAI, compresa la pagina openai.com/verify.
Cosa prevede l’AI Act
L’articolo 50 del regolamento europeo sull’intelligenza artificiale divide gli obblighi in due. I fornitori di sistemi generativi, come OpenAI e Google, devono marcare i contenuti prodotti in un formato leggibile dalle macchine. Chi usa l’AI per pubblicare testi che informano il pubblico su questioni di interesse generale deve dichiararlo, salvo che il testo sia passato da una revisione umana e che qualcuno se ne assuma la responsabilità editoriale. Per redazioni, uffici stampa e aziende italiane la filigrana resta quindi un obbligo del fornitore, mentre la dichiarazione al lettore, quando serve, spetta a chi pubblica.
Fonti: The Decoder su SynthID Detector, The Decoder su textGrain, OpenAI, Regolamento (UE) 2024/1689.



