Provenienza e rilevamento 7 min di lettura

Cos'è SynthID e cosa cambia per il doppiaggio audio

Una filigrana non udibile nell'audio AI che sopravvive a tagli, cambi di velocità e conversioni. Cosa fa davvero, e chi può leggerla.

SynthID è una filigrana per i contenuti generati dall'intelligenza artificiale, sviluppata da Google DeepMind. Nell'audio viene inserita direttamente nel suono invece di essere allegata come metadato, è impercettibile per gli ascoltatori ed è progettata per resistere alle modifiche che di solito distruggono i marcatori.

ElevenLabs, le cui API di doppiaggio gestiscono questo sito, ha iniziato ad aggiungerla all'audio generato nel 2026. Il loro annuncio, pubblicato nella settimana del 25 giugno 2026 e aggiornato l'ultima volta il 9 agosto, specifica che hanno "iniziato a includere SynthID nelle generazioni Text to Speech per gli utenti gratuiti" e che avrebbero "esteso la copertura a tutte le generazioni audio di ElevenLabs nelle settimane successive".

Se sei qui perché vuoi rimuoverne una, passa direttamente all'ultima sezione. La risposta breve è che non puoi farlo, mentre quella più lunga spiega perché probabilmente non dovresti nemmeno volerlo.

In cosa si differenzia dai metadati?

I metadati si trovano accanto a un file. Una filigrana di questo tipo si trova invece all'interno del segnale stesso.

Questa distinzione è il fulcro di tutto. I metadati si rimuovono facilmente: basta ricodificare il file, rimuovere i tag o registrare lo schermo durante la riproduzione per eliminare il marcatore senza alterare l'audio. Chiunque voglia nascondere l'origine di un file può farlo con un solo comando.

SynthID è integrata nell'audio stesso tramite modifiche troppo impercettibili per essere notate da un ascoltatore, ma rilevabili da un modello che sa cosa cercare. Rimuoverla significherebbe danneggiare l'audio.

ElevenLabs dichiara che le filigrane "rimangono anche quando le clip vengono tagliate, velocizzate, private dei metadati o convertite in un tipo di file diverso", e afferma che resistono al ritaglio e ad altre trasformazioni comunemente diffuse online.

Quindi i soliti trucchi non funzionano. Convertire un file da WAV a MP3 non la elimina. E non serve a nulla nemmeno tagliare i primi 10 secondi, cambiare la velocità o rimuovere ogni singolo tag dal file.

Chi può leggerla?

Chiunque, ed è proprio questo l'aspetto che le persone non si aspettano.

ElevenLabs mette a disposizione un rilevatore audio gratuito all'indirizzo elevenlabs.io/app/audio-detector. Questo strumento verifica prima la presenza della filigrana e, se non la trova, passa al precedente AI Speech Classifier. Non serve avere un account collegato a chi ha generato il file e non serve nemmeno l'originale.

Si tratta di una vera e propria svolta per la tracciabilità dell'origine. In passato, il rilevamento dipendeva dal fatto che un ascoltatore notasse qualcosa di strano, o che un classificatore indovinasse le caratteristiche acustiche: due metodi inaffidabili e destinati a peggiorare con il miglioramento dei modelli. Una filigrana è una prova di tipo diverso: o c'è o non c'è.

Cosa non fa

Ci sono quattro limiti che vale la pena sottolineare, poiché spesso se ne esagerano le capacità.

Non ti identifica. La filigrana segnala solo che l'audio è stato generato da un sistema specifico. Non è una firma che collega un file a un account, e leggerla non rivela a chi la analizza chi lo ha creato.

Non copre l'audio di altri sistemi. Funziona in base al fornitore. Un rilevatore progettato per la filigrana di un determinato servizio non dirà nulla di utile su un file generato altrove, e un file senza filigrana non prova affatto che si tratti di una registrazione umana. È semplicemente un'assenza.

Non resiste a tutto. Sopravvivere alla normale gestione non significa essere indistruttibile. Qualsiasi filigrana può essere degradata da un'elaborazione sufficientemente aggressiva, ma la vera domanda pratica è se il processo necessario per rimuoverla non finisca per rovinare anche l'audio. Questo è l'obiettivo del progetto, non una garanzia assoluta.

Non ti dice se un doppiaggio è autorizzato. La provenienza non è un'autorizzazione. Un doppiaggio con filigrana di un tuo video va benissimo. Un doppiaggio senza filigrana del materiale protetto da diritto d'autore di qualcun altro costituisce comunque una violazione. Il marcatore descrive come è stato realizzato qualcosa, non se avevi il diritto di farlo.

Perché sta succedendo proprio ora?

Perché viene imposto per legge, e la tempistica non è un caso.

L'articolo 50 del regolamento europeo sull'intelligenza artificiale (AI Act) è diventato applicabile il 2 agosto 2026. Richiede ai fornitori di sistemi di IA che generano audio, immagini, video o testi sintetici di garantire che l'output sia "marcato in un formato leggibile meccanicamente e rilevabile come generato o manipolato artificialmente".

Se lo leggi come un requisito tecnico, ottieni esattamente ciò che è SynthID: un marcatore che una macchina può rilevare, legato al contenuto e non al contenitore del file, abbastanza resiliente da sopravvivere alla normale gestione.

Questo obbligo ricade sui fornitori del sistema di IA, non su di te in quanto creator che lo utilizza. I tuoi obblighi sono diversi e generalmente più limitati, e abbiamo già spiegato quando devi effettivamente etichettare un video doppiato con l'AI, inclusa la questione a parte relativa a ciò che richiede YouTube.

L'audio doppiato con questo servizio la contiene?

Non risponderemo a questa domanda con un'affermazione netta, perché non disponiamo di una fonte certa.

Il post sul lancio pubblicato da ElevenLabs non menziona il doppiaggio (Dubbing) tra i prodotti coperti al momento della stesura di questo articolo, e l'articolo del loro centro assistenza che descrive la copertura attuale non è accessibile pubblicamente. Qualsiasi dichiarazione faremmo in un senso o nell'altro sarebbe un'ipotesi presentata come un dato di fatto, e questo è esattamente il tipo di domanda in cui un errore può causare danni reali a chi si affida a queste informazioni.

Quello che possiamo dirti è come verificarlo per il tuo file: passalo nel rilevatore Audio Detector di ElevenLabs. È gratuito, richiede un minuto e risponde alla domanda sul file specifico in tuo possesso.

Il nostro articolo più ampio che spiega se qualcuno può accorgersi che il tuo video è doppiato con l'AI separa le tre domande che le persone spesso confondono, poiché un ascoltatore, una piattaforma e un rilevatore forniscono tre risposte diverse.

Per quanto riguarda l'input: non raccogliamo mai campioni vocali. Non esiste una fase di registrazione o un profilo vocale memorizzato, poiché l'endpoint di caricamento accetta un file e una delle 32 lingue di destinazione, nient'altro. Non devi nemmeno dichiarare la lingua di origine, poiché viene rilevata direttamente dall'audio.

Si può rimuovere una filigrana audio AI?

No, e non ti aiuteremo a provarci.

L'elaborazione che degraderebbe una filigrana di questo tipo danneggerebbe anche l'audio, annullandone lo scopo. E la vera domanda da farsi è perché dovresti volerlo fare.

Se stai doppiando i tuoi contenuti, una filigrana non ti costa nulla. Contrassegna l'audio come generato dall'AI, il che è vero e non è un segreto per nessuno. YouTube esonera esplicitamente dall'obbligo di dichiarazione il doppiaggio della propria voce, e l'obbligo sui deepfake dell'Unione Europea riguarda i contenuti che "potrebbero apparire falsamente autentici a una persona", cosa che una traduzione delle tue stesse parole non fa.

Se rimuoverla dovesse esserti utile, l'unico scopo sarebbe quello di spacciare un audio sintetico per qualcosa che non è. Questo è esattamente il caso d'uso per cui esiste la filigrana, e non scriveremo una soluzione per aggirarla.

Altre letture consigliate

Se stai pianificando un lavoro di doppiaggio, le guide specifiche per lingua coprono l'aspetto pratico: doppiare i video di YouTube dall'italiano al coreano è una delle combinazioni in cui la qualità della voce sintetica viene esaminata più attentamente, doppiare i video di marketing dall'italiano al portoghese è un'altra, e l'indice dei casi d'uso contiene tutte le altre.

Domande frequenti

Cos'è SynthID?

Una tecnologia di filigrana di Google DeepMind che inserisce un marcatore impercettibile nei contenuti generati dall'AI. Nell'audio risiede all'interno del segnale anziché nei metadati, quindi resiste a conversioni e modifiche che rimuoverebbero un tag.

ElevenLabs inserisce la filigrana nell'audio?

ElevenLabs ha iniziato a includere SynthID nell'audio generato nel 2026, a partire dal Text to Speech per gli utenti gratuiti nella settimana del 25 giugno, dichiarando che l'avrebbe estesa a tutte le generazioni audio. Il loro post pubblicato non menziona specificamente il doppiaggio (Dubbing), quindi ti consigliamo di verificare un determinato file con il loro rilevatore gratuito Audio Detector anziché dare la cosa per scontata.

Si può rimuovere una filigrana audio AI?

Non tramite le normali modifiche. ElevenLabs dichiara che la filigrana resiste a tagli, variazioni di velocità, rimozione dei metadati e conversioni di formato. Un'elaborazione abbastanza aggressiva da comprometterla finirebbe per degradare anche l'audio.

La presenza di una filigrana significa che il mio doppiaggio non è autorizzato?

No. Una filigrana indica solo come è stato realizzato l'audio, non se avevi il diritto di farlo. Doppiare i propri contenuti va benissimo e continua a essere corretto indipendentemente dal fatto che l'output sia marcato o meno.

Continua a leggere

Pronto per diventare globale?

Inizia a tradurre i tuoi file audio e video in 32 lingue oggi stesso.

Inizia a doppiare ora