Precisione e affidabilità

Clean verbatim o full verbatim: cosa toglie ciascun livello e quale ti dà davvero l'IA

Ogni modulo d’ordine per una trascrizione fa la stessa domanda, e chi ordina per la prima volta quasi sempre tira a indovinare. «Clean verbatim o full verbatim?» sembra un’impostazione di qualità. Non lo è. È una decisione su che cosa faccia fede: quello che la persona ha detto, o quello che intendeva dire. Sbagli da una parte e paghi una trascrizione che nessuno riesce a leggere; sbagli dall’altra e hai editato un testimone senza dirlo a nessuno.

Ecco gli stessi quindici secondi di parlato a ciascun livello, cosa toglie ogni livello, chi ha davvero bisogno di quale, e cosa hai realmente in mano quando un’IA ti consegna una trascrizione.

Una frase, tre trascrizioni

In una riunione di pianificazione qualcuno dice questo:

Full verbatim:

Io, ehm, io penso che noi… che dovremmo, cioè, rilasciare martedì. [ride] O, ecco, mercoledì. Mercoledì va bene.

Clean verbatim:

Io penso che dovremmo rilasciare martedì. O mercoledì. Mercoledì va bene.

Editata (a volte venduta come «intelligent verbatim»):

Penso che dovremmo rilasciare martedì o mercoledì.

La prima è una registrazione in forma di testo. La seconda è quello che chi parla firmerebbe. La terza è una parafrasi: più corta e più liscia, e non è più una citazione. Solo le prime due sono trascrizioni.

Cosa toglie ciascun livello

Le definizioni del settore sono abbastanza coerenti da stare in una tabella. Full verbatim, come lo definisce Rev, significa che «ogni singola parola pronunciata nel file audio viene scritta parola per parola»; clean verbatim significa che il file è stato «leggermente editato per una lettura agevole», senza parafrasi. Verificato a settembre 2026.

Rimosso?Full verbatimClean verbatimEditata
Suoni di esitazione: ehm, eh, mmmrestarimossorimosso
Intercalari: cioè, tipo, praticamenterestarimossorimosso
False partenze: «noi… che dovremmo»restarimossorimosso
Balbettii e parole ripetuterestarimossorimosso
Autocorrezioni: «martedì. O mercoledì»restarestafuso
«Sì», «mhm» degli altri parlantirestadi solito rimossorimosso
Non verbale: [ride], [tosse], [pausa]resta, etichettatorimossorimosso
Gergo e grammaticacome dettocome dettocorretti
Struttura della frasecome dettacome dettariscritta

Due righe risolvono la maggior parte delle discussioni. Le autocorrezioni restano nel clean verbatim: «O mercoledì. Mercoledì va bene» è chi parla che cambia idea a verbale, e tagliarlo cambia il significato. E la grammatica resta come detta: il clean verbatim toglie rumore, non sistema l’italiano. Nel momento in cui una trascrizione comincia a correggere la grammatica è passata all’editing, e non si può più mettere fra virgolette.

Chi ha bisogno del full verbatim, e quanto costa

Il full verbatim serve a chiunque la cui analisi dipenda da come è stata detta una cosa, non solo da cosa.

  • Procedimenti giudiziari. Un verbale di deposizione che elimina l’«eh, io… io non ricordo» di un testimone ha tolto proprio l’esitazione su cui un avvocato discuterà dopo. Gli stenografi giudiziari scrivono tutto esattamente per questo.
  • Ricerca qualitativa che codifica il parlato in sé. Analisi conversazionale, analisi del discorso, parte della psicologia e della linguistica: la pausa e la falsa partenza sono i dati.
  • Storia orale. Un archivio è una fonte. Ripulirlo equivale a ritoccare una fotografia in un fascicolo di prove.

Il costo è reale ed è stato misurato. Uno studio del 2022 su Emerging Themes in Epidemiology, basato su due trial di salute di comunità in Ghana, ha rilevato che la trascrizione verbatim richiedeva dalle 6 alle 10 ore per ogni ora di intervista, contro 1-2 ore per note ampliate dell’intervistatore. La conclusione non era «il verbatim serve sempre». Era che, per domande applicate relativamente semplici, note ben supervisionate bastavano, e che nei focus group, dove l’interazione stessa portava il significato, le note «non riuscivano a cogliere l’interazione e la ricchezza» e il verbatim restava necessario. Questa è la forma onesta della risposta: verbatim dove la trama è il risultato, non ovunque.

Chi ha bisogno del clean verbatim

Quasi tutti gli altri, ed è lo standard che la maggior parte dei servizi preventiva.

  • Trascrizioni di podcast e note dell’episodio. Nessuno apre la pagina di un podcast per gli «ehm».
  • Interviste per articoli. Da qui si cita, e il clean verbatim è ciò che una citazione dovrebbe essere: le parole di chi parla, meno il rumore che toglierebbe da sé. (Cosa si possa tagliare dentro una citazione è un’altra questione, con regole proprie: la trattiamo in cosa si può tagliare da una citazione.)
  • Verbali di riunione, lezioni, materiale di studio. Conta il contenuto, e ogni intercalare è un dosso.
  • Sottotitoli. I sottotitoli in full verbatim violano due volte la regola della velocità di lettura: gli intercalari mangiano caratteri e le false partenze diventano micro-battute a sé, uno dei difetti delle nostre regole di timing dei sottotitoli.

Cos’è davvero una trascrizione fatta dall’IA

È la parte che i moduli d’ordine non spiegano mai, quindi eccola senza giri di parole.

L’output grezzo dell’IA non è né l’una né l’altra. I modelli vocali sono addestrati in gran parte su audio sottotitolato, e i sottotitoli gli «ehm» non li scrivono. Così i modelli hanno imparato a non scriverli. Una trascrizione grezza di qualsiasi motore moderno conserva la maggior parte delle parole e lascia cadere una quota imprevedibile di esitazioni, balbettii e ripetizioni: più di quanto il full verbatim consenta, meno di quanto il clean verbatim richieda. Se uno standard legale o di ricerca dice «full verbatim», una trascrizione IA non rivista non lo soddisfa, qualunque cosa dica la pagina di marketing. Qualcuno deve confrontarla con l’audio.

Il clean verbatim è il terreno in cui l’IA è davvero brava, a una condizione. Speecho lo fa in due punti, e funzionano in modo diverso di proposito.

Il contatore di intercalari rimuove per lista: un insieme noto di suoni di esitazione e intercalari per ciascuna di 12 lingue, più quelli che aggiungi tu, più le ripetizioni immediate di parola. È gratis, gira nel browser ed evidenzia ogni singola occorrenza prima di rimuovere qualsiasi cosa, così vedi che il «tipo» di «un tipo di problema diverso» sta per sparire e lo rimetti. Non tocca le false partenze né le autocorrezioni, perché una lista di parole non sa distinguere «noi… che dovremmo» da una ripetizione voluta.

Dentro Speecho, lo stile di note Testo pulito (senza intercalari) fa il lavoro completo con un modello linguistico: intercalari, false partenze, balbettii e autocorrezioni immediate (tenendo la versione corretta), con la punteggiatura sistemata dove le rimozioni lo richiedono. Lavora paragrafo per paragrafo e ha l’istruzione di non riassumere, accorciare, riordinare o riformulare nient’altro. Quell’istruzione è tutta la differenza fra clean verbatim ed editing, ed è il motivo per cui il risultato va comunque letto una volta prima di pubblicarlo: un modello che segue una regola non è una persona che verifica una citazione.

Nessuno dei due dovrebbe mai produrre la terza colonna. Se uno strumento ti restituisce frasi più corte e più lisce di quelle pronunciate, ha editato, non ripulito, e attorno a quel risultato non puoi mettere le virgolette.

La regola pratica

Fatti una sola domanda: qualcuno dovrà mai discutere di come è stata detta questa cosa? Se sì, un tribunale, un comitato etico, uno storico futuro, tieni il full verbatim, tratta la trascrizione IA come una bozza e falla confrontare con l’audio. Se no, il clean verbatim è il documento giusto, ed è quello che l’IA produce bene: trascrivi, lancia la ripulitura, leggi una volta, pubblica.

In ogni caso, la trascrizione da conservare è quella grezza. Un file verbatim si può sempre ripulire. Uno già pulito non si può ri-sporcare.

Verificalo con il tuo audio Provalo con la tua registrazione peggiore → 15 minuti gratis · i crediti non scadono mai · nessun abbonamento

Continua a leggere

Precisione e affidabilità

Quanto è accurata la trascrizione AI nel 2026? Una risposta onesta

La trascrizione AI raggiunge il 90–97% di accuratezza sulle parole con audio pulito, ma il numero reale dipende dalla tua registrazione. Cosa lo sposta e come avvicinarsi alla perfezione.

14 lug 2026 · 8 min di lettura
Precisione e affidabilità

È sicuro caricare l'audio su uno strumento di trascrizione?

Interviste, sedute di terapia e riunioni del consiglio sono materiale delicato. Ecco cosa succede davvero al tuo audio quando lo trascrivi, e le domande da fare a qualsiasi strumento prima di caricare.

24 giu 2026 · 5 min di lettura
Come trascrivere

Cosa si può tagliare da una citazione: la regola AP, quella del Times e dove stanno le trascrizioni con IA

I manuali di stile delle redazioni concordano sul fatto che si possano togliere gli «ehm» e discordano su quasi tutto il resto. Cosa dicono davvero AP, il New York Times e il Washington Post sull'alterare una citazione, e perché una trascrizione con IA non verificata non è una fonte citabile.

3 set 2026 · 6 min di lettura

Trasforma la tua prossima registrazione in testo

Carica audio o video e ottieni trascrizione pulita, sottotitoli, riassunto e traduzione in pochi minuti.

Trascrivi il primo file gratis → 15 minuti gratis · i crediti non scadono mai · nessun abbonamento