RisorseTrascrizione di file

Come trascrivere un’intervista con etichette dei parlanti su Mac

Aggiungi etichette dei parlanti a un’intervista, verifica chi ha detto ogni passaggio, correggi le attribuzioni ed esporta la conversazione rivista.

2026-10-04 · 7 min
Due partecipanti all'intervista si fronteggiano, con nastri vocali blu e terracotta che conducono a paragrafi alternati di trascrizione.

La risposta breve

Per trascrivere un'intervista e distinguere le persone che parlano, utilizzare la trascrizione del file con la diarizzazione dell'oratore (etichettatura dell'oratore) abilitata. Aggiunge le etichette degli oratori a parti del testo riconosciuto, aiutandoti a rivedere una domanda e la relativa risposta senza considerare l'intera registrazione come un'unica voce. Preparare le risorse per il riconoscimento e il relatore prima di iniziare, quindi riascoltare per verificare i compiti.

Alison Workspace supporta questo flusso di lavoro per file audio e video leggibili su un dispositivo Apple-silicon Mac, M1 o successivo, con macOS 15 o successivo. Puoi selezionare un numero previsto di persone che parlano, rivedere la trascrizione generata, modificare l'assegnazione dell'oratore di un paragrafo, rinominare le etichette ed esportare il testo. Inizia con uno scambio chiaro tra l'intervistatore e l'ospite piuttosto che giudicare il risultato dalla musica o da più persone che parlano insieme.

Cosa indicano le etichette dei parlanti

Il riconoscimento vocale chiede cosa è stato detto. La diarizzazione dell'oratore chiede quale voce ha parlato durante una parte della registrazione. Una trascrizione può contenere parole corrette con l'oratore sbagliato o un'etichetta dell'oratore corretto allegata a una frase riconosciuta in modo errato. Esamina entrambe le dimensioni.

Le etichette iniziali distinguono le voci all’interno della registrazione. Non forniscono automaticamente nomi verificati né dimostrano che una persona in un altro file sia la stessa. Le caratteristiche vocali aiutano a raggruppare i passaggi per parlante; verificare l’identità reale è un compito separato.

La separazione degli interlocutori in questa guida indica il testo etichettato. Ciò non significa esportare un file audio isolato per ciascun partecipante o rimuovere la voce di una persona da uno scambio sovrapposto. Decidi se hai bisogno di una registrazione di conversazione leggibile o di tracce audio separate prima di scegliere un flusso di lavoro.

Prepara una registrazione che puoi verificare

Utilizza la migliore registrazione originale disponibile, con parlato facile da ascoltare. Evita di creare una copia compressa semplicemente per ridurne le dimensioni se l'originale è già importato. Un ospite che parla a bassa voce, musica di sottofondo e voci provenienti da microfoni diversi possono aumentare il lavoro necessario per verificare il risultato.

Ascolta prima un breve scambio. Nota quante persone parlano effettivamente, inclusa un'introduzione o una domanda da parte del produttore, se presente. Sapere che l'intervista principale ha due partecipanti non dimostra che ogni parte del file abbia solo due voci.

Se sono già disponibili registrazioni separate dei partecipanti, conservarle come riferimenti. Il flusso di lavoro corrente etichetta il file importato; non descrive l'unione automatica di tracce partecipanti separate in una conversazione sincronizzata. Assicurati di utilizzare registrazioni che puoi trascrivere e conservare.

Prepara la distinzione dei parlanti e il numero previsto

La separazione degli interlocutori ha risorse oltre al riconoscimento vocale. Nella finestra di trascrizione dei file di Alison, abilita l'opzione dell'parlante e segui la richiesta di disponibilità del modello. L'attivazione di un'impostazione senza risorse utilizzabili non è la prova che il record finale conterrà etichette.

Il menu di conteggio offre una stima automatica e conteggi noti da 2 a 6. Per un'intervista autenticamente tra due persone, la scelta di 2 indica al processo quante voci raggruppare. Se non sei sicuro, usa la modalità automatica e controlla il risultato. Il menu di conteggio noto è un intervallo di impostazione, non un limite misurato sul numero che la modalità automatica può gestire.

Un conteggio è una guida, non una garanzia. Se appare una terza voce, o se una persona cambia microfono o stile di conversazione, un conteggio fisso errato può raggruppare male i passaggi. Controlla la registrazione completa invece di dare per scontato che l'apertura stabilisca ogni oratore.

Trascrivi il file dell’intervista

Scegli la lingua di riconoscimento per il discorso vero e proprio. Se hai bisogno di una traduzione, seleziona la sua destinazione in modo indipendente e conferma che la coppia richiesta è disponibile. Puoi lasciare disattivata la traduzione mentre controlli i nomi e le assegnazioni dei relatori nella lingua originale.

  1. Aggiungi il file audio o video dell'intervista alla coda di trascrizione.
  2. Verificare la durata del file accettato e selezionare la lingua parlata.
  3. Preparare le risorse necessarie per il riconoscimento; il rilevamento automatico della lingua richiede un modello locale compatibile.
  4. Abilitare la diarizzazione degli oratori (etichettatura degli oratori) e preparare le risorse degli oratori richieste.
  5. Scegli un numero noto di persone che parlano quando giustificato o lascialo in automatico, quindi avvia la trascrizione.
  6. Aprire il risultato e riprodurre i passaggi di ciascun partecipante prima di accettare le etichette.

Lascia che lo stato del file indichi se l'elaborazione è stata completata. Se il risultato è parziale, rivedere solo la parte elaborata e gestire il resto mancante prima di presentarlo come intervista completa.

Correggi le attribuzioni prima di aggiungere nomi

Individua una frase chiara per ciascuna voce e riproduci l'audio. Stabilire quale etichetta iniziale corrisponde all'intervistatore e quale corrisponde all'ospite. Controllate anche i passaggi successivi: una etichetta di apertura corretta non dimostra che tutti i cambi di relatore siano stati gestiti correttamente.

Quando un paragrafo viene assegnato in modo errato, entra nella modalità di modifica della trascrizione e scegli l'oratore esistente corretto per quel paragrafo. Se necessario, correggi le parole separatamente. Un cambio di nome si applica all'etichetta in tutto il documento; non è lo strumento giusto per spostare un solo paragrafo etichettato erroneamente.

Risposte molto brevi e interruzioni meritano attenzione. Un segmento riconosciuto può estendersi su un cambio di parlante e le informazioni temporali disponibili influiscono sulla precisione con cui può essere diviso. Non dare per scontato che ogni breve “sì” o osservazione sovrapposta riceverà la sua etichetta perfetta.

Rinomina le etichette dopo aver confermato le voci

Sostituisci le etichette generiche con nomi o ruoli confermati come Intervistatore e Ospite. I ruoli sono utili quando non sono necessari nomi personali. Mantieni l'ortografia coerente con il materiale di accompagnamento dell'intervista anziché tirare a indovinare da un'introduzione riconosciuta automaticamente.

I controlli del nome dell'oratore aggiornano le etichette utilizzate dal record e dalle sue esportazioni. Riprodurre un passaggio con nome per confermare che una modifica globale del nome non ha associato il nome dell'ospite all'intervistatore. Quando una voce reale è stata suddivisa in più etichette, verificarne i passaggi prima di assegnare lo stesso nome.

Rinominare un'etichetta registra la tua decisione editoriale. Non è un'autenticazione vocale e non crea un profilo di identità automatico per i file futuri. Rivedi le etichette di una nuova registrazione in modo indipendente.

Esporta una conversazione facile da verificare

Scegli TXT, Markdown, PDF o CSV per un documento leggibile o riutilizzabile. Laddove esistono etichette degli oratori, abilitare l'opzione per includere gli oratori; conservare i timestamp se il lettore avrà bisogno di tornare alla registrazione. Le scelte di esportazione originale, tradotta e bilingue dipendono dal testo disponibile nel record.

SRT e VTT sono disponibili anche per un flusso di lavoro dei sottotitoli e includono sempre l'asse temporale richiesto. Controlla la visualizzazione prevista prima di condividere un file di sottotitoli: un documento di intervista utile e una comoda traccia di sottotitoli video richiedono decisioni di formattazione diverse.

Riascoltare nomi, citazioni, numeri, impegni e attribuzioni incerte prima di condividere. Una bozza etichettata dal relatore ti aiuta a trovare questi passaggi; non rende affidabile una citazione non verificata.

Controlla i problemi di attribuzione

Se non vengono visualizzate etichette, controlla che la diarizzazione degli parlanti (etichettatura degli parlanti) sia stata abilitata e che le relative risorse siano pronte. Il riconoscimento può produrre testo mentre il palco dell'parlante opzionale non fornisce assegnazioni utilizzabili. Un risultato testuale corretto e un'etichettatura del relatore riuscita non sono lo stesso stato.

Se le etichette sono sbagliate, rivedere l'impostazione del conteggio e l'audio. Voci simili, discorsi distanti, cambiamenti nel suono del microfono, rumore di fondo e conversazioni sovrapposte possono rendere difficile il raggruppamento. Usa passaggi chiari come ancore, correggi ciò che puoi verificare e lascia visibile l'attribuzione incerta anziché inventare certezza.

Una volta pronte le risorse, il riconoscimento supportato e il lavoro del relatore verranno eseguiti localmente sul tuo Mac. Conserva il file sorgente per la revisione e scegli una destinazione intenzionale per la trascrizione vocale esportata. Il prossimo passo utile è uno scambio chiaro di interviste con etichette che hai controllato personalmente.

Referenze ufficiali controllate il 4 ottobre 2026

Microsoft: diarization and generic speaker identifiers
Amazon Transcribe: speaker labels and timestamps
FluidAudio: on-device speaker diarization framework

Domande frequenti

Dovrei scegliere la modalità automatica o 2 parlanti per un colloquio a due persone?

Scegli 2 quando nel file parlano esattamente due persone. Se le introduzioni o le interruzioni aggiungono altre voci, utilizza un conteggio che rifletta la registrazione oppure prova la modalità automatica e controlla le attribuzioni dei parlanti.

La diarizzazione degli oratori (etichettatura degli oratori) identifica automaticamente i nomi delle persone?

No, assegna etichette vocali all'interno della registrazione. Conferma tu stesso le persone o i ruoli, quindi rinomina le etichette nella trascrizione.

Posso correggere chi ha detto un paragrafo?

Sì. L'editor della trascrizione ti consente di modificare l'assegnazione di un paragrafo a un oratore esistente. Rinominare un parlante modifica invece l'etichetta in tutto il record.

Perché una persona ha ricevuto due etichette?

Il raggruppamento delle voci può essere influenzato da discorsi brevi, rumore, microfoni diversi o cambiamenti nella consegna. Rileggi i passaggi rilevanti prima di decidere se le etichette appartengono alla stessa persona.

Posso esportare la voce isolata di ogni persona?

Questa funzionalità etichetta il testo della trascrizione vocale. Non fornisce un'esportazione di tracce audio separata per ciascun oratore né rimuove le voci sovrapposte.

I nomi dei relatori verranno visualizzati nel documento esportato?

Abilita Includi parlanti quando il record ha etichette. I nomi confermati vengono utilizzati nell'esportazione. Controlla il documento scelto o il formato dei sottotitoli prima di condividerlo.

Lo stesso numero di parlante identificherà la stessa persona in un altro file?

No, tratta le etichette in ciascuna registrazione in modo indipendente. Il flusso di lavoro qui descritto non stabilisce un'identità vocale tra file.

Guide correlate