Cara Mentranskripsikan Wawancara dengan Label Pembicara di Mac
Tambahkan label pembicara pada wawancara, periksa siapa yang mengatakan setiap bagian, koreksi penetapannya, lalu ekspor percakapan yang sudah ditinjau.
2026-10-04 · 7 min
Jawaban singkat
Untuk menyalin wawancara dan membedakan orang yang berbicara, gunakan transkripsi file dengan diarisasi pembicara (pelabelan pembicara) yang diaktifkan. Ini menambahkan label pembicara ke bagian teks yang dikenali, membantu Anda meninjau pertanyaan dan jawabannya tanpa memperlakukan keseluruhan rekaman sebagai satu suara. Persiapkan sumber pengenalan dan pembicara sebelum memulai, lalu dengarkan kembali untuk memeriksa tugasnya.
Alison Workspace mendukung alur kerja ini untuk file audio dan video yang dapat dibaca di Apple-silicon Mac, M1 atau lebih baru, yang menjalankan macOS 15 atau lebih baru. Anda dapat memilih perkiraan jumlah orang yang berbicara, meninjau transkrip ucapan yang dihasilkan, mengubah tugas pembicara paragraf, mengganti nama label, dan mengekspor teks. Mulailah dengan percakapan yang jelas antara pewawancara dan tamu daripada menilai hasil dari musik atau beberapa orang yang berbicara bersama.
Apa yang ditunjukkan label pembicara
Pengenalan ucapan menanyakan apa yang dikatakan. Diarisasi pembicara menanyakan suara mana yang berbicara selama sebagian rekaman. Transkrip pidato dapat berisi kata-kata yang benar dengan pembicara yang salah, atau label pembicara yang benar yang dilampirkan pada kalimat yang dikenali secara salah. Tinjau kedua dimensi.
Label awal membedakan suara dalam rekaman tersebut. Label tidak otomatis memberikan nama terverifikasi atau membuktikan bahwa orang dalam file lain adalah orang yang sama. Karakteristik suara membantu mengelompokkan bagian ucapan berdasarkan pembicara; memastikan identitas asli adalah tugas terpisah.
Pemisahan pembicara dalam panduan ini berarti teks berlabel. Ini tidak berarti mengekspor file audio yang terisolasi untuk setiap peserta atau menghapus suara seseorang dari pertukaran yang tumpang tindih. Putuskan apakah Anda memerlukan rekaman percakapan yang dapat dibaca atau trek audio terpisah sebelum memilih alur kerja.
Siapkan rekaman wawancara yang dapat diperiksa
Gunakan rekaman asli terbaik yang tersedia, dengan ucapan yang mudah didengar. Hindari membuat salinan terkompresi hanya untuk memperkecil ukurannya jika salinan asli sudah diimpor. Tamu yang tenang, musik latar, dan suara yang berasal dari mikrofon berbeda dapat meningkatkan pekerjaan yang diperlukan untuk memeriksa hasilnya.
Dengarkan percakapan singkatnya terlebih dahulu. Perhatikan berapa banyak orang yang benar-benar berbicara, termasuk perkenalan atau pertanyaan produser jika ada. Mengetahui bahwa wawancara utama memiliki dua peserta tidak membuktikan bahwa setiap bagian file hanya memiliki dua suara.
Jika rekaman peserta terpisah sudah tersedia, simpanlah sebagai referensi. Alur kerja saat ini memberi label pada file yang diimpor; ini tidak menjelaskan penggabungan trek peserta yang terpisah secara otomatis ke dalam percakapan yang disinkronkan. Pastikan Anda menggunakan rekaman yang dapat Anda transkripsikan dan simpan.
Siapkan pemisahan pembicara dan jumlah orang
Pemisahan pembicara memiliki sumber daya selain pengenalan ucapan. Di jendela transkripsi file Alison, aktifkan opsi speaker dan ikuti perintah kesiapan modelnya. Mengaktifkan pengaturan tanpa sumber daya yang dapat digunakan bukanlah bukti bahwa rekaman akhir akan berisi label.
Menu penghitungan menawarkan estimasi otomatis dan penghitungan yang diketahui dari 2 hingga 6. Untuk wawancara dua orang, memilih 2 akan memberitahukan proses berapa banyak suara yang akan dikelompokkan. Jika Anda tidak yakin, gunakan otomatis dan periksa hasilnya. Menu penghitungan yang diketahui adalah rentang pengaturan, bukan batas terukur pada jumlah yang dapat ditangani oleh mode otomatis.
Hitungan adalah pedoman, bukan jaminan. Jika suara ketiga muncul, atau jika seseorang mengubah mikrofon atau gaya bicaranya, penghitungan tetap yang salah dapat mengelompokkan bagian-bagian tersebut dengan buruk. Periksa rekaman lengkapnya daripada berasumsi bahwa pembukaannya dilakukan oleh setiap pembicara.
Transkripsikan file wawancara
Pilih bahasa pengenalan untuk ucapan sebenarnya. Jika Anda memerlukan terjemahan, pilih targetnya secara mandiri dan konfirmasikan bahwa pasangan yang diperlukan tersedia. Anda dapat menonaktifkan terjemahan sambil memeriksa nama dan tugas pembicara dalam bahasa aslinya.
- Tambahkan file audio atau video wawancara ke antrian transkripsi.
- Periksa durasi file yang diterima dan pilih bahasa lisan.
- Mempersiapkan sumber daya pengenalan yang diperlukan; deteksi bahasa otomatis memerlukan model lokal yang kompatibel.
- Aktifkan diarisasi pembicara (pelabelan pembicara) dan siapkan sumber daya pembicara yang diminta.
- Pilih jumlah orang yang berbicara jika dibenarkan, atau biarkan otomatis, lalu mulai transkripsi.
- Buka hasilnya dan putar ulang bagian-bagian dari masing-masing peserta sebelum menerima label.
Biarkan status file memberi tahu Anda apakah pemrosesan telah selesai. Jika hasilnya parsial, tinjau hanya bagian yang diproses dan atasi sisanya sebelum menyajikannya sebagai wawancara lengkap.
Perbaiki penetapan pembicara sebelum memberi nama
Temukan kalimat yang jelas dari setiap suara dan putar audionya. Tetapkan label awal mana yang sesuai dengan pewawancara dan mana yang sesuai dengan tamu. Periksa juga bagian selanjutnya: label pembuka yang benar tidak membuktikan bahwa semua pergantian pembicara ditangani dengan benar.
Jika sebuah paragraf salah ditetapkan, masuk ke mode pengeditan transkrip ucapan dan pilih pembicara yang tepat dari pembicara yang sudah ada untuk paragraf tersebut. Perbaiki kata-katanya secara terpisah jika perlu. Perubahan nama berlaku untuk label di seluruh rekaman; ini bukan alat yang tepat untuk hanya memindahkan satu paragraf yang diberi label salah.
Balasan dan interupsi yang sangat singkat patut mendapat perhatian. Segmen yang dikenali dapat mencakup pergantian pembicara, dan informasi waktu yang tersedia memengaruhi seberapa tepat segmen tersebut dapat dibagi. Jangan berasumsi bahwa setiap pernyataan singkat “ya” atau pernyataan yang tumpang tindih akan mendapat label sempurna.
Ganti nama label setelah memastikan suaranya
Ganti label umum dengan nama atau peran yang dikonfirmasi seperti Pewawancara dan Tamu. Peran berguna ketika Anda tidak memerlukan nama pribadi. Jaga agar ejaan tetap konsisten dengan materi yang menyertai wawancara daripada menebak-nebak dari pendahuluan yang dikenali secara otomatis.
Kontrol nama pembicara memperbarui label yang digunakan oleh rekaman dan ekspornya. Putar ulang bagian yang disebutkan untuk mengonfirmasi bahwa perubahan nama global tidak melampirkan nama tamu ke pewawancara. Ketika satu suara asli telah dipecah menjadi beberapa label, periksa bagiannya sebelum memberi nama yang sama.
Mengganti nama label mencatat keputusan editorial Anda. Ini bukan autentikasi suara dan tidak membuat profil identitas otomatis untuk file di masa mendatang. Tinjau label rekaman baru secara mandiri.
Ekspor percakapan yang mudah diperiksa
Pilih TXT, Markdown, PDF, atau CSV untuk dokumen yang dapat dibaca atau digunakan kembali. Jika ada label pembicara, aktifkan opsi untuk menyertakan speaker; simpan stempel waktu jika pembaca perlu kembali ke rekaman. Pilihan ekspor asli, terjemahan, dan bilingual bergantung pada teks yang tersedia dalam catatan.
SRT dan VTT juga tersedia untuk alur kerja subtitle dan selalu menyertakan sumbu waktu yang diperlukan. Periksa tampilan yang diinginkan sebelum membagikan file subtitle: dokumen wawancara yang berguna dan trek subtitle video yang nyaman memerlukan keputusan format yang berbeda.
Dengarkan kembali nama, kutipan, angka, komitmen, dan atribusi yang tidak pasti sebelum berbagi. Draf yang diberi label pembicara membantu Anda menemukan bagian-bagian ini; hal ini tidak membuat kutipan yang tidak dicentang dapat diandalkan.
Periksa masalah pada label pembicara
Jika tidak ada label yang muncul, periksa apakah diarisasi speaker (pelabelan speaker) telah diaktifkan dan sumber dayanya sudah siap. Pengenalan dapat menghasilkan teks sementara tahap pembicara opsional tidak memberikan tugas yang dapat digunakan. Hasil teks yang berhasil dan pelabelan pembicara yang berhasil tidak memiliki status yang sama.
Jika label salah, periksa kembali pengaturan hitungan dan audio. Suara yang mirip, ucapan yang berjauhan, perubahan suara mikrofon, kebisingan latar belakang, dan pembicaraan yang tumpang tindih dapat mempersulit pengelompokan. Gunakan bagian-bagian yang jelas sebagai jangkar, perbaiki apa yang dapat Anda verifikasi, dan biarkan atribusi yang tidak jelas terlihat daripada menciptakan kepastian.
Setelah sumber daya siap, pengenalan yang didukung dan pekerjaan speaker berjalan secara lokal di Mac Anda. Simpan file sumber untuk ditinjau dan pilih tujuan yang diinginkan untuk transkrip ucapan yang diekspor. Langkah berguna berikutnya adalah pertukaran wawancara yang jelas dengan label yang telah Anda periksa secara pribadi.
Referensi resmi diperiksa 4 Oktober 2026
Microsoft: diarization and generic speaker identifiers
Amazon Transcribe: speaker labels and timestamps
FluidAudio: on-device speaker diarization framework
Pertanyaan yang sering diajukan
Haruskah saya memilih pembicara otomatis atau 2 untuk wawancara dua orang?
Pilih 2 ketika tepat dua orang berbicara dalam file. Jika perkenalan atau interupsi menambah suara lain, gunakan hitungan yang mencerminkan rekaman atau coba otomatis dan periksa penetapan pembicaranya.
Apakah diarisasi pembicara (pelabelan pembicara) secara otomatis mengidentifikasi nama orang?
Tidak, Ini memberikan label suara dalam rekaman. Konfirmasikan sendiri orang atau perannya, lalu ganti nama label di transkrip ucapan.
Bisakah saya mengoreksi siapa yang mengatakan satu paragraf?
Ya. Editor transkrip ucapan memungkinkan Anda mengubah tugas paragraf ke pembicara yang sudah ada. Mengganti nama pembicara akan mengubah label tersebut di seluruh rekaman.
Mengapa satu orang menerima dua label?
Pengelompokan suara dapat dipengaruhi oleh ucapan singkat, kebisingan, mikrofon yang berbeda, atau perubahan penyampaian. Putar ulang bagian yang relevan sebelum memutuskan apakah label tersebut milik orang yang sama.
Bisakah saya mengekspor suara terisolasi setiap orang?
Fitur ini memberi label pada teks transkrip ucapan. Itu tidak menyediakan ekspor trek audio terpisah untuk setiap speaker atau menghapus suara yang tumpang tindih.
Apakah nama pembicara akan muncul di dokumen yang diekspor?
Aktifkan Sertakan Pembicara ketika rekaman memiliki label. Nama yang dikonfirmasi digunakan dalam ekspor. Periksa format dokumen atau subtitle yang dipilih sebelum membagikannya.
Akankah nomor pembicara yang sama mengidentifikasi orang yang sama di file lain?
Tidak, Perlakukan label di setiap rekaman secara terpisah. Alur kerja yang dijelaskan di sini tidak menetapkan identitas suara lintas file.