Sumber dayaTranskripsi file

Cara Mentranskripsikan Banyak File Audio Berbagai Bahasa di Mac Secara Offline

Siapkan model lokal, pilih deteksi otomatis atau kelompok berdasarkan bahasa, lalu periksa dan ekspor setiap rekaman dalam antrean multibahasa.

2026-10-04 · 7 min
Antrean kartu audio berwarna-warni mengarah ke dokumen transkrip ucapan terpisah dengan latar belakang gading yang hangat.

Jawaban singkat

Untuk mentranskripsikan beberapa rekaman dalam berbagai bahasa di Mac, siapkan sumber daya pengenalan lokal, masukkan file ke antrean, dan tentukan cara menangani bahasa yang diucapkan. Deteksi otomatis berguna jika model yang kompatibel sudah terpasang. Jika Anda mengetahui bahasanya tetapi deteksi tidak dapat diandalkan, kelompokkan file dengan bahasa yang sama dan proses dengan memilih bahasa sumber secara langsung.

Alison Workspace mendukung antrian file, pilihan pengenalan multibahasa, terjemahan opsional, dan diarisasi speaker (pelabelan speaker). Ini memerlukan Apple-silikon Mac, M1 atau lebih baru, dengan macOS 15 atau lebih baru. Setelah sumber daya yang diperlukan siap, pengenalan file yang didukung berjalan secara lokal. Rencanakan fakta bahwa antrian berbagi pengaturan untuk suatu proses: beberapa file dalam bahasa yang berbeda tidak menimbulkan masalah yang sama dengan satu rekaman yang berganti bahasa berulang kali.

Atur file berdasarkan pekerjaan yang perlu Anda selesaikan

Misalkan Anda memiliki ceramah bahasa Inggris, wawancara bahasa Jepang, dan rekaman suara bahasa Spanyol. Anda menginginkan dokumen bahasa asli yang terpisah untuk masing-masing dokumen, dengan terjemahan hanya jika itu membantu. Ini adalah alur kerja ilustratif, bukan laporan uji akurasi tiga bahasa.

Simpan nama file agar Anda dapat membedakannya tanpa harus membuka setiap transkrip ucapan. Periksa suaranya, perkiraan panjangnya, dan bahasa utamanya. Untuk audio yang disematkan dalam video, file tersebut masih memerlukan trek audio yang dapat diakses dan didekodekan; gambarnya tidak menyediakan kata-kata untuk pengenalan ucapan.

Putuskan apakah Anda memerlukan teks sumber, alat bantu membaca terjemahan, label pembicara, atau subjudul. Setiap opsi menambahkan persyaratan terpisah dan tugas peninjauan terpisah. Memulai dengan teks asli dapat mempermudah identifikasi masalah bahasa sebelum menambahkan terjemahan.

Siapkan sumber daya pengenalan sebelum offline

Menu pengenalan menawarkan banyak bahasa, namun mesin dan modelnya harus mendukung bahasa yang ingin Anda gunakan. Bahasa yang muncul di menu tidak menjamin bahwa setiap model yang terinstal dapat menanganinya dengan baik. Gunakan model multibahasa untuk kumpulan yang memerlukan beberapa bahasa sumber.

Deteksi bahasa file otomatis Alison memerlukan model Whisper lokal yang dapat digunakan. Beberapa bahasa yang dipilih secara eksplisit dapat menggunakan pengenalan sistem yang tersedia pada versi macOS yang kompatibel, namun itu bukan pengganti bahasa otomatis. Ikuti pesan kesiapan aplikasi alih-alih berasumsi bahwa model yang digunakan oleh alur kerja lain sudah siap di sini.

Unduh dan persiapkan sumber daya saat terhubung, lalu coba file pendek dengan pengaturan yang diinginkan sebelum mengandalkan sesi offline. Persiapan pertama bisa memakan waktu. Tidak ada pemeriksaan model siap pakai yang dapat membuktikan kualitas aksen asing atau rekaman berisik.

Pilih deteksi otomatis atau grup berbasis bahasa

Untuk file yang masing-masing memiliki bahasa utama yang jelas, deteksi otomatis dapat menghindari penyortiran setiap item secara manual. Hal ini masih bisa saja salah, khususnya dalam keheningan, musik, sedikit pembicaraan, atau pembukaan yang tidak biasa. Periksa hasil untuk setiap file daripada menerima seluruh antrean karena transkrip ucapan pertama terlihat benar.

Jika Anda mengetahui bahasanya, pendekatan yang lebih terkontrol adalah dengan menjalankan file berbahasa Inggris dengan memilih bahasa Inggris, kemudian file Jepang dengan memilih bahasa Jepang, dan seterusnya. Antrean menggunakan pilihan pengenalan bersama untuk proses tersebut; panduan ini tidak menjelaskan pengaturan bahasa terpisah yang dilampirkan pada setiap file yang diantri.

Jangan memulai kumpulan bahasa campuran dengan bahasa tetap kecuali Anda benar-benar menginginkan bahasa tersebut untuk semua file. Jika pengenalan terlihat salah, periksa audio dan bahasanya terlebih dahulu. Mengubah bahasa terjemahan target tidak dapat memperbaiki transkrip ucapan sumber yang dihasilkan dengan pengaturan pengenalan yang salah.

Mulai batch yang dapat dikelola

Mulailah dengan kumpulan kecil sehingga Anda dapat mengonfirmasi pengaturan, kesiapan sumber daya, dan keluaran sebelum memproses kumpulan yang lebih besar. Beberapa file dimasukkan dalam antrean untuk diproses; ini bukan jaminan bahwa semua file dijalankan secara bersamaan atau selesai pada kecepatan tetap.

  1. Pilih file yang dapat Anda baca secara lokal dan konfirmasikan nama, durasi, dan bahasa lisan yang diharapkan.
  2. Buka jendela transkripsi file dan tambahkan beberapa file, atau seret ke dalam antriannya.
  3. Pilih deteksi bahasa otomatis dengan model multibahasa yang siap pakai, atau kelompokkan file berdasarkan bahasa dan pilih bahasa sumber eksplisit.
  4. Nonaktifkan terjemahan untuk dokumen dalam bahasa asli, atau pilih salah satu target terjemahan yang didukung untuk dijalankan dan persiapkan sumber dayanya.
  5. Mengaktifkan diarisasi pembicara (pelabelan pembicara) hanya jika berguna dan menyiapkan sumber dayanya; gunakan jumlah orang yang berbicara sesuai dengan yang diharapkan hanya jika sesuai dengan file yang dijalankan.
  6. Mulai antrian, lalu tinjau status setiap file dan teks yang dihasilkan sebelum mengekspor dokumennya.

Periksa file yang ditolak sebagai masalah media terlebih dahulu. File tanpa trek audio atau pengkodean yang tidak dapat dibaca tidak akan diperbaiki dengan menambahkan lebih banyak bahasa ke pengaturan model.

Jaga agar pengenalan, terjemahan, dan pengaturan speaker tetap berbeda

Pengakuan menghasilkan kata-kata dalam bahasa yang diucapkan. Terjemahan mengubah kata-kata itu menjadi bahasa bacaan lain. Pemisahan pembicara mengelompokkan teks dengan suara. Kedua hal tersebut dapat digunakan bersama-sama, namun kesuksesan pada satu hal tidak menentukan kesuksesan pada hal lainnya.

Misalnya, bagian bahasa Jepang yang dikenali dengan benar mungkin masih memiliki target terjemahan yang tidak tersedia atau penugasan pembicara yang salah. Jaga agar dokumen asli tetap terlihat saat meninjau dokumen terjemahan. Verifikasi nama, gambar, dan pernyataan negatif penting terhadap rekaman tersebut, terutama ketika terjemahannya tampak lebih halus dibandingkan teks sumber.

Pasangan terjemahan bergantung pada sumber daya yang tersedia di Mac sebenarnya. Pengenalan multibahasa tidak berarti bahwa setiap bahasa sumber dapat diterjemahkan ke setiap bahasa target. Jika terjemahan tidak tersedia, Anda masih dapat menggunakan dan meninjau transkrip ucapan bahasa sumber daripada salah memberi label sebagai terjemahan.

Tangani rekaman yang mengubah bahasa secara berbeda

Folder yang sebagian besar berisi file satu bahasa adalah alasan bagus untuk mempertimbangkan deteksi otomatis. Satu wawancara dengan peralihan berulang-ulang antara bahasa Jepang dan Inggris memerlukan perhatian tersendiri. Deteksi otomatis tidak memastikan bahwa setiap tombol di dalam rekaman dikenali dengan benar.

Tinjau bagian-bagian seputar perubahan bahasa. Jika hasilnya terus-menerus kehilangan satu bahasa, pertimbangkan untuk memproses kutipan yang sesuai secara terpisah dengan bahasa yang diinginkan, menggunakan alat pengeditan media biasa untuk mempersiapkannya. Pertahankan yang asli dan ingatlah bahwa transkrip ucapan suatu kutipan menggunakan garis waktu kutipan tersebut.

Tidak ada klaim di sini atas pengakuan bahasa campuran yang sempurna atau kualitas yang setara di setiap bahasa yang didukung. Latar belakang musik, pidato daerah, nama yang asing, dan kondisi rekaman yang berbeda juga mempengaruhi apa yang perlu diperbaiki.

Periksa penyelesaian dan coba lagi hanya setelah mendiagnosis masalah

Uji coba transkripsi file Alison saat ini menyediakan durasi audio kumulatif 60 menit, terpisah dari mendengarkan langsung. Antrian menggunakan sisa uang saku secara berurutan. File selanjutnya mungkin hanya menerima sisa waktu atau tidak menerima sama sekali; lihat panjang yang diharapkan dan diproses daripada berasumsi bahwa setiap file yang ditambahkan akan selesai sepenuhnya.

Hasil sebagian bukanlah transkrip ucapan lengkap dari rekaman yang panjang. Pekerjaan yang gagal atau dibatalkan dapat dicoba kembali setelah Anda memeriksa penyebabnya. Jika file diproses dalam bahasa yang salah, pilih bahasa yang benar untuk proses lainnya; jika sumber daya hilang, persiapkan terlebih dahulu. Tinjau tunjangan sebelum mengulangi batch yang panjang.

Jika Anda membuka kunci akses file lengkap, jalankan kembali file yang terpengaruh. Mengubah akses tidak secara otomatis mengisi akhir dokumen sebelumnya yang belum diproses. Jaga agar hubungan antara file, statusnya, dan transkrip ucapan terbaru tetap jelas.

Tinjau dan ekspor setiap dokumen dengan sengaja

Gunakan pencarian dan pemutaran untuk memeriksa bagian-bagian penting di setiap hasil. Mengedit satu transkrip ucapan tidak berarti dokumen lain dalam antrian telah ditinjau. Berikan nama berbeda pada file yang diekspor dan simpan rekaman aslinya untuk diperiksa nanti.

Menu ekspor transkrip ucapan saat ini menawarkan TXT, Markdown, CSV, PDF, SRT, dan VTT. Pilih teks asli, terjemahan jika tersedia, atau keduanya; opsi speaker dan stempel waktu dokumen bergantung pada rekaman dan format. Ekspor setiap rekaman melalui menunya daripada berasumsi bahwa menambahkan kumpulan akan menghasilkan ekspor massal dengan sekali klik.

Pengakuan lokal menjelaskan di mana pemrosesan terjadi. Itu tidak mengontrol apa yang nantinya dilakukan folder ekspor, drive bersama, atau cadangan yang disinkronkan dengan file tersebut. Pilih di mana Anda menyimpan rekaman dan dokumen Anda. Langkah selanjutnya adalah antrean kecil yang bahasa dan keluarannya dapat Anda verifikasi sebelum Anda meningkatkan skalanya.

Referensi resmi diperiksa 4 Oktober 2026

WhisperKit: on-device speech-to-text and model choices
Apple: file-based media reading
FluidAudio: local speaker diarization

Pertanyaan yang sering diajukan

Bisakah rekaman dengan bahasa berbeda dimasukkan ke dalam satu antrean?

Ya, tetapi proses ini berbagi pengaturan bahasa. Gunakan deteksi otomatis dengan model multibahasa yang kompatibel, atau kelompokkan file berdasarkan bahasa dan jalankan grup tersebut dengan bahasa sumber eksplisit.

Apakah deteksi bahasa otomatis memerlukan pengunduhan model?

Dibutuhkan model Whisper lokal yang dapat digunakan. Siapkan model tersebut sebelum sesi offline. Mesin sistem untuk satu bahasa yang dipilih secara eksplisit bukanlah pengganti bahasa otomatis.

Akankah ini dapat menangani peralihan dua bahasa dalam satu file dengan andal?

Jangan berasumsi seperti itu. Tinjau kembali bagian-bagian yang berpindah dan pertimbangkan kutipan yang disiapkan secara terpisah dengan pengaturan bahasa yang benar ketika satu bahasa berulang kali terlewatkan.

Apakah menyalin dalam bahasa Jepang secara otomatis memberi saya teks bahasa Inggris?

Tidak, Pengenalan ucapan dan terjemahan adalah pilihan terpisah. Pilih Bahasa Inggris sebagai target terjemahan yang didukung dan persiapkan pasangan yang diperlukan jika Anda menginginkan bantuan membaca bahasa Inggris.

Bisakah saya menyalin file tanpa internet setelah persiapan?

Pengenalan yang didukung berjalan secara lokal setelah sumber daya yang diperlukan dapat digunakan. Siapkan juga sumber terjemahan dan pembicara opsional, dan konfirmasikan alur kerja yang diinginkan sebelum offline.

Apakah label pembicara tersedia untuk batch?

Pemisahan speaker dapat diaktifkan untuk dijalankan ketika sumber dayanya sudah siap. Tinjau setiap file secara independen; nomor pembicara tidak menentukan identitas orang yang sama di seluruh file.

Apakah transkripsi batch mencakup ekspor massal otomatis?

Antrean memproses beberapa file. Ekspor setiap transkrip dari menunya sendiri; panduan ini tidak menjanjikan ekspor seluruh antrean dengan satu klik.

Panduan terkait