Mac에서 여러 언어의 오디오 파일을 오프라인으로 일괄 전사하기
로컬 모델을 준비하고 자동 언어 감지 또는 언어별 처리를 선택한 후, 다국어 대기열의 녹음을 각각 검토하고 내보내세요.
2026-10-04 · 7 min
먼저 핵심 답변
Mac에서 서로 다른 언어의 녹음을 여러 개 전사하려면 로컬 인식 리소스를 준비하고 파일을 대기열에 넣은 다음, 녹음의 언어를 어떻게 처리할지 정하세요. 호환되는 모델이 설치되어 있으면 자동 언어 감지가 유용합니다. 언어는 알고 있지만 자동 감지가 불안정하다면 같은 언어의 파일을 묶어 원본 언어를 직접 지정하고 처리하세요.
Alison Workspace는 파일 대기열, 다국어 인식 선택, 선택적 번역 및 화자 분할(화자 라벨링)을 지원합니다. Apple 실리콘 Mac, M1 이상, macOS 15 이상이 필요합니다. 필요한 리소스가 준비되면 지원되는 파일 인식이 로컬로 실행됩니다. 대기열이 실행에 대한 설정을 공유한다는 사실을 염두에 두고 계획하십시오. 서로 다른 언어로 된 여러 파일은 언어를 반복적으로 전환하는 하나의 녹음과 동일한 문제가 아닙니다.
완료해야 하는 작업을 중심으로 파일을 정리하세요
영어 강의, 일본어 인터뷰, 스페인어 음성 녹음이 있다고 가정해 보겠습니다. 도움이 되는 경우에만 번역이 포함된 별도의 원본 언어 문서가 필요합니다. 이는 3개 언어 정확도 테스트 보고서가 아닌 예시적인 작업 흐름입니다.
모든 전사문을 열지 않고도 구분할 수 있도록 파일 이름을 유지하세요. 소리, 대략적인 길이, 주요 언어를 확인하세요. 비디오에 포함된 오디오의 경우 파일에는 여전히 액세스 가능하고 디코딩 가능한 오디오 트랙이 필요합니다. 그 그림은 음성 인식에 단어를 제공하지 않습니다.
원본 텍스트, 번역된 읽기 도구, 화자 라벨 또는 자막이 필요한지 결정하십시오. 각 옵션에는 별도의 요구 사항과 별도의 검토 작업이 추가됩니다. 원본 텍스트로 시작하면 번역을 추가하기 전에 언어 문제를 더 쉽게 식별할 수 있습니다.
오프라인으로 전환하기 전에 인식 리소스 준비
인식 메뉴는 다양한 언어를 제공하지만 엔진과 모델은 사용하려는 언어를 지원해야 합니다. 메뉴에 나타나는 언어는 설치된 모든 모델이 동일하게 처리할 수 있다는 것을 보장하지 않습니다. 여러 소스 언어가 필요한 배치에는 다국어 모델을 사용합니다.
Alison의 자동 파일 언어 감지에는 사용 가능한 로컬 Whisper 모델이 필요합니다. 명시적으로 선택된 일부 언어는 호환되는 macOS 버전에서 사용 가능한 시스템 인식을 사용할 수 있지만 이는 자동 언어 대체가 아닙니다. 여기에서 다른 워크플로에서 사용하는 모델이 준비되었다고 가정하는 대신 앱의 준비 메시지를 따르세요.
연결되어 있는 동안 리소스를 다운로드하고 준비한 다음 오프라인 세션에 의존하기 전에 의도한 설정으로 짧은 파일을 사용해 보세요. 첫 번째 준비에는 시간이 걸릴 수 있습니다. 어떤 모델 준비 검사도 익숙하지 않은 악센트나 시끄러운 녹음의 품질을 입증할 수 없습니다.
자동 감지 또는 언어 기반 그룹 선택
각각의 기본 언어가 명확한 파일의 경우 자동 감지를 통해 모든 항목을 수동으로 정렬하는 것을 피할 수 있습니다. 특히 침묵, 음악, 아주 적은 말투, 특이한 오프닝의 경우에는 여전히 틀릴 수 있습니다. 첫 번째 전사문이 올바르게 보이므로 전체 대기열을 수락하는 대신 모든 파일에 대한 결과를 검사하세요.
언어를 알고 있는 경우 보다 제어된 접근 방식은 영어를 선택한 상태에서 영어 파일을 실행한 다음 일본어를 선택한 상태에서 일본어 파일을 실행하는 것입니다. 대기열은 해당 실행에 대해 공유 인식 선택을 사용합니다. 이 가이드에서는 대기 중인 모든 파일에 첨부된 별도의 언어 설정을 설명하지 않습니다.
실제로 모든 파일에 해당 언어를 사용하려는 경우가 아니면 고정 언어로 혼합 언어 배치를 시작하지 마십시오. 인식이 잘못된 것 같으면 먼저 오디오와 언어를 확인하세요. 대상 번역 언어를 변경해도 잘못된 인식 설정에서 생성된 원본 전사문을 복구할 수 없습니다.
관리 가능한 배치 시작
더 큰 컬렉션을 처리하기 전에 설정, 리소스 준비 및 출력을 확인할 수 있도록 작은 세트부터 시작하세요. 여러 파일이 처리 대기 중입니다. 이는 모든 파일이 동시에 실행되거나 고정된 속도로 완료된다는 약속이 아닙니다.
- 로컬에서 읽을 수 있는 파일을 선택하고 해당 파일의 이름, 기간 및 예상 음성 언어를 확인합니다.
- 파일 복사 창을 열고 여러 파일을 추가하거나 대기열로 끌어다 놓습니다.
- 준비된 다국어 모델로 자동 언어 감지를 선택하거나 언어별로 파일을 그룹화하고 명시적인 소스 언어를 선택합니다.
- 원본 언어 문서의 번역을 해제하거나 실행을 위해 지원되는 번역 대상 하나를 선택하고 해당 리소스를 준비합니다.
- 유용한 경우에만 화자 분할(화자 라벨링)을 활성화하고 해당 리소스를 준비합니다. 해당 실행의 파일에 맞는 경우에만 예상되는 발언자 수를 사용하십시오.
- 대기열을 시작한 다음 문서를 내보내기 전에 각 파일의 상태와 생성된 텍스트를 검토합니다.
거부된 파일을 먼저 미디어 문제로 확인하세요. 오디오 트랙이 없거나 읽을 수 없는 인코딩이 있는 파일은 모델 설정에 더 많은 언어를 추가해도 수정되지 않습니다.
인식, 번역, 화자 설정을 서로 다르게 유지하세요.
인식은 사용되는 언어로 단어를 생성합니다. 번역은 그 단어를 또 다른 읽기 언어로 바꿉니다. 화자 분리는 음성별로 텍스트를 그룹화합니다. 함께 사용할 수 있지만 하나의 성공이 다른 것의 성공을 보장하지는 않습니다.
예를 들어 올바르게 인식된 일본어 구절에도 번역 대상을 사용할 수 없거나 화자 지정이 잘못되었을 수 있습니다. 번역된 문서를 검토할 때 원본이 보이도록 유지하세요. 특히 번역이 원본 텍스트보다 매끄럽게 보이는 경우 녹음 내용과 이름, 그림 및 중요한 부정적인 설명을 확인하십시오.
번역 쌍은 실제 Mac에서 사용 가능한 리소스에 따라 달라집니다. 다중 언어 인식기가 모든 소스 언어가 모든 대상 언어로 번역될 수 있음을 의미하지는 않습니다. 번역을 사용할 수 없는 경우에도 번역으로 잘못 표시하는 대신 원어 전사문을 사용하고 검토할 수 있습니다.
언어가 다르게 변경되는 녹음 처리
대부분 단일 언어 파일로 구성된 폴더는 자동 감지를 고려하는 좋은 이유입니다. 일본어와 영어가 반복적으로 바뀌는 인터뷰 하나는 별도의 주의가 필요합니다. 자동 감지는 녹음 내부의 모든 스위치가 올바르게 인식되었는지 확인하지 않습니다.
언어 변경에 관한 구절을 검토하세요. 결과에서 지속적으로 하나의 언어가 손실되는 경우 일반 미디어 편집 도구를 사용하여 선택한 의도한 언어로 적절한 발췌문을 별도로 처리하는 것이 좋습니다. 원본을 보존하고 발췌문의 전사문은 해당 발췌문의 타임라인을 사용한다는 점을 기억하세요.
여기에는 완벽한 혼합 언어 인식이나 지원되는 모든 언어의 동일한 품질에 대한 주장이 없습니다. 배경 음악, 지역 음성, 낯선 이름, 다양한 녹음 조건도 수정이 필요한 부분에 영향을 미칩니다.
완료를 확인하고 문제를 진단한 후에만 다시 시도하세요.
Alison의 파일 전사 평가판은 현재 실시간 청취와 별도로 60분의 누적 오디오 지속 시간을 제공합니다. 대기열은 남은 허용량을 순서대로 사용합니다. 이후 파일은 남은 시간만 수신하거나 전혀 수신하지 않을 수 있습니다. 추가된 모든 파일이 완전히 완료될 것이라고 가정하기보다는 예상 길이와 처리된 길이를 살펴보세요.
부분 결과는 긴 녹음의 완전한 전사문이 아닙니다. 실패하거나 취소된 작업은 원인을 확인한 후 다시 시도할 수 있습니다. 파일이 잘못된 언어로 처리된 경우 다시 실행하려면 올바른 언어를 선택하세요. 리소스가 누락된 경우 먼저 준비하세요. 긴 배치를 반복하기 전에 허용량을 검토하십시오.
전체 파일 액세스를 잠금 해제한 경우 영향을 받은 파일을 다시 실행하십시오. 액세스 권한을 변경해도 이전 문서의 처리되지 않은 끝 부분이 자동으로 채워지지 않습니다. 파일, 파일 상태, 최신 전사문 간의 관계를 명확하게 유지하세요.
각 문서를 의도적으로 검토하고 내보내기
검색 및 재생을 사용하여 각 결과의 중요한 구절을 검사하세요. 하나의 전사문을 편집한다고 해서 대기열에 있는 다른 문서가 검토되었다는 의미는 아닙니다. 내보낸 파일에 고유한 이름을 지정하고 나중에 확인할 수 있도록 원본 녹음을 보관하세요.
현재 전사문 내보내기 메뉴는 TXT, Markdown, CSV, PDF, SRT 및 VTT를 제공합니다. 가능한 경우 원본 텍스트, 번역 또는 둘 다를 선택하십시오. 발표자 및 문서 타임스탬프 옵션은 녹음 및 형식에 따라 다릅니다. 배치를 추가하면 원클릭 대량 내보내기가 가능하다고 가정하는 대신 메뉴를 통해 각 전사 기록를 내보냅니다.
로컬 인식은 처리가 발생하는 위치를 설명합니다. 나중에 동기화된 내보내기 폴더, 공유 드라이브 또는 백업이 파일에 대해 수행하는 작업을 제어하지 않습니다. 녹음과 문서를 보관할 위치를 선택하세요. 다음 단계는 확장하기 전에 언어와 출력을 확인할 수 있는 작은 대기열입니다.
공식 참고자료는 2026년 10월 4일에 확인되었습니다.
WhisperKit: on-device speech-to-text and model choices
Apple: file-based media reading
FluidAudio: local speaker diarization
자주 묻는 질문
다른 언어로 녹음된 내용을 하나의 대기열에 넣을 수 있나요?
예, 하지만 실행은 언어 설정을 공유합니다. 즉시 호환되는 다국어 모델로 자동 감지를 사용하거나 언어별로 파일을 그룹화하고 명시적인 소스 언어로 해당 그룹을 실행하세요.
자동 언어 감지에는 모델 다운로드가 필요합니까?
사용 가능한 로컬 Whisper 모델이 필요합니다. 오프라인 세션 전에 해당 모델을 준비하세요. 명시적으로 선택된 언어에 대한 시스템 엔진은 자동 언어 대체가 아닙니다.
하나의 파일 내에서 두 가지 언어 전환을 안정적으로 처리할 수 있습니까?
그렇게 가정하지 마십시오. 전환 구절을 검토하고 한 언어가 반복적으로 누락되는 경우 올바른 언어 설정으로 별도로 준비된 발췌문을 고려하십시오.
일본어로 전사하면 자동으로 영어 텍스트가 제공되나요?
아니요. 인식과 번역은 별개의 선택입니다. 지원되는 번역 대상으로 영어를 선택하고, 영어 읽기 도구를 원하는 경우 필수 쌍을 준비하세요.
준비 후에 인터넷 없이도 파일을 복사할 수 있나요?
지원되는 인식은 필요한 리소스를 사용할 수 있게 되면 로컬로 실행됩니다. 선택적 번역 및 발표자 리소스도 준비하고 오프라인으로 전환하기 전에 의도한 작업 흐름을 확인하세요.
일괄적으로 화자 라벨을 사용할 수 있나요?
리소스가 준비되면 실행을 위해 화자 분리를 활성화할 수 있습니다. 각 파일을 독립적으로 검토합니다. 화자 번호는 파일 전체에서 동일한 사람의 신원을 확인하지 않습니다.
일괄 전사에는 자동 대량 내보내기가 포함되나요?
대기열은 여러 파일을 처리합니다. 각 전사문의 메뉴에서 따로 내보낼 수 있습니다. 이 가이드는 전체 대기열을 한 번의 클릭으로 내보낼 수 있다고 설명하지 않습니다.