Mac에서 인터뷰를 화자별로 전사하는 방법
인터뷰에 화자 라벨을 추가하고 각 발언의 화자를 확인하세요. 배정과 이름을 수정한 후 검토한 대화를 내보낼 수 있습니다.
2026-10-04 · 7 min
먼저 핵심 답변
인터뷰를 기록하고 말하는 사람을 구별하려면 화자 분할(화자 라벨링)이 활성화된 파일 기록을 사용하십시오. 인식된 텍스트 부분에 화자 라벨을 추가하여 전체 녹음을 하나의 음성으로 처리하지 않고도 질문과 답변을 검토할 수 있도록 도와줍니다. 시작하기 전에 인식 및 발표자 리소스를 준비한 다음 다시 듣고 과제를 확인하세요.
Alison Workspace는 macOS 15 이상을 실행하는 Apple 실리콘 Mac, M1 이상에서 읽을 수 있는 오디오 및 비디오 파일에 대해 이 워크플로를 지원합니다. 예상되는 발언자 수를 선택하고, 생성된 전사문을 검토하고, 단락의 화자 할당을 변경하고, 레이블 이름을 바꾸고, 텍스트를 내보낼 수 있습니다. 음악이나 여러 사람이 함께 이야기하는 결과를 판단하기보다는 인터뷰 진행자과 게스트 간의 명확한 대화부터 시작하십시오.
화자 라벨이 알려주는 것
음성 인식에서는 무슨 말을 했는지 묻습니다. 화자 분할은 녹음 중 어떤 음성이 말했는지 묻습니다. 전사문에는 화자가 잘못된 올바른 단어가 있거나 잘못 인식된 문장에 올바른 화자 레이블이 첨부되어 있을 수 있습니다. 두 측면을 모두 검토하세요.
초기 라벨은 해당 녹음 안의 목소리를 구분합니다. 확인된 실명을 자동으로 제공하거나 다른 파일의 사람이 동일 인물임을 입증하지는 않습니다. 음성 특성은 발언을 화자별로 묶는 데 사용되며, 실제 신원을 확인하는 것은 별도의 작업입니다.
이 가이드에서 화자 분리는 라벨이 붙은 텍스트를 의미합니다. 이는 각 참가자에 대해 격리된 오디오 파일을 내보내거나 겹치는 교환에서 한 사람의 음성을 제거하는 것을 의미하지 않습니다. 워크플로를 선택하기 전에 읽을 수 있는 대화 기록이 필요한지 아니면 별도의 오디오 트랙이 필요한지 결정하세요.
검토할 수 있는 인터뷰 녹음 준비하기
듣기 쉬운 음성이 포함된 최상의 원본 녹음을 사용하십시오. 원본을 이미 가져온 경우 크기를 줄이기 위해 압축된 복사본을 만들지 마십시오. 조용한 게스트, 배경 음악, 다양한 마이크에서 나오는 음성으로 인해 결과를 확인하는 데 필요한 작업이 늘어날 수 있습니다.
먼저 짧은 대화를 들어보세요. 소개 또는 프로듀서의 질문(있는 경우)을 포함하여 실제로 얼마나 많은 사람들이 말하는지 기록해 보세요. 주요 인터뷰에 두 명의 참가자가 있다는 것을 안다고 해서 파일의 모든 부분에 두 명의 목소리만 있다는 것을 증명하는 것은 아닙니다.
별도의 참가자 녹음이 이미 사용 가능한 경우 참조용으로 보관하십시오. 현재 작업 흐름은 가져온 파일에 레이블을 지정합니다. 별도의 참가자 트랙을 동기화된 대화에 자동으로 병합하는 방법은 설명하지 않습니다. 복사하고 보관할 수 있는 녹음을 사용하고 있는지 확인하세요.
화자 분리와 예상 인원 준비하기
화자 분리에는 음성 인식 외에도 리소스가 있습니다. Alison의 파일 전사 창에서 화자 옵션을 활성화하고 모델 준비 프롬프트를 따릅니다. 사용 가능한 리소스 없이 설정을 활성화한다고 해서 최종 전사 기록에 레이블이 포함된다는 증거는 아닙니다.
카운트 메뉴는 자동 추정과 2에서 6까지의 알려진 카운트를 제공합니다. 실제 2인 인터뷰의 경우 2를 선택하면 그룹화할 음성 수를 프로세스에 알려줍니다. 확실하지 않은 경우 자동을 사용하고 결과를 검사하십시오. 알려진 개수 메뉴는 설정 범위이지 자동 모드에서 처리할 수 있는 개수에 대한 측정된 제한이 아닙니다.
카운트는 지침일 뿐 보장은 아닙니다. 세 번째 음성이 나타나거나 한 사람이 마이크나 말하기 스타일을 변경하는 경우 잘못된 고정 개수로 인해 구절이 잘못 그룹화될 수 있습니다. 오프닝이 모든 화자를 설정한다고 가정하기보다는 전체 녹음을 확인하십시오.
인터뷰 파일 전사하기
실제 음성에 대한 인식 언어를 선택합니다. 번역이 필요한 경우 해당 대상을 독립적으로 선택하고 필요한 쌍이 사용 가능한지 확인하십시오. 원래 언어로 이름과 화자 할당을 확인하는 동안 번역을 해제할 수 있습니다.
- 인터뷰 오디오 또는 비디오 파일을 전사 대기열에 추가합니다.
- 허용된 파일의 길이를 확인하고 음성 언어를 선택하세요.
- 필요한 인정 자원을 준비합니다. 자동 언어 감지에는 호환되는 로컬 모델이 필요합니다.
- 화자 분할(화자 라벨링)을 활성화하고 요청된 화자 리소스를 준비합니다.
- 정당화될 때 말하는 사람의 수를 선택하거나 자동으로 두고 전사를 시작합니다.
- 라벨을 수락하기 전에 각 참가자의 결과와 재생 구절을 엽니다.
파일 상태를 통해 처리 완료 여부를 알 수 있습니다. 결과가 부분적일 경우 처리된 부분만 검토하고 누락된 부분을 처리한 후 완전한 인터뷰로 제시합니다.
이름을 넣기 전에 화자 배정 수정하기
각 음성에서 명확한 문장을 찾아 오디오를 재생합니다. 인터뷰 진행자에 해당하는 초기 라벨과 게스트에 해당하는 라벨을 설정합니다. 뒷부분도 확인하세요. 시작 라벨이 정확하다고 해서 화자의 모든 변경 사항이 올바르게 처리되었음을 증명하는 것은 아닙니다.
단락이 잘못 할당된 경우 전사문의 편집 모드로 들어가서 해당 단락에 대한 올바른 기존 화자를 선택하십시오. 필요한 경우 단어를 별도로 수정하세요. 이름 변경은 전사 기록 전체의 레이블에 적용됩니다. 레이블이 잘못 지정된 단락 하나만 이동하는 데는 적합한 도구가 아닙니다.
매우 짧은 답변과 중단에는 주의를 기울여야 합니다. 인식된 세그먼트는 화자 변경에 걸쳐 있을 수 있으며 사용 가능한 타이밍 정보는 세그먼트를 얼마나 정확하게 분할할 수 있는지에 영향을 미칩니다. 모든 짧은 "예" 또는 중복된 발언이 자체적으로 완벽한 라벨을 받을 것이라고 가정하지 마십시오.
목소리를 확인한 후 라벨 이름 바꾸기
일반 레이블을 인터뷰 진행자 및 게스트과 같은 확인된 이름이나 역할로 바꿉니다. 역할은 개인 이름이 필요하지 않을 때 유용합니다. 자동으로 인식된 소개에서 추측하기보다는 인터뷰에 수반되는 자료와 철자를 일관되게 유지하십시오.
화자 이름 컨트롤은 전사 기록 및 해당 내보내기에 사용되는 레이블을 업데이트합니다. 전역 이름 변경으로 인해 게스트의 이름이 인터뷰 진행자에게 연결되지 않았는지 확인하기 위해 명명된 구절을 재생합니다. 하나의 실제 음성이 여러 레이블로 분할된 경우 동일한 이름을 지정하기 전에 해당 부분을 확인하십시오.
라벨 이름을 바꾸면 편집 결정이 기록됩니다. 이는 음성 인증이 아니며 향후 파일에 대한 자동 ID 프로필을 생성하지 않습니다. 새 녹음의 라벨을 독립적으로 검토합니다.
나중에도 확인하기 쉬운 대화 내보내기
읽기 가능하거나 재사용 가능한 문서의 경우 TXT, Markdown, PDF 또는 CSV를 선택하세요. 화자 라벨이 있는 경우 화자를 포함하는 옵션을 활성화합니다. 독자가 녹음 내용으로 돌아가야 하는 경우 타임스탬프를 유지하세요. 원본, 번역 및 이중 언어 내보내기 선택은 기록에서 사용 가능한 텍스트에 따라 다릅니다.
SRT 및 VTT는 자막 워크플로우에도 사용할 수 있으며 항상 필요한 시간 축을 포함합니다. 자막 파일을 공유하기 전에 의도한 디스플레이를 확인하십시오. 유용한 인터뷰 문서와 편안한 비디오 자막 트랙에는 서로 다른 형식 결정이 필요합니다.
공유하기 전에 이름, 인용문, 번호, 약속, 불확실한 귀속을 다시 들어보세요. 발표자가 라벨을 붙인 초안은 이러한 구절을 찾는 데 도움이 됩니다. 확인되지 않은 인용문을 신뢰할 수 있게 만들지는 않습니다.
화자 라벨 문제 해결하기
라벨이 표시되지 않으면 화자 분할(화자 라벨 지정)이 활성화되어 있고 해당 리소스가 준비되었는지 확인하세요. 선택적인 화자 스테이지가 사용 가능한 할당을 제공하지 않는 동안 인식을 통해 텍스트를 생성할 수 있습니다. 성공적인 텍스트 결과와 성공적인 화자 라벨 지정은 동일한 상태가 아닙니다.
라벨이 잘못된 경우 카운트 설정과 오디오를 다시 확인하세요. 비슷한 목소리, 먼 곳의 말소리, 마이크 소리의 변화, 배경 소음, 겹치는 말 등으로 인해 그룹화가 어려울 수 있습니다. 명확한 구절을 기준으로 삼고, 확인할 수 있는 부분을 수정하고, 확실성을 만들어내기보다는 불확실한 원인을 눈에 띄게 남겨두십시오.
리소스가 준비되면 지원되는 인식 및 화자 작업이 Mac에서 로컬로 실행됩니다. 검토를 위해 소스 파일을 보존하고 내보낸 전사문의 의도적인 대상을 선택합니다. 다음으로 유용한 단계는 개인적으로 확인한 라벨과의 명확한 인터뷰 교환입니다.
공식 참고자료는 2026년 10월 4일에 확인되었습니다.
Microsoft: diarization and generic speaker identifiers
Amazon Transcribe: speaker labels and timestamps
FluidAudio: on-device speaker diarization framework
자주 묻는 질문
2인 인터뷰의 경우 자동 또는 2명의 발표자를 선택해야 합니까?
파일에서 정확히 두 사람이 말하는 경우 2를 선택하세요. 소개나 중단으로 인해 다른 음성이 추가되는 경우 녹음을 반영하는 개수를 사용하거나 자동으로 시도하고 화자 배정을 검토하세요.
화자 분할(화자 라벨링)이 사람의 이름을 자동으로 식별합니까?
아니요, 녹음 내에서 음성 라벨을 할당합니다. 사람이나 역할을 직접 확인한 다음 전사문에서 라벨의 이름을 바꾸세요.
누가 한 단락을 말했는지 정정할 수 있나요?
그렇습니다. 전사문 편집기를 사용하면 단락 할당을 기존 화자에게 변경할 수 있습니다. 화자의 이름을 바꾸면 대신 전사 기록 전체에서 해당 레이블이 변경됩니다.
한 사람이 두 개의 라벨을 받은 이유는 무엇입니까?
음성 그룹화는 짧은 음성, 소음, 다양한 마이크 또는 전달 변경의 영향을 받을 수 있습니다. 라벨이 같은 사람의 것인지 결정하기 전에 관련 구절을 다시 읽어보세요.
각 사람의 개별 음성을 내보낼 수 있나요?
이 기능은 전사문 텍스트에 레이블을 지정합니다. 각 화자에 대해 별도의 오디오 트랙 내보내기를 제공하거나 겹치는 음성을 제거하지 않습니다.
내보낸 문서에 발표자 이름이 표시됩니까?
전사 기록에 레이블이 있는 경우 발언자 포함을 활성화합니다. 내보내기에는 확인된 이름이 사용됩니다. 공유하기 전에 선택한 문서나 자막 형식을 확인하세요.
동일한 화자 번호가 다른 파일에 있는 동일한 사람을 식별합니까?
아니요. 각 녹음의 라벨을 독립적으로 처리합니다. 여기에 설명된 워크플로는 파일 간 음성 ID를 설정하지 않습니다.