แหล่งข้อมูลการถอดเสียงไฟล์

วิธีถอดเสียงสัมภาษณ์พร้อมป้ายกำกับผู้พูดบน Mac

เพิ่มป้ายกำกับผู้พูดให้บทสัมภาษณ์ ตรวจสอบว่าแต่ละช่วงใครเป็นคนพูด แก้การระบุผู้พูด แล้วส่งออกบทสนทนาที่ตรวจทานแล้ว

2026-10-04 · 7 min
ผู้เข้าร่วมสัมภาษณ์สองคนเผชิญหน้ากัน โดยมีริบบิ้นเสียงสีน้ำเงินและดินเผาซึ่งนำไปสู่ย่อหน้าข้อความที่ถอดเสียงสลับกัน

คำตอบสั้น ๆ

หากต้องการถอดเสียงการสัมภาษณ์และแยกแยะผู้พูด ให้ใช้การถอดเสียงไฟล์โดยเปิดใช้งานการแยกเสียงของผู้พูด (การติดป้ายกำกับผู้พูด) โดยจะเพิ่มป้ายกำกับผู้พูดลงในส่วนของข้อความที่จดจำได้ ช่วยให้คุณตรวจสอบคำถามและคำตอบได้โดยไม่ต้องถือว่าการบันทึกทั้งหมดเป็นเสียงเดียว เตรียมแหล่งข้อมูลการจดจำและผู้พูดก่อนเริ่ม จากนั้นฟังอีกครั้งเพื่อตรวจสอบการระบุผู้พูด

Alison Workspace รองรับขั้นตอนการทำงานนี้สำหรับไฟล์เสียงและวิดีโอที่อ่านได้บน Apple-silicon Mac, M1 หรือใหม่กว่า ที่ใช้ macOS 15 หรือใหม่กว่า คุณสามารถเลือกจำนวนคนที่คาดว่าจะพูด ตรวจสอบข้อความที่ถอดเสียงที่สร้างขึ้น เปลี่ยนการกำหนดผู้พูดในย่อหน้า เปลี่ยนชื่อป้ายกำกับ และส่งออกข้อความ เริ่มต้นด้วยการแลกเปลี่ยนที่ชัดเจนระหว่างผู้สัมภาษณ์กับแขกรับเชิญ แทนที่จะตัดสินผลลัพธ์จากดนตรีหรือหลายๆ คนพูดคุยกัน

ป้ายกำกับผู้พูดบอกอะไรบ้าง

การรู้จำเสียงจะถามสิ่งที่พูด การถอดเสียงของผู้พูดจะถามว่าเสียงใดพูดระหว่างส่วนหนึ่งของการบันทึก ข้อความที่ถอดเสียงอาจมีคำที่ถูกต้องกับผู้พูดที่ไม่ถูกต้อง หรือมีป้ายกำกับผู้พูดที่ถูกต้องติดอยู่กับประโยคที่จดจำได้อย่างไม่ถูกต้อง ทบทวนทั้งสองมิติ

ป้ายกำกับเริ่มต้นแยกเสียงภายในไฟล์บันทึกนั้น ไม่ได้ระบุชื่อจริงที่ยืนยันแล้วโดยอัตโนมัติ หรือพิสูจน์ว่าบุคคลในอีกไฟล์เป็นคนเดียวกัน ลักษณะเสียงช่วยจัดกลุ่มช่วงคำพูดตามผู้พูด ส่วนการยืนยันตัวบุคคลเป็นอีกขั้นตอนหนึ่ง

การแยกผู้พูดในคู่มือนี้หมายถึงข้อความที่มีป้ายกำกับ ไม่ได้หมายถึงการส่งออกไฟล์เสียงแบบแยกสำหรับผู้เข้าร่วมแต่ละคนหรือลบเสียงของบุคคลหนึ่งออกจากการแลกเปลี่ยนที่ทับซ้อนกัน ตัดสินใจว่าคุณต้องการบันทึกการสนทนาที่อ่านได้หรือแยกแทร็กเสียงก่อนที่จะเลือกเวิร์กโฟลว์

เตรียมไฟล์สัมภาษณ์ที่ตรวจทานได้

ใช้การบันทึกต้นฉบับที่ดีที่สุดที่มีอยู่ พร้อมด้วยคำพูดที่ได้ยินง่าย หลีกเลี่ยงการทำสำเนาแบบบีบอัดเพื่อลดขนาดหากต้นฉบับนำเข้าแล้ว แขกที่เงียบเสียง เพลงแบ็คกราวด์ และเสียงที่มาจากไมโครโฟนต่างๆ สามารถเพิ่มงานที่จำเป็นในการตรวจสอบผลลัพธ์ได้

ฟังแลกเปลี่ยนสั้นๆก่อน สังเกตจำนวนคนที่พูดจริง รวมถึงการแนะนำหรือคำถามของโปรดิวเซอร์ หากมี การรู้ว่าการสัมภาษณ์หลักมีผู้เข้าร่วมสองคนไม่ได้พิสูจน์ว่าทุกส่วนของไฟล์มีเพียงสองเสียง

หากมีการบันทึกของผู้เข้าร่วมแยกกันอยู่แล้ว ให้เก็บไว้เป็นข้อมูลอ้างอิง เวิร์กโฟลว์ปัจจุบันจะติดป้ายกำกับไฟล์ที่นำเข้า ไม่ได้อธิบายการรวมแทร็กของผู้เข้าร่วมที่แยกจากกันเข้ากับการสนทนาที่ซิงโครไนซ์โดยอัตโนมัติ ตรวจสอบให้แน่ใจว่าคุณใช้การบันทึกที่คุณสามารถถอดเสียงและเก็บรักษาได้

เตรียมการแยกผู้พูดและจำนวนคนที่คาดไว้

การแยกผู้พูดมีแหล่งข้อมูลนอกเหนือจากการรู้จำเสียง ในหน้าต่างการถอดเสียงไฟล์ของ Alison ให้เปิดใช้งานตัวเลือกผู้พูดและปฏิบัติตามข้อความแจ้งความพร้อมของโมเดล การเปิดการตั้งค่าโดยไม่มีทรัพยากรที่ใช้งานได้ไม่ได้พิสูจน์ว่าบันทึกสุดท้ายจะมีป้ายกำกับ

เมนูนับเสนอการประมาณค่าอัตโนมัติและการนับที่ทราบตั้งแต่ 2 ถึง 6 สำหรับการสัมภาษณ์สองคนอย่างแท้จริง การเลือก 2 คนจะบอกขั้นตอนว่าจะจัดกลุ่มเสียงกี่เสียง หากไม่แน่ใจให้ใช้ระบบอัตโนมัติและตรวจสอบผลลัพธ์ เมนูการนับที่ทราบเป็นช่วงการตั้งค่า ไม่ใช่ขีดจำกัดที่วัดได้ของโหมดอัตโนมัติของตัวเลขที่สามารถจัดการได้

การนับเป็นเพียงแนวทาง ไม่ใช่การรับประกัน หากมีเสียงที่สามปรากฏขึ้น หรือหากบุคคลหนึ่งเปลี่ยนไมโครโฟนหรือรูปแบบการพูด การนับคงที่ที่ไม่ถูกต้องอาจทำให้จัดกลุ่มข้อความได้ไม่ดี ตรวจสอบการบันทึกแบบเต็มแทนที่จะคิดว่าการเปิดเป็นผู้พูดทุกคน

ถอดเสียงไฟล์สัมภาษณ์

เลือกภาษาการจดจำสำหรับคำพูดจริง หากคุณต้องการการแปล ให้เลือกเป้าหมายแยกกันและยืนยันว่ามีคู่ที่ต้องการ คุณสามารถปิดการแปลได้ในขณะที่ตรวจสอบชื่อและการกำหนดวิทยากรในภาษาต้นฉบับ

  1. เพิ่มไฟล์เสียงหรือวิดีโอการสัมภาษณ์ลงในคิวการถอดเสียง
  2. ตรวจสอบระยะเวลาของไฟล์ที่ยอมรับและเลือกภาษาพูด
  3. เตรียมทรัพยากรการรับรู้ที่จำเป็น การตรวจหาภาษาอัตโนมัติจำเป็นต้องมีโมเดลท้องถิ่นที่เข้ากันได้
  4. เปิดใช้งานการแยกเสียงของผู้พูด (การติดป้ายกำกับผู้พูด) และเตรียมทรัพยากรของผู้พูดที่ร้องขอ
  5. เลือกจำนวนผู้พูดที่ทราบเมื่อมีเหตุผล หรือปล่อยให้เป็นอัตโนมัติ จากนั้นเริ่มการถอดเสียง
  6. เปิดผลการแข่งขันและเล่นซ้ำข้อความจากผู้เข้าร่วมแต่ละคนก่อนที่จะยอมรับป้ายกำกับ

ให้สถานะของไฟล์บอกคุณว่าการประมวลผลเสร็จสมบูรณ์หรือไม่ หากผลลัพธ์ออกมาเพียงบางส่วน ให้ตรวจสอบเฉพาะส่วนที่ประมวลผลแล้วและจัดการกับส่วนที่เหลือที่ขาดหายไปก่อนที่จะนำเสนอเป็นการสัมภาษณ์ที่สมบูรณ์

แก้การระบุผู้พูดก่อนเพิ่มชื่อ

ค้นหาประโยคที่ชัดเจนจากแต่ละเสียงและเล่นเสียงของมัน กำหนดป้ายกำกับเริ่มต้นที่ตรงกับผู้สัมภาษณ์และตรงกับแขกรับเชิญ ตรวจสอบข้อความในภายหลังด้วย: ป้ายเปิดที่ถูกต้องไม่ได้พิสูจน์ว่าการเปลี่ยนแปลงของผู้พูดทั้งหมดได้รับการจัดการอย่างถูกต้อง

เมื่อกำหนดย่อหน้าไม่ถูกต้อง ให้เข้าสู่โหมดแก้ไขของข้อความที่ถอดเสียง และเลือกผู้พูดที่มีอยู่ให้ถูกต้องสำหรับย่อหน้านั้น แก้ไขคำแยกกันหากจำเป็น การเปลี่ยนชื่อมีผลกับป้ายกำกับตลอดทั้งบันทึก ไม่ใช่เครื่องมือที่เหมาะสมสำหรับการย้ายย่อหน้าที่มีป้ายกำกับผิดเพียงย่อหน้าเดียว

การตอบกลับและการขัดจังหวะที่สั้นมากสมควรได้รับความสนใจ เซ็กเมนต์ที่ได้รับการยอมรับสามารถขยายช่วงการเปลี่ยนผู้พูด และข้อมูลจังหวะเวลาที่มีอยู่จะส่งผลต่อความแม่นยำในการแบ่งเซ็กเมนต์นั้น อย่าถือว่าทุกคำที่ “ใช่” สั้นๆ หรือคำพูดที่ทับซ้อนกันจะได้รับการติดป้ายกำกับที่สมบูรณ์แบบในตัวเอง

เปลี่ยนชื่อป้ายกำกับหลังยืนยันเสียงแล้ว

แทนที่ป้ายกำกับทั่วไปด้วยชื่อหรือบทบาทที่ได้รับการยืนยัน เช่น ผู้สัมภาษณ์และแขก บทบาทมีประโยชน์เมื่อคุณไม่ต้องการชื่อส่วนตัว พยายามสะกดให้สอดคล้องกับเนื้อหาประกอบการสัมภาษณ์ แทนที่จะเดาจากคำนำที่ระบบจดจำโดยอัตโนมัติ

ตัวควบคุมชื่อผู้พูดจะอัปเดตป้ายกำกับที่ใช้โดยเรกคอร์ดและการส่งออก เล่นข้อความที่มีชื่อซ้ำเพื่อยืนยันว่าการเปลี่ยนชื่อทั้งเอกสารไม่ได้แนบชื่อแขกไว้กับผู้สัมภาษณ์ เมื่อเสียงจริงหนึ่งเสียงถูกแบ่งออกเป็นหลายป้ายกำกับ ให้ตรวจสอบข้อความก่อนที่จะตั้งชื่อเดียวกัน

การเปลี่ยนชื่อป้ายกำกับจะบันทึกการตัดสินใจด้านบรรณาธิการของคุณ ไม่ใช่การรับรองความถูกต้องด้วยเสียงและไม่สร้างโปรไฟล์ข้อมูลระบุตัวตนอัตโนมัติสำหรับไฟล์ในอนาคต ตรวจสอบป้ายกำกับของการบันทึกใหม่อย่างอิสระ

ส่งออกบทสนทนาที่ตรวจสอบได้ง่าย

เลือก TXT, Markdown, PDF หรือ CSV สำหรับเอกสารที่อ่านได้หรือนำมาใช้ซ้ำได้ หากมีป้ายกำกับผู้พูด ให้เปิดใช้งานตัวเลือกเพื่อรวมผู้พูดด้วย เก็บการประทับเวลาไว้หากผู้อ่านจำเป็นต้องกลับไปที่การบันทึก ตัวเลือกการส่งออกต้นฉบับ แปล และสองภาษาจะขึ้นอยู่กับข้อความที่มีอยู่ในเรกคอร์ด

SRT และ VTT พร้อมใช้งานสำหรับเวิร์กโฟลว์คำบรรยายและรวมแกนเวลาที่ต้องการไว้ด้วยเสมอ ตรวจสอบการแสดงผลที่ต้องการก่อนแชร์ไฟล์คำบรรยาย: เอกสารสัมภาษณ์ที่มีประโยชน์และแทร็กคำบรรยายวิดีโอที่สะดวกสบายจำเป็นต้องมีการตัดสินใจเกี่ยวกับการจัดรูปแบบที่แตกต่างกัน

ฟังชื่อ คำพูดอ้างอิง หมายเลข คำมั่นสัญญา และการระบุแหล่งที่มาที่ไม่ชัดเจนอีกครั้งก่อนแบ่งปัน ฉบับร่างที่มีผู้พูดช่วยคุณค้นหาข้อความเหล่านี้ มันไม่ได้ทำให้ใบเสนอราคาที่ไม่ได้ตรวจสอบมีความน่าเชื่อถือ

ตรวจสอบปัญหาป้ายกำกับผู้พูด

หากไม่มีป้ายกำกับปรากฏขึ้น ให้ตรวจสอบว่าได้เปิดใช้งานการแยกเสียงของผู้พูด (การติดป้ายกำกับผู้พูด) และทรัพยากรพร้อมแล้ว การจดจำสามารถสร้างข้อความได้ในขณะที่เวทีวิทยากรเสริมไม่มีการกำหนดการใช้งาน ผลลัพธ์ข้อความที่สำเร็จและการติดป้ายกำกับผู้พูดที่สำเร็จนั้นไม่ใช่สถานะเดียวกัน

หากป้ายกำกับไม่ถูกต้อง ให้ลองตั้งค่าการนับและเสียงอีกครั้ง เสียงที่คล้ายกัน คำพูดที่อยู่ห่างไกล การเปลี่ยนแปลงของเสียงไมโครโฟน เสียงพื้นหลัง และการพูดคุยที่ทับซ้อนกันอาจทำให้การจัดกลุ่มทำได้ยาก ใช้ข้อความที่ชัดเจนเป็นจุดยึด แก้ไขสิ่งที่คุณสามารถตรวจสอบได้ และปล่อยให้การระบุแหล่งที่มาที่ไม่แน่นอนปรากฏให้เห็น แทนที่จะสร้างความมั่นใจ

หลังจากที่ทรัพยากรพร้อมแล้ว การจดจำและการทำงานของผู้พูดที่รองรับจะทำงานในเครื่อง Mac ของคุณ เก็บไฟล์ต้นฉบับไว้เพื่อตรวจสอบและเลือกปลายทางที่ต้องการสำหรับข้อความที่ถอดเสียงที่ส่งออก ขั้นตอนต่อไปที่เป็นประโยชน์คือการแลกเปลี่ยนการสัมภาษณ์ที่ชัดเจนกับป้ายกำกับที่คุณได้ตรวจสอบเป็นการส่วนตัว

ข้อมูลอ้างอิงอย่างเป็นทางการได้รับการตรวจสอบเมื่อวันที่ 4 ตุลาคม พ.ศ. 2569

Microsoft: diarization and generic speaker identifiers
Amazon Transcribe: speaker labels and timestamps
FluidAudio: on-device speaker diarization framework

คำถามที่พบบ่อย

ฉันควรเลือกผู้พูดอัตโนมัติหรือผู้พูด 2 คนสำหรับการสัมภาษณ์สองคน?

เลือก 2 เมื่อคนสองคนพูดในไฟล์พอดี หากการแนะนำหรือการขัดจังหวะเพิ่มเสียงอื่นๆ ให้ใช้การนับที่สะท้อนถึงการบันทึกหรือลองอัตโนมัติและตรวจสอบการระบุผู้พูด

การแยกเสียงของผู้พูด (การติดฉลากผู้พูด) ระบุชื่อบุคคลโดยอัตโนมัติหรือไม่

ไม่ โดยจะกำหนดป้ายกำกับเสียงภายในการบันทึก ยืนยันบุคคลหรือบทบาทด้วยตนเอง จากนั้นเปลี่ยนชื่อป้ายกำกับในข้อความที่ถอดเสียง

ฉันขอแก้ไขผู้ที่พูดหนึ่งย่อหน้าได้ไหม

ใช่ โปรแกรมแก้ไขข้อความที่ถอดเสียงช่วยให้คุณเปลี่ยนการมอบหมายย่อหน้าให้กับผู้พูดที่มีอยู่ได้ การเปลี่ยนชื่อผู้พูดจะเปลี่ยนป้ายกำกับนั้นตลอดทั้งบันทึกแทน

เหตุใดบุคคลหนึ่งจึงได้รับสองป้ายกำกับ

การจัดกลุ่มเสียงอาจได้รับผลกระทบจากเสียงพูดสั้น เสียงรบกวน ไมโครโฟนที่แตกต่างกัน หรือการเปลี่ยนแปลงในการส่ง เล่นข้อความที่เกี่ยวข้องซ้ำก่อนที่จะตัดสินใจว่าป้ายกำกับเป็นของบุคคลคนเดียวกันหรือไม่

ฉันสามารถส่งออกเสียงแยกของแต่ละคนได้หรือไม่

คุณลักษณะนี้ติดป้ายกำกับข้อความถอดเสียงคำพูด ไม่มีการส่งออกแทร็กเสียงแยกต่างหากสำหรับผู้พูดแต่ละคนหรือลบเสียงที่ทับซ้อนกัน

ชื่อวิทยากรจะปรากฏในเอกสารที่ส่งออกหรือไม่

เปิดใช้งานรวมวิทยากรเมื่อบันทึกมีป้ายกำกับ ชื่อที่ยืนยันแล้วจะถูกนำมาใช้ในการส่งออก ตรวจสอบเอกสารหรือรูปแบบคำบรรยายที่เลือกก่อนแชร์

หมายเลขวิทยากรคนเดียวกันจะระบุบุคคลคนเดียวกันในไฟล์อื่นหรือไม่

ไม่ ปฏิบัติต่อป้ายกำกับในการบันทึกแต่ละรายการอย่างแยกจากกัน เวิร์กโฟลว์ที่อธิบายไว้ในที่นี้ไม่ได้สร้างข้อมูลประจำตัวของเสียงข้ามไฟล์

คู่มือที่เกี่ยวข้อง