संसाधनफ़ाइल लिप्यंतरण

Mac पर वक्ताओं के लेबल के साथ इंटरव्यू का लिप्यंतरण कैसे करें

इंटरव्यू में वक्ताओं के लेबल जोड़ें, जाँचें कि हर अंश किसने कहा, गलत आवंटन सुधारें और जाँची हुई बातचीत निर्यात करें।

2026-10-04 · 7 min
दो साक्षात्कार प्रतिभागी एक-दूसरे का सामना करते हैं, नीले और टेराकोटा आवाज रिबन के साथ वैकल्पिक वाक् लिप्यंतरण पैराग्राफ की ओर अग्रसर होते हैं।

संक्षिप्त उत्तर

एक साक्षात्कार को ट्रांसक्रिप्ट करने और बोलने वाले लोगों को अलग करने के लिए, स्पीकर डायराइजेशन (स्पीकर लेबलिंग) सक्षम होने के साथ फ़ाइल ट्रांसक्रिप्शन का उपयोग करें। यह मान्यता प्राप्त पाठ के कुछ हिस्सों में स्पीकर लेबल जोड़ता है, जिससे आपको पूरी रिकॉर्डिंग को एक आवाज माने बिना किसी प्रश्न और उसके उत्तर की समीक्षा करने में मदद मिलती है। शुरू करने से पहले पहचान और वक्ता संसाधन तैयार करें, फिर असाइनमेंट की जांच करने के लिए वापस सुनें।

Alison Workspace, macOS 15 या बाद के संस्करण पर चलने वाले Apple-सिलिकॉन Mac, M1 या नए पर पढ़ने योग्य ऑडियो और वीडियो फ़ाइलों के लिए इस वर्कफ़्लो का समर्थन करता है। आप बोलने वाले लोगों की अपेक्षित संख्या का चयन कर सकते हैं, उत्पन्न वाक् लिप्यंतरण की समीक्षा कर सकते हैं, पैराग्राफ के स्पीकर असाइनमेंट को बदल सकते हैं, लेबल का नाम बदल सकते हैं और पाठ को निर्यात कर सकते हैं। संगीत या कई लोगों के एक साथ बात करने से परिणाम का आकलन करने के बजाय साक्षात्कारकर्ता और अतिथि के बीच स्पष्ट आदान-प्रदान से शुरुआत करें।

वक्ताओं के लेबल क्या बताते हैं

वाक् पहचान पूछती है कि क्या कहा गया था। स्पीकर डायराइज़ेशन पूछता है कि रिकॉर्डिंग के एक हिस्से के दौरान कौन सी आवाज़ बोली गई थी। एक वाक् लिप्यंतरण में गलत वक्ता के साथ सही शब्द हो सकते हैं, या गलत पहचाने गए वाक्य के साथ सही वक्ता लेबल जुड़ा हो सकता है। दोनों आयामों की समीक्षा करें.

शुरुआती लेबल उस रिकॉर्डिंग के भीतर आवाज़ों को अलग करते हैं। वे अपने आप सत्यापित नाम नहीं देते और यह साबित नहीं करते कि दूसरी फ़ाइल का व्यक्ति भी वही है। आवाज़ की विशेषताएँ अंशों को वक्ता के अनुसार समूहित करने में मदद करती हैं; वास्तविक पहचान की पुष्टि अलग कार्य है।

इस गाइड में वक्ता पृथक्करण का अर्थ है लेबल किया गया पाठ। इसका मतलब प्रत्येक भागीदार के लिए एक अलग ऑडियो फ़ाइल निर्यात करना या ओवरलैपिंग एक्सचेंज से एक व्यक्ति की आवाज़ को हटाना नहीं है। वर्कफ़्लो चुनने से पहले तय करें कि आपको पढ़ने योग्य वार्तालाप रिकॉर्ड या अलग ऑडियो ट्रैक की आवश्यकता है या नहीं।

जाँची जा सकने वाली इंटरव्यू रिकॉर्डिंग चुनें

सुनने में आसान भाषण के साथ सर्वोत्तम उपलब्ध मूल रिकॉर्डिंग का उपयोग करें। यदि मूल पहले से ही आयातित है तो उसके आकार को कम करने के लिए संपीड़ित प्रतिलिपि बनाने से बचें। धीमे बोलने वाला अतिथि, पृष्ठभूमि संगीत और विभिन्न माइक्रोफ़ोन से आने वाली आवाज़ें परिणाम की जांच करने के लिए आवश्यक कार्य को बढ़ा सकती हैं।

पहले एक संक्षिप्त बातचीत सुनें. ध्यान दें कि वास्तव में कितने लोग बोलते हैं, जिसमें परिचय या यदि उपस्थित हों तो निर्माता का प्रश्न भी शामिल है। यह जानते हुए कि मुख्य साक्षात्कार में दो प्रतिभागी हैं, यह साबित नहीं होता कि फ़ाइल के प्रत्येक भाग में केवल दो आवाज़ें हैं।

यदि अलग-अलग प्रतिभागी रिकॉर्डिंग पहले से ही उपलब्ध हैं, तो उन्हें संदर्भ के रूप में रखें। वर्तमान वर्कफ़्लो आयातित फ़ाइल को लेबल करता है; यह अलग-अलग प्रतिभागी ट्रैकों को स्वचालित रूप से सिंक्रनाइज़ वार्तालाप में विलय करने का वर्णन नहीं करता है। सुनिश्चित करें कि आप उन रिकॉर्डिंग्स का उपयोग कर रहे हैं जिन्हें आप ट्रांसक्राइब कर सकते हैं और अपने पास रख सकते हैं।

वक्ताओं का पृथक्करण और अपेक्षित संख्या तैयार करें

वक्ता पृथक्करण में वाक् पहचान के अतिरिक्त संसाधन भी होते हैं। Alison की फ़ाइल-ट्रांसक्रिप्शन विंडो में, स्पीकर विकल्प को सक्षम करें और इसके मॉडल-तत्परता संकेत का पालन करें। प्रयोग करने योग्य संसाधनों के बिना किसी सेटिंग को चालू करना इस बात का प्रमाण नहीं है कि अंतिम रिकॉर्ड में लेबल होंगे।

गिनती मेनू 2 से 6 तक स्वचालित अनुमान और ज्ञात गिनती प्रदान करता है। वास्तव में दो-व्यक्ति साक्षात्कार के लिए, 2 चुनने से प्रक्रिया को पता चलता है कि समूह में कितनी आवाज़ें हैं। यदि आप निश्चित नहीं हैं, तो स्वचालित का उपयोग करें और परिणाम का निरीक्षण करें। ज्ञात-गिनती मेनू एक सेटिंग रेंज है, न कि उस संख्या पर मापी गई सीमा जिसे स्वचालित मोड संभाल सकता है।

गिनती मार्गदर्शन है, गारंटी नहीं। यदि कोई तीसरी आवाज़ आती है, या यदि एक व्यक्ति माइक्रोफ़ोन या बोलने की शैली बदलता है, तो गलत निश्चित गिनती मार्ग को बुरी तरह समूहित कर सकती है। यह मानने के बजाय कि उद्घाटन प्रत्येक वक्ता को स्थापित करता है, पूरी रिकॉर्डिंग की जाँच करें।

इंटरव्यू फ़ाइल का लिप्यंतरण करें

वास्तविक भाषण के लिए पहचान भाषा चुनें। यदि आपको अनुवाद की आवश्यकता है, तो स्वतंत्र रूप से उसका लक्ष्य चुनें और पुष्टि करें कि आवश्यक जोड़ी उपलब्ध है। आप मूल भाषा में नाम और स्पीकर असाइनमेंट की जाँच करते समय अनुवाद को छोड़ सकते हैं।

  1. साक्षात्कार ऑडियो या वीडियो फ़ाइल को प्रतिलेखन कतार में जोड़ें।
  2. स्वीकृत फ़ाइल की अवधि जांचें और बोली जाने वाली भाषा का चयन करें।
  3. आवश्यक वाक् पहचान संसाधन तैयार करें; स्वचालित भाषा पहचान के लिए एक संगत स्थानीय मॉडल की आवश्यकता होती है।
  4. स्पीकर डायराइजेशन (स्पीकर लेबलिंग) सक्षम करें और अनुरोधित स्पीकर संसाधन तैयार करें।
  5. उचित होने पर बोलने वाले लोगों की ज्ञात संख्या चुनें, या इसे स्वचालित पर छोड़ दें, फिर प्रतिलेखन शुरू करें।
  6. लेबल स्वीकार करने से पहले परिणाम खोलें और प्रत्येक प्रतिभागी के अंशों को दोबारा चलाएं।

फ़ाइल की स्थिति आपको बताएगी कि प्रसंस्करण पूरा हुआ या नहीं। यदि परिणाम आंशिक है, तो केवल संसाधित भाग की समीक्षा करें और इसे पूर्ण साक्षात्कार के रूप में प्रस्तुत करने से पहले छूटे हुए शेष से निपटें।

नाम जोड़ने से पहले वक्ता आवंटन सुधारें

प्रत्येक आवाज़ से एक स्पष्ट वाक्य ढूंढें और उसका ऑडियो चलाएं। स्थापित करें कि कौन सा प्रारंभिक लेबल साक्षात्कारकर्ता से मेल खाता है और कौन सा अतिथि से मेल खाता है। बाद के अंशों की भी जाँच करें: एक सही उद्घाटन लेबल यह साबित नहीं करता है कि स्पीकर के सभी परिवर्तन सही ढंग से संभाले गए थे।

जब कोई पैराग्राफ गलत तरीके से असाइन किया जाता है, तो वाक् लिप्यंतरण के संपादन मोड में प्रवेश करें और उस पैराग्राफ के लिए सही मौजूदा स्पीकर चुनें। यदि आवश्यक हो तो शब्दों को अलग-अलग ठीक करें। पूरे रिकॉर्ड में लेबल पर नाम परिवर्तन लागू होता है; यह केवल एक गलत लेबल वाले अनुच्छेद को आगे बढ़ाने के लिए सही उपकरण नहीं है।

बहुत संक्षिप्त उत्तर और रुकावटें ध्यान देने योग्य हैं। एक मान्यता प्राप्त खंड एक स्पीकर परिवर्तन को फैला सकता है, और उपलब्ध समय की जानकारी प्रभावित करती है कि इसे कितनी सटीकता से विभाजित किया जा सकता है। यह मत मानिए कि प्रत्येक संक्षिप्त "हाँ" या ओवरलैप की गई टिप्पणी को अपना स्वयं का सही लेबल प्राप्त होगा।

आवाज़ों की पुष्टि के बाद लेबल का नाम बदलें

जेनेरिक लेबल को साक्षात्कारकर्ता और अतिथि जैसे पुष्टि किए गए नामों या भूमिकाओं से बदलें। भूमिकाएँ तब उपयोगी होती हैं जब आपको व्यक्तिगत नामों की आवश्यकता नहीं होती है। स्वचालित रूप से मान्यता प्राप्त परिचय से अनुमान लगाने के बजाय साक्षात्कार के साथ आने वाली सामग्री के अनुरूप वर्तनी रखें।

स्पीकर-नाम नियंत्रण रिकॉर्ड और उसके निर्यात द्वारा उपयोग किए गए लेबल को अपडेट करते हैं। यह पुष्टि करने के लिए नामित अंश को दोबारा चलाएं कि वैश्विक नाम परिवर्तन के कारण साक्षात्कारकर्ता के साथ अतिथि का नाम नहीं जुड़ा है। जब एक वास्तविक आवाज़ को कई लेबलों में विभाजित किया गया हो, तो एक ही नाम निर्दिष्ट करने से पहले उनके अंशों की जाँच करें।

किसी लेबल का नाम बदलना आपके संपादकीय निर्णय को रिकॉर्ड करता है। यह आवाज़ से पहचान का प्रमाणीकरण नहीं है और भविष्य की फ़ाइलों के लिए स्वचालित पहचान प्रोफ़ाइल नहीं बनाता है। नई रिकॉर्डिंग के लेबल की स्वतंत्र रूप से समीक्षा करें।

आसानी से जाँची जा सकने वाली बातचीत निर्यात करें

पठनीय या पुन: प्रयोज्य दस्तावेज़ के लिए TXT, Markdown, PDF, या CSV चुनें। जहां स्पीकर लेबल मौजूद हों, वहां स्पीकर शामिल करने का विकल्प सक्षम करें; यदि पाठक को रिकॉर्डिंग पर वापस लौटने की आवश्यकता होगी तो टाइमस्टैम्प रखें। मूल, अनुवादित और द्विभाषी निर्यात विकल्प रिकॉर्ड में उपलब्ध पाठ पर निर्भर करते हैं।

SRT और VTT उपशीर्षक वर्कफ़्लो के लिए भी उपलब्ध हैं और हमेशा उनके आवश्यक समय अक्ष को शामिल करते हैं। उपशीर्षक फ़ाइल साझा करने से पहले इच्छित प्रदर्शन की जाँच करें: एक उपयोगी साक्षात्कार दस्तावेज़ और एक आरामदायक वीडियो उपशीर्षक ट्रैक के लिए अलग-अलग स्वरूपण निर्णयों की आवश्यकता होती है।

साझा करने से पहले नाम, उद्धरण, संख्याएँ, प्रतिबद्धताएँ और अनिश्चित विशेषताएँ फिर से सुनें। स्पीकर-लेबल वाला ड्राफ्ट आपको इन अंशों को ढूंढने में मदद करता है; यह एक अनियंत्रित उद्धरण को विश्वसनीय नहीं बनाता है।

वक्ता लेबल की समस्याएँ जाँचें

यदि कोई लेबल दिखाई नहीं देता है, तो जांचें कि स्पीकर डायराइज़ेशन (स्पीकर लेबलिंग) सक्षम था और इसके संसाधन तैयार थे। पहचान पाठ का उत्पादन कर सकती है जबकि वैकल्पिक वक्ता चरण कोई उपयोगी असाइनमेंट प्रदान नहीं करता है। एक सफल पाठ परिणाम और सफल स्पीकर लेबलिंग एक ही स्थिति नहीं हैं।

यदि लेबल गलत हैं, तो गिनती सेटिंग और ऑडियो पर दोबारा जाएँ। समान आवाज़ें, दूर की बोली, माइक्रोफ़ोन ध्वनि में परिवर्तन, पृष्ठभूमि शोर और ओवरलैपिंग बातचीत समूह बनाना कठिन बना सकती है। एंकर के रूप में स्पष्ट अनुच्छेदों का उपयोग करें, जो आप सत्यापित कर सकते हैं उसे सही करें, और निश्चितता का आविष्कार करने के बजाय अनिश्चित आरोप को दृश्यमान छोड़ दें।

संसाधन तैयार होने के बाद, समर्थित पहचान और स्पीकर कार्य आपके Mac पर स्थानीय रूप से चलता है। समीक्षा के लिए स्रोत फ़ाइल को सुरक्षित रखें और निर्यातित वाक् लिप्यंतरण के लिए एक जानबूझकर गंतव्य चुनें। अगला उपयोगी कदम उन लेबलों के साथ एक स्पष्ट साक्षात्कार आदान-प्रदान है जिन्हें आपने व्यक्तिगत रूप से जांचा है।

आधिकारिक संदर्भों की जाँच 4 अक्टूबर, 2026 को की गई

Microsoft: diarization and generic speaker identifiers
Amazon Transcribe: speaker labels and timestamps
FluidAudio: on-device speaker diarization framework

अक्सर पूछे जाने वाले प्रश्न

क्या मुझे दो व्यक्तियों के साक्षात्कार के लिए स्वचालित या 2 स्पीकर चुनना चाहिए?

जब फ़ाइल में बिल्कुल दो लोग बोलें तो 2 चुनें। यदि परिचय या व्यवधान में अन्य आवाजें जोड़ी जाती हैं, तो एक गिनती का उपयोग करें जो रिकॉर्डिंग को दर्शाती है या स्वचालित प्रयास करें और असाइनमेंट की समीक्षा करें।

क्या स्पीकर डायराइज़ेशन (स्पीकर लेबलिंग) स्वचालित रूप से लोगों के नामों की पहचान करता है?

नहीं, यह रिकॉर्डिंग के भीतर वॉयस लेबल निर्दिष्ट करता है। लोगों या भूमिकाओं की स्वयं पुष्टि करें, फिर वाक् लिप्यंतरण में लेबल का नाम बदलें।

क्या मैं सही कर सकता हूँ कि एक पैराग्राफ किसने कहा?

हाँ. वाक् लिप्यंतरण संपादक आपको पैराग्राफ के असाइनमेंट को मौजूदा स्पीकर में बदलने की सुविधा देता है। किसी स्पीकर का नाम बदलने से वह लेबल पूरे रिकॉर्ड में बदल जाता है।

एक व्यक्ति को दो लेबल क्यों प्राप्त हुए?

वॉयस ग्रुपिंग छोटे भाषण, शोर, विभिन्न माइक्रोफोन या डिलीवरी में बदलाव से प्रभावित हो सकती है। यह तय करने से पहले कि क्या लेबल एक ही व्यक्ति के हैं, प्रासंगिक अंशों को दोबारा दोहराएं।

क्या मैं प्रत्येक व्यक्ति की पृथक आवाज़ को निर्यात कर सकता हूँ?

यह सुविधा वाक् प्रतिलेख पाठ को लेबल करती है। यह प्रत्येक स्पीकर के लिए अलग ऑडियो-ट्रैक निर्यात प्रदान नहीं करता है या ओवरलैपिंग आवाज़ों को नहीं हटाता है।

क्या निर्यातित दस्तावेज़ में स्पीकर के नाम दिखाई देंगे?

जब रिकॉर्ड में लेबल हों तो स्पीकर शामिल करें सक्षम करें। निर्यात में पुष्टि किए गए नामों का उपयोग किया जाता है. इसे साझा करने से पहले चुने हुए दस्तावेज़ या उपशीर्षक प्रारूप की जाँच करें।

क्या वही स्पीकर नंबर किसी अन्य फ़ाइल में उसी व्यक्ति की पहचान करेगा?

नहीं, प्रत्येक रिकॉर्डिंग में लेबल को स्वतंत्र रूप से व्यवहार करें। यहां वर्णित वर्कफ़्लो क्रॉस-फ़ाइल ध्वनि पहचान स्थापित नहीं करता है।

संबंधित गाइड