पैराटेक्स्ट को दुनिया की अधिकांश लेखन प्रणालियों के साथ काम करने की क्षमता के साथ डिज़ाइन किया गया है। इस उद्देश्य के लिए, पैराटेक्स्ट में विभिन्न भाषा सेटिंग्स हैं, जिनमें शामिल हैं: वर्णमाला वर्ण संवाद। अंग्रेज़ी के लिए नीचे दिया गया उदाहरण देखें:
छोटे और बड़े अक्षर
वर्णमाला वर्ण संवाद (प्रोजेक्ट मेनू > प्रोजेक्ट सेटिंग्स > भाषा सेटिंग्स > वर्णमाला वर्ण टैब) वह जगह है जहाँ किसी भाषा के सभी छोटे और बड़े अक्षर सूचीबद्ध होते हैं। यह सूची पैराटेक्स्ट को बताती है कि कौन से अक्षर किसी भाषा का हिस्सा हैं और पैराटेक्स्ट में वर्ण जाँच का आधार बनती है।
💡 नोट: विराम चिह्न और संख्या जैसे अतिरिक्त वर्णों को मैन्युअल रूप से वर्ण जांच सूची में जोड़ना होगा (देखें प्रोजेक्ट मेनू > टूल्स > इन्वेंटरी की जाँच > कैरेक्टर इन्वेंटरी OR विराम चिह्न सूची), लेकिन सब कुछ वर्णमाला वर्ण संवाद स्वचालित रूप से वैध वर्णों के रूप में सूची में जोड़ दिए जाते हैं।
💡 नोट: वर्णमाला वर्ण सूची में केवल आपके विशिष्ट लेखन प्रणाली में प्रयुक्त वर्ण या अक्षर ही शामिल होने चाहिए, ताकि यदि कभी गलती से टाइप हो जाएँ, तो वर्ण जाँच अनुपयुक्त अक्षरों को चिह्नित कर सके। यदि आप यह सत्यापित नहीं करते कि नए प्रोजेक्ट में वास्तव में कौन से वर्ण उपयोग किए गए हैं, तो एक प्रोजेक्ट से दूसरे प्रोजेक्ट में वर्णों की प्रतिलिपि बनाने से आसानी से अमान्य वर्ण आ सकते हैं।
किसी भाषा के लिए वर्णमाला क्रम निर्दिष्ट करना
"वर्णमाला वर्ण" संवाद में वर्णों का क्रम यह निर्धारित करता है कि पैराटेक्स्ट प्रोजेक्ट में शब्दों को कैसे क्रमबद्ध किया जाएगा। ऐसे कई स्थान हैं जहाँ पैराटेक्स्ट को आपके द्वारा यहाँ परिभाषित "वर्णमाला" क्रम का उपयोग करके जानकारी को एक क्रमबद्ध सूची के रूप में प्रस्तुत करना होगा। इनमें से कुछ स्थान इस प्रकार होंगे:
- सूची विंडो में खोज परिणाम
- वर्डलिस्ट टूल
- शब्दावली (यदि किसी परियोजना में शब्दावली हो)
💡 यदि पैराटेक्स्ट आपकी अपेक्षा के अनुसार चीजों को व्यवस्थित नहीं कर रहा है, एक इसका एक कारण पात्रों का क्रम भी हो सकता है। वर्णमाला वर्ण संवाद।
उच्चारण वर्ण
भाषाओं में उच्चारण वाले अक्षर होना आम बात है, जैसे á ê ɨ ñ ò ü। इन्हें किसी प्रोजेक्ट की वर्णमाला सूची में शामिल किया जाना चाहिए। नीचे दिए गए स्पेनिश उदाहरण में स्वरों पर विचार करें:
ध्यान दें कि प्रत्येक उच्चारण वर्ण के छोटे और बड़े अक्षर शामिल हैं। यह भी ध्यान दें कि उच्चारण वाले स्वर, बिना उच्चारण वाले स्वरों के समान पंक्ति में हैं। यह आवश्यक नहीं है, लेकिन यह एक विकल्प है जिसका उपयोग तब किया जाता है जब आप चाहते हैं कि पैराटेक्स्ट सॉर्टिंग करते समय उच्चारणों को अनदेखा कर दे। यह तब मददगार हो सकता है जब आपकी भाषा में स्वर/तनाव चिह्न जैसे कुछ ऐसे हों जो शब्द के अर्थ को न बदलें।
यदि सॉर्ट ऑर्डर उपरोक्त उदाहरण की तरह कॉन्फ़िगर किया गया था, तो पैराटेक्स्ट व्यवहार नहीं करेगा e और é छाँटते समय अलग-अलग अक्षरों के रूप में। उदाहरण के लिए, निम्नलिखित काल्पनिक शब्दों को इस तरह छाँटा जाएगा:
- pepa
- pépa
- peसहूलियत
- péसहूलियत
इस तरह से छांटने से आपकी शब्दावली में अलग-अलग उच्चारण वाले अक्षरों से शुरू होने वाले शब्दों के लिए अलग-अलग खंड नहीं होंगे।
उच्चारण वाले वर्णों को गैर-उच्चारण वाले वर्णों से स्वतंत्र रूप से छांटना
यदि आप चाहते हैं कि उच्चारण वाले वर्णों को गैर-उच्चारण वाले वर्णों से स्वतंत्र रूप से क्रमबद्ध किया जाए (उदाहरण के लिए: उन्हें अलग-अलग अक्षरों के रूप में मानें), तो उच्चारण वाले वर्णों को अलग-अलग पंक्तियों में रखना होगा। नीचे दिए गए संशोधित स्पेनिश उदाहरण पर विचार करें:
यदि सॉर्ट क्रम को उपरोक्त “संशोधित स्पेनिश” उदाहरण की तरह कॉन्फ़िगर किया गया था, तो निम्नलिखित काल्पनिक शब्द इस तरह से सॉर्ट किए जाएंगे (क्योंकि e पहले आता है é):
- pepa
- peसहूलियत
- pépa
- péसहूलियत
किसी प्रोजेक्ट को इस तरह कॉन्फ़िगर करना ज़्यादा आम लगता है कि उच्चारण वाले और उच्चारण-रहित स्वर एक साथ क्रमबद्ध हों, जबकि उच्चारण वाले और उच्चारण-रहित व्यंजन एक-दूसरे से स्वतंत्र रूप से क्रमबद्ध हों। नीचे दिए गए स्पेनिश उदाहरण में ñ/Ñ के उदाहरण पर विचार करें:
यह कॉन्फ़िगरेशन पैराटेक्स्ट को सामान्य रूप से सॉर्ट करने का कारण बनेगा एन एस से अलग ñ का टिल्ड डायक्रिटिक के साथ। निम्नलिखित काल्पनिक शब्दों को इस प्रकार क्रमबद्ध किया जाएगा, क्योंकि n पहले आता है ñ:
- sonir
- soñir
- sunआरा
- suñआरा
इससे शब्दावली में “ से शुरू होने वाले शब्दों के लिए दो अलग-अलग खंड भी हो जाएंगेN" तथा "Ñ“, यदि आपने अपनी परियोजना में शब्दावली रखने का विकल्प चुना है।
द्वि आलेख
कई लेखन प्रणालियों में डायग्राफ, ट्राइग्राफ और अन्य मल्टी-ग्राफ का उपयोग किया जाता है। आप पैराटेक्स्ट को बता सकते हैं कि इन्हें कैसे क्रमबद्ध किया जाए। कुछ भाषा समुदाय मल्टी-ग्राफ पर बहुत ध्यान देते हैं क्योंकि ये उनकी भाषा की वर्तनी के लिए बहुत महत्वपूर्ण हैं, जबकि अन्य पैराटेक्स्ट को इन्हें अनदेखा करने और केवल अलग-अलग वर्णों के आधार पर क्रमबद्ध करने की अनुमति देते हैं। आइए नीचे दिए गए फुलफुलडे उदाहरण में एक मध्यम स्थिति पर विचार करें जिसमें चार डायग्राफ (mb, nd, ng, और nj) हैं:
इस उदाहरण में, पैराटेक्स्ट इन डायग्राफ से शुरू होने वाले शब्दों और एकल-वर्ण से शुरू होने वाले शब्दों के बीच अंतर करेगा और उन्हें तदनुसार क्रमबद्ध करेगा। उदाहरण के लिए:
- mआई
- mbआजी
- nAnii
- ndअरनी
- ngअरी
ऐसे अक्षर जिनके लिए विशेष कीबोर्ड की आवश्यकता हो सकती है
आपके प्रोजेक्ट में कई ऐसे अक्षर हो सकते हैं जिनकी ज़रूरत हो सकती है, लेकिन आपका कंप्यूटर उन विशेष अक्षरों वाले कीबोर्ड सॉल्यूशन के बिना उन्हें टाइप नहीं कर सकता। इन अक्षरों के उदाहरण हैं ç /Ç, ɨ/ɨ , Ŋ/ŋ, ɓ/ɓ, ɔ/ˆ और कई अन्य। फुफुल्दे ने बी (ɓ) और हुक्ड डी (ɗ) और इसके उदाहरण हैं। आपको इन अक्षरों को टाइप करने का तरीका चाहिए होगा, या फिर उन्हें कॉपी करके पेस्ट करने का तरीका चाहिए होगा। वर्णमाला वर्ण सूची। विशेष वर्ण टाइप करने का एक तरीका है स्वत: सुधार पैराटेक्स्ट में सुविधा। स्वतः सुधार के बारे में अधिक जानकारी के लिए देखें इस लेख:
दूसरा तरीका है किसी को ढूंढना या स्थापित करना कीमैन कीबोर्डअगर आपके प्रोजेक्ट में कई विशेष वर्णों की ज़रूरत है, और/या आप अपने कंप्यूटर पर दूसरे प्रोग्रामों में विशेष वर्ण टाइप करना चाहते हैं, तो यह सबसे अच्छा समाधान है। कई कीमैन कीबोर्ड में मोबाइल डिवाइस (जैसे: एंड्रॉइड या आईओएस फ़ोन) पर टाइप करने के लिए विशेष कीबोर्ड भी होते हैं।
विराम चिह्नों को वर्णमाला वर्ण के रूप में उपयोग करने से बचें
विराम चिह्नों को शब्द-निर्माण (वर्णमाला) वाले वर्णों से अलग रखना बहुत ज़रूरी है। ऐसा न करने पर कई तरह की समस्याएँ पैदा हो सकती हैं। खोज और क्रम सही ढंग से काम नहीं करेंगे; वर्ण, विराम चिह्न और वर्तनी जाँच सभी त्रुटियाँ नहीं ढूँढ पाएँगे; और शब्दसूची उपकरण अप्रत्याशित स्थानों पर शब्दों को तोड़ सकता है।
उदाहरण: कुछ लैटिन-आधारित लेखन प्रणालियाँ ग्लोटल स्टॉप को दर्शाने के लिए एक छोटे टिक मार्क का उपयोग करती हैं, और लोग अक्सर एक एपॉस्ट्रॉफी टाइप करते हैं ' या उस टिक मार्क के लिए दायाँ एकल उद्धरण चिह्न ' लगाएँ। इसी प्रकार, कुछ वर्तनी वेलर n (ŋ) को 'ng' के साथ एपॉस्ट्रॉफी या दाएँ एकल उद्धरण चिह्न का उपयोग करके लिखें। हालाँकि, इन दोनों प्रतीकों में से कोई भी सामान्यतः शब्द-निर्माण वर्ण नहीं होता है और हो सकता है कि कंप्यूटर इन्हें आपकी अपेक्षा के अनुसार संसाधित न करे (अर्थात, यह इन्हें अक्षर के बजाय विराम चिह्न के रूप में मानेगा)। इनके उपयोग की एक सीमा यह है कि अब इनमें लोअर और अपर केस होते हैं। इसके बजाय, इनमें से किसी एक का उपयोग करने की अनुशंसा की जाती है। लैटिन छोटा अक्षर साल्टिलोꞌ (U+A78C) या संशोधक अक्षर एपॉस्ट्रॉफी ʼ (U+02BC) क्योंकि कंप्यूटर इन्हें शब्द-निर्माण वर्णों के रूप में पहचानेगा, विराम चिह्नों के रूप में नहीं। आमतौर पर, वर्तनी में ग्लोटल स्टॉप के लिए बड़े अक्षर की आवश्यकता नहीं होती है, लेकिन अगर आपको इसकी आवश्यकता है, तो लैटिन स्मॉल लेटर साल्टिलो का उपयोग करें। ꞌ (U+A78C) और लैटिन कैपिटल लेटर साल्टिलो (U+A78B)। अन्य विशेष वर्णों की तरह, आपको ग्लोटल स्टॉप के लिए चुने गए वर्ण को टाइप करने का एक तरीका चाहिए होगा।
नीचे दिए गए उदाहरण पर विचार करें जिसमें ग्लोटल स्टॉप को दर्शाने के लिए साल्टिलो का उपयोग किया गया है:
💡 ध्यान दें कि साल्टिलो जैसे अक्षर अक्सर ग्लोटल स्टॉप का प्रतिनिधित्व करते हैं या एनजी जैसे ट्राइग्राफ का हिस्सा होते हैंꞌ जिन वर्तनी में बड़े अक्षरों की आवश्यकता नहीं होती। यदि किसी वर्तनी में बड़े अक्षरों वाले साल्टिलो की आवश्यकता है, तो आगे की स्लैश के बाद लैटिन के बड़े अक्षर साल्टिलो (U+A78B) को इस प्रकार रखें: ꞌ/Ꞌ.
संकुचन और हाइफ़नेशन
कई भाषाओं में संकुचन का प्रयोग होता है। उदाहरण के लिए, अंग्रेज़ी में "don't", "dosn't" और "won't" जैसे शब्द हैं। वर्तनी में स्वरों के विलोपन को "मचिखुलुपिरिरो मावा ख्रीस्तु येसु” (चिचेवा/न्यांजा)। इसलिए, सही वर्तनी के लिए एपॉस्ट्रॉफ़ की ज़रूरत होती है, लेकिन उन्हें अक्षर या शब्द-निर्माण वर्ण नहीं माना जाता। हाइफ़न के बारे में भी यही कहा जा सकता है: कुछ वर्तनी में उचित वर्तनी के लिए उनकी ज़रूरत होती है, लेकिन उन्हें शब्द-निर्माण वर्ण नहीं माना जाता।
पैराटेक्स्ट में संकुचन और हाइफ़नेशन को संभालने का तरीका उन्हें शब्द-मध्य विराम चिह्न के रूप में निर्दिष्ट करना है। शब्द-मध्यस्थ विराम चिह्न सेटिंग पर पाया जाता है अन्य कैरेक्टर टैब पर, भाषा सेटिंग के अंतर्गत। नीचे दी गई न्यांजा के लिए वर्ड-मीडियल विराम चिह्न सेटिंग पर विचार करें:
यहाँ हाइफ़न और एपॉस्ट्रॉफ़ लगाने से पैराटेक्स्ट को पता चलता है कि कुछ शब्दों में हाइफ़न या एपॉस्ट्रॉफ़ होंगे। यह महत्वपूर्ण है क्योंकि अगर हाइफ़न और एपॉस्ट्रॉफ़ यहाँ सूचीबद्ध नहीं हैं, तो पैराटेक्स्ट हाइफ़न या एपॉस्ट्रॉफ़ वाले सभी शब्दों को दो भागों में बाँट देगा। उदाहरण के लिए, न्यांजा शब्द mʼchikhulupiriro दो शब्दों में विभाजित किया जाएगा (m chikhulupiriro) जहाँ एपॉस्ट्रॉफी आती है। इसी प्रकार, फुलफुलडे शब्द adotoo-mi दो शब्दों में विभाजित किया जाएगा (adotoo mi) जहाँ हाइफ़न होता है।
निष्कर्ष
समीक्षा में, वर्णमाला वर्ण सूची में आपकी भाषा के लिए आवश्यक सभी शब्द-निर्माण वर्ण होने चाहिए। अप्रयुक्त वर्णों को वहाँ नहीं छोड़ा जाना चाहिए। (ऐसा अक्सर तब होता है जब एक प्रोजेक्ट की वर्णमाला वर्ण सूची को दूसरे प्रोजेक्ट में कॉपी किया जाता है।) विराम चिह्नों का उपयोग कभी भी वर्णमाला के भाग के रूप में नहीं किया जाना चाहिए। यदि इसकी आवश्यकता पड़े, तो पैराटेक्स्ट में उस अक्षर को दर्शाने के लिए कोई अन्य स्वीकार्य दिखने वाला वर्ण खोजें। आपको अपने कंप्यूटर के कीबोर्ड द्वारा उत्पन्न न होने वाले विशेष वर्णों को टाइप करने का कोई तरीका ढूँढ़ना या बनाना पड़ सकता है। पैराटेक्स्ट में स्वतः सुधार सुविधा or मुख्य आदमी दो अच्छे संभावित समाधान हैं।
किसी अनुवाद परियोजना की शुरुआत में, अपनी परियोजना के वर्णों को ठीक से क्रमबद्ध करने के लिए समय निकालने से अनुवाद का प्रारूप तैयार करना और उसकी जाँच करना बहुत आसान हो जाएगा। इससे पाठ टाइप करना भी आसान हो जाएगा, और इससे पैराटेक्स्ट के कई खोज, क्रमबद्धता और जाँच कार्य ठीक से काम कर पाएँगे।