कई यूरोपीय भाषाओं में, शब्दावली सीखना पहले से ही सिर्फ शब्द गिनने से ज्यादा जटिल है। स्पेनिश क्रियाएँ, फ्रेंच उच्चारण, जर्मन संयुक्त शब्द और रूसी कारक—ये सब बदल देते हैं कि किसी शब्द को “जानने” का क्या मतलब है।
लेकिन जब हम मंदारिन चीनी और जापानी की ओर बढ़ते हैं, तो यह सवाल और भी रोचक हो जाता है।
यहाँ शब्दावली सिर्फ शब्दों की बात नहीं है। यह अक्षरों, लिपियों, उच्चारणों, संयुक्त शब्दों, ध्वनियों और संदर्भ की भी बात है।
कोई विद्यार्थी बोला हुआ शब्द जान सकता है, लेकिन लिखित रूप में उसे पहचान न पाए। या वह कोई अक्षर जानता हो, लेकिन जिस संयुक्त शब्द में वह आता है, उसका अर्थ न समझ पाए। या वह किसी जापानी शब्द में कांजी पहचान ले, लेकिन दूसरे शब्द में उसे पढ़ न पाए।
इसलिए अगर हम पूछें:
“मुझे मंदारिन या जापानी में कितने शब्द जानने चाहिए?”
तो जवाब है:
शब्द महत्वपूर्ण हैं — लेकिन वे इस प्रणाली की सिर्फ एक परत हैं।
मंदारिन: ऐसी भाषा जहाँ अक्षर और शब्द एक जैसे नहीं होते
मंदारिन चीनी को अक्सर अपेक्षाकृत आइसोलेटिंग भाषा कहा जाता है। सरल शब्दों में, इसका मतलब है कि शब्द आमतौर पर स्पेनिश, रूसी या तुर्की जैसी भाषाओं की तरह लंबे अंत जोड़कर अपना रूप नहीं बदलते। क्रिया “मैं,” “आप,” या “वह” के लिए अलग-अलग रूप नहीं लेती। संज्ञाएँ कारक के अनुसार अपना रूप नहीं बदलतीं। व्याकरणिक अर्थ अक्सर शब्द-क्रम, पार्टिकल्स, संदर्भ और अलग-अलग कार्य-शब्दों से व्यक्त होता है। WALS, एक प्रमुख भाषा-प्रकार डेटाबेस, चीनी को रूप-रचना के पैमाने पर आइसोलेटिंग पक्ष का क्लासिक उदाहरण मानता है।
पहली नज़र में यह अच्छी बात लगती है।
और कुछ हद तक यह सच भी है। मंदारिन सीखने वालों को स्पेनिश जैसी बड़ी क्रिया-सारिणियाँ या रूसी जैसे कारक-अंत याद नहीं करने पड़ते।
लेकिन मंदारिन की एक अलग चुनौती है:
चीनी अक्षर हमेशा शब्द के बराबर नहीं होता।
उदाहरण के लिए:
- 人 का अर्थ “व्यक्ति” हो सकता है
- 大 का अर्थ “बड़ा” हो सकता है
- 学 सीखने या पढ़ाई से जुड़ा है
- 大学 का अर्थ “विश्वविद्यालय” है
- 学生 का अर्थ “विद्यार्थी” है
शुरुआती विद्यार्थी अलग-अलग अक्षर सीखकर महसूस कर सकते हैं कि वे “शब्द” सीख रहे हैं। कभी-कभी यह सही भी होता है। लेकिन अक्सर वास्तविक मंदारिन शब्दावली दो या अधिक अक्षरों वाले शब्दों से बनती है।
यही एक कारण है कि चीनी सीखने वालों के लिए भ्रमित करने वाली हो सकती है। अक्षरों का अपना अर्थ होता है, लेकिन शब्द अक्सर अक्षरों को जोड़कर बनाए जाते हैं।
चीनी शब्द-विभाजन क्यों महत्वपूर्ण है
अंग्रेज़ी में शब्दों के बीच स्पेस होते हैं। लिखित चीनी में ऐसा नहीं होता।
वाक्य अक्षरों की एक निरंतर श्रृंखला के रूप में लिखा जाता है। मातृभाषी पाठक इसे स्वाभाविक रूप से समझते हैं, लेकिन सीखने वालों — और यहाँ तक कि कंप्यूटर सिस्टमों — के लिए यह एक महत्वपूर्ण सवाल खड़ा करता है:
एक शब्द कहाँ खत्म होता है और अगला कहाँ शुरू होता है?
इसे शब्द-विभाजन कहा जाता है। चीनी नेचुरल लैंग्वेज प्रोसेसिंग में यह एक बड़ा विषय है, क्योंकि चीनी शब्दों में कई अक्षर हो सकते हैं, लेकिन सामान्य लेखन में उनके बीच स्पेस नहीं होते। चीनी शब्द-विभाजन पर शोध बताता है कि साफ़ शब्द-सीमाएँ न होने के कारण कई भाषा-प्रोसेसिंग कार्यों के लिए विभाजन एक जरूरी और कभी-कभी कठिन पहला कदम बन जाता है।
सीखने वालों के लिए इसका बहुत व्यावहारिक असर होता है।
जब आप चीनी पढ़ते हैं, तो आप केवल अक्षरों को नहीं पहचान रहे होते। आप यह भी सीख रहे होते हैं कि अक्षर कैसे मिलकर असली शब्द और अभिव्यक्तियाँ बनाते हैं।
उदाहरण के लिए, अगर आप देखते हैं:
中国人
तो आपको समझना होगा कि इसे इस तरह बाँटा जा सकता है:
中国 — चीन
人 — व्यक्ति
मिलकर अर्थ: चीनी व्यक्ति
जो विद्यार्थी हर अक्षर को अलग-अलग पहचानता है, उसे पूरी अभिव्यक्ति को जल्दी पहचानने के लिए फिर भी अभ्यास की जरूरत हो सकती है।
चीनी में सचमुच शब्द होते हैं
एक आम सरलीकृत धारणा है कि चीनी में “असल में शब्द नहीं होते, केवल अक्षर होते हैं।”
यह सही नहीं है।
चीनी में निश्चित रूप से शब्द होते हैं। बात यह है कि अक्षरों, रूपिमों और शब्दों के बीच संबंध वर्णमालात्मक भाषाओं से अलग है। जेरोम पैकार्ड का चीनी रूप-रचना पर काम खास तौर पर इस विचार के खिलाफ तर्क देता है कि चीनी में शब्द या रूप-रचना नहीं है। इसके बजाय, चीनी में एक अलग तरह की रूप-रचनात्मक प्रणाली है, जहाँ अक्षर और शब्द-निर्माण ऐसे तरीकों से जुड़ते हैं जो अंग्रेज़ी जैसे नहीं हैं।
सीखने वालों के लिए इसका मतलब है कि मंदारिन शब्दावली कई स्तरों पर सीखी जानी चाहिए:
- बोला हुआ शब्द,
- लिखित अक्षर,
- अलग-अलग अक्षरों का अर्थ,
- संयुक्त शब्द,
- टोन पैटर्न,
- और आम वाक्य-संदर्भ।
अगर आप केवल एक-एक करके अक्षर सीखते हैं, तो आपका ज्ञान बिखरा रह सकता है। अगर आप केवल पिनयिन और बोले हुए शब्द सीखते हैं, तो आपकी पढ़ने की क्षमता पीछे रह सकती है। अगर आप केवल शब्द-सूचियाँ याद करते हैं, तो आप यह समझने से चूक सकते हैं कि अर्थपूर्ण हिस्सों से शब्द कैसे बनते हैं।
एक मजबूत मंदारिन विद्यार्थी धीरे-धीरे इन सभी परतों को जोड़ता है।
मंदारिन शब्दावली: सीखने वालों को क्या गिनना चाहिए?
तो मंदारिन सीखने वाले को क्या गिनना चाहिए?
केवल अक्षरों की गिनती काफी नहीं है। कई आम शब्दों में दो या अधिक अक्षर होते हैं। केवल शब्दों की गिनती भी अधूरी है, क्योंकि अक्षरों का ज्ञान सीखने वालों को नए संयुक्त शब्दों का अनुमान लगाने, उन्हें याद रखने और पहचानने में मदद करता है।
व्यावहारिक रूप से सीखने वाला व्यक्ति तीन चीज़ों पर नज़र रख सकता है:
1. आम शब्द
ये वे शब्दावली-इकाइयाँ हैं जिनकी आपको सुनने, बोलने और पढ़ने के लिए जरूरत होती है।
2. आम अक्षर
ये आपको पढ़ने और यह समझने में मदद करते हैं कि शब्द कैसे बनते हैं।
3. आम वाक्यांश और पैटर्न
ये दिखाते हैं कि शब्दावली वास्तव में वाक्यों में कैसे इस्तेमाल होती है।
उदाहरण के लिए, 学习 (“पढ़ाई करना”) शब्द को जानना उपयोगी है। लेकिन जब आप इसे वास्तविक पैटर्न में भी देखते हैं, तो यह ज्ञान कहीं ज्यादा मजबूत हो जाता है:
- 我学习中文。 — मैं चीनी भाषा पढ़ता/पढ़ती हूँ।
- 他在大学学习。 — वह विश्वविद्यालय में पढ़ाई करता है।
- 学习语言需要时间。 — भाषा सीखने में समय लगता है।
यहीं शब्दावली इस्तेमाल करने लायक बनती है।
जापानी: एक साथ कई लेखन प्रणालियों वाली भाषा
जापानी एक अलग तरह की चुनौती पेश करती है।
मंदारिन के विपरीत, जापानी मिश्रित लेखन प्रणाली का इस्तेमाल करती है। आधुनिक जापानी में ये शामिल होते हैं:
- हिरागाना,
- काताकाना,
- कांजी,
- और कभी-कभी लैटिन वर्णमाला।
हिरागाना अक्सर व्याकरणिक अंतों, मूल जापानी शब्दों और कार्य-शब्दों के लिए इस्तेमाल होता है। काताकाना अक्सर विदेशी उधार शब्दों, नामों, ज़ोर देने और ध्वनि-प्रतीकात्मक शब्दों के लिए इस्तेमाल होता है। कांजी चीनी मूल के अक्षर हैं, जिनका उपयोग कई मुख्य अर्थ वाले शब्दों, जैसे संज्ञाओं, क्रिया-मूलों और विशेषण-मूलों के लिए होता है। जापानी लेखन प्रणाली को व्यापक रूप से लोगोग्राफिक कांजी और वर्णांश-आधारित काना के मिश्रण के रूप में बताया जाता है।
इसका मतलब है कि जापानी शब्दावली सीखना केवल अर्थ और उच्चारण की बात नहीं है। यह लिपि की भी बात है।
किसी शब्द को कांजी, काना या कभी-कभी दोनों के मेल से लिखा जा सकता है।
उदाहरण के लिए:
- 食べる — खाना
- 食べます — खाते हैं / खाएँगे, विनम्र रूप
- 食べた — खाया
- 食べ物 — खाने की चीज़
यहाँ कांजी 食 खाने से जुड़ा मूल अर्थ लिए हुए है, जबकि हिरागाना व्याकरणिक हिस्सों और अंतों को दिखाता है।
यह अंग्रेज़ी से बहुत अलग है, जहाँ वर्तनी प्रणाली कठिन है, लेकिन फिर भी एक ही वर्णमालात्मक लिपि इस्तेमाल करती है।
कांजी शब्दों के बराबर नहीं होते
शुरुआती विद्यार्थी जो सबसे बड़ी गलतियाँ कर सकते हैं, उनमें से एक यह सोचना है:
“अगर मैं 2,000 कांजी सीख लूँ, तो मुझे 2,000 जापानी शब्द आ जाते हैं।”
जापानी इस तरह काम नहीं करती।
एक कांजी आम तौर पर अपने-आप में पूरा शब्द नहीं होता। यह एक लिखित अक्षर है, जो कई शब्दों में आ सकता है।
उदाहरण के लिए, कांजी 学 सीखने या पढ़ाई से जुड़ा है। यह ऐसे शब्दों में आता है:
- 学生 — विद्यार्थी
- 学校 — स्कूल
- 大学 — विश्वविद्यालय
- 文学 — साहित्य
इसलिए कांजी सीखना आपको एक मजबूत संकेत देता है। लेकिन आपको असली शब्द फिर भी सीखने पड़ते हैं।
जापानी में एक और जटिलता भी है: कई कांजी के एक से अधिक उच्चारण होते हैं। कोई अक्षर एक शब्द में एक तरह से पढ़ा जा सकता है और दूसरे शब्द में दूसरी तरह से। यही एक कारण है कि जापानी पढ़ने में समय लगता है, यहाँ तक कि उन विद्यार्थियों के लिए भी जो पहले से कई अक्षर जानते हैं।
जापान सरकार सामान्य उपयोग वाले कांजी की आधिकारिक सूची Jōyō kanji-hyō बनाए रखती है, और सांस्कृतिक मामलों की एजेंसी इसे स्पष्ट रूप से जापान की लेखन-प्रणाली से जुड़ी नीति का हिस्सा बताती है। लेकिन सामान्य उपयोग वाले कांजी जान लेने का मतलब अपने-आप यह नहीं होता कि आप उन कांजी वाले हर शब्द को जानते हैं।
सीखने वालों के लिए, कांजी का ज्ञान और शब्दावली का ज्ञान एक-दूसरे से जुड़ते हैं, लेकिन वे एक जैसे नहीं हैं।
जापानी शब्दावली में व्याकरण भी शामिल होता है
जापानी संरचना के स्तर पर भी मंदारिन से अलग है।
मंदारिन में रूप-परिवर्तन बहुत कम है, जबकि जापानी में कई व्याकरणिक अंत और सहायक रूप इस्तेमाल होते हैं। ये अक्सर कांजी मूल के बाद हिरागाना में लिखे जाते हैं।
उदाहरण के लिए:
- 見る — देखना
- 見ます — देखते हैं, विनम्र रूप
- 見た — देखा
- 見ない — नहीं देखते
- 見られる — देखा जा सकता है / देखा जाता है / देख सकते हैं, संदर्भ के अनुसार
कोई विद्यार्थी कांजी 見 पहचान सकता है, लेकिन पूरे अर्थ को समझने के लिए उसे अंतों को भी समझना होगा।
इसीलिए जापानी शब्दावली और व्याकरण गहराई से जुड़े हुए हैं। आप उन्हें पूरी तरह अलग नहीं कर सकते।
आधिकारिक JLPT स्तर-विवरण भी इस संबंध को दिखाते हैं। बुनियादी स्तरों पर भी पढ़ने की क्षमता को शब्दावली, काना और बुनियादी कांजी के साथ मिलाकर समझाया जाता है; उच्च स्तरों पर सीखने वालों से अलग-अलग विषयों और परिस्थितियों में अधिक जटिल लिखित और बोली गई सामग्री समझने की अपेक्षा की जाती है।
मंदारिन बनाम जापानी: समान अक्षर, अलग प्रणालियाँ
क्योंकि जापानी में इस्तेमाल होने वाले कांजी ऐतिहासिक रूप से चीनी अक्षरों से आए हैं, सीखने वाले कभी-कभी मान लेते हैं कि मंदारिन और जापानी शब्दावली एक ही तरह काम करती है।
ऐसा नहीं है।
कुछ समानताएँ हैं। कुछ अक्षर एक जैसे या मिलते-जुलते दिखते हैं। कुछ शब्दों की ऐतिहासिक जड़ें साझा हैं। चीनी अक्षरों का ज्ञान जापानी कांजी में मदद कर सकता है, और कांजी का ज्ञान कुछ लिखित चीनी पहचानने में मदद कर सकता है।
लेकिन प्रणालियाँ अलग हैं।
मंदारिन चीनी शब्दों को सीधे लिखने के लिए अक्षरों का इस्तेमाल करती है। जापानी कांजी को हिरागाना और काताकाना के साथ एक मिश्रित प्रणाली के अंदर इस्तेमाल करती है। जापानी कांजी के अक्सर कई उच्चारण होते हैं, और वही अक्षर शब्द के अनुसार अलग तरह से व्यवहार कर सकता है।
इसलिए अक्षरों का ज्ञान केवल आंशिक रूप से काम आता है।
मंदारिन सीखने वाले को अक्षरों को मंदारिन उच्चारण, टोन और संयुक्त शब्दों से जोड़ना होता है।
जापानी सीखने वाले को कांजी को जापानी शब्दों, कई उच्चारणों, काना अंतों और व्याकरण से जोड़ना होता है।
यहाँ “5,000 शब्दों” का मतलब क्या है?
मंदारिन में 5,000 शब्द शब्दावली की मजबूत नींव हो सकते हैं, लेकिन सीखने वाले को अक्षरों का ज्ञान, टोन की सटीकता, शब्द-विभाजन कौशल और वाक्यांशों के स्तर पर प्रवाह भी चाहिए।
जापानी में 5,000 शब्द भी मजबूत आधार हो सकते हैं, लेकिन पढ़ने की क्षमता बहुत हद तक काना, कांजी, उच्चारणों और व्याकरणिक पैटर्न पर निर्भर करती है।
इसलिए वही संख्या अलग-अलग सीखने के कामों को छिपा देती है।
मंदारिन के लिए सवाल केवल यह नहीं है:
मुझे कितने शब्द आते हैं?
यह भी है:
मुझे कितने अक्षर पहचान में आते हैं?
क्या मैं टोन सुनकर उनका सही उच्चारण कर सकता/सकती हूँ?
क्या मैं निरंतर लिखे पाठ में शब्दों को पहचान सकता/सकती हूँ?
क्या मुझे आम संयुक्त शब्द और वाक्य-पैटर्न आते हैं?
जापानी के लिए सवाल है:
मुझे बोले जाने वाले कितने शब्द आते हैं?
क्या मैं उन्हें काना या कांजी में पढ़ सकता/सकती हूँ?
क्या मुझे कांजी के आम उच्चारण पता हैं?
क्या मैं शब्द से जुड़े अंतों को समझ सकता/सकती हूँ?
क्या मैं उसी शब्द को विनम्र, अनौपचारिक या बदले हुए रूपों में पहचान सकता/सकती हूँ?
ये सवाल सिर्फ शब्द गिनने से ज्यादा उपयोगी हैं।
बेहतर सीखने की रणनीति
मंदारिन के लिए, सीखने वालों को अक्षरों को केवल अलग-थलग चिह्नों की तरह पढ़ने से बचना चाहिए। बेहतर तरीका है इन्हें जोड़ना:
अक्षर → शब्द → उच्चारण → टोन → वाक्य
उदाहरण के लिए, केवल 学 ही न सीखें। इसे 学生, 大学, और 学习 जैसे वास्तविक शब्दों में सीखें, और फिर उन शब्दों को वाक्यों में देखें।
जापानी के लिए, सीखने वालों को कांजी को केवल अलग-थलग चित्रों की तरह पढ़ने से बचना चाहिए। बेहतर तरीका है:
कांजी → शब्द → उच्चारण → काना अंत → वाक्य
उदाहरण के लिए, केवल 食 ही न सीखें। 食べる, 食べ物, 食事 सीखें, और देखें कि ये शब्द वास्तविक जापानी में कैसे इस्तेमाल होते हैं।
दोनों भाषाओं में संदर्भ बहुत जरूरी है। शब्दावली तभी उपयोगी बनती है जब वह ध्वनि, अर्थ, लेखन और वास्तविक उपयोग से जुड़ती है।
असल सीख
मंदारिन और जापानी दिखाती हैं कि शब्दावली का आकार गुमराह कर सकता है।
कोई विद्यार्थी हजारों “शब्द” जान सकता है, लेकिन फिर भी पढ़ने में कठिनाई महसूस कर सकता है, क्योंकि अक्षरों या कांजी का ज्ञान कम है। दूसरा विद्यार्थी कई अक्षर जान सकता है, लेकिन फिर भी वास्तविक वाक्यों को समझने में कठिनाई महसूस कर सकता है, क्योंकि उसने संयुक्त शब्द, उच्चारण, व्याकरण या संदर्भ नहीं सीखा है।
इसलिए लक्ष्य केवल शब्दावली के आइटम इकट्ठा करना नहीं है।
लक्ष्य एक जुड़ी हुई प्रणाली बनाना है:
बोले हुए शब्द, लिखित रूप, अक्षर, ध्वनियाँ, व्याकरण, संयुक्त शब्द और वास्तविक जीवन में उपयोग।
मंदारिन में शब्दावली सीखने को शब्दों के साथ अक्षरों, टोन और विभाजन से जोड़ना जरूरी है।
जापानी में शब्दावली सीखने को शब्दों के साथ काना, कांजी, उच्चारणों और व्याकरणिक अंतों से जोड़ना जरूरी है।
इससे ये भाषाएँ असंभव नहीं हो जातीं। इसका मतलब बस इतना है कि इनके लिए एक अलग मानसिक मॉडल चाहिए।
अगले लेख में हम अरबी और अन्य सेमिटिक भाषाओं को देखेंगे, जहाँ शब्दावली रूट्स, पैटर्न, औपचारिक भाषा और बोली जाने वाली बोलियों से आकार लेती है।