बड़े ऐप्स में छोटी भाषाएँ सीखने वाले लोग अक्सर समीक्षाओं में एक ही बात कहते हैं: कॉन्टेंट मशीन-अनुवादित लगता है, या ग़लत व्याकरण और ग़लत शब्दावली सिखाता है। ये समीक्षाएँ ज़्यादातर दूसरी भाषाओं के बारे में हैं, और हम किसी ख़ास उज़्बेक कोर्स के बारे में यह नहीं कह रहे। पर किसी भी छोटी भाषा के लिए यह जोखिम असली है, और उज़्बेक में कुछ ऐसी ख़ूबियाँ हैं जिनसे लापरवाह टेक्स्ट को पहचानना आसान हो जाता है, एक शुरुआती के लिए भी।
Uzbekcha हम बनाते हैं, जो अभी उपलब्ध नहीं है। इसका ज़िक्र सिर्फ़ एक बार, आख़िर में है।
मुख्य बातें
- उज़्बेक जांचने के लिए उज़्बेक जानना ज़रूरी नहीं। लिपि, स्पेलिंग, प्रत्यय-बदलाव और शब्द-क्रम, सब नियम से जांचे जा सकते हैं।
- सबसे तेज़ जांच: लैटिन कोर्स में सिरिलिक न हो, oʻ और gʻ, o और g से अलग रहें, और क्रिया वाक्य के आख़िर में हो।
- एक ग़लती कुछ साबित नहीं करती, सावधान प्रोडक्ट भी करते हैं। बार-बार ग़लतियाँ होने का मतलब है कि टेक्स्ट किसी देसी बोलने वाले ने नहीं जांचा।
- शक हो तो किसी दूसरे स्रोत से मिलाएँ या किसी इंसान से पूछें।
छोटी भाषा जोखिम में क्यों है
दर्जनों भाषाएँ देने वाला ऐप आम तौर पर अपना कोर्स एक बार लिखता है और फिर हर भाषा में बना देता है। बड़ी भाषा के लिए कई एडिटर होते हैं और ग़लती बताने वाले कई यूज़र। छोटी भाषा के लिए अनुवाद ऑटोमैटिक या जल्दबाज़ी में किया गया हो सकता है, और ग़लतियाँ सालों तक टिकी रह सकती हैं क्योंकि बहुत कम सीखने वाले इतना जानते हैं कि उन्हें पकड़ सकें। उज़्बेक में दो अपनी अलग मुश्किलें हैं: इसने अपनी लिपि हाल ही में, जीवित लोगों की याद में, बदली है, और इसका ज़्यादातर व्याकरण प्रत्ययों में है, जिन्हें ऑटोमैटिक अनुवाद ठीक से संभाल नहीं पाता।
चेकलिस्ट
1. सिर्फ़ एक लिपि
लैटिन आधिकारिक लिपि है। जो कोर्स लैटिन सिखाता है, उसमें सिरिलिक नहीं होनी चाहिए, सिवाय एक लेबल किए गए संदर्भ के। लैटिन शब्दों के अंदर सिरिलिक अक्षर, या बिना किसी व्याख्या के पूरी लाइनें सिरिलिक में, इसका मतलब है कि टेक्स्ट अलग-अलग मिले-जुले स्रोतों से जोड़ा गया है।
2. अक्षर oʻ और gʻ
Oʻ और gʻ अलग अक्षर हैं, o और g के सजे हुए रूप नहीं। Ot का मतलब घोड़ा है और oʻt का मतलब आग या घास। भाषा का नाम oʻzbek है, “ozbek” नहीं। अगर कोई कोर्स यह निशान हटा दे, तो वह अलग शब्द सिखा रहा है।
आधिकारिक तौर पर यह निशान एक मॉडिफ़ायर लेटर (ʻ) है, और san’at (कला) और ma’no (अर्थ) जैसे शब्दों में तुतुक़ बेल्गिसी एक राइट सिंगल कोटेशन मार्क (’) है। रोज़ाना टाइप करने में दोनों सीधी एपॉस्ट्रफ़ी (o', g') बन जाते हैं, और सब इससे काम चला लेते हैं, इसलिए अकेली सीधी एपॉस्ट्रफ़ी ग़लती नहीं है। किसी पढ़ाई के प्रोडक्ट में जो देखना चाहिए वह है निरंतरता। एक ही स्क्रीन पर तीन अलग-अलग निशान, या निशान जो कभी हों कभी न हों, बताते हैं कि टेक्स्ट किसी ने जांचा ही नहीं।
3. तुर्की या क़ज़ाख़ बनावट
उज़्बेक तुर्की और क़ज़ाख़ से रिश्तेदार है, और उन भाषाओं की सामग्री ढूँढना आसान है, इसलिए उनकी बनावट कभी-कभी घुस आती है। दो संकेत:
- स्वर बदलने वाले प्रत्यय। मानक उज़्बेक ने स्वर-सामंजस्य लगभग छोड़ दिया है, इसलिए हर प्रत्यय का एक ही रूप है। बहुवचन हमेशा -lar है: kitoblar (किताबें)। जो बहुवचन दो रूपों के बीच बदलता है, जैसे तुर्की के -lar और -ler करते हैं, वह मानक उज़्बेक नहीं है।
- आम शब्दों में तुर्की स्वर। तुर्की का a अक्सर उज़्बेक में o होता है: तुर्की का baş (सिर) उज़्बेक में bosh है। अक्षर ö, ü, ş, ç और ı तुर्की के हैं। उज़्बेक oʻ, u, sh और ch लिखता है।
4. प्रत्यय के ध्वनि-बदलाव
सही उज़्बेक कुछ रूपों को उनसे पहले आने वाली चीज़ के हिसाब से बदलता है। दो चीज़ें जिन्हें आसानी से जांचा जा सकता है:
- -ga (“को/की ओर”) k के बाद -ka और q के बाद -qa बन जाता है: Samarqandga, पर eshikka (दरवाज़े की ओर) और qishloqqa (गाँव की ओर)। बोलते वक़्त यह ग़लत भी हो जाए तो लोग समझ जाएँगे, पर लिखी हुई पढ़ाई की सामग्री में इसे सही होना चाहिए।
- संख्या के बाद संज्ञा एकवचन रहती है और संख्या -ta लेती है: ikkita non (दो नान)। Ikki nonlar ग़लत है।
जो कोर्स बिना इन बदलावों के प्रत्यय चिपका देता है, वह शायद जनरेट किया गया है, लिखा नहीं गया।
5. शब्द-क्रम
क्रिया आख़िर में आती है। “मैं चाय पीता हूँ” है Men choy ichaman, शाब्दिक रूप से “मैं चाय पीता”। प्रश्न-शब्द अपनी जगह रहते हैं और क्रिया या विधेय फिर भी आख़िर में रहता है: Metro bekati qayerda? (मेट्रो स्टेशन कहाँ है?)। जो उज़्बेक वाक्य अंग्रेज़ी के क्रम को शब्द-दर-शब्द फॉलो करते हैं, वे शब्द-दर-शब्द अनुवाद का संकेत हैं।
6. प्रत्यय-क्रम
संज्ञा पर क्रम तय है: जड़, बहुवचन, स्वामित्व, कारक। Kitob-lar-im-da का मतलब है “मेरी किताबों में”। कोई भी और क्रम ग़लत है।
7. ऑडियो
अंग्रेज़ी जैसा लहजा, पहले अक्षर पर ज़ोर (rah-MAT की जगह RAH-mat) या x को “ks” पढ़ना, इसका मतलब है कि टेक्स्ट-टू-स्पीच आवाज़ किसी दूसरी भाषा के लिए बनी है। पूरी जांच है कुछ उज़्बेक ऑडियो ग़लत क्यों सुनाई देता है में।
एक ग़लती फ़ैसला नहीं है
हर स्रोत कभी न कभी चूकता है, यह पेज भी शामिल है। एक पेज पर एक अजीब स्पेलिंग बहुत कम बताती है; कई पाठों में दोहराया हुआ पैटर्न बहुत कुछ बताता है। कोर्स को पैटर्न से आँकें, और ज़रूरी चीज़ों को दूसरे स्रोत से मिला लें।
जब कुछ ग़लत लगे तो क्या करें
- उस चीज़ को दूसरे स्रोत से मिलाएँ: कोई किताब, ट्यूटर या देसी बोलने वाला।
- अगर ऐप में तरीक़ा हो तो इसकी रिपोर्ट करें।
- अगर चूकें बार-बार हों, तो उस स्रोत से स्पेलिंग और व्याकरण लेना बंद कर दें।
Uzbekcha यहाँ कहाँ फ़िट होता है
Uzbekcha एक AI ट्यूटर है, जिसे हम ताशकंद में उज़्बेक के लिए बना रहे हैं। यह अभी उपलब्ध नहीं है, और सिर्फ़ प्रतीक्षा-सूची है। बड़े लैंग्वेज मॉडल अपने आप उज़्बेक की बनावट (मॉर्फोलॉजी) में डगमगाते हैं, इसलिए Uzbekcha में जनरेट किया गया उज़्बेक एक मॉर्फोलॉजिकल वैलिडेटर से गुज़रता है, जो प्रत्यय-क्रम, प्रत्यय की सीमा पर होने वाले ध्वनि-बदलाव और लैटिन-लिपि की निरंतरता जांचता है, और यह जांचे हुए व्याकरण और डिक्शनरी स्रोतों पर आधारित है।