指南 · 问题

语言学习应用里的乌兹别克语靠谱吗?一份自查清单

简短回答

有时候是,你自己就能查出来。大型语言应用的评论区里经常有人抱怨小语种是机器翻译的,或者语法本身就是错的,乌兹别克语用户少,正好属于风险比较高的那一类。哪怕你完全不懂乌兹别克语,也能看出一些不用心的地方:拉丁字母课程里混进西里尔字母、oʻ 和 gʻ 被漏掉或者和普通的 o、g 混为一谈、看起来像土耳其语的形式、后缀不管音变规则、动词不在句子最后,还有带英语口音的发音。出一次错说明不了什么,出好几次就该考虑换一个来源了。

Uzbekcha 即将上线。它会把每个词的词根和每个后缀都拆开给你看,让你明白句子是怎么搭起来的,而不是整句死记。

即将登陆 iOS 和 Android。准备好时只发一封邮件,并附创始会员优惠。绝不打扰。

在大应用里学小语种的人,评论区里常常反映同一件事:内容读起来像机器翻译,或者教的语法和词汇本身就是错的。这些评论大多是针对别的语言,我们也不是在说某一门具体的乌兹别克语课程。但对任何小语种来说,这种风险都是真实存在的,而乌兹别克语又有几个特点,让不用心的文本连新手都能看出来。

Uzbekcha 是我们自己做的产品,目前尚未上线,只在文末提到一次。

要点

  • 检验乌兹别克语,不需要你会乌兹别克语。文字、拼写、后缀变化和词序,都可以按规则来检查。
  • 最快的几项检查:拉丁字母课程里没有西里尔字母, 没有和 og 混淆,动词在句尾。
  • 出一次错说明不了什么,用心做的产品也会出错。反复出现的规律,说明文本没有母语者校对过。
  • 拿不准的时候,找第二个来源对比,或者直接问一个人。

为什么小语种风险更高

一款提供几十种语言的应用,通常是把课程写一遍,然后套用到每种语言上。大语种有很多编辑,也有很多用户会反馈错误。小语种的翻译可能是自动生成的,或者做得比较仓促,错误可能留存好几年,因为很少有学习者懂得足够多、能发现问题。乌兹别克语还多了两重难度:它在不久前才换过文字,而且大部分语法都藏在后缀里,机器翻译处理这个特别容易出错。

检查清单

1. 只用一种文字

拉丁字母是官方文字。一门教拉丁字母的课程,不应该出现西里尔字母,除非明确标注为参考。拉丁字母单词里混进西里尔字母,或者整行都是没有说明的西里尔字母,说明文本是从不同来源拼凑出来的。

2. oʻ 和 gʻ 这两个字母

是独立的字母,不是 og 加了装饰。Ot 是马,oʻt 是火或者草。这门语言叫 oʻzbek,不是「ozbek」。如果课程漏掉了这个标记,教的就是不同的词。

按规范,这个标记是一个修饰字母(ʻ),而 san’at(艺术)、ma’no(意思)这类词里的 tutuq belgisi 是右单引号(’)。日常打字时两者都会变成一个直的撇号(o'g'),大家也都能应付。所以单独一个直撇号本身不算错误。在教学产品里要看的是一致性:同一屏上出现三种不同的标记,或者标记时有时无,说明这些文本没有人校对过。

3. 土耳其语或哈萨克语的形式

乌兹别克语和土耳其语、哈萨克语是亲属语言,而这两种语言的材料更容易找到,所以它们的形式有时会混进来。两个信号:

  • 后缀跟着变元音。 标准乌兹别克语基本已经失去了元音和谐,所以每个后缀只有一种形式。复数永远是 -larkitoblar(书,复数)。如果复数在两种形式之间切换,像土耳其语的 -lar 和 -ler 那样,就不是标准乌兹别克语。
  • 常用词里出现土耳其语的元音。 土耳其语的 a 在乌兹别克语里常常是 o:土耳其语 baş(头)对应乌兹别克语 bosh。字母 ö、ü、ş、ç、ı 是土耳其语的。乌兹别克语写的是 ushch

4. 后缀的音变

正确的乌兹别克语会根据前面的音调整某些形式。有两处很容易检查:

  • -ga(去、向)在 k 后面变成 -ka,在 q 后面变成 -qaSamarqandga,但要写 eshikka(去门那里)和 qishloqqa(去村里)。口语里说错了别人也听得懂,但书面教学材料应该写对。
  • 数字后面名词保持单数,数字本身加 -taikkita non(两个馕)。Ikki nonlar 是错的。

一门把后缀直接粘上去、不管这些音变的课程,很可能是生成出来的,而不是人写的。

5. 词序

动词放在最后。「我喝茶」是 Men choy ichaman,字面意思是「我 茶 喝」,这和中文「我把茶喝了」是类似的语序,动词同样跟在宾语后面。疑问词留在原来的位置,谓语或动词仍然在句尾:Metro bekati qayerda?(地铁站在哪里?)乌兹别克语句子如果逐字照搬英语的词序,说明是逐词翻译出来的。

6. 后缀的顺序

名词上后缀的顺序是固定的:词根、复数、领属、格。Kitob-lar-im-da 是「在我的书里」。任何别的顺序都是错的。

7. 音频

英语式的口音、重音落在第一个音节(RAH-mat 而不是 rah-MAT),或者把 x 读成「ks」,都说明这是为别的语言做的合成语音。完整的检查方法见为什么有些乌兹别克语音频听起来不对

一次错误说明不了什么

任何来源都会偶尔出错,我们自己也不例外。页面上一处奇怪的拼写说明不了太多问题;好几节课里反复出现同样的规律,才说明问题。要看规律来判断一门课程,重要的内容都要拿第二个来源核实一下。

发现问题该怎么办

  1. 拿一本教材、一位私教或一位母语者做第二个来源核实一下。
  2. 如果应用支持反馈,就报告给开发者。
  3. 如果错误频繁出现,就别再从这个来源学拼写和语法了。

Uzbekcha 适合放在哪里

Uzbekcha 是我们在塔什干开发的一款乌兹别克语 AI 家教应用,目前还没有上线,只能加入候补名单。大语言模型单靠自己处理乌兹别克语的词形变化并不可靠,所以 Uzbekcha 生成的乌兹别克语要经过一个词法校验器,检查后缀顺序、后缀交界处的音变,以及拉丁字母书写的一致性,并且以经过核实的语法和词典资料为依据。

常见问题

语言应用里的乌兹别克语是机器翻译的吗?

有可能。在大型多语言应用的评论里,抱怨小语种是机器翻译的很常见,不过这不代表某一款具体应用的乌兹别克语就一定如此。先看产品自己怎么说是谁写的、谁录的音,再用这份清单在几节课里检验一下。

作为新手,怎么判断乌兹别克语文字对不对?

找那些不需要词汇量就能看出来的地方:拉丁字母课程里出现西里尔字母、oʻ 和 gʻ 被写成普通的 o 和 g、数字后面用了复数名词、-ga 在 k 或 q 后面没有变化,以及动词不在句尾的句子。每一项检查只需要几秒钟。

乌兹别克语用普通撇号来写算错吗?

日常打字不算。官方规定 oʻ 和 gʻ 用的是修饰字母(ʻ),san’at 这类词里的 tutuq belgisi 用的是右单引号(’),但在手机键盘上两者都会变成一个直的撇号,大家也都这么用。在教学材料里,标记不统一说明文本没有校对过,漏掉标记则会改变词义。

乌兹别克语有像土耳其语那样的元音和谐吗?

标准乌兹别克语基本已经失去了元音和谐,所以每个后缀只有一种形式。如果一门课程里乌兹别克语的后缀会像土耳其语词尾那样跟着变元音,那它教的就不是标准乌兹别克语。

如果发现应用里有错该怎么办?

拿一本教材、一位私教或一位母语者做第二个信息来源核对一下。如果应用能反馈问题,就报告给开发者。如果错误很频繁,这款应用最多留着练听力用,语法和拼写从你信得过的来源那里学。

本页属于《乌兹别克语怎么学?零基础到能开口说的完整指南》,那里把本站每一页都对应到学习的某个阶段。

抢先体验

用你自己的语言学乌兹别克语。

Uzbekcha 为你逐课生成课程:你的语言、你来这里的原因、你的水平,每个词都有音频。加入候补名单,第一时间获知。