跳到主要内容Fasaha

读阿拉伯语,生词要逐个查吗?研究怎么说

根据上下文猜词,完全猜对的只有约四分之一;读得轻松,需要认识98%的词。读阿拉伯语时,什么时候该查词,什么时候不必查。

· 作者 Amaan

读阿拉伯语时,每个生词都要查吗?

不必,但也别每个词都靠猜。卡住句子的词、反复出现的词就去查,其余的跳过。一项针对中级学习者的研究发现,根据上下文猜词,完全猜对的只有25.6%;而要读得轻松,大约需要认识98%的词。不标短元音的阿拉伯语就更难猜了。

卡住句子或反复出现的词就查,其余的跳过。单靠猜,失败的次数比学习者预想的多:在Nassaji 2003年的研究中,根据上下文作出的猜测只有25.6%完全正确。

阅读研究认为,读得轻松需要认识一页中约98%的词,即每五十个词里只有一个生词;下限约为95%。低于这个比例,上下文能提供的线索就太少了。

阿拉伯语更难猜。在不标短元音的印刷文本里,كتب 可以是“他写了”“它被写了”或“书籍”,只能靠周围的词来判断。

查词的成本决定策略。如果用的是按词根排序的纸质词典,学习者就渐渐不查了;如果查一次只需点按一下,有选择地查词就是理所当然的默认做法。

如果你每行要标出的词超过一个左右,这篇文本目前对你来说偏难。这是我们的经验法则,不是研究结论,它只是把上面的数字用到了实处。

读懂一页书,需要认识多少词?

按引用最多的估算,约为一页中98%的词,即每五十个词里只有一个生词。Laufer和Ravenhorst-Kalovski(2010)认为,达到充分理解的最低要求约为认识95%的词,最佳为98%。Hu和Nation(2000)发现,多数读者需要认识约98%的词,才能在没有帮助的情况下读懂一篇短篇小说。

这些数字应当看作比例,而不是定律。它们是在英语上测得的,词汇量按词族计算。2023年,Kremmel等人以斯里兰卡的104名成年学习者为对象,重复了Hu和Nation的研究,发现即使认识98%的词,按原研究的定义,读者仍未达到充分理解。更稳妥的理解是:这是一道斜坡,而不是一道悬崖。认识的词每多一个百分点都有帮助,并不存在某条线,一越过去阅读就突然变得容易。

Nation(2006)估计,要认识一般英语书面语中98%的词,需要8,000至9,000个词族的词汇量。阿拉伯语的算法不同:一个词根带出许多词,一个词又以多种附着形式出现,所以英语的总数不能照搬。能借用的是比例:一篇每行都藏着生词的文本,还算不上阅读材料,而是一道查词典的练习。

根据上下文猜词,有多大用?

没有常见建议说的那么有用。在Nassaji 2003年的研究中,21名中级英语学习者尝试根据上下文推断生词:完全猜对的占25.6%,部分猜对的占18.6%,猜错的占55.8%。猜词恰恰在最不需要它的地方最灵——在一篇几乎其他每个词都已认识的文本里。

这并不是反对猜词,而是反对把猜词当作唯一的策略,也反对那种流行的建议:去读只能看懂80%到90%的文本。如果这指的是认识80%到90%的词,那么几乎每行都会冒出一个生词,而每一次猜测所依赖的上下文,本身就漏洞百出。

猜错的代价也比看上去大。猜错的当下并不觉得错,于是错误的意思可能就此在记忆里扎下根来。事后快速核对一下,猜测就会变成你真正认识的词,或者变成一次让你记得住的纠正。

为什么阿拉伯语更难猜?

阿拉伯语通常不标短元音,所以一个书面词可能是好几个不同的词。كتب 可以是 كَتَبَ(他写了)、كُتِبَ(它被写了)或 كُتُب(书籍)。ملك 可以是 مَلِك(国王)、مَلَك(天使)、مُلْك(国权)或 مَلَكَ(他拥有了)。要靠周围的词来判断,而周围的词只有你认识,才帮得上忙。

还有两种情况,会让认识的词看起来像生词。一是小词在书写时附在它身上:وَبِكُتُبِهِمْ(并以他们的书)在纸面上只是一个词。二是词在内部变形:كِتَاب(书)的复数是 كُتُب。认识 كِتَاب 的学习者,可能认不出 كُتُبِهِمْ。所以,好用的阿拉伯语查词工具必须能找到词典形式和词根,而不只是逐个字母去匹配。

熟练的读者并不是在盲猜。他们认出词根和词型,元音随之而定;我们那篇讲如何读不标音符的阿拉伯语的文章,会一步步演示这个过程。在这种辨认变成自动反应之前,查词就是练出它的办法。

查过的词更容易记住吗?

是的,前提是读者真的去查。在Hulstijn、Hollander和Greidanus 1996年的一项研究中,阅读时页边印有词义的高级学习者,比配有词典的学习者记住了更多目标词,主要原因是配词典的那一组很少翻开词典。一个词遇到三次也有帮助,但主要是在它的意思已经给出或查过的情况下。

Luppescu和Day(1993)从另一面考察了同样的取舍。293名日本大学生阅读了一篇英语短篇小说,其中允许使用双语词典的学生,在随后的词汇测试中得分显著高于没有词典的学生。

综合起来看:查词让一个词更可能留在记忆里;页边注释让查词毫无成本;而查词的成本,决定了查词到底会发生几次。三者之中,成本是读者自己能改变的那一个。

为什么在阿拉伯语里,查词的成本这么关键?

纸质阿拉伯语词典按词根排序,而不是按拼写,所以每次查词都要先找出词根,而柔母会把词根藏起来。اتَّصَلَ(他联系了)收在 و·ص·ل 之下;مُسْتَشْفًى(医院)收在 ش·ف·ي 之下。如果每查一次都要这样搜寻一番,跳过不查就是理性的选择。如果查一次只需点按一下,这笔账就反过来了。

点按查词的词典,就是随叫随到的页边注释:你需要时,意思就在那里;不需要时,它就看不见。真正该问的是:点按一下,有多大比例能找到对应的词条?我们测过自己的:在214,689个真实阿拉伯语文本的词上(取自面向学习者的文章、故事、字幕、一部古典书籍和阿拉伯语维基百科),在Fasaha中点按,96.03%的词都打开了词典词条(2026年9月3日测得)。未命中的主要是词典尚未收录的词,以及人名和外来词,另有一小部分是查词功能本应找到的词形。

没有哪种工具能完美地读懂不标音符的阿拉伯语。当一个书面词可能是两个不同的词时,收藏之前,先把卡片给出的读法放回句子里核对一下。

“读两遍”:今晚就能用的方法

先把一段读一遍,抓住大意,标出让你卡住的词。只查这些词,然后把这一段再读一遍,有音频就配着音频读,并把出现了两次的词收藏起来。如果你每行要标出的词超过一个左右,这篇文本目前对你来说偏难:降一个级别,以后再回来读它。

这是我们自己的方法,不是上述研究的结论,但它建立在那些研究的数字之上。它让你保持在上下文能发挥作用的95%至98%区间,把查词花在会改变意思的地方,并让重复出现的频率来决定哪些词进入复习。下面的步骤就是按顺序列出的同一套方法。

Fasaha能帮上什么,不能帮上什么

Fasaha正是为这套方法而设计的。它的故事、文章、播客和视频中的每个词,点按一下就会显示词义、词根、词型和同根词;文本按A0到C2分级;你收藏的单词会按间隔复习的节奏回到你面前。

它不会替你决定哪些词重要,那是“读两遍”要做的事。它也无法让未分级的文本变容易:如果一页报纸每行都有生词,正确的做法仍然是先读低一级的材料。

八个随元音而变的阿拉伯语词

每一项是一个书面形式,以及它可能代表的几个词。这就是不标音符的阿拉伯语词难猜的原因,也是周围的词承载大量意思的原因。

  1. كتب: كَتَبَ · كُتِبَ · كُتُب — 他写了 · 它被写了 · 书籍
  2. علم: عِلْم · عَلَم · عَلِمَ · عَلَّمَ — 知识 · 旗帜 · 他知道了 · 他教了
  3. ملك: مَلِك · مَلَك · مُلْك · مَلَكَ — 国王 · 天使 · 国权 · 他拥有了
  4. شعر: شِعْر · شَعْر · شَعَرَ — 诗歌 · 头发 · 他感觉到
  5. قبل: قَبْلَ · قَبِلَ · قُبِلَ · قَبَّلَ — 在……之前 · 他接受了 · 它被接受了 · 他亲吻了
  6. حمل: حَمَلَ · حَمْل · حِمْل · حَمَل — 他搬运了 · 携带、怀孕 · 负担 · 羊羔
  7. عقد: عَقْد · عِقْد · عُقَد · عَقَدَ — 合同 · 项链 · 结(复数) · 他系上了、他缔结了
  8. ذهب: ذَهَب · ذَهَبَ — 金子 · 他去了
已知词的比例落到纸面上意味着什么。比例数据来自Hu和Nation(2000)以及Laufer和Ravenhorst-Kalovski(2010);最后一列是我们的描述,按每行约十个词计算。
认识的词生词按每行约十个词计读起来的感觉
98%每50个词1个每五行一个轻松:上下文能发挥作用
95%每20个词1个每两行一个读得下去,需要查几个词
90%每10个词1个每行约一个吃力:句子不断被打断
80%每5个词1个每行约两个是在解码,不是在阅读

遇到生词,是猜好还是查好?

两者都要,顺序是先猜,再核对重要的词。在Nassaji 2003年对中级学习者的研究中,根据上下文作出的猜测只有25.6%完全正确,而且猜错了也可能感觉是对的。快速核对一下,猜测就会变成你真正认识的词。

读阿拉伯语需要认识多少个词?

对阿拉伯语来说,并没有一个可靠的单一数字。针对英语的研究认为,读得轻松需要认识文本中约98%的词,而对一般英语书面语来说,这需要8,000至9,000个词族(Nation 2006)。对阿拉伯语而言,实用的检验就是你面前这一页:如果上面几乎每个词你都认识,它就适合你目前的水平。

什么是泛读?它对学阿拉伯语有用吗?

泛读是指大量、快速地阅读简单的文本,以理解意思为主,很少查词。只有当文本对你确实简单,即认识约98%的词时,泛读才有效。对大多数B1以下的学习者来说,这意味着要读专为学习者编写的分级文本,因为依我们的经验,在这个阶段,普通的阿拉伯语文本很少有这么简单的。

为什么在词典里找不到某个阿拉伯语词?

多数阿拉伯语词典按词根排序,而不是按拼写。要查 مَكْتَبَة(图书馆),得到 ك·ت·ب 下面找;要查 اتَّصَلَ(他联系了),得到 و·ص·ل 下面找,因为 و 已经并入了 ت。我们关于阿拉伯语词根和词型的指南,介绍了如何手工找出词根。

参考资料

关于Fasaha

Fasaha是一款以阅读为先的阿拉伯语应用。故事、播客、视频或文章里的每个词,都能展开查看词义、词根、词型和同根词,并可收藏下来进行间隔复习。

  • 支持iPhone、iPad、Mac和Android。
  • 界面语言:英语、阿拉伯语、土耳其语、俄语、乌兹别克语、西班牙语、法语、德语、印度尼西亚语、马来语、乌尔都语、意大利语、葡萄牙语、孟加拉语和哈萨克语。
  • 可免费开始使用;会员可解锁完整书库,费用由应用商店结算。

全部文章