读阿拉伯语,生词要逐个查吗?研究怎么说
根据上下文猜词,完全猜对的只有约四分之一;读得轻松,需要认识98%的词。读阿拉伯语时,什么时候该查词,什么时候不必查。
· 作者 Amaan
读阿拉伯语时,每个生词都要查吗?
不必,但也别每个词都靠猜。卡住句子的词、反复出现的词就去查,其余的跳过。一项针对中级学习者的研究发现,根据上下文猜词,完全猜对的只有25.6%;而要读得轻松,大约需要认识98%的词。不标短元音的阿拉伯语就更难猜了。
卡住句子或反复出现的词就查,其余的跳过。单靠猜,失败的次数比学习者预想的多:在Nassaji 2003年的研究中,根据上下文作出的猜测只有25.6%完全正确。
阅读研究认为,读得轻松需要认识一页中约98%的词,即每五十个词里只有一个生词;下限约为95%。低于这个比例,上下文能提供的线索就太少了。
阿拉伯语更难猜。在不标短元音的印刷文本里,كتب 可以是“他写了”“它被写了”或“书籍”,只能靠周围的词来判断。
查词的成本决定策略。如果用的是按词根排序的纸质词典,学习者就渐渐不查了;如果查一次只需点按一下,有选择地查词就是理所当然的默认做法。
如果你每行要标出的词超过一个左右,这篇文本目前对你来说偏难。这是我们的经验法则,不是研究结论,它只是把上面的数字用到了实处。
读懂一页书,需要认识多少词?
按引用最多的估算,约为一页中98%的词,即每五十个词里只有一个生词。Laufer和Ravenhorst-Kalovski(2010)认为,达到充分理解的最低要求约为认识95%的词,最佳为98%。Hu和Nation(2000)发现,多数读者需要认识约98%的词,才能在没有帮助的情况下读懂一篇短篇小说。
这些数字应当看作比例,而不是定律。它们是在英语上测得的,词汇量按词族计算。2023年,Kremmel等人以斯里兰卡的104名成年学习者为对象,重复了Hu和Nation的研究,发现即使认识98%的词,按原研究的定义,读者仍未达到充分理解。更稳妥的理解是:这是一道斜坡,而不是一道悬崖。认识的词每多一个百分点都有帮助,并不存在某条线,一越过去阅读就突然变得容易。
Nation(2006)估计,要认识一般英语书面语中98%的词,需要8,000至9,000个词族的词汇量。阿拉伯语的算法不同:一个词根带出许多词,一个词又以多种附着形式出现,所以英语的总数不能照搬。能借用的是比例:一篇每行都藏着生词的文本,还算不上阅读材料,而是一道查词典的练习。
根据上下文猜词,有多大用?
没有常见建议说的那么有用。在Nassaji 2003年的研究中,21名中级英语学习者尝试根据上下文推断生词:完全猜对的占25.6%,部分猜对的占18.6%,猜错的占55.8%。猜词恰恰在最不需要它的地方最灵——在一篇几乎其他每个词都已认识的文本里。
这并不是反对猜词,而是反对把猜词当作唯一的策略,也反对那种流行的建议:去读只能看懂80%到90%的文本。如果这指的是认识80%到90%的词,那么几乎每行都会冒出一个生词,而每一次猜测所依赖的上下文,本身就漏洞百出。
猜错的代价也比看上去大。猜错的当下并不觉得错,于是错误的意思可能就此在记忆里扎下根来。事后快速核对一下,猜测就会变成你真正认识的词,或者变成一次让你记得住的纠正。
为什么阿拉伯语更难猜?
阿拉伯语通常不标短元音,所以一个书面词可能是好几个不同的词。كتب 可以是 كَتَبَ(他写了)、كُتِبَ(它被写了)或 كُتُب(书籍)。ملك 可以是 مَلِك(国王)、مَلَك(天使)、مُلْك(国权)或 مَلَكَ(他拥有了)。要靠周围的词来判断,而周围的词只有你认识,才帮得上忙。
还有两种情况,会让认识的词看起来像生词。一是小词在书写时附在它身上:وَبِكُتُبِهِمْ(并以他们的书)在纸面上只是一个词。二是词在内部变形:كِتَاب(书)的复数是 كُتُب。认识 كِتَاب 的学习者,可能认不出 كُتُبِهِمْ。所以,好用的阿拉伯语查词工具必须能找到词典形式和词根,而不只是逐个字母去匹配。
熟练的读者并不是在盲猜。他们认出词根和词型,元音随之而定;我们那篇讲如何读不标音符的阿拉伯语的文章,会一步步演示这个过程。在这种辨认变成自动反应之前,查词就是练出它的办法。
查过的词更容易记住吗?
是的,前提是读者真的去查。在Hulstijn、Hollander和Greidanus 1996年的一项研究中,阅读时页边印有词义的高级学习者,比配有词典的学习者记住了更多目标词,主要原因是配词典的那一组很少翻开词典。一个词遇到三次也有帮助,但主要是在它的意思已经给出或查过的情况下。
Luppescu和Day(1993)从另一面考察了同样的取舍。293名日本大学生阅读了一篇英语短篇小说,其中允许使用双语词典的学生,在随后的词汇测试中得分显著高于没有词典的学生。
综合起来看:查词让一个词更可能留在记忆里;页边注释让查词毫无成本;而查词的成本,决定了查词到底会发生几次。三者之中,成本是读者自己能改变的那一个。
为什么在阿拉伯语里,查词的成本这么关键?
纸质阿拉伯语词典按词根排序,而不是按拼写,所以每次查词都要先找出词根,而柔母会把词根藏起来。اتَّصَلَ(他联系了)收在 و·ص·ل 之下;مُسْتَشْفًى(医院)收在 ش·ف·ي 之下。如果每查一次都要这样搜寻一番,跳过不查就是理性的选择。如果查一次只需点按一下,这笔账就反过来了。
点按查词的词典,就是随叫随到的页边注释:你需要时,意思就在那里;不需要时,它就看不见。真正该问的是:点按一下,有多大比例能找到对应的词条?我们测过自己的:在214,689个真实阿拉伯语文本的词上(取自面向学习者的文章、故事、字幕、一部古典书籍和阿拉伯语维基百科),在Fasaha中点按,96.03%的词都打开了词典词条(2026年9月3日测得)。未命中的主要是词典尚未收录的词,以及人名和外来词,另有一小部分是查词功能本应找到的词形。
没有哪种工具能完美地读懂不标音符的阿拉伯语。当一个书面词可能是两个不同的词时,收藏之前,先把卡片给出的读法放回句子里核对一下。
“读两遍”:今晚就能用的方法
先把一段读一遍,抓住大意,标出让你卡住的词。只查这些词,然后把这一段再读一遍,有音频就配着音频读,并把出现了两次的词收藏起来。如果你每行要标出的词超过一个左右,这篇文本目前对你来说偏难:降一个级别,以后再回来读它。
这是我们自己的方法,不是上述研究的结论,但它建立在那些研究的数字之上。它让你保持在上下文能发挥作用的95%至98%区间,把查词花在会改变意思的地方,并让重复出现的频率来决定哪些词进入复习。下面的步骤就是按顺序列出的同一套方法。
Fasaha能帮上什么,不能帮上什么
Fasaha正是为这套方法而设计的。它的故事、文章、播客和视频中的每个词,点按一下就会显示词义、词根、词型和同根词;文本按A0到C2分级;你收藏的单词会按间隔复习的节奏回到你面前。
它不会替你决定哪些词重要,那是“读两遍”要做的事。它也无法让未分级的文本变容易:如果一页报纸每行都有生词,正确的做法仍然是先读低一级的材料。
八个随元音而变的阿拉伯语词
每一项是一个书面形式,以及它可能代表的几个词。这就是不标音符的阿拉伯语词难猜的原因,也是周围的词承载大量意思的原因。
- كتب: كَتَبَ · كُتِبَ · كُتُب — 他写了 · 它被写了 · 书籍
- علم: عِلْم · عَلَم · عَلِمَ · عَلَّمَ — 知识 · 旗帜 · 他知道了 · 他教了
- ملك: مَلِك · مَلَك · مُلْك · مَلَكَ — 国王 · 天使 · 国权 · 他拥有了
- شعر: شِعْر · شَعْر · شَعَرَ — 诗歌 · 头发 · 他感觉到
- قبل: قَبْلَ · قَبِلَ · قُبِلَ · قَبَّلَ — 在……之前 · 他接受了 · 它被接受了 · 他亲吻了
- حمل: حَمَلَ · حَمْل · حِمْل · حَمَل — 他搬运了 · 携带、怀孕 · 负担 · 羊羔
- عقد: عَقْد · عِقْد · عُقَد · عَقَدَ — 合同 · 项链 · 结(复数) · 他系上了、他缔结了
- ذهب: ذَهَب · ذَهَبَ — 金子 · 他去了
| 认识的词 | 生词 | 按每行约十个词计 | 读起来的感觉 |
|---|---|---|---|
| 98% | 每50个词1个 | 每五行一个 | 轻松:上下文能发挥作用 |
| 95% | 每20个词1个 | 每两行一个 | 读得下去,需要查几个词 |
| 90% | 每10个词1个 | 每行约一个 | 吃力:句子不断被打断 |
| 80% | 每5个词1个 | 每行约两个 | 是在解码,不是在阅读 |
遇到生词,是猜好还是查好?
两者都要,顺序是先猜,再核对重要的词。在Nassaji 2003年对中级学习者的研究中,根据上下文作出的猜测只有25.6%完全正确,而且猜错了也可能感觉是对的。快速核对一下,猜测就会变成你真正认识的词。
读阿拉伯语需要认识多少个词?
对阿拉伯语来说,并没有一个可靠的单一数字。针对英语的研究认为,读得轻松需要认识文本中约98%的词,而对一般英语书面语来说,这需要8,000至9,000个词族(Nation 2006)。对阿拉伯语而言,实用的检验就是你面前这一页:如果上面几乎每个词你都认识,它就适合你目前的水平。
什么是泛读?它对学阿拉伯语有用吗?
泛读是指大量、快速地阅读简单的文本,以理解意思为主,很少查词。只有当文本对你确实简单,即认识约98%的词时,泛读才有效。对大多数B1以下的学习者来说,这意味着要读专为学习者编写的分级文本,因为依我们的经验,在这个阶段,普通的阿拉伯语文本很少有这么简单的。
为什么在词典里找不到某个阿拉伯语词?
多数阿拉伯语词典按词根排序,而不是按拼写。要查 مَكْتَبَة(图书馆),得到 ك·ت·ب 下面找;要查 اتَّصَلَ(他联系了),得到 و·ص·ل 下面找,因为 و 已经并入了 ت。我们关于阿拉伯语词根和词型的指南,介绍了如何手工找出词根。
参考资料
- Hu和Nation(2000),“Unknown vocabulary density and reading comprehension”,Reading in a Foreign Language 13(1)
- Laufer和Ravenhorst-Kalovski(2010),“Lexical threshold revisited”,Reading in a Foreign Language 22(1)
- Kremmel等(2023),“Unknown vocabulary density and reading comprehension: replicating Hu and Nation (2000)”,Language Learning
- Nation(2006),“How large a vocabulary is needed for reading and listening?”,Canadian Modern Language Review 63(1)
- Nassaji(2003),“L2 vocabulary learning from context”,TESOL Quarterly 37(4)
- Hulstijn、Hollander和Greidanus(1996),“Incidental vocabulary learning by advanced foreign language students”,The Modern Language Journal 80(3)
- Luppescu和Day(1993),“Reading, dictionaries, and vocabulary learning”,Language Learning 43(2)
- Quranic Arabic Corpus,古兰经词典,词根 م ل ك
关于Fasaha
Fasaha是一款以阅读为先的阿拉伯语应用。故事、播客、视频或文章里的每个词,都能展开查看词义、词根、词型和同根词,并可收藏下来进行间隔复习。
- 支持iPhone、iPad、Mac和Android。
- 界面语言:英语、阿拉伯语、土耳其语、俄语、乌兹别克语、西班牙语、法语、德语、印度尼西亚语、马来语、乌尔都语、意大利语、葡萄牙语、孟加拉语和哈萨克语。
- 可免费开始使用;会员可解锁完整书库,费用由应用商店结算。
全部文章
- 开端章逐词读:29个词、18个词根,与《古兰经》的十分之一: 每次礼拜都要诵读的七节经文,逐词拆开:全部29个词的词义、词根和词型,再依据古兰经阿拉伯语语料库的统计,看这18个词根在《古兰经》中能延伸多远。
- 多邻国只能通过英语学阿拉伯语。如果英语不是你的母语,这意味着什么: 如果英语是你的母语,多邻国有适合你的阿拉伯语课程。如果英语是你的第二语言,或者你要帮的学习者说土耳其语、乌兹别克语、西班牙语或俄语,那就没有。本文教你在多邻国自己的列表上核实这一点,并给出七个问题,帮你筛出真正好用的应用。