日语词汇学习法:七种方法的比较
每个学习者最终都会发现同一件事:日语的语法是有限的,日语的词汇不是。语法大纲可以学完,单词学不完。正因如此,词汇学习法是整个学习计划里杠杆最大的一个决定——却也是大多数人从来没有刻意做过的决定,他们只是顺着第一本教材恰好采用的做法一路漂流下去。本篇诚实地比较七种方法,包括每一种不擅长什么,然后讲清楚决定“什么能真正留下来”的原则、那些怎么也记不住的词该怎么办,以及走到2,000、6,000或10,000词的真实算术。
1. 七种方法一览
下面表中的“留存率”指的是每投入一小时换来的留存,而不是抽象意义上的留存——一种方法花四十分钟把一个词牢牢定住,并不自动就优于另一种用两分钟让它定住一半的方法。这里的每种方法都对某些人有效;没有一种对所有情形都有效。
| 方法 | 每个词的时间成本 | 每小时的留存率 | 最适合的阶段 | 主要的失败方式 |
|---|---|---|---|---|
| 大量词表 | 非常低(5–10秒) | 单用时低 | 初次接触;课前预习;考前突击 | 记住的是词表的顺序,而不是词本身 |
| 抽认卡+间隔重复(SRS) | 中等(做一张卡30–60秒,每次复习约8秒) | 高 | 各个阶段;默认的主引擎 | 顽固词堆积、卡组臃肿;记住的是卡片而不是词 |
| 例句挖掘 | 高(每条2–4分钟) | 非常高 | N4以上,能读懂真实材料之后 | 做卡本身变成爱好,把学习时间吃光 |
| 阅读驱动的习得 | 单次遭遇很低,但需要8–20次遭遇 | 早期低,后期非常高 | N3以上,或者词汇量过了约1,500词的人 | 低于可理解的门槛时,它几乎什么也教不了 |
| 听力沉浸 | 边际成本近乎为零(通勤、家务) | 对新词很差,对速度很好 | 任何阶段,作为巩固手段 | 听不懂的音频是背景噪音,不是输入 |
| 写作/产出练习 | 最高(真正用起来,每个词要几分钟) | 对产出能力最高 | 任何阶段,小剂量 | 没有纠正,就会把自己的错误固化下来 |
| 助记法/关键词法 | 高(想出一个要30–90秒) | 对具体那一个词非常高 | 针对难词和汉字读音的定点使用 | 什么词都用,最后想起来的是助记,不是日语 |
2. 每种方法真正的用途
大量词表背负的恶名,只有一半是应得的。把50个词从上到下读一遍,作为记住它们的办法确实很差,但作为遇见它们的办法却相当出色。在开始正式刷卡之前,先花二十分钟看一遍N5词表,那么之后出现的每一张卡都是第二次相遇而不是第一次,而第二次相遇的成本明显更低。对汉语母语者来说,这一步的价值尤其落在读音上——字面意思往往一眼就懂,真正陌生的是假名读法。灾难性的用法是把词表当成方法的全部:因为词总以同样的顺序出现,你建立起来的是依赖顺序的记忆,然后就会发现 出発(しゅっぱつ,出发)只有跟在 到着(とうちゃく,抵达)后面时才想得起来。
配合间隔重复的抽认卡是主力,这有充分的理由:它是唯一一种把回忆的尝试系统性地安排在记忆正在消退的那个点上的方法,而记忆恰恰是在那里被加固的。机制和排程的算法在间隔重复指南里有详细说明;对选择方法而言,真正重要的是它的取舍。SRS 在把大量“形—义”联结廉价地送进记忆这件事上无可匹敌,在教你一个词在句子里如何活动这件事上则相对薄弱。一张写着 遠慮 →“客气、顾虑”的卡片,能让你在阅读题里认出 遠慮(えんりょ),却不会帮你说出 遠慮なくどうぞ(“别客气,请用”)。用它来铺广度,不要用它来挖深度。
例句挖掘是负责深度的方法。你采集的不是词,而是在真实材料里遇到的、除了一处之外都能看懂的句子。与其为 割引(わりびき,折扣)做一张卡,不如把 今日は全品20%割引です(きょうは ぜんぴん にじゅっパーセント わりびきです,“今天全场商品打八折”)整句留下来——这一个单位里同时装着这个词、它常搭配的词语,以及它的语体。留存效果非常好,因为句子提供了光秃秃的释义给不了的回忆线索。代价是实打实的:把找到它、核对读音、录入进去的时间都算上,每条要两到四分钟。多数放弃例句挖掘的人,都是因为想把什么都挖进来。
阅读驱动的习得是你最终学到大部分词汇的途径,而在跨过某个门槛之前它几乎没有用。二语阅读研究一致发现,附带习得需要相当多次的遭遇——常被引用的数字是大约八到二十次接触,一个词才算可靠地掌握——而且要能舒服地独立阅读,需要认识文本中约98%的词,也就是每一百个词里只有两个生词。低于这个比例,你是在解码而不是在阅读,几乎什么也留不下。这正是“多读就好了”作为初学者建议会失效、到了N3左右却变成绝佳建议的诚实原因。
听力沉浸被严重夸大,同时又确实有价值,只是它干的活和大家以为的不一样。它很少教你新词。它做得极好的,是把慢的知识变成快的知识:一个要四秒才想得起来的词在会话里毫无用处,而反复听正是把这四秒压缩到四分之一秒的东西。它还能纠正你只靠眼睛学来的那些词的发音——这在日语里是个巨大的问题,一日 或 十分 的读法你可能一错就是好几年。听不懂的音频放着基本等于没放;听得懂的音频作用极大。
产出练习——写句子、记日记、开口说——每个词的成本很高,却无可替代,因为它是唯一能让“认得出”和“用得出”之间的落差浮上水面的方法。你不会靠翻抽认卡发现自己没法可靠地在 借りる(かりる,借入)和 貸す(かす,借出)之间做出选择;你会在第一次需要说出其中一个的时候发现。每周用当前这一批词写五个句子,就足以把这类漏洞大部分暴露出来。
助记法是手术刀,不是锤子。给每个词都编一个画面既撑不下去也事与愿违,因为助记只是多加了一道你迟早想丢掉的回忆步骤。但对一个已经让你栽了十次的词,花三十秒建立一个鲜明、具体、稍微有点荒唐的联结,是手上最有效的干预。汉字读音是另一个正当的目标,尤其是当声符正在按可预测的方式起作用、助记只需要覆盖那个例外的时候。
3. 真正决定留存的原则
方法只是表面。它们下面躺着为数不多的几条原则,而一个平庸的方法配上这些原则,胜过一个时髦的方法却不守这些原则。
- 主动回忆远胜被动复习。 把一个词和它的意思并排读一遍,感觉很有产出,实际留下的很少。在看答案之前先试着把意思取出来——哪怕取不出来——留下的要多得多。实用的检验标准是:如果你能整场学习下来一次都没有不确定过,那你不是在学,你只是在看。把答案盖住。念出声来。让核对之前的那段停顿难受一点。
- 分散胜过集中。 六天里每天十分钟,进入长期记忆的东西比周日一小时更多,而且这个差距是巨大的,不是微弱的。计划性复习的全部依据就在这里;如果结构上你什么都不改,就改这一条。
- 交错胜过分块。 先学二十个动词、再学二十个名词、再学二十个形容词,看着更整齐,效果却不如把它们混着学。混合练习逼你在解题之前先判断这是哪一类问题,而这正是真实使用所要求的。它也确实更难,练习时的分数更低——这就是人们半途放弃它的原因。
- 认知和产出是两种不同的能力。 日语 → 汉语 是认知;汉语 → 日语 是产出。产出大约要难上两到三倍,遗忘也更快,而开口说话需要的正是它。多数学习者有庞大的认知词汇和很小的产出词汇,这对付日本语能力考试(JLPT)够用,对付会话则不够。对你真正想用起来的那1,000–2,000词,要刻意测试产出的方向。
- 语境胜过孤立——但更贵。 在句子里学到的词记得更牢、用得更准。孤立学到的词,单个的习得速度更快。明智的处理不是二选一:把常见、具体、不会有歧义的词(犬、水、高い)先孤立地成批拿下,把语境学习留给用法本身就是难点的词——抽象名词、近义词之间的区分、以及任何带着语法搭配的表达。
- 按词频排序,是能拿到的最便宜的优化。 在大规模语料里,形状是一致的:最高频的一千个词大约占实际文本的一半到六成,前五千个词占八成左右,此后每多学一千个,买到的东西就更少。按大致的词频顺序学词——分级词表近似的正是这个顺序——意味着你早期的力气花在了这周还会再遇到的词上。
交错这一条值得补一句只跟日语有关的注,因为这门语言把现成的交错材料直接递到了你手上:自动词与他动词的成对词。開ける(あける,把某物打开)和 開く(あく,某物开了);出す(だす,拿出去)和 出る(でる,出去);始める(はじめる,开始某事)和 始まる(はじまる,某事开始了)。分成两块分开学,它们会糊成一团。放在一起学,把这一对明确地对照起来,并在提示里带上助词——ドアを開ける 对 ドアが開く——它们就会互相加固。
4. 顽固词:怎么也记不住的那些
在任何一副一千词的卡组里,一小撮词——常常在5%上下——会吃掉你复习时间中大得离谱的一份。这些就是顽固词(leech),多数SRS工具会在错到八次左右时自动给它们打上标记。放着不管代价很高:五十个顽固词,每个多花十次复习,就是五百次本来不必做的复习。处理起来很快,但前提是先诊断,因为顽固词的成因各不相同。
- 干扰——最常见的成因。 词并不难;它是在和一个相似的词相撞。訪ねる(たずねる,拜访)和 尋ねる(たずねる,询问)读音完全一样。貸す 和 借りる 是一对你说得清、一着急却产不出来的反义词。解法违反直觉:别再试图把它们分开,而是把两个放进同一张卡片,并写明两者的对比。已经连在一起的东西是解不开的,那就干脆有意地、正确地把它们连起来。
- 提示本身写坏了。 一张写着 適当 →“合适、恰当”的卡片会永远错下去,因为 適当(てきとう)同时还带着“随便、敷衍了事”这个日常义,而你的大脑正在拒绝一个它知道有问题的释义。这对汉语母语者尤其危险——汉语的“适当”只有褒义的那一半,正好把错误的释义坐实了。用一个把某一个义项钉死的句子,重写这张卡。
- 没有挂钩。 既没有画面、又和自己没有关系的抽象词,没有东西可以附着。这正是助记法值回成本的地方,也是一个私人化的例句——关于你自己的工作、城市或家人——胜过教材例句的地方。
- 它确实价值不高。 有时候一个词错了十五次,是因为你根本遇不到它。删掉它。删卡不是失败;那是把未来的二十次复习,重新分配给你真正会遇到的词。如果它重要,你会在阅读中重新把它捡回来。
给这件事定一个固定的约会——每周十五分钟,看一看复习队列标记出来的东西,给每一个套用上面四种处方之一。这是整个系统里回报最高的一刻钟,而几乎没有人真的去做。
5. 把几种方法组合起来的一周
没有哪一种方法能同时覆盖广度、深度、速度和产出。一个跑得动的星期,是把三到四种方法放进固定的时段,这样等你坐下来的时候,选择已经做完了。下面是给中级学习者的一个大致每天35–45分钟的框架;数字按自己的情况缩放,骨架保持不变。
| 星期 | 做什么 | 时间 |
|---|---|---|
| 周一/周三/周五 | 完整的一节:清空复习队列,然后加10–15个新词。最后用10分钟读一点每页会遇到2–5个生词的材料 | 40分钟 |
| 周二/周四 | 只复习,不加新词——这正是阻止队列滚雪球的办法。再加20分钟你真的听得懂的听力,只有通勤路上有空就放在通勤路上 | 20分钟+通勤 |
| 周六 | 深度的一节:从这一周读过、看过的东西里挖出5–8个句子,然后用这周这批词自己写五个句子 | 45分钟 |
| 周日 | 复习,然后是15分钟的顽固词盘点。剩下的时间休息——计划需要余量,否则第一个漏掉的日子会变成漏掉的一个月 | 25分钟 |
有两个细节决定成败。第一,不加新词的日子不是让步,而是负荷管理:产生未来复习量的正是新词,所以每周留两天干燥日,能让队列不至于长得比你清得还快。第二,一切都拴在一个已有的习惯上——通勤、咖啡、地铁。在固定时刻运转的每日学习能活下来;“有空的时候”做的那种活不下来。
6. 诚实的算术:到2,000、6,000、10,000要多久
词汇目标被报出来的时候,通常不附带复习成本,于是看上去比实际便宜得多。缺掉的那一半在这里。在典型的间隔重复排程里,每个新词在走向稳固掌握的路上,大约会产生八到十二次复习。这意味着每天稳定摄入N个新词,最终会停在每天大约五到十倍于N的复习量上。十个新词不是十份工作;是十份,再加上五十到一百次复习。
| 目标 | 每天新词 | 需要的学习天数 | 稳定状态下的每日时间 | 现实的所需时间 |
|---|---|---|---|---|
| 2,000(扎实的初级,N4左右) | 10 | 200 | 25–35分钟 | 每周六天,9–12个月 |
| 6,000(从容的中级,N2左右) | 15 | 400 | 35–50分钟 | 从零开始累计2–3年 |
| 10,000(高级,N1左右) | 20 | 500 | 50–75分钟 | 累计3–5年,而且很少有人能全程保持每天20个 |
“学习天数”那一栏是算术,“现实的所需时间”那一栏是算术再加上诚实。没有人一年365天都学,留存率也从来不是100%,生病、加班和假期一次就带走好几周。在完美执行的数字上打个15–25%的折扣,是正常的体验,而不是哪里出了问题的信号。
关于目标本身,还有两点保留。第一,日本语能力考试(JLPT)自从改制之后就没有再公布过官方词汇表——旧的 出題基準 给最低级别大约800词、给最高级别大约10,000词,而你现在看到的每一个数字,都是从历年真题反推出来的估计,所以级别与词数的对应关系只能当作近似值。第二,“认识6,000个词”掩盖了一个极大的区间:认知层面的6,000词,和你能产出的6,000词,是完全不同的成就。做计划的时候,除非你刻意训练过反方向,否则就假设你的产出词汇是认知词汇的三分之一到一半。
本站的材料大致对应着这几层:基础词汇模块收了1,500个日常词,JLPT模块五个级别合计2,904词,JPT模块5,862词、重心偏向商务和职场用语——总计一万出头,足够不换材料就走完上面这一整条路线。想规划路线的话,学习页面可以看到各个词库是怎么划分的。
7. 在不自欺的前提下衡量进度
几乎所有人都在用的那个指标——加了多少词——恰恰是什么都没测到的那一个。加是免费的;留住才是工作。这里有四把更好的尺子:
- 成熟的项目数,而不是总项目数。 只数那些复习间隔已经越过你自己设定的某个门槛的词——比如三周。一副3,000词、其中900词成熟的卡组,是比一副1,200词、其中1,100词成熟的卡组更小的成就,而真正读得下文章的是后一个学习者。
- 真实文本每页的生词数。 拿一页你真正想读的东西,数一数不认识的词,每个月记录一次这个数字。看着它从40降到12再降到4,是语言学习里最能提气的一张图,而且它测的是你真正在意的东西,不是某个替代指标。
- 提取速度。 要三秒才想得起来的词,在会话里是用不上的。定期用被逼着的节奏跑一批——每项三秒,不许思考——凡是没答上来的,都当作“还没完成”而不是“已经掌握”。
- 产出的抽查。 每个月一次,从卡组里取30个中文释义,把日语写出来。分数会明显低于你的认知分数。那个落差就是你真实的口语上限,而在其他任何指标里它都看不见。
不管你测什么,每次都用同样的方式测,并且写下来。人对自己进度的记忆在两个方向上都不可靠:状态差的一周你会以为自己什么都没学到,学得顺的一次之后你会以为自己记住了一百个词。三行的记录胜过这两种印象。回忆训练本身可以在学习页面里跑,记录里翻出来的问题词,推回复习卡组就好。
8. 用一段话决定怎么选
如果你还不到大约1,000词,就把时间往词表和间隔重复上压,也不必为孤立学习感到内疚——在语境变得划算之前,你需要的是广度,而这个阶段的阅读还给不了你回报。在大约1,000到3,000词之间,让SRS这台引擎继续转,但开始把重心往句子和阅读那边挪,并给最有用的那些词加上产出方向。过了3,000词,把比例倒过来:阅读和听力成为你主要的习得渠道,SRS降格成一张网,接住光靠阅读兜不住的那些东西。助记法这把手术刀,和每周一次的顽固词盘点,从头到尾都不变。而无论处在哪个级别都不会变的那一件事,是排程——周日的一小时永远赢不了六天里的二十分钟,无论你用哪种方法去填那二十分钟。
挑两种方法,不是七种:一种当广度的引擎,一种做深度。引擎每天转,深度每周做,每个周日盘点一次顽固词,数成熟的词而不是加进来的词。按每天十到十五个新词这样做上一年,你会走到2,500词开外——这不是什么英雄般的数字,却足以改变日语给你的感觉。