认知科学

IMPACT ENGLISH · SINCE 2002

统计学习:婴儿怎么从语音里切词

2026-09-25 20:07:07 学习科学研究组 35110

本文性质: 实证(Evidence) 证据标签: 观察 Observation/模型 Model/假设 Hypothesis/实证 Evidence

本篇涉及的证据类型:实证 Evidence/模型 Model/观察 Observation。凡属本院课堂观察与教学模型的部分,均不作效果承诺。

一段连续播放的外语语音里没有空格,孩子是听不出词与词的分界的。但八个月大的婴儿,在听了几分钟后,就能对刚出现过的那几个「词」表现出反应。

没人教过语法,孩子却学会了说话

家长常感叹孩子学话快:没人给他讲主谓宾,他也说得对。过去这被归为「语感」,一个说不清也教不会的东西。统计学习的研究给出了一种更具体的解释:婴儿在听大人说话时,并不需要先懂意思,而是在做一件很像统计的事——哪些音节经常连在一起出现,哪些组合很少出现。经常连在一起的那一段,就被当成一个单位。这个过程不需要讲解,也不需要奖惩,只要有足够多的输入。这条线索对成人学外语的意义在于:输入本身携带着结构信息,问题在于我们给了多少输入、以及有没有让输入持续。

大脑会在无意识中统计共现规律

Saffran、Aslin 与 Newport 在 1996 年发表于 Science 的研究,是这一领域的标志性工作。研究者给八个月大的婴儿播放一段由无意义音节构成的人工语言,音节之间没有任何停顿,但其中某些三音节组合在后文中的出现概率更高。仅仅两分钟的暴露之后,婴儿对「词」与「非词」表现出不同的反应。这说明婴儿能从连续的语音流里提取出统计规律,并不需要先具备词汇或语法知识。Reber 在更早的研究中把这类无意识获得规律的现象称为内隐学习,并在 1993 年的综述里整理了数十年的证据。需要把层次标清楚:内隐学习的存在与统计信息的提取能力,是有实验支持的实证结论;但这项研究证明的是「婴儿能提取统计规律」,不等于「只要放音频孩子就能学会外语」——两者之间隔着输入量、注意、互动与意义这些条件。

让输入自己教学生一部分东西

本院据此调整了输入的设计,方向是让输入自己承担一部分教学功能。三处具体做法:第一,把同一个句型在听读材料里以高频率自然复现,而不是只出现一次就换新内容;第二,固定使用若干高频搭配(如 make a decision、take a break),让学生先按整块记,而不是逐词拼;第三,允许一部分材料暂时听不懂细节,只要求能跟上整体节奏。这一安排是本院的教学模型,它借用的是统计学习研究的结论,但「复现几次、用哪些搭配」是我们的选择。

统计学习要靠大量输入,不是速成法

边界要说在前面。第一,统计学习依赖大量输入,它天然是慢变量,不能当成速成法。第二,婴儿的统计学习在语言关键期周围发生,成人是否拥有同样强的能力,研究结论并不一致。第三,光有输入而没有理解与互动,效果会明显打折——能被吸收的输入通常是「大致能懂」的那一类。第四,本院不据此承诺任何学习速度或分数结果。

今天就能开始

把同一份听读材料连听三天,不换新内容,先让复现发生。

本文依据

  • 观察来源: 本院教学中,同一材料连续多日复现的班级,对固定搭配的整块提取更顺畅——属教学观察,未做统计检验。
  • 模型出处: 「高频搭配整块记 + 同一材料连续复现」为本院课程研发部输入设计原则。
  • 待验证项: 成人学习者的统计学习效率与输入量的关系,本院未做对照实验,属待验证项。
  • 外部文献: Saffran, J. R., Aslin, R. N., & Newport, E. L. (1996). Statistical learning by 8-month-old infants. Science, 274(5294), 1926–1928;Reber, A. S. (1993). Implicit Learning and Tacit Knowledge. Oxford University Press。
首页
教学案例
教学现场
联系