LingoLeap

配套研究 · 母语对比

哪些英语发音对中文母语的 TOEFL 考生最难?

LingoLeap Research Team · 2026 年 9 月

速览结论

6,057 次设置了界面语言的听后重复练习中,中文界面学习者(4,904 次)与英文界面学习者(1,045 次)在几乎所有英语音上得分接近,最大差距不到 1.4 分。唯一明显分化的是 /θ/:它是中文界面组最难的音(63.5/100),比该组第二难的音还低约 9 分,而在英文界面组里它甚至没有进入难点排名。

主研究 里,我们刻意没有讨论母语——因为大多数练习没有可用的母语信息。这一页专门做那一个数据能支持的母语切分:中文界面学习者对英文界面学习者。

我们原本担心结果会是“中国学习者整体更弱”这种既不新鲜、也容易被误读的结论。数据给出的却是更有意思的图景:两组几乎处处相同,只有一个音真正分化。正是这种“处处相同”让那一个例外变得可信——它不是能力差异的副产品,而是一个具体的、可练习的发音目标。

Section 1

数据与一个重要限制

学习者没有申报母语。我们用其在 LingoLeap 选择的界面语言作为母语的近似代理。这有两个后果:其一,界面语言不等于母语;其二,只有约 26% 的学习者设置了界面语言(6,057 / 23,390 次练习)。因此本页描述的是这个子集,不代表全部 TOEFL 考生,也不应据此推断人群整体。

除此之外,方法与主研究一致:每段录音经自动语音发音评估,得到 0–100 的音素准确度,词尾 -s 通过目标文本与识别结果对齐来判断。一个音素只有在某一组内累计约 1,000 次以上测量时才参与该组排名,样本更少的音不排名。我们报告样本量、平均值与组间差值,但不做显著性检验——重复的学习者与题目不是相互独立的观察值。

Section 2

规律 1:唯一真正分化的音是 /θ/

/θ/ 是中文界面组最难的音,平均 63.5/100;在英文界面组,它甚至没有进入难点排名。

中文界面英文界面020406080100/θ/ thin63.5英文界面组样本不足,未参与排名/ŋ/ sing72.572.9/z/ zoo74.473.4// goat78.878.7/s/ see80.579.1/d/ day81.280.8/t/ tea8281.3/w/ way82.482.3LingoLeap Research
图 1. 两组学习者在八个音上的平均发音准确度(0–100)。除 /θ/ 外,成对柱几乎等高;/θ/ 在英文界面组测量不足,未参与排名。虚线为 60 分阈值。 LingoLeap Research · 2026

差距的大小值得停下来看:中文界面组第二难的音是 /ŋ/(72.5),已经比 /θ/ 高出约 9 分。也就是说,/θ/ 不是“又一个偏难的音”,而是与其余音明显断层的单一异常点。它的 3,252 次测量中有 36.0% 低于 60 分阈值。

为什么偏偏是这个音?

普通话和多数汉语方言的音系里没有 /θ/,学习者常用最接近的 /s/ 或 /t/ 替代——这正是跨语言语音研究预测的音素层面差异 [2]。这是对模式的合理解释,但本页并未做发音实验来直接验证替代机制。

Section 3

规律 2:其余几乎处处相同

这一节其实是上一节的“对照组”。如果两组只在 /θ/ 上不同、在别处都一致,那么 /θ/ 的差距就更可能是真实的语言现象,而不是采样或整体水平造成的假象。

中文界面英文界面差值
/θ/63.5未排名
/ŋ/72.572.9-0.4
/z/74.473.4+1.0
/oʊ/78.878.7+0.1
/s/80.579.1+1.4
/d/81.280.8+0.4
/t/8281.3+0.7
/w/82.482.3+0.1
表 1. 两组在可比音上的平均准确度与差值;/θ/ 因英文界面组样本不足而未排名。 LingoLeap Research · 2026

句子长度带来的影响也几乎一致。两组的复述完整度都随句子变长而下降,而且下降的曲线基本重合——短句 79.5%81.2%,长句 51.5%53.2%

中文界面英文界面0%25%50%75%100%≤6 7–9 10–12 13–15 16+ LingoLeap Research
图 2. 两组按句长的平均复述比例;两组曲线基本重合。 LingoLeap Research · 2026

词尾 -s 也是同样的故事:中文界面组遗漏 10.7%,英文界面组 9.6%,非常接近。把这些放在一起,结论很清楚——两组的听后重复画像高度重合,唯一显著的裂缝在 /θ/。

Section 4

该怎么读这个结果

最大的、未设界面语言的一组(17,333 次)同样把 /θ/ 排在最难,平均约 61——与中文界面组一致。考虑到 LingoLeap 的用户以中文使用者为主,这与“未设语言者多为中文母语”的假设相符,可作为旁证,但不能当作独立验证。

对中文母语的考生来说,这组数据把一个含糊的担忧(“我的发音不够好”)收窄成一个具体目标:/θ/ 值得单独、优先练习,而大多数其他音上,你和英文界面学习者的差距其实很小。这也说明,与其笼统地“练发音”,不如按母语定位到少数真正分化的音。

Section 5

本研究不能说明什么

  • 界面语言是母语的代理,并不等于母语;也无法区分二代移民、双语者等情况。
  • 覆盖面有限:只有约 26% 的学习者设置了界面语言,英文界面组仅 1,045 次练习,样本明显小于中文组。
  • /θ/ 在英文界面组未参与排名,是因为其测量次数低于阈值,因此我们只说“未进入难点排名”,不宣称“对英文界面学习者很容易”。
  • 这些是自动语音评估结果,不是语音学家的人工判断;/θ/ 的替代机制(/s/ 还是 /t/)也未在本页直接验证。
  • 观察性数据,不含显著性检验或因果推断。
Section 6

把结论变成练习

如果你是中文母语考生,最实际的一步是把 /θ/ 放进真实句子里练,而不是孤立地念单音。下面两个入口分别对应方法和练习:

Section 7

数据集说明

LingoLeap Research Team(2026)。哪些英语发音对中文母语的 TOEFL 考生最难? LingoLeap Research,版本 1.0。

https://lingoleap.ai/zh-TW/research/chinese-learners-toefl-pronunciation

Section 8

注释与资料来源

  1. [1] Best, C. T., & Tyler, M. D. (2007). Nonnative and second-language speech perception. In Language Experience in Second Language Speech Learning (pp. 13–34). John Benjamins.
  2. [2] Saito, K. (2019). Effects of second language pronunciation teaching revisited. Language Learning, 69(3), 652–708.
  3. [3] Microsoft. (2026). Use pronunciation assessment. Microsoft Learn.
Section 9

学习者经常问的问题

对中文母语的 TOEFL 考生来说,最难的英语音是哪个?

是 /θ/(thin 里的 “th”),而且领先明显。在中文界面学习者中,它平均只有 63.5/100,比第二难的音低约 9 分;其测量样本中有 36% 低于 60 分阈值。普通话和多数汉语方言里没有 /θ/,这通常被认为是主要原因。

中国学习者的英语发音是不是整体更差?

不是。在这份数据里,两组在几乎每个音上都非常接近:/ŋ/(72.5 对 72.9)、/z/(74.4 对 73.4)、/s/(80.5 对 79.1)等差距都小于 1.5 分。真正拉开差距的只有 /θ/,而不是整体能力。

学习者的母语是怎么判断的?

母语并非用户申报。我们用学习者在 LingoLeap 选择的界面语言作为母语的近似代理,按用户关联。这一代理并不完美,而且只有约四分之一的学习者设置了界面语言,因此本页只描述这个子集,不代表全部 TOEFL 考生。

中文母语者应该怎么练 /θ/ 这个音?

把舌尖轻轻放在上下齿之间,送气但不发声,避免用 /s/ 替代。可以练最小对立对(think/sink、thin/sin),并把这个音放进真实的听后重复句子中练习,而不是只单独练。