这篇记录我目前借助 AI 和网络内容练习英语口语的三种方式:和 AI 语音聊天、听书跟读、podcast 跟读。三种方式练到的东西不一样,不能互相替代。

1. 和 AI 语音聊天

用法是把 AI 当陪练:自己开口说英语,它负责接住话题,让对话继续下去。我用过三个,感受各不相同:

  • Gemini:太迎合,太 AI。无论你说什么,它都先认同,再把话题接下去,聊不出真人对谈的感觉。
  • Claude:比 Gemini 好一点点,而且可以把口音换成英音。但本质一样:认同太多、引导式回复,聊久了像在和客服或治疗师说话。
  • ChatGPT:口音最接近真人,但仍然无法摆脱 AI 的迎合感和引导感。

结论:和 AI 聊天只适合练习自己的输出——自己组织句子、开口表达。AI 的回复只是脚手架,不能当模仿对象,否则说出来的英语会带着 AI 味。

2. 听书跟读

做法是用 ElevenReader 听书(TTS 朗读),一边听一边跟读。目前在读 Cioran 的《On the Heights of Despair》,密集的段落一段要读 45 分钟左右。

跟读书练的不是口语,是阅读,具体练三样东西:

  1. 发音肌肉。书面词(philosophical、lyrical、lucidity 这类)在对话里几乎不出现,不读出来,这些词就永远停留在看得懂但读不顺的状态。
  2. 长句 parsing。读出声强迫你把复杂句子的成分拆开,默读时会糊弄过去的结构漏洞,出声读会全部暴露。
  3. 注意力锚点。一段读 45 分钟靠的就是跟读维持专注,去掉跟读,深读的强度大概率会掉。

它练不了的是真实对话的节奏,因为没人开口说话是书面语。材料选择上,要选略高于自己舒适区的书,太简单的材料这三样都练不到。

3. Podcast 跟读(还没开始)

听书跟读练不到的东西——真实口语的节奏:弱读、连读、突然的加速减速、半句重来、互相打断——只能从真人对话里学。所以下一步是 podcast 跟读,计划是:

  • 只跟真人音频,不跟 TTS。TTS 语速均匀、每个词发音完整、语调模板化,比对话 AI 更不像真人。
  • 用 transcript 辅助:先看着文本跟读几遍,再关掉文本纯听跟读,最后自己把这段话说一遍。
  • 以 30–60 秒的片段为单位循环,吃透一段再换下一段。
  • 难度进阶:Philosophize This!(清晰的单口)→ On Being、Lex Fridman Podcast(慢访谈)→ Very Bad Wizards(真人对谈)。

podcast 跟读还没开始,开始之后再记录效果。