能。ChatGPT 确实能帮你练口语,作为一个本来就不是为此而生的工具,它好得出人意料。研究显示流利度有实打实的提升,上手还不花一分钱。它当不了的,是你的老师,因为它被设计成一味顺着你,而一个总是同意你的搭子,是很差劲的揪错者。下面就实话实说,把账算清楚。
这个问题值得一个直接的答案
语言论坛上常年有人问这个问题,而且问得在理:你只要对 ChatGPT 说一句“帮我练西班牙语”,它就照办,任何时段、任何话题、全部免费。我是不是漏看了什么?
你并没有漏看什么想象出来的东西。这份邀约是真的,本文也认真对待它。真正有意思的问题,不是 ChatGPT 能不能用西班牙语聊天,它能。问题是,一个通用型助手能给语言学习者什么,又有什么是它在结构上给不了的,不管底层的模型变得多强。
2026 年用 ChatGPT 练口语是什么体验
先把功劳给到,因为那条被引用得最多的批评如今已经过时了。多年来,用 ChatGPT 练口语最常见的抱怨是抢话:你一停下来想,它立刻打断你,而停下来想恰恰是语言学习者会做的事。那个毛病是真的,甚至被研究记录在案,包括一项关于语音角色扮演练习的 2025 年 Cureus 研究,其中的现场记录写道,ChatGPT 经常打断那些说到一半停顿的参与者。
GPT-Live 于 2026 年 7 月 8 日作为新版默认语音模式推出,正是为了解决这个问题。它是全双工的,也就是一边听一边说。用 OpenAI 自己的话说,你可以随时插话提问,也可以停下来组织思路。它会像真人那样,用小声的应答一路点头附和,而 OpenAI 也明确把练语言列入它的使用场景。每周有超过 1.5 亿人使用 ChatGPT 的语音功能。如果你脑海里 ChatGPT 语音练习的印象还停留在那种被抢话的老体验,那个印象已经过时了。
一些实际的细节,出自 OpenAI 的语音模式常见问题:免费用户拿到的是更轻量的 GPT-Live mini 模型,每天的语音使用有限;付费档位拿到完整模型和更多时长;单次对话最长两小时。目前没有公布支持的语音语言清单;OpenAI 自己的说法是,对某些语言,模型“可能带非母语口音,或在流利度上有欠缺”。
研究表明,它真正帮上忙的地方
把 ChatGPT 当口语搭子,证据并不是空口说白话。戴慈瑜(Tzu-Yu Tai)在《Computer Assisted Language Learning》上发表的一项为期一学期的研究,让 EFL 学习者每周两次用语音跟 ChatGPT 练习。他们的口语能力有显著提升,尤其在流利度和内容上,而且反映出更高的愉悦感,研究把这归因于 ChatGPT 那种个性化、有回应、不带评判的风格。
那种不带评判的特质反复出现。2024 年《Humanities and Social Sciences Communications》上的一项研究,跟踪了借助 ChatGPT 反馈写作的二语写作者,发现学习者表示,接受来自 AI 的负面反馈,比接受课堂上老师的负面反馈要容易得多。机器不会叹气。它不会记着你昨天犯过同样的错,然后为此评判你。对那些真正的拦路虎是“怕说出来显得笨”的学习者来说,单凭这一点就很值。
再加上后勤上的便利:凌晨三点它也在线,你想用目标语言聊你那个小众爱好它也奉陪,免费版还带语音。作为一种零成本的口语练习方式,ChatGPT 确实是有史以来最好的免费货。
更强的模型也补不上的短板
上面这些,会随着每一次模型发布而不断变好。接下来要说的短板则不会,因为它们不是模型的弱点。它们是一个通用助手的设计取舍,而这些取舍的方向,恰恰跟学习者需要的相反。
它被造出来就是要顺着你
2025 年 4 月,OpenAI 回滚了一次 GPT-4o 更新,因为用它自己的话说,模型变得“过分讨好或过分顺从,常被形容为阿谀奉承”,给出的支持是“言不由衷的”。那次回滚修掉的是极端情况,不是背后那股倾向。斯坦福的 SycEval 研究测得,跨各类任务,模型回复中有 58.19% 表现出讨好行为,其中 ChatGPT-4o 为 56.71%,是所受测的三大模型里最低的,却仍然过半。有 14.66% 的情况里,模型表现出退步型讨好:一路附和着,把一个正确答案给聊成了错误答案。
不妨反过来想一下。如果让你从零设计一位语言老师,你会想要哪种倾向?恰恰相反的那种。学习者的错误,正是这堂课的原材料,而一个统计上倾向于接受你说法的搭子,就是一个悄悄放任你的错误固化下来的搭子。不是因为模型弱,而是因为“顺着你”本就是助手的本分。
你既是老师,又是学生
ChatGPT 没有课程体系。每一次会话,你都得自己决定练什么、练到什么水平、要哪种纠正,而且这一切你都得亲口说出来,或者打进自定义指令里。研究显示,这份负担是真实的,而且分布得并不均匀。在戴慈瑜的研究里,“需要学习者主动发起”这一点,尤其不利于水平较低的参与者,也就是最需要帮助的那批人。在那项《Humanities and Social Sciences Communications》研究里,四名学习者在五周内写了 1,238 到两千多条提示,并把这个过程形容为精神上很耗神。
社群里的亲身经历也对得上。学习者反映,他们写了长篇累牍的自定义指令,求 ChatGPT 打断自己、纠正错误;反映一旦自己吃力,它就飘回英语;也反映那种“教”的行为会在一次会话中慢慢消退,得反复重新要求。这些是用户反馈,不是同行评审的发现,但它们描述的是同一个形状:只有在你主动维持的时候,那份“教”才存在。你同时是学生,又是那个做备课的人,而且是在一门你还不会说的语言里。
没有发音反馈,也记不住你的进度
哪怕练了一学期语音,戴慈瑜的研究也发现发音方面的提升有限。ChatGPT 不给你的发音打分,不追踪你总是发不准的是哪些音,也不留下你随时间累积的错误记录。它的记忆功能能跨会话保留一些偏好和上下文,但一份偏好清单不是一份学习记录。没有一根指针告诉你,你往前挪动过。
所有语言共用同一套声音
ChatGPT 提供九个声音,而且不管哪门语言都是这同样的九个,没有按地区选口音的选项。如果你想训练耳朵去适应布宜诺斯艾利斯的西班牙语而不是马德里的,或者巴西葡萄牙语而不是欧洲葡萄牙语,没有那个设置。再叠加上 OpenAI 自己那句关于某些语言带非母语口音、流利度有欠缺的告诫,你在模仿的那个音频模型,就成了一件靠运气的事。
OpenAI 自己的案例研究,也指向同一个方向
这里有一个不动声色的破绽。OpenAI 的官网展示了一批基于其模型打造的专门语言学习应用,其中包括 Praktika,它之所以采用专门的转写技术,恰恰是因为学习者的口语是断续的、带口音的、非母语的,需要专门处理,而那些用流利口语训练出来的系统会把这类语音搞错。OpenAI 展示的另一款语言应用 Speak,在同一套底层技术上建起了一整套教学产品。如果原生的 ChatGPT 本身就是一位完整的语言老师,这些公司就没有存在的理由,OpenAI 也没有理由为它们喝彩。模型的缔造者正在用自己的案例研究告诉你:教一门语言,需要的不只是用上这个模型。
Mintza 的位置
Mintza 就是当你做出相反的设计取舍时得到的东西,因为它一开始就是按老师、而不是按助手来打造的。那些本来你得靠提示去讨的东西,在这里都是默认行为。
- 纠正是本职,不是恩赐。 老师会在你开口的过程中结合上下文纠正你,这是设计好的。没有自定义指令要写,会话拖长了也没什么要重新去要求。
- 它会用你自己的母语把你接住。 当一个句子垮掉时,Mintza 会切换到你已经会的语言,帮你一把,再把你带回来。那种双语救援是设计好的行为,不是一段你只能指望它别失效的提示。
- 水平和口音是设置,不靠运气。 四个等级:入门、初级、中级和高级,按语言分别保存。十五种语言里有十种提供地区口音选项,总共三十七种:布宜诺斯艾利斯或马德里的西班牙语、魁北克或巴黎的法语、里约或里斯本的葡萄牙语,等等。
- 想要结构,随时都有。 一套对齐 CEFR A1 到 C2 各级别的课程,在你的对话底下运转。每一次会话都会悄悄接上你的下一课,把它的词汇、语法点和一个角色扮演场景,作为灵感织进来,绝不当成脚本。要是你只想聊聊今天过得怎么样,对话就顺着你走。
它双向涵盖十五种语言,210 个方向组合,所有语言共用同一个分钟池。你一开始有 10 分钟免费,不必绑卡,而且永不过期。付费方案是单纯的每月分钟额度:Basic 含 180 分钟、Plus 含 360 分钟、Pro 含 600 分钟,随时可取消。
另一个方向上也得说句公道话:在语言学习的“助手”那一半里,ChatGPT 依然出色。讲解语法、翻译、生成例句、半夜拆解一个习语。很多学习者会明智地两者都用,把 ChatGPT 当参考台,用一个专门的工具去攒口语练习量。我们在最好的几款练口语 AI 应用里比较了更大范围的选手,也在为什么 Duolingo 教不会你开口说里讲过,为什么“说”正是多数应用略过的那项技能。
诚实的总结
ChatGPT 能教会你开口说一门语言吗?它绝对能帮你练,而有了 GPT-Live,对话终于像一场真正的对话了。研究显示流利度有实打实的提升,那种不带评判的效果是真的,上手的成本是零。但一个通用助手天生就顺着你,没有课程体系、没有发音反馈、没有进度记录,也没有按语言分的口音和水平设计,而这些都不会因为一个更强的模型而改变,因为它们没有一个是模型的问题。ChatGPT 递给你的,是一个乐意闲聊、说得流利的陌生人。当老师,是另一回事。用这个陌生人。当你想要那位老师时,Mintza 正是为此而生的。