你用中文提问,AI 用日文回答——AI「语言串台」的原理和解法

所以,问题出在哪里?

你用中文问了一个问题,回复框里蹦出来的,是一整段日文(或者是韩文,或者是英文)
图片 
图1 突然开始用日文回复(之前正常)
没有更换语言,没有改设置,之前对话也是OK的,就是这一次突然开始都是日文回复。让它用中文回复一遍,中文回复可能又正常了。
图片 
图2 要求用中文回复,也正常了
首先恭喜你,你使用的是正版 AI (至少我是Claude的订阅用户,而且据我搜索的反馈,正版的Claude出现的概率较大)


01.
不是你一个人的问题
图片

这玩意儿至少从今年春天就开始了。
在 V2EX 这个技术论坛上,一直有人在吐槽同一件事。有人发帖「最近 claude 很抽风啊,中文问题用日文回答」,底下一堆人附和:有人 coding 到一半冒出韩文,也有人怀疑是上下文太长了才开始用韩文回答。[1]
图片 
图3 V2EX上5月就有用户在反馈
到这个月初,还有新帖在问「Claude 最近总是用日文或者韩文,有遇到过吗」,评论区照样一片「+1」,还有人补了一句关键的:「特别是多轮对话以后,会莫名其妙用日文或韩文回复你」。[2]
图片 
图4 V2EX上7月初还有用户在反馈
在 GitHub 上 Claude Code 的官方问题反馈仓库里,就躺着这样一条用户提交的 issue:有用户在项目配置里明明写死了「永远用繁体中文,不得使用日文、韩文」,结果每次跑完一个命令,Claude 就整段回日文。最有意思的是,它自己也会「反应过来」,道个歉——可那句道歉,还是用日文说的。[3]
图片 
图5 用户在配置文件里写死了语言,Claude 还是用日文道歉
这条 issue 的下场是:挂了两个月,没有一个官方的人回复过,最后被机器人以「太久没人跟进」为由自动关掉了。它身上贴着的标签,一个是 bug,另一个是 area:model——后面这个的意思是,这事归模型层管,不是客户端哪个按钮坏了。
也就是说,连仓库自己都把它归进了「模型的毛病」这一类,然后没人管,烂在那儿了。
真实牛逼!!
而且这毛病是双向的。同一个帖子里,有个工作语言是日文的老哥反过来说:「我工作语言是日文,反倒是偶尔会混进中文词」。[2] 你被它串到日文,他被它串到中文,方向正好相反。
还不止中日韩。还有老哥反馈,日语翻译为中文的时候,甚至还会蹦出韩语俄语印地语(感觉都不是一个语系的)
图片 
图6 V2EX上用户反馈还有其他语言
所以,这特么怎么回事,如何解决?


02.
AI 为啥会这样
图片

要讲清楚,得先接受一件反直觉的事:

1. AI 不认识「语言」
我们觉得中文是中文、英文是英文,是两样东西。
但 AI 不这么认为。
AI 处理文字的方式,是先把所有句子拆成一小块一小块的碎片(专业点叫 token,你可以理解成乐高积木),然后一块接一块地往外拼。对 AI 来说,这些积木只是一串编号,编号背后并没有贴着「这块是中文」「这块是日文」的标签。它不知道自己在「说哪国话」,它只是在拼下一块最可能接上的积木。
所以从根上说,它不是「先决定用中文,再开口」,AI生成的内容是一个字一个字「预测」出来的,语言是这个过程的结果,不是它事先设好的开关 (所以,这算不算“上梁不正下梁歪”啊哈哈哈哈)

2. 「用中文」并不是圭臬
很多人以为,只要在设置里写一句「用中文回复」,就等于开关锁死,从此高枕无忧。
其实并不是。
前面说了,AI的逻辑是一个字一个字往外拼的。每拼一个字,都是在考虑与前面的字组合的概率有多大(甚至都不会考虑「接下来该用什么语言」),而你那句「用中文」的提示词,只是AI在分析概率时参考的一堆信号里的一个点。当下这一段的上文是什么语气、你刚才贴进去的是不是一大段英文报错、系统在后台有没有帮你把长对话压缩过——这些也都在投票。
那么问题就很明显了:
对话越长,你那句「用中文」离「此刻」就越远,分量越轻(甚至可能会丢失);你往对话里贴的英文、代码越多,英文的票就越多;而当系统为了省内存把前面的对话悄悄压缩掉之后,你最初那句叮嘱,可能已经被压缩没了。到某一个节点,「用中文」这张票被盖过去了,AI就跑歪了。
这也正好解释了论坛里大家反复提到的规律:多轮对话之后、上下文特别长的时候,最容易出事。
这才是病根。
它同时解释了为什么会蹦日文、韩文、英文,甚至俄语印地语——因为 AI 压根没有一个「当前语言」的开关,滑到哪儿都不奇怪。
至于为什么偏偏最容易滑到日韩,下面这条是加重因素。

3. 很多字在AI眼里是同一个
你写的「猫」,和日本人写的「猫」,在电脑底层是同一个字符、同一块积木。这不是巧合:中日韩三种文字共用着一大批同源同义的汉字。早年间制定电脑字符标准时,就把这些字归到了同一套编码里。[4] 结果就是:AI 手里那盒积木里,有很大一部分是「中日韩通用件」,AI拿起一块「猫」,并不清楚这块到底是从中文来的还是从日文来的。
于是对AI来说,中文和日文不是两个分开的抽屉,而是挤在一起、边界很模糊的一片。第一个字拼歪了,隔壁的日文就容易滑过来——不是因为它讨厌中文,而是这两家住得实在太近。
这也解释了前面那个日文老哥的遭遇:边界模糊是双向的,从哪边滑过去都一样
不过要说清楚一点:这条只解释了「为什么日文的概率特别高」。韩文里日常用的谚文(就是那些圈圈框框)跟汉字根本不是一套东西,俄语印地语更是八竿子打不着。所以真正管总的还是上一条——没有语言开关,滑到哪儿都可能,中文这层只是让日文这个方向格外顺滑而已。

4. AI 的「母语」,其实是英文
除了往日韩滑,AI 还常常直接甩回一段英文。
这又是另一个原因。
今天这些主流大模型,绝大部分是喂英文材料「带大」的(没办法,英文的语料实在是太多了,远超其他任何语言)。它对英文学得最扎实,对别的语言就松一些(还有一些可怜的小语种,其实都是用英文翻译的)。所以当它一「放松」,除了滑向邻居日韩,还很容易直接退回英文——那是它的老家,是AI最不费劲最不吃力最省事的选择。

5. 为啥还是日文道歉?
那为啥还是用日文道歉来着?
因为 AI 说话是滚雪球的逻辑:开头几个字一旦是日文,后面就顺着日文的惯性往下滚,越滚越顺溜。
还有个很多人没想到的地方:AI 刚吐出来的那几个日文字,立刻就变成了上文的一部分,而且是离「此刻」最近的那一部分。按上一节那套投票逻辑,离得越近票越重——所以它现在是在跟自己刚说完的话投票,而你几千字之前那句「请用中文」,早就排到队尾去了。
说白了,它不是在跟你较劲,是在跟刚才的自己顺拐。
AI 没有一个「当前语言」的仪表盘可以一键扳回中文,哪怕它在某个点上「意识到」不对、想道歉,这份道歉也是在同一股惯性里生成的,于是连道歉都用日文说了出来。
不是揣着明白装糊涂,是真的被前面的惯性拽着,一时半会儿拐不回来。
这种时候你让它「翻回中文」,它还经常不肯把前面的内容给你转回来,等于白折腾一趟(只有Token在燃烧哈哈哈哈哈)[2]
当然,不止Claude,ChatGPT 也犯过更离谱的:
2024 年初 ChatGPT 有过一次大面积「抽风」,整段整段的乱码,也有人收到了莫名其妙换成别的语言的回复。官方后来复盘说,是一次更新引入的 bug,让模型在「挑数字」这一步挑歪了;再往下追,根子是推理程序在某些 GPU 配置下算错了结果。[5]
那次跟本文说的其实不是一个病——那是一次性的基础设施故障,当天就修好了,而本文说的是模型天天如此的常态。但它从侧面戳穿了同一件事:AI 拼的是编号,不是「意思」——编号一歪,语言就跟着乱套。


03.
怎么解决这个问题
图片

坏消息是:这是生成式模型的特性,谁也给不了你一个「永不复发」的根治办法。
好消息是:没法根治,但可以降低概率。
所以,从官方到民间,修复的方法都是降低概率:
1. 开口就把话说死。 别指望它自己猜准。对话第一句就明确写上「接下来请全程用中文回答」,比什么都直接。它本来就是靠上文来猜你想要哪种语言的,你把这个信号给足,它就少犯浑。
2. 对话长了,就把要求「重申」一遍,别指望开头那句管到底。 这条是从上面第 5 条原理直接长出来的:AI 每一步都在跟离它最近的上文投票,所以语言要求离当前这句话越近,票就越重
真正有效的做法是:在长对话里隔一段就重申一次,或者干脆把「用中文回答」跟在你当前这个问题的后面一起发过去。
至于「自定义指令」这类长期设置(比如 ChatGPT 的自定义指令、Claude 的个人偏好或项目说明文件),该写还是要写,但你得知道它只是一张「底票」,不是保票——前面那条 GitHub issue 里的老哥就是把语言写死在配置文件里,照样被回了一嘴日文。
3. 跑偏了别硬掰,直接新开一个对话。 一旦它开始串语言,你在原对话里反复纠正,往往越纠越乱(它自己都在惯性里出不来)。最干脆的办法是新开一个干净对话,把问题重新问一遍。
4. 别把一个对话用得太长,聊完一个话题就清一下。 长对话、被压缩过的上下文,是重灾区。养成习惯:一件事聊完就新开或清空,别在一个超长对话里从头滚到尾。
5. 少往里塞无关的外语内容。 大段英文报错、整篇外文文档直接甩进去,都会把它带偏。能自己先摘一句重点的,就别整坨贴(我的技巧是:用中文描述一遍问题,然后用分隔符把代码、英文之类的内容框起来)
6. (给爱折腾的人)把「温度」调低一点。 如果你用的是能调参数的接口,把那个控制「放飞程度」的温度值往下调,它会更老实、更少乱窜。普通网页版用户没有这个开关,跳过这条就行。
最后,破一个特别常见的误区:把 App 的界面语言改成中文,不等于让它用中文回答你。界面是给你看的按钮和菜单,回答用什么语言是另一回事,两个开关互不相干。你把界面调成中文,它照样可能用日文答你。
这些招数说到底,都是同一件事的不同做法:它每一步都在重新投票决定用什么语言,你能做的,就是每一步都把「用中文」这张票的概率提高一点。
不是AI坏了。是AI从来就不真正明白「语言」是什么东西——在它眼里,中文、日文、英文,本来就是同一盒混在一起的积木。

参考资料
[1]:Grefer,《最近 claude 很抽风啊,中文问题用日文回答》,V2EX,2026-05-22,https://www.v2ex.com/t/1214620
[2]: YDDDD,《Claude 最近总是用日文或者韩文,有遇到过吗》,V2EX,2026-07-08,https://www.v2ex.com/t/1225769
[3]: anthropics/claude-code Issue #46846「Language instruction ignored: Claude responds in Japanese」,GitHub,2026-04-12,https://github.com/anthropics/claude-code/issues/46846
[4]: Wikipedia,"Han unification",访问 2026-07,https://en.wikipedia.org/wiki/Han_unification
[5]: Richard Speed,"ChatGPT starts spouting nonsense in 'unexpected responses' shocker",The Register,2024-02-21,https://www.theregister.com/2024/02/21/chatgpt_bug/