Anthropic 研究发现 Claude 在不同语言下行为差异显著中文版本更严谨
Anthropic 研究揭示,Claude 的行为因语言而异,中文用户面对的是一个既挑错又安慰的混合体,差异甚至超过换一个模型版本。
Anthropic 发布论文,分析 30 万段对话发现:Claude 在不同语言中表现出不同价值观——印地语更温暖,俄语更严谨。中文版本混合了暖心安慰和直言不讳。模型之间的差异(0.24σ)远小于语言带来的差异(0.49σ),说明你用的语言比模型版本更能影响对话风格。
正文摘录
 新智元报道  你半夜失眠问 Claude 该不该辞职,它体贴得像个认识了十年的老朋友。 你写了段破绽百出的代码让 Claude 看,它不但没嘲笑,还先夸了句结构清晰。 你一直以为,这就是 Claude 天生的好脾气。 但先别急着感动! 就在刚刚,Anthropic 发了一篇论文,把自家 309,815 段真实对话摊在聚光灯下,一行行数了一遍,然后发现—— 那根本不是它的性格,那只是你碰巧说对了语言。   两个人,一份计划书 走出对话时命运不一样 在论文里,Anthropic 举了这样一个例子。 两个人手里攥着同一份商业计划书,跑去问 Claude 这事到底靠不靠谱。一个人用了印地语,另一个人用了俄语。 在印地语和阿拉伯语里,Claude 会用礼貌措辞、开玩笑、肯定你的想法和你的作品;在英语和俄语里,Claude 会挑战你的假设、纠正你的细节、要你拿证据。 这个差距有多大? 用印地语说话时,Claude 的「温暖」比全局平均高出接近半个标准差,是整项研究里最强的一次单项偏移。 这里简单解释一下。