Anthropic 新研究:同是 Claude,不同模型和不同语言下"性格"竟不一样
本站为独立第三方技术服务平台,提供多模型 API 聚合接入服务,与 Anthropic、OpenAI、Google 等模型提供商无任何关联、授权或合作关系。
以下内容基于 Anthropic 公开发布的研究说明整理,仅作行业信息解读。
核心要点
- 在早前研究中,Anthropic 发现 Claude 在对话里会表达 3000 多种价值观,比如诚实、温暖等。
- 新研究进一步追问:这些��值观在不同 Claude 模型之间、以及不同语言之间,表现是否一致?
- 研究团队分析了 30 万+ 条匿名对话,把相似价值观聚类后,归纳出四条关键差异轴。
- 结论是:模型之间的差异总体温和,但每个 Claude 模型都稳定地落在这些轴上的不同位置;而语言的影响,最明显地体现在"温暖 vs 严谨"这条轴上。
详细解读
四条价值观差异轴
因为直接比较 3000 种价值观太难看出规律,研究把相似的价值聚成簇,最终提炼出四条轴:
- 顺从 vs 审慎(Deference vs. Caution)
- 温暖 vs 严谨(Warmth vs. Rigor)
- 深入 vs 简洁(Depth vs. Brevity)
- 坦率 vs 执行(Candor vs. Execution)
每个模型在这四条轴上都有自己的"坐标"。研究举了个例子:Sonnet 4.6 更活泼、更倾向肯定用���,而 Opus 4.7 更可能给出坦率的批评。换句话说,同样一句话问下去,不同模型的"回话风格"确实存在可观测的系统性差异。
语言也会改变 Claude 的表达
更有意思的是语言维度。研究发现 Claude 表达的价值观会随对话语言而变,其中最明显的还是"温暖 vs 严谨"这条轴:
- 在印地语和阿拉伯语里,Claude 最偏向温暖;
- 在俄语里,它更偏向严谨——常常会反过来请用户提供支撑证据。
这意味着,语言不只是"翻译层",它可能实实在在地影响模型的回应倾向。
研究团队自己也留了个问号
值得一提的是,Anthropic 在说明里保持了克制:虽然这些价值观每天在影响数百万次对话,但他们目前还不清楚这些差异为什么会出现,也不确定这种差异是否"应该存在"。这套分析方法的意义,是让他们能进一步搞清楚——哪些因素在影响 Claude 的价值观表达,以及未来该如何(以及是否要)去引导它。
对开发者意味着什么
这份研究看着偏"对齐哲学",但对每天调 API 的开发者其实很有实操价值:
- "选哪个模型"不只是比跑分。 同一家的 Sonnet 和 Opus,在语气、批判性、详略上就有稳定差异。做客服/陪伴场景,偏温暖肯定的模型可能更合适;做代码 review、事实核查,偏坦率、审慎的模型更靠谱。
- 语言会影响输出风格。 如果你的产品面向多语言用户,同一个 prompt 在不同语种下的"性格"可能不同,值得针对性测试,而不是想当然地复用一套预期。
- 没有"全能最优"的单一模型。 不同任务、不同语言、不同风格诉求,最优解往往是不同模型的组合——这也正是多模型策略的现实依据。
落到实践:用一套代码横向对比多个模型
想验证"同一个问题、不同模型回法有多不一样",最省事的方式是用一个统一接口把它们摆在一起跑。Code0 是多模型聚合 API 网关——一个 Key 接入 300+ 主流大模型(Claude、GPT、Gemini、DeepSeek 等),且兼容 OpenAI SDK,零改造接入,横向对比只需改 model 字段:
from openai import OpenAI
client = OpenAI(
base_url="https://hk.code0.ai/v1",
api_key="sk-你的Key", # 在 console.code0.ai 获取
)
prompt = "我写了一段方案,帮我评价一下有没有问题。"
for model in ["claude-opus-4-8", "claude-sonnet-4-6", "gpt-5.4", "gemini-3-pro"]:
resp = client.chat.completions.create(
model=model,
messages=[{"role": "user", "content": prompt}],
)
print(f"\n===== {model} =====")
print(resp.choices[0].message.content)
同一段 prompt 跑一圈,你能直观感受到"坦率批评"和"温暖肯定"的差别——把选型建立在自己场景的实测上,而不是别人的结论上。按量即用、失败不计费;可用模型与计费口径以 console.code0.ai 控制台为准。
总结
这份研究给了一个朴素但常被忽略的提醒:模型是有"性格"的,而且这种性格会随模型版本、甚至对话语言而变。 对开发者来说,与其纠结"哪个模型最强",不如在自己的真实场景里把候选模型摆在一起对比,让数据帮你选。而要做到这一点,一套能一键切换多模型的统一接入,往往比反复接不同家的 SDK 省事得多。



