为什么很多人感觉 Claude 比 GPT更聪明?
有一个非常有价值的第三方实验。
Viktor 在完全相同的工具、workspace、prompt 下测试 GPT-5.6 Sol/Terra/Luna 与 Fable/Sonnet 等模型,最后把差异总结成:
GPT-5.6 tends to under-explore and under-communicate。
Claude tends to over-explore and over-communicate。
也就是说:
GPT 的典型错误是:“差不多够了,交付。”
Claude 的典型错误是:“我再查查,我再解释一点,我顺手再把这个也处理了。”
同一个测试里,Claude 发出的 Slack 回复中位长度大约是 GPT 的两倍,并且往往进行了更多次 Agent 调用;GPT 整体任务速度和成本明显更低。
这其实高度符合两家的对齐哲学。
那么为什么很多人感觉 Claude 比 GPT更聪明?
这是一个很重要的心理学现象。
假设两个模型实际上都知道正确答案。
GPT:
A 更好。主要原因是 X 和 Y。
如果你的目标是 Z,则改选 B。
Claude:
我认为这里真正的问可能不是 A 和 B 哪个更好,而是你实际上在优化 X 还是 Y。
如果结合你前面提出的约束,我会倾向于 A,不过这里有一个容易被忽略的问……
第二个答案很容易让人形成:
“Claude 理解我。”
甚至:
“Claude 比 GPT 聪明。”
实际上这里混合了三件不同的东西:
能力深度 + 探索预算 + 表达方式。
用户往往把三者全部感知成“智商”。
这也是为什么 benchmark 只有 1~2 分差异的模型,实际使用感受却可能非常大。
(以上为来自 GPT5.6 Sol 的辩解)
@aigc1024
 
 
Back to Top