这次 Anthropic 做得最狠的一件事,是让 Opus 5 的能力基本追到 Fable 5,价格却还和 Opus 4.8 一样。
Opus 5 的 API 价格是每百万 Token 输入 5 美元、输出 25 美元。Fable 5 分别是 10 美元和 50 美元,刚好贵一倍。
跑分不用全看,挑几个和日常使用关系比较大的就够了。
在复杂编程任务里,Opus 5 开到最高强度,只比 Fable 5 的最好成绩低 0.5%,完成一次任务的成本只有一半。
让 AI 自己操作电脑时,Opus 5 花了 Fable 5 三分之一多一点的成本,成绩反而更高。让它从头到尾跑完一项工作,通过率也比第二名高了差不多 50%。
换成平时能感受到的变化,就是把一个复杂任务交给它以后,中途需要提醒和接手的次数有机会更少。
这次我更在意的也是这一点。官方案例里,Opus 5 修复问时会继续找到真正的原因,还会补上容易遗漏的情况。发现没有现成数据可以验证代码,它就自己搭了一套测试。
不过,Fable 5 的能力上限还是更高。以前用它,很多时候是在为那一点上限付双倍价格。现在日常做产品、写代码、查资料和跑自动化流程,我会直接用 Opus 5。只有少数特别难、确实需要追求最高能力的任务,我才会继续用 Fable 5。
前沿能力正在从少数高价任务,慢慢变成每天都能用的工具。这才是 Opus 5 这次更新最有价值的地方。
@aigc1024