Anthropic 新模型 Claude Opus 5 正式发布,把自家最强的 Fable 5 给按下去了,价格还只要一半。
Opus 5 的 API 价格跟 Opus 4.8 一模一样,一分钱没涨,看来还是被 Kimi K3、ChatGPT 5.6 Sol 这些友商压力到了,出新模型都不敢动价格了。
跑分也挺猛的。Frontier-Bench 这个测 agentic coding 的榜,Opus 5 比 Fable 5 高出 28%,也压过了 GPT-5.6 Sol。ARC-AGI-3 更夸张,这个榜给模型出的都是没见过的新题,Opus 5 直接坐上榜一,分数是第二名 GPT-5.6 Sol 的三倍。当然也不是全赢,SWE-bench Pro 上还差 Fable 一丝。
不过这次除了模型,Anthropic 还顺手公布了另一件事,我觉得比跑分更值得看。他们把 Claude Code 的系统提示词删掉了 80%,编程测评上一点没掉分。
删掉八成还不掉分,那被删的都是些什么?
官方的解释是,模型变聪明之后,就不需要那么多指令和例子了。你给它举例子,反而是在框它,它会以为你只要这一种样子,然后就只给你这一种。
比如以前提示词里写的是,绝对不要写多段的文档注释,不要写多行的注释块。现在改成,写出来的代码要读起来像周围的代码,注释是多还是少,也跟着上下文来。
简单来说,以前是给它列规矩,现在是给它讲目标,剩下怎么做,它自己拿主意。
还有一类被点名要删的,是「最后加一步验证」「开个 subagent 帮我复查」这种指令,因为 Opus 5 自己就会验,你再写一遍,它反而验过头。
Anthropic 自己也承认,以前把 Claude Code 管得太死,所以这次还新加了个 /doctor 命令,帮你给 CLAUDE.md 和 skills 瘦身。
这事跟我这周写的那篇
OpenAI 最新官方 prompt 指南说的是同一件事,那份指南的第一条最佳实践,也是让你把 prompt 删短。
两家先后都在讲同一个意思,模型强起来之后,prompt 真的别再往里堆了。
很多人实测完 Opus 5 都说,3D 这块的效果比 Fable 5 好不少。我自己也试了一下,让它做了个 3D 风洞汽车测试模拟器,气流经过车身形成的流体很自然,效果确实有点东西。不过它也是真烧 token,额度随便用几下就肉眼可见地往下掉。
说了这么多,我就想问,Codex 那边是不是又要发额度了?
巧了,写到这里我刷了一下朋友圈,看到 Codex 崩了,一大堆天才程序员瞬间陨落了,看来 OpenAI 又要重置额度了[旺柴]