Anthropic 发布 Claude Opus 5.5:跑同样的活便宜四成,五小时用量上限被取消
2026年9月22日(周二),Anthropic 发布了 Claude Opus 5.5,这是新的 5.5 模型家族的第一个成员。据 MacRumors 报道,Anthropic 称 Opus 5.5 在大多数工作上达到了 Claude Fable 5.1 的水平,但运行成本比 Opus 5 低 40%,输出速度快 30% 以上。据 Quartz 报道,新模型的定价为每百万 token 输入 4 美元、输出 20 美元,相对 Opus 5 的 5 美元与 25 美元降价 20%,而缓存读取价格从 0.50 美元降到 0.20 美元,降幅 60%。同一天上午 OpenAI 也发布了 GPT-6 Sol 与 GPT-6 Luna,两家在价格表上正面相遇。
先看钱。按 Quartz 的报道,Opus 5.5 的标价是每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 的 5 美元与 25 美元低 20%;缓存读取降到每百万 token 0.20 美元,比 Opus 5 的 0.50 美元低 60%。Quartz 特意指出,「缓存读取」在智能体与编码类工作负载里占了成本的大头,所以这一项的降幅对实际账单的影响往往比标价更大。Anthropic 给的口径是:因为完成同一件工作需要的 token 更少,典型工作负载的运行成本比 Opus 5 低约 40%。这也是这次发布最容易被误读的一点——40% 是「按任务算」的数字,20% 才是「按 token 算」的数字,两者不是矛盾,而是同一个事实的两种量法:价格降了一部分,剩余部分靠少用 token 省出来。
第二件事是能力定位,这里有两组数字需要分开看:官方基准和内部实测。据 MacRumors 报道,在 Anthropic 公布的基准上,Opus 5.5 在智能体编码、知识工作、计算机操作、图表视觉识别与跨学科推理上都超过了 Fable 5.1;Anthropic 还说这个模型表达更自然,会把重要信息放在回答的开头,让人一眼看到重点,少用行话和生僻措辞,并且会遵守给出的写作规则。但 Quartz 报道里 Anthropic 自己也承认了一件事:在当前能力水平下,基准分数作为真实世界差异的指南已经越来越不可靠,两个模型在实际使用中的差距比分数看起来要小。这种主动给自家基准打折的说法,在发布稿里并不常见。
内部实测那一组更具体,也更能说明这次发布的重点在哪。按 Quartz 的报道,Anthropic 做了一次内部编码测试,让两个模型把一款被广泛使用的服务端软件从 C 翻译成 Rust:Opus 5.5 用了 9.5 小时,成本比对照低 51%;Fable 5.1 用了 12 小时。早期测试者的反馈也被写进了报道:其中一位用 Opus 5.5 在不到三小时内审计并修复了一个 20 万行的代码库,同一件事 Opus 5 花了 20 多小时并消耗了 2.5 倍的 token;投资机构 Walleye Capital 表示,这个模型在其最低设置下就通过了他们的评测集,而在更高设置下,它发现了评测说明里的一个错误,此前没有任何模型能做到这一点。把这几条放在一起看,Anthropic 想推的不是「更聪明」,而是「同样聪明但更省」,交付的重点是效率而不是上限。
第四件事是订阅用户能直接感受到的变化。据 MacRumors 报道,随着 Opus 5.5 上线,Anthropic 提高了 Pro、Max、Team 以及按席位计费的企业版计划的五小时用量上限;订阅用户还收到了一次速率限制重置,可以在现在到 10月22日之间的任意时间使用。Quartz 的报道补充说,Anthropic 预计会在接下来几周内推出 Claude Sonnet 5.5 与 Claude Haiku 5.5,也就是说 5.5 是一个家族而不是单一模型。据 Benzinga 报道,此前的五小时用量上限在这几个计划上被取消。对日常重度使用者来说,这一条可能比基准分数更直接影响使用体验——上限决定了你能连续干多久的活。
第五件事是安全侧的处理,这部分和发布同等重要。按 MacRumors 的报道,因为 Opus 5.5 在生物学与网络安全能力上与 Claude Mythos 5.1 相当,Anthropic 给它套用了与 Fable 5.1 相似的防护措施:大部分网络安全任务会被转到更早的模型上,经过审核的研究人员可以申请 Cyber Verification Program 与 Life Sciences Verification Program 获得更宽的访问权限。据 Quartz 报道,发布前有两家独立安全研究机构 Frontier Design 与 METR 对该模型做了外部评估;在 Anthropic 覆盖近 2000 个模拟场景的内部行为审计中,它超过了此前所有 Claude;在一项专门的围栏评估里,Anthropic 称 Opus 5.5 的越界尝试率比 Opus 5 低了约 85%。这些都是厂商自述的数字,但它们至少给出了可复核的指标口径。
最后是时间线上的一个反差,这几乎是这次发布最值得记住的部分。据 Gizmodo 报道,距 Anthropic 首席执行官 Dario Amodei 呼吁整个行业「为前沿定节奏」、在失去对技术的控制之前放慢脚步,还不到两周;而公司随后就发布了它迄今为止最强的模型。Quartz 引用 TechCrunch 称,这是 Amodei 公开呼吁放慢能力发展、让安全实践跟上之后的第一次发布。据 Investing.com 报道,这次发布也发生在一次预期中的 IPO 之前,Anthropic 正处在与 OpenAI 竞争的压力之下。把这几条放在一起,逻辑并不复杂:一边是公开的政策主张,一边是市场竞争的节奏,而产品发布的日程由后者决定。
🤔 常见问题解答
Opus 5.5 到底便宜了多少?
按 Quartz 的报道,标价从 Opus 5 的每百万 token 输入 5 美元、输出 25 美元,降到输入 4 美元、输出 20 美元,降幅 20%;缓存读取从 0.50 美元降到 0.20 美元,降幅 60%。Anthropic 的另一个口径是:因为完成同样工作所需的 token 更少,典型工作负载的运行成本比 Opus 5 低约 40%。前者是单价,后者是按任务算的总价。
它在基准上真的超过了 Fable 5.1 吗?
按 MacRumors 的报道,在 Anthropic 公布的基准上,Opus 5.5 在智能体编码、知识工作、计算机操作、图表视觉识别与跨学科推理上超过了 Fable 5.1。但 Quartz 报道里 Anthropic 自己也表示,基准分数的差距作为真实世界差异的参考已经变得不太可靠,两个模型在实际使用中的差距比分数看起来更小。
五小时用量上限是怎么回事?
按 MacRumors 的报道,随着 Opus 5.5 上线,Anthropic 提高了 Pro、Max、Team 以及按席位计费的企业版计划的五小时用量上限,订阅用户还收到一次可在 10月22日前任意时间使用的速率限制重置。据 Benzinga 报道,这些计划上的五小时用量上限被取消。Anthropic 同时表示,Claude Sonnet 5.5 与 Claude Haiku 5.5 预计在接下来几周内发布。
安全防护上有什么特别安排?
按 MacRumors 的报道,因为 Opus 5.5 在生物学与网络安全能力上与 Claude Mythos 5.1 相当,Anthropic 采用了与 Fable 5.1 相似的防护:多数网络安全任务会被转到更早的模型,经过审核的研究人员可通过 Cyber Verification Program 与 Life Sciences Verification Program 申请更宽的访问权限。据 Quartz 报道,发布前该模型经过了 Frontier Design 与 METR 两家独立机构的外部评估。
🛠️ 推荐工具
- 代码差异对比工具这次发布的重点是「少用 token 干同样的活」,而验证这件事最直接的办法就是对 diff。同一个重构任务,用旧模型与新模型各跑一遍,把两边的改动贴进对比工具,你会看到差异是集中在真问题上,还是散落在无意义的格式调整里——后者才是真正的浪费
- Markdown 编辑器Anthropic 专门提到新模型「会遵守给出的写作规则」,而给模型的写作规则通常就是一份 Markdown 格式规范。把它写好、放在固定位置、每次调用都带上,是让「少用 token」真正成立的前提:规则写得清楚,模型就不用反复试探,也就不会在来回纠错里烧掉上下文
- 速率限制计算器用量上限放宽与一次性重置会直接改变配额规划。如果你的自动化流水线是按旧上限设计的,节流与重试策略大概率已经过时。先用计算器把新的请求速率与并发上限算清楚,再决定要不要把批处理窗口拉长——限额变了却不改调度,是最容易被忽略的一类故障源
总结
2026年9月22日,Anthropic 发布 Claude Opus 5.5,这是 5.5 模型家族的第一个成员。据 Quartz 报道,定价为每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 的 5 美元与 25 美元降价 20%,缓存读取从 0.50 美元降到 0.20 美元、降幅 60%;因为完成同一工作所需 token 更少,典型工作负载的运行成本比 Opus 5 低约 40%,输出速度提高 30% 以上。据 MacRumors 报道,在 Anthropic 公布的基准上,Opus 5.5 在智能体编码、知识工作、计算机操作、图表识别与跨学科推理上超过了 Fable 5.1;Anthropic 同时承认基准分数作为真实差异的参考已越来越不可靠。安全的处理上,因为它在生物学与网络安全能力上与 Mythos 5.1 相当,Anthropic 套用了与 Fable 5.1 相似的防护,多数网络安全任务会转到更早的模型;发布前该模型经过了 Frontier Design 与 METR 的外部评估。订阅侧,Pro、Max、Team 与按席位企业版的五小时用量上限被提高或取消,并给出可在 10月22日前使用的速率限制重置;Sonnet 5.5 与 Haiku 5.5 预计在几周内发布。本文所有事实与数字均来自 MacRumors、Quartz 与 Benzinga 等媒体报道,未加入推测。
来源链接:MacRumors: Anthropic Launches Claude Opus 5.5 With Fable-Level Performance at a Lower Price
Quartz: Anthropic launches Claude Opus 5.5 at lower cost, higher performance
Benzinga: Anthropic Launches Claude Opus 5.5, Cuts Costs 40% and Scraps 5-Hour Usage Caps