Anthropic正式上线Claude Opus 5.5 任务运行成本直降40%

时间:2026-09-23来源:互联网作者:xzwh

Anthropic正式推出Claude 5.5系列首款模型Claude Opus 5.5,官方称其多数任务表现与Claude Fable 5.1持平,相比上一代Opus 5,默认典型任务成本降低40%、输出速度提升超30%;该版本发布仅约两小时后,OpenAI随即推出GPT-6 Sol与GPT-6 Luna,进一步扩充GPT-6产品矩阵。

Claude Opus 5.5在9项官方测试中,有7项表现超越Claude Fable 5.1、Opus 5、GPT-6 Astra等主流模型,尤其在Terminal-Bench 4.0、FrontierCode v1.1、CursorBench 4.0三项编程测试中拿下最高分,分别达到66.4%、54.4%、57.8%,仅在业务流程与科研Agent测试中落后于GPT-6 Astra。第三方机构Artificial Analysis的Intelligence榜单中,Opus 5.5以58分登顶,领先其余两款头部模型5分。

价格层面,Opus 5.5每百万输入、输出Token分别定价4美元、20美元,较Opus 5下调20%,缓存读取成本降幅达60%;平台同时开放快速模式,速度最高为普通模式2.5倍,对应输入、输出Token定价为8美元、40美元。此外Anthropic还上调了多档付费套餐的五小时使用额度,并为订阅用户新增一次可自主选择时间的额度重置权益。

Claude Opus 5.5将长任务处理能力作为核心升级方向:早期测试中,它不到一天就能完成68万行代码的迁移,对20万行代码库的审查修复仅耗时不到3小时,相比需要20小时以上、Token消耗为其2.5倍的Opus 5效率大幅提升。

在将HAProxy负载均衡软件从C语言改写为Rust的内部测试中,Opus 5.5仅用时9.5小时就完成全部改写,版本几乎通过所有回归测试,综合成本比Fable 5.1低51%。在要求零编造、仅能从稀缺网页副本提取信息撰写财报的测试中,Opus 5.5生成的18份报告有16份达标,而Fable 5.1与Opus 5无一通过;在GDPval-AA v2.1知识工作测试中,它也以1846分的成绩超越Fable 5.1的1735分。

Opus 5.5在写作沟通上优化为优先输出关键信息,回答更简洁;安全表现同样大幅提升,尝试突破隔离边界的频次较Opus 5、Claude Mythos 5.1降低约85%,在Gray Swan提示词注入测试中,攻击成功率与Fable 5.1并列最低。不过目前多数网络安全类专业任务仍会被系统转交Opus 4.8处理。

当前Opus 5.5已在Claude官方平台,以及亚马逊云科技、谷歌云、微软Azure等第三方云平台上线,开发者可通过claude-opus-5-5标识调用,平台仍保留零数据保留选项。后续Claude Sonnet 5.5与Haiku 5.5版本也计划在未来几周内陆续推出。

相关文章 更多>>

热门推荐