Claude Opus 5.5 发布:成本下降 40%,长任务与智能体编程更受关注
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5。根据 Anthropic 公布的信息,该模型典型工作负载成本较 Opus 5 低 40%,输出速度提升 30% 以上,并在智能体编程、知识工作、计算机使用和安全评测中展示改进。
Anthropic 于 2026-09-23 发布 Claude Opus 5.5,这是 Claude 5.5 家族的首个模型。Anthropic 表示,Opus 5.5 在大多数工作上的表现达到 Claude Fable 5.1 的水平,典型工作负载成本较 Opus 5 低 40%。
对视觉创作者和需要处理复杂项目的团队来说,最值得关注的是效率变化。Anthropic 公布的价格为:缓存读取每百万 token $0.20,输入 token 每百万 $4,输出 token 每百万 $20,缓存写入每百万 $5;Opus 5 对应价格分别为 $0.50、$5、$25 和 $6.25。Anthropic 还称,Opus 5.5 的输出生成速度比 Opus 5 快 30% 以上,快速模式最高可达 2.5 倍,价格为每百万输入 token 8 美元、每百万输出 token 40 美元。
在公布的基准中,Opus 5.5 在 Terminal-Bench 4.0 上得分 66.4%,FrontierCode v1.1(主)为 54.4%,CursorBench 4.0 为 57.8%,OSWorld 2.0 为 81.8% partial,Chartography 为 89.0% with tools。GDPval-AA v2.1 中,Opus 5.5 得分 1846 Elo,覆盖 44 种职业。Anthropic 同时提醒,在当前能力水平下,基准差距未必能可靠代表现实工作差异;其数据还包含不同 effort 设置、工具使用和安全回退机制,比较时需要保留这些限定条件。
Anthropic 还分享了早期测试案例:一位测试者在不到一天内完成 68 万行代码迁移;另一项代码库审计中,Opus 5.5 处理 200,000 行代码耗时不到三小时,而 Opus 5 超过 20 小时。HAProxy 从 C 迁移至 Rust 的内部测试中,Opus 5.5 用时 9.5 小时,Fable 5.1 用时 12 小时,成本低 51%。这些均为 Anthropic 或早期测试者提供的结果,并非 AiPix 独立测试。
安全方面,Anthropic 称 Opus 5.5 在其自动化行为审计中取得迄今最佳成绩,并在测试场景中追平或超过 Opus 5 的提示词注入防御表现。该模型在网络安全、生物学和知识蒸馏相关任务上采用与 Fable 5.1 同类的防护措施,部分任务会透明回退到其他模型。Anthropic 也明确表示,对齐评估仍存在模型察觉自己处于测试环境等局限。
AiPix 分析:对于图像、视频和设计工作流,较低 token 成本和更快输出可能有利于长上下文创意整理、代码辅助和多轮方案迭代。但基准成绩不能直接等同于视觉生成质量,实际选择仍应结合任务类型、平台接入方式、成本控制和安全要求。Anthropic 表示,Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周内推出;Claude Opus 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。
来源
- Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%Anthropic:Newsroom(网页)
在 AiPix 中继续
把资讯中的能力转化为实际的图片或画布工作流。
打开 AI 画布