Anthropic 正式发布旗舰大模型 Claude Opus 5.5。该模型在多项编程基准测试中拔得头筹,实测一天可迁移 68 万行代码;API 降价 20%,缓存读取费率直降 60%,大幅降低了复杂 AI 智能体的调用成本。
Anthropic 正式推出最新旗舰大语言模型 Claude Opus 5.5。新模型在编程、专业知识与计算机操作等多项基准测试中登顶,输出生成速度相比前代 Opus 5 提升超过 30%。

在大规模代码库级别的复杂任务中,Opus 5.5 展现了显著的能力突破。
在衡量复杂命令行任务能力的 Terminal-Bench 4.0 测试中,Opus 5.5 取得 66.4% 的高分,大幅领先前代 Opus 5 的 52.3%,并拉开了与 OpenAI 竞品 GPT-6 Astra(57.9%)的差距。

在基于真实 Cursor 会话的多文件任务评估 CursorBench 4.0 中,Opus 5.5 拿到 57.8%,即便将推理 effort 设为默认中档,得分(52.5%)仍高于其他顶尖模型的最高档表现,且单项成本大幅降低。
工程实测方面,早期测试者使用 Opus 5.5 迁移包含 68 万行代码的系统,耗时不到 1 天,而传统工程团队通常需要数周;审计并修复 20 万行代码库仅耗时不到 3 小时,Token 消耗仅为前代的 40%。此外,在将网络负载均衡软件 HAProxy 从 C 语言完整重构为 Rust 的内部评测中,Opus 5.5 仅用 9.5 小时便通过了几乎全部回归测试,总成本下降 51%。

随着能力跃升,Anthropic 同步下调了调用费率:

Opus 5.5 的语言风格发生了明显变化。以往模型容易过早陷入细节推演与冗长代码中,Opus 5.5 则优先提炼核心财务损益、关键数值与根本原因,随后再展开代码实现与上下文解释。这种清晰直接的表达不仅降低了用户的信息提取难度,也使人类检查与安全审计变得更为高效。

在安全控制上,Opus 5.5 部署了多项前沿措施:

Anthropic 同时确认,Sonnet 5.5 与轻量级模型 Haiku 5.5 也将在未来数周内陆续上线。
免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断