前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
AI 前沿/09.23 · 12:59/4 MIN/编译自 听雨/0 阅读

Opus 5.5发布:代码跑分登顶,缓存读取价砍60%

Anthropic 正式发布旗舰大模型 Claude Opus 5.5。该模型在多项编程基准测试中拔得头筹,实测一天可迁移 68 万行代码;API 降价 20%,缓存读取费率直降 60%,大幅降低了复杂 AI 智能体的调用成本。

Anthropic 正式推出最新旗舰大语言模型 Claude Opus 5.5。新模型在编程、专业知识与计算机操作等多项基准测试中登顶,输出生成速度相比前代 Opus 5 提升超过 30%。

多项基准跑分对比

编程能力大幅跃升:一天迁移 68 万行代码

在大规模代码库级别的复杂任务中,Opus 5.5 展现了显著的能力突破。

在衡量复杂命令行任务能力的 Terminal-Bench 4.0 测试中,Opus 5.5 取得 66.4% 的高分,大幅领先前代 Opus 5 的 52.3%,并拉开了与 OpenAI 竞品 GPT-6 Astra(57.9%)的差距。

Terminal-Bench 4.0 跑分对比

在基于真实 Cursor 会话的多文件任务评估 CursorBench 4.0 中,Opus 5.5 拿到 57.8%,即便将推理 effort 设为默认中档,得分(52.5%)仍高于其他顶尖模型的最高档表现,且单项成本大幅降低。

工程实测方面,早期测试者使用 Opus 5.5 迁移包含 68 万行代码的系统,耗时不到 1 天,而传统工程团队通常需要数周;审计并修复 20 万行代码库仅耗时不到 3 小时,Token 消耗仅为前代的 40%。此外,在将网络负载均衡软件 HAProxy 从 C 语言完整重构为 Rust 的内部评测中,Opus 5.5 仅用 9.5 小时便通过了几乎全部回归测试,总成本下降 51%。

大规模代码迁移与修复表现

API 价格调整:缓存读取降价 60%

随着能力跃升,Anthropic 同步下调了调用费率:

  • 常规单价下降:百万输入和输出 Token 价格分别调至 4 美元和 20 美元,降幅达 20%。由于解决复杂任务所需的步骤和 Token 数量减少,典型任务的综合使用成本可降低 40%。
  • 缓存读取费率腰斩:对长上下文和 AI 智能体开发至关重要的缓存读取价格,从每百万 Token 0.50 美元降至 0.20 美元,降幅达 60%。
  • 新增 Fast 模式:为低延迟敏感业务提供最高 2.5 倍的标准输出速度,价格为每百万输入 Token 8 美元、输出 Token 40 美元。

API 定价调整与成本优化

交互逻辑转变:重归“结论先行”

Opus 5.5 的语言风格发生了明显变化。以往模型容易过早陷入细节推演与冗长代码中,Opus 5.5 则优先提炼核心财务损益、关键数值与根本原因,随后再展开代码实现与上下文解释。这种清晰直接的表达不仅降低了用户的信息提取难度,也使人类检查与安全审计变得更为高效。

表达风格对比:结论先行

强化安全护栏与反蒸馏防护

在安全控制上,Opus 5.5 部署了多项前沿措施:

  1. 前沿安全审查:模型已通过 METR 与 Frontier Design 的外部审查,并内置针对生物安全与高风险网络安全的自动防护降级机制。
  2. AI 智能体三层防护:执行操作前预先校验,运行环境接入可审计的开源沙箱,并在代码合并前自动进行漏洞审查。
  3. 多维反蒸馏保护:启用 preserved thinking 机制,限制编辑推理上下文,默认强制开启思考过程,并在输出文本中嵌入了不影响阅读体验的统计水印,以防止外部机构未经授权抓取模型的深层推理数据。

Agent 安全沙箱架构

Anthropic 同时确认,Sonnet 5.5 与轻量级模型 Haiku 5.5 也将在未来数周内陆续上线。

标签:AnthropicClaudeAI智能体大语言模型代码生成

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

Transformers 直接跑 GGUF:Python 追平 llama.cpp
置顶

Transformers 直接跑 GGUF:Python 追平 llama.cpp

tokenizers v1 最高快 30 倍,中文却只快 6.8 倍
置顶

tokenizers v1 最高快 30 倍,中文却只快 6.8 倍

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
亚马逊封杀 Meta Muse:问题不在 AI 购物,在浏览器跑在谁的机器上
置顶

亚马逊封杀 Meta Muse:问题不在 AI 购物,在浏览器跑在谁的机器上

//

24小时热榜

Expedia 接入 Meta Muse 智能体:可直接预订行程
TOP1

Expedia 接入 Meta Muse 智能体:可直接预订行程

NVIDIA 发布 Isaac ROS 5.0:引入智能体工作流
TOP2

NVIDIA 发布 Isaac ROS 5.0:引入智能体工作流

3

OpenAI公布第三方AI安全评估的四大重点与七项原则

11小时前
OpenAI公布第三方AI安全评估的四大重点与七项原则
4

OpenAI升级GPT-6提示词缓存:最高立减90%成本

11小时前
OpenAI升级GPT-6提示词缓存:最高立减90%成本
5

安全公司 Trail of Bits:SAML 是设计上的失败,该退役了

18小时前
安全公司 Trail of Bits:SAML 是设计上的失败,该退役了
6

工程师用 gzip 做语言模型:靠压缩长度打分生成文本

18小时前
工程师用 gzip 做语言模型:靠压缩长度打分生成文本
7

OpenAI 发布 GPT-6 Sol 与 Luna:性能比肩旗舰,API 降价 50%

11小时前
OpenAI 发布 GPT-6 Sol 与 Luna:性能比肩旗舰,API 降价 50%
8

OpenAI 发布 Astra for Law:法律专属 AI 基础平台

18小时前
OpenAI 发布 Astra for Law:法律专属 AI 基础平台
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断