Anthropic 推出 Claude Sonnet 5.5。新模型提速超 30%,任务综合成本降低达 30%,编程表现逼近旗舰 Opus 5.5,并首次将网络安全防御机制下放至中端主力模型。
Anthropic 正式发布 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5。与一周前发布的旗舰模型 Opus 5.5 侧重突破能力上限不同,Sonnet 5.5 定位为应对日常高频任务的实用主力模型,重点优化响应速度与使用成本。
Sonnet 5.5 的输出生成速度比前代提升超 30%,完成单项任务的综合成本降低高达 30%。这主要得益于模型在执行任务时所需的 Token 数量减少,以及工具调用(Tool Calls)次数的大幅精简,而非直接调低标价。该模型的 API 计费标准与 Sonnet 5 保持一致,即每百万输入 Token 2 美元、每百万输出 Token 10 美元,整体价格仅为 Opus 5.5 的一半。
Anthropic 研发产品经理 Theo Chu 表示,Sonnet 主要面向注重成本的客户,非常适合处理需要稳定执行、但不需要 Opus 级别深度判断力的日常工作流程。

相比前代 Sonnet 5,Sonnet 5.5 性能提升最显著的领域是编程开发。在评估 AI 智能体编程能力的基准测试 Terminal-Bench 4.0 中,Sonnet 5.5 取得了 70.6% 的成绩,较前代的 10.3% 出现跨越式增长,甚至略微超过了同项测试中得分 66.4% 的旗舰模型 Opus 5.5。
在涵盖 44 项职业知识工作的综合评估 GDPval-AA 中,Sonnet 5.5 获得 1844 分,比 Sonnet 5 提升约 400 分,与 Opus 5.5 仅有 2 分差距。
早期接入测试的企业客户均反馈了明显的效率提升:Zendesk 的工单处理速度提升了 20%;Box 反映任务处理速度达到原先的 2.4 倍,Token 消耗减少 12%;Atlassian 则表示其 Rovo 智能体的运行速度相比在 Sonnet 5 上最高加快了 30%。
Sonnet 5.5 是首个配备高级网络安全防护及反蒸馏分类器的 Sonnet 系列模型,此前此类防护机制仅部署于顶级旗舰产品。Anthropic 表示,由于新模型的网络技术能力较前代大幅提高,因此需要引入与 Fable、Opus 旗舰系统相同的回退安全机制。一旦检测到较高风险的网络安全请求,系统将自动把该请求转派给旧版 Sonnet 5 执行。
Anthropic 指出,Sonnet 5.5 并未突破其模型的整体前沿能力边界,因此安全对齐测试主要集中在特定风险领域。当前中端大语言模型竞争正在加剧,OpenAI 近期以相同的 Token 价格推出了 GPT-6 Sol,Google 也在以优惠费率力推 Gemini 3.8 Flash。Anthropic 随后还将推出其体量最小、成本最低的 Haiku 5.5 模型。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断