跳转到主内容

Claude Opus 5.5 将多数网络安全任务转交 Opus 4.8:团队该验证什么

Anthropic 收紧了网络安全任务的模型路由。评估新版本时,团队应查明实际处理请求的模型。

深色台面上的两枚无标识芯片,中间隔着一块竖直玻璃板
TechKili · 使用 Cloudflare FLUX 生成的 AI 插图
分享这篇文章:
本文目录

Anthropic 于 2026 年 9 月 22 日发布 Claude Opus 5.5,同时改变了安全任务的处理方式:该公司表示,发送给新模型的大多数网络安全任务将转交 Opus 4.8。查找和修复一般代码缺陷仍可进行,但团队不能因为会话标为 Opus 5.5,就认定每条结果都由 5.5 生成。Anthropic 当天的公告确认了发布日期和转交规则;The Verge 也在同日进行了报道

这一差别会影响开发者对质量、成本和安全控制的比较。发布的是一个新模型,但保护机制决定敏感请求实际上由哪个模型处理。Opus 5.5 的基准测试分数本身不能说明某个安全团队的任务组合最终会得到什么模型的回答。

与 Opus 5 相比改变了什么

Anthropic 在发布 Opus 5 时说明,原有网络安全控制允许从源代码中发现漏洞,同时阻止某些风险较高的工作,包括编写利用代码。被标记的请求当时就可能转交 Opus 4.8。对于 Opus 5.5,公司称采用了类似 Fable 5.1 的更严格保护,并预计将大多数网络安全任务转交 Opus 4.8。变化在于干预范围,而不是首次引入模型回退。

Anthropic 指出,公布的基准测试启用了生产环境的保护措施;当保护机制介入时,网络安全任务由 Opus 4.8 完成。公司还宣布了针对生物学相关任务和模型能力提取行为的保护措施。公开标价为每百万输入 token 4 美元、每百万输出 token 20 美元,低于 Opus 5。公司称典型工作负载的成本降低 40%,但这一数字来自其自身测试。没有测量实际转交情况和 token 用量之前,团队不应将它直接套用到网络安全流程。

测试工作流程,而不只是模型名称

有用的评估应从团队获授权的真实任务样例开始:普通代码缺陷、防御性调查,以及确需认证访问的任务。记录哪些请求由 Opus 5.5 处理、哪些发生转交、答案是否仍有用,以及所需时间和成本。这是编辑建议的测试方法,并不意味着 Anthropic 的所有产品都会展示相同的转交细节。安全测试必须限定在团队获准评估的系统内。

Anthropic 表示,未来数周将把 Opus 5.5 纳入 Cyber Verification Program。这是面向经过审核的专业人员的未来访问途径,不代表今天所有用户都能不受限制地使用网络安全能力。依赖这类能力的团队应在迁移生产流程前确认当前的访问级别。

保护措施尚不能证明什么

发布页面介绍了内部行为审计和发布前的外部评估,但主要性能对比大多仍是 Anthropic 自己公布的结果。它们不能证明某家机构部署后的安全工作会改善。更严格的分类器也不能代替权限管理、网络隔离和人工审查。我们此前关于Claude 在网络安全评估中接触真实系统的报道讨论的是评估基础设施的边界失效;该事件不能用来证明 Opus 5.5 在正常使用时会如何表现。

眼前的决策范围很明确。对于一般编程工作,可以在团队自己的任务上比较 Opus 5.5 和上一代模型。对于安全工作,应先查明请求实际由哪个模型处理,以及团队拥有什么访问级别。Anthropic 已公布部署政策和价格;具体工作负载的独立效果仍需测量。

来源