Google Cloud 在 Gemini Enterprise Agent Platform 上将 Anthropic 的 Cyber Verification Program(CVP)以 Preview 形式开放,允许经过验证的组织在受控防御场景下使用部分 Claude 模型,同时仍限制恶意或无正当防御用途的活动。具体申请资格、区域覆盖、模型差异和数据留存等关键细节尚未披露,企业应以平台权限和官方文档为准。
Google Cloud 在 2026 年 9 月 14 日发布的 Gemini Enterprise Agent Platform 更新中宣布,Anthropic 的 Cyber Verification Program(CVP)已在该平台进入 Preview。该计划允许经过验证的组织,在受控的防御性网络安全场景中使用部分 Claude 模型,同时放宽模型默认针对高风险“双重用途”网络安全任务设置的限制。
这一变化并不意味着 Claude 的网络安全能力已经向所有用户无条件开放。Google Cloud 的发布说明将 CVP描述为面向“经过验证的组织”的平台能力,使用范围仍限定在合法的防御性网络安全任务;恶意软件开发、大规模数据外传等缺乏正当防御用途的活动,仍不属于可通过验证计划获得许可的范围。
Google Cloud 发布说明确认 CVP 进入 Preview
Google Cloud 在 Gemini Enterprise Agent Platform 发布说明中写道,Anthropic 的 Cyber Verification Program 已在该平台提供预览。说明列出的支持模型包括 Claude Opus 4.7、Claude Opus 4.8、Claude Sonnet 5 和 Claude Opus 5。
根据该页面,CVP 的主要变化是:经过验证的组织可以使用受支持的 Claude 模型开展合法的防御性网络安全工作,模型默认的双重用途限制在相应场景下被解除。Google Cloud 没有在发布说明中进一步披露申请审核标准、地区范围、可用配额、具体接口或不同模型之间的权限差异。
因此,Preview 应理解为一项受账户资格和平台权限控制的云服务能力,而不是一次面向普通开发者的模型解锁。实际可用模型、申请资格、区域和数据处理条款,仍需以 Google Cloud 文档和组织账户显示的权限为准。
CVP 试图解决网络安全模型的双重用途难题
前沿模型在网络安全领域具有明显的双重用途。一方面,它们可以帮助防御团队分析大型代码库、寻找漏洞、验证风险、进行红队演练,并生成修复建议;另一方面,漏洞利用分析、攻击路径建模和安全工具开发等任务,也可能被滥用于入侵和破坏系统。
Anthropic 在其关于 Claude 实时网络安全防护的说明中,将相关活动分为两类。第一类是几乎总是具有恶意性质、缺乏正当防御用途的“禁止使用”,例如大规模数据外传和勒索软件开发;第二类是具有合法防御用途、但同样可能被攻击者利用的“高风险双重用途”活动,例如漏洞利用和进攻性安全工具开发。
Anthropic 表示,CVP 是一个免费的、基于申请的计划,目标是让专业网络安全人员在合法的双重用途任务中减少不必要的拦截,同时保留对明显恶意活动的限制。该公司说明,计划以组织为单位进行审核,申请者需要验证身份;在原生 Claude 平台等部分入口,只有获得授权的管理员可以提交申请。
这类机制与单纯调整模型提示词或关闭安全分类器不同。它把模型能力分配与组织身份、使用场景和责任边界联系起来,试图让“谁可以使用、在什么环境中使用、使用后如何追踪”成为模型开放的一部分。
Google Cloud 与 Anthropic 的公开说明存在一个值得注意的差异
Anthropic 的帮助页面目前仍写明,Cyber Verification Program“目前不适用于 Google Vertex AI”。而 Google Cloud 9 月 14 日的发布说明则明确宣布,CVP 已在 Gemini Enterprise Agent Platform进入 Preview。
两份页面可能对应不同的产品层级、更新时间或资格范围。Gemini Enterprise Agent Platform 是 Google Cloud 新的代理平台入口,而 Anthropic 帮助页面的表述可能仍反映此前 Vertex AI 集成的状态。现有公开材料尚不足以判断这是一次完整的产品范围更新,还是 Google Cloud 平台侧先行提供了受限预览。
在没有更多说明之前,更稳妥的表述是:Google Cloud 已宣布 CVP 在 Gemini Enterprise Agent Platform上进入 Preview,但并不能据此推断所有 Vertex AI 用户都已经能够申请或使用该计划。企业用户仍应以 Google Cloud 控制台、正式申请流程和 Anthropic 的账户资格通知为准。
支持模型的网络安全能力并不相同
Google Cloud 发布说明列出的模型横跨 Opus 和 Sonnet 两个系列,但 Anthropic对不同模型的网络安全能力和安全控制并没有作出完全相同的描述。
在 Claude Opus 4.7 的发布说明中,Anthropic表示,该模型配备了会自动识别并阻止禁止或高风险网络安全使用的防护措施,并邀请需要开展漏洞研究、渗透测试和红队工作的安全专业人员加入CVP。
在 Claude Sonnet 5 的发布说明中,Anthropic则称,Sonnet 5 的网络安全任务能力明显低于当时的 Opus 模型,并建议需要较少护栏限制的网络安全工作优先使用 Claude Opus 4.8。至于 Google Cloud 所列的 Claude Opus 4.8 和 Opus 5,Google 的平台说明确认它们属于支持范围,但并未公开 CVP 预览下的具体安全配置。
这意味着“加入 CVP”不应被理解为所有模型都获得完全相同的权限。模型版本、平台入口、组织审核状态和具体任务类别,都可能影响实际结果。
从模型开放转向受控防御工作流
网络安全 AI 的竞争正在从单项基准分数,转向漏洞发现、验证、修复、测试和审计能否在一个受控流程中连续完成。Google 此前推出的 Fairwind 计划,也采取了面向可信防御者的有限访问模式,将 Gemini 网络安全能力优先提供给经过筛选的政府机构、关键基础设施运营者和软件维护者。AIFlux此前对 Fairwind 计划的报道指出,访问机制、人工确认、日志记录和错误修复能力,往往与模型本身的漏洞发现率同样重要。
Anthropic最近发布的 2026年9月AI滥用与网络安全报告也将风险重点放在多智能体编排、凭证保护和运行时边界上。报告称,攻击者正在尝试让多个代理并行承担侦察、工具开发、凭证处理和数据整理等任务。这类趋势意味着,防御能力的安全开放不能只依赖模型是否拒绝单次请求,还需要限制代理可以访问的网络、工具、凭证和数据,并为长时间运行的任务设置审批和紧急停止机制。
仍待明确的申请资格与运行边界
Google Cloud 目前没有公开以下关键信息:
- 哪些组织可以申请 CVP,以及验证需要提交哪些材料;
- Preview 覆盖哪些国家或地区,是否存在区域级限制;
- 不同 Claude 模型对应的具体网络安全任务范围;
- 通过 Google Cloud 使用 CVP 时,日志、数据留存和零数据留存政策如何适用;
- 模型输出是否必须在隔离环境中执行,以及是否要求人工复核后才能将补丁部署到生产系统。
Anthropic的帮助页面还写明,采用 Zero Data Retention(ZDR)的组织目前不符合 CVP 的自助申请资格;同时,CVP 并不会解除对明确禁止使用的限制。这些条款说明,验证计划的目标并不是提供不受约束的攻击能力,而是在经过身份和用途审查的组织中,降低合法防御任务被默认安全策略拦截的概率。
Google Cloud 将 CVP带入 Gemini Enterprise Agent Platform,显示云平台开始把高风险模型能力纳入更细的企业权限体系。下一步的关键,不只是计划能否从 Preview 扩大到更广泛的客户,而是 Google Cloud 和 Anthropic 能否公开清晰、一致且可审计的申请标准、模型权限和责任边界。
在这些信息进一步披露之前,CVP更适合被描述为面向获验证防御组织的受控预览,而不是 Claude 网络安全能力的全面解禁。
来源: