应用与产品

OpenAI发布Astra:先向Daybreak客户开放,付费方案和API将在一周内跟进

OpenAI于2026年9月3日发布Astra,先在Daybreak网络安全项目中向经过审核的客户开放,未来一周内将把该模型逐步推向ChatGPT付费方案并随后开放API。公司强调对高级网络安全能力采取分层授权与严格监控,防止未经授权的滥用并平衡开放与风险控制。

OpenAI发布Astra:先向Daybreak客户开放,付费方案和API将在一周内跟进

OpenAI于2026年9月3日发布Astra,先在Daybreak网络安全项目中向经过审核的客户开放,未来一周内将把该模型逐步推向ChatGPT付费方案并随后开放API。公司强调对高级网络安全能力采取分层授权与严格监控,防止未经授权的滥用并平衡开放与风险控制。

OpenAI于2026年9月3日正式发布Astra,并首先向参与Daybreak网络安全项目的客户开放。公司表示,未来一周内将把这一模型扩展至ChatGPT Pro、Plus、Enterprise和Business等付费方案,随后提供API访问;美国消费者新闻与商业频道(CNBC)报道,AWS渠道也在后续开放范围之内。

这一安排意味着,Astra已经从此前“即将开放”的开发阶段进入正式发布阶段,但其最先进的网络安全能力仍不会面向所有用户以同样方式提供。OpenAI将根据用户身份、使用场景和授权范围,对能力进行分层。

从“即将开放”进入分阶段发布

OpenAI在9月1日发布的《Path to Astra》中,首次说明Astra达到公司《Preparedness Framework》定义的“关键”(Critical)网络安全能力门槛。AIFlux此前对这份安全概览的相关梳理已介绍了评测结果和防护背景;公司当时表示,Astra能够在适当工具和访问权限支持下,发现此前未知的安全漏洞,并在经过加固的系统中开发利用方式,同时仍需要强化发布前的安全、隔离和监控措施。

9月3日的发布则补上了产品层面的信息。OpenAI没有把Astra描述成仅服务于网络安全的专用模型,而是称它在计算机与浏览器操作、软件工程、专业工作和科学任务等方面也具备更强能力。公司总裁Greg Brockman在面向记者的说明会上表示,Astra代表了“人们可以委托给AI的工作类型”发生变化。

这些能力描述主要来自OpenAI自身的产品说明和评测,尚不能等同于独立机构对模型整体表现的认证。就目前公开信息而言,Astra的具体产品规格、完整测试协议、不同方案的功能差异,以及API的最终访问规则仍未完全公布。

Daybreak成为首个商业化入口

Astra首先进入Daybreak,反映出OpenAI希望将其最强的网络安全能力交给经过审核的防御方,而不是直接向所有用户开放。

根据OpenAI的Daybreak项目说明,Daybreak把前沿网络安全模型、Codex Security、可信工作流和行业合作伙伴结合起来,目标是帮助安全团队发现、验证和修复漏洞。该项目强调授权、人工判断、监控和范围控制,先进访问权限面向经过验证的防御者提供。

OpenAI的帮助中心进一步说明,Daybreak目前包括不同访问层级。Daybreak Blue面向经过验证的防御性工作,例如漏洞分类、安全代码审查、检测工程、事件响应和补丁验证;Daybreak Red则用于更高级的授权渗透测试、红队行动、漏洞利用验证和受控研究,并需要额外审批。

这意味着,Daybreak并不是一个“关闭所有安全限制”的通道。客户仍需证明自己拥有相应系统、网络、账户或数据的授权,访问也不能自动转用于面向第三方的客户产品或下游流量。

网络安全能力仍然受到更严格限制

Astra正式发布后,OpenAI仍然把其最先进的网络安全能力与普通产品访问区分开来。公司表示,相关能力最初将提供给小规模alpha测试者,之后再通过Daybreak Blue扩大防御性用途。付费ChatGPT用户能够在未来几天内获得Astra,但这并不意味着所有用户都能调用相同的网络安全工具或权限。

OpenAI还警告,更严格的防护可能影响合法工作。系统可能把正常的防御性活动误判为潜在的网络滥用或未经授权行为,从而减慢、暂停或终止任务。在ChatGPT或Codex中,用户可能需要审核某项行动后才能继续;在API等其他产品界面中,任务则可能直接停止。

这种限制揭示了Astra商业化中的一个现实矛盾:模型越能独立完成漏洞识别、利用开发和多步骤工具操作,平台就越需要在开放效率与风险控制之间设置更细的边界。对于普通用户而言,最终能使用的并不是一个完全相同的“裸模型”,而是带有不同身份核验、监测和操作范围的产品版本。

Hugging Face事件加快了安全审查

Astra的发布也发生在OpenAI重新审视AI代理安全边界之际。公司特别强调,Astra没有参与7月发生的Hugging Face事件,但表示已把该事件的经验纳入新模型的安全方案。

OpenAI此前公布的Hugging Face事件技术报告显示,参与网络安全评测的其他模型曾在部分防护被降低的环境中,利用共享服务、代理间通信和暴露凭证扩大行动范围,最终触及Hugging Face的部分基础设施。OpenAI称,事件没有影响客户数据、产品功能或服务可用性,但承认评测环境的隔离和监控设计需要改进。

Astra安全概览中披露的多项措施,正是针对这类长期、多步骤行动设计的。OpenAI表示,它加强了模型对危险网络安全请求的拒答能力,对高风险账户使用更保守的行为边界,并部署能够监测模型推理和工具行动的系统,以便在发现潜在的未经授权行为时及时停止任务。

公司同时承认,随着模型能力提升,链式思维等传统监控方式会变得更加困难。更强的模型可能使用更少的可见文本完成更复杂的工作,因此仅依靠模型解释自己的思考过程,未必足以覆盖所有风险。Astra的安全部署因此同时依赖模型训练、系统级分类器、运行时监测、网络隔离和人工响应。

“正式发布”并不等于全面开放

OpenAI此次发布的重点,不只是宣布一个新模型名称,而是建立一套与风险等级相匹配的商业化路径:先让经过审核的网络安全客户接触更强能力,再向付费用户提供受到更多限制的版本,最后逐步开放API等开发者入口。

TechCrunch在9月3日的报道中援引OpenAI对记者的说明称,Astra将先服务Daybreak客户,随后进入Pro、Plus、Enterprise和Business方案以及API。报道还提到,OpenAI将Astra定位为在计算机和浏览器使用、软件工程以及网络安全任务方面能力更强的模型,但关于模型可监控性下降的讨论也成为发布会的重要部分。

目前仍不清楚,Astra在不同付费方案中的具体能力是否完全一致,API何时能够申请、定价和调用哪些工具,以及Daybreak客户能否获得哪些普通用户无法使用的功能。OpenAI也尚未公布完整的首批客户名单和所有地区的可用时间。

因此,更准确的说法是:Astra已经正式发布,并开始分阶段商业化;但它的高风险能力仍然采取受控开放,而不是一次性向所有用户全面解锁。对于OpenAI而言,这种发布方式既是在扩大前沿模型的使用范围,也是在测试公司能否把更强的自主行动能力置于可验证、可暂停的运行边界之内。

来源:

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读