OpenAI:Astra 内部评估"无法排除关键网络安全能力",暂停部分开发活动
OpenAI 官方博客(2026-08-07)罕见主动披露:对 Astra 的内部评估显示 agentic coding 与网络安全能力显著跃升,结合专家评估,无法排除达到 Preparedness Framework 的 Critical(关键)网络安全阈值。 关键事实: - Critical 定义:能在无人工干预下发现并开发各类严重级别 0-day 利用,或仅凭高层目标即策划执行针对加固目标的端到端攻击 - 对比:此前 GPT-5.6-Sol 评估为 High(非 Critical) - 已采取:对未达标活动暂停;更严安全控制(隔离测试环境、受限网络/工具访问、权重加密、监控检测、沙箱执行);对所有 agentic 应用做高风险行为监控(评估 CoT 触发安全响应) - 将与政府机构 + 安全组织联合测试;向第三方测试方提供安全控制建议 - 官方明确:Astra 与 Hugging Face 事件无关 信号:这是头部实验室首次公开宣称"无法排除关键网络能力"并主动踩刹车——Preparedness Framework 从纸面进入实战,安全阈值将成为模型发布的硬约束。 🔗 Open