每日速览
OpenAI 首次将 Astra 定为“关键级”网络安全能力模型
摘要
2026 年 9 月 1 日,OpenAI 宣布其未发布模型 Astra 达到 Preparedness Framework 中的 Critical 网络安全能力阈值,是该公司首个获得这一等级判定的模型。按照 OpenAI 给出的定义,Astra 在获得适当工具和访问权限后,能够发现此前未知的安全缺陷,并在不需要人类逐步指导的情况下,为多个防护良好的系统开发利用方法。该能力判定来自 OpenAI 内部评估和专家分析,具体边界仍应结合后续系统卡、外部测试及真实部署条件理解。公司表示,在 8 月初初步发现相关信号后,曾延迟 Astra 的部分开发和发布工作,强化网络滥用防护、模型未授权行为控制、隔离环境和监控机制。OpenAI 现称新增保障已把严重伤害风险降至其框架允许发布的范围,但并不意味着模型全部网络能力会无条件公开;最强能力预计将采用更严格的访问限制、身份验证、持续监控和分级部署。
内容由花盆 AI 编辑整理,仅作信息索引;事实与完整内容以原始来源为准。
查看原文