OpenAI 因 Astra 模型在网络安全与 Agentic Coding 方面的能力逼近「严重(Critical)」风险阈值,决定放缓开发进度并加强安全管控。
📝 详细摘要
OpenAI 宣布将有意放缓其前沿模型 Astra 的开发进度。内部评估显示,Astra 在 Agentic Coding 与网络安全方面的能力进步显著,已逼近其「准备框架」中的 Critical 风险区间,即可能具备在无人协助下独立识别并利用 0-day 漏洞,或规划并执行针对高防护目标完整攻击策略的能力。相比此前被评为 High 风险的 GPT-5.6-Sol,Astra 的风险等级有所提升。为此,OpenAI 正在引入隔离测试环境、受限访问、模型权重保护及沙箱执行等强化措施,并部署了能够审查模型思维链的通用监控系统,同时计划与政府及第三方安全组织合作进行独立评估,以确保技术发展能助力防御而非助长攻击。
💡 主要观点
- Astra 模型能力逼近 Critical 风险阈值。 内部评估显示 Astra 在 Agentic Coding 与网络安全领域的进步,使其可能具备独立发现 0-day 漏洞或执行复杂网络攻击的能力,跨入严重风险区间。
💬 文章金句
- Astra 在 Agentic Coding(代理式编码)和网络安全方面的能力进步,可能将其推入"严重(Critical)"风险区间。
- 确保高能力模型能够帮助防御者在攻击者利用漏洞之前发现并修补漏洞,而不是让攻防天平向进攻方倾斜。
📊 文章信息
AI 初评:81
来源:FreeBuf
作者:FreeBuf
分类:人工智能
语言:中文
阅读时间:6 分钟
字数:1340
标签: AI 安全, OpenAI, Astra, 网络安全, 风险评估