🔴 AI 安全

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
9月24日AI 安全

GPT-6 Astra 被评为首个「严重级」模型:能力越强,看管越严

什么是「严重级」

9月24日,OpenAI 按自家《预备框架》(Preparedness Framework)给 GPT-6 Astra 的网络安全能力评了「严重级」(Critical)——这是该分级体系启用以来第一个触及最高风险阈值的模型。类似台风预警里的最高级别:不是说它一定作恶,而是它「有能力造成严重后果」,必须配套最高等级的防护。

它强在哪

评测显示,该模型能在加固浏览器中自动生成沙箱逃逸利用链,并在 12 小时内于加固内核完成本地提权——也就是「越狱出安全沙箱」和「突破操作系统权限」这两件安全人员最头疼的事,它可以自己完成。

已经全面铺开

该模型已通过 ChatGPT 各档套餐、API 和 AWS 分发,微软同日宣布其在 Foundry Models 正式可用。前沿模型的攻防能力,正直接进入云产品分发环节。

白话解读

能力分级就像给汽车装限速器:车越快,刹车和安全气囊就得越硬。模型被评「严重级」不等于危险已发生,而是提醒所有使用方——这类模型上线的同时,防护必须同步跟上。

GPT-6 AstraPreparedness Framework沙箱逃逸
InfoQ 中文
← 上一篇:GPT-6 与 Claude Opus 5.5 同日发布… 下一篇:首例:AI 智能体入侵政府网站… →
延伸阅读
大模型

OpenAI 发布 GPT-6 Astra:105万 token 上下文,「AGI 之争」再起

AI 安全

AI 安全大论战:智能体的缰绳该握在谁手里

实用方法

普通人用好 AI 的四条原则

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。

↑