搁置一个月后 GPT-6 Astra 正式发布:首个「关键级」网络安全模型,10 万卡训练
当地时间 9 月 3 日,OpenAI 正式发布 GPT-6 Astra(拉丁语「群星」):10 万块 GPU 训练、多项跑分逼近满分。因为首个触发准备框架「关键级」网络安全阈值的 OpenAI 模型,Astra 在更强的防护机制下向有限客户开放,8 月初的「搁置」传闻就此落地。
核心结论
「关键级」阈值首次被真实触发并完成交付,准备框架从纸面规则变成可复用的发布流程。
有限客户开放成为超前沿模型的新分发形态:能力先到,准入后到。
安全能力产品化的一周:OpenAI 与谷歌在同一周内给出了两种不同的「安全模型」交付设计。
一、从「搁置」到发布:一个月里发生了什么
8 月上旬,Astra 曾因安全评估进度被曝搁置发布:它是第一个在 OpenAI 内部准备框架(Preparedness Framework)评估中被定为「关键级(Critical)」网络安全能力的模型,按规则必须先补齐防护再上线。
当地时间 9 月 3 日,OpenAI 正式发布 GPT-6 Astra。官方同步刊出《迈向 Astra:关键能力与前沿防护机制》,解释了这套防护如何让一个「关键级」模型被安全地交付给客户。
二、模型本身:10 万卡与逼近满分的跑分
规模口径:InfoQ 报道称训练动用了 10 万块 GPU,多项基准跑分逼近满分;OpenAI 将其定义为「新一代智能」,并称是目前智能水平最高的模型。
Astra 在拉丁语中意为「星辰、群星」,命名延续了 GPT-5.6 之后的天文序列。从官方文档与多方报道看,长程推理、代码与网络攻防能力是三条主线,具体基准构成以 OpenAI 系统卡为准。
三、「关键级」意味着什么
准备框架把模型风险按网络安全、生物、化学等门部分级,「关键级」是最高一档:意味着模型在专家红队评估中展现出攻击性网络任务上的前沿能力。
对应的交付条件也最严:更强的防护机制、受限的客户范围、持续的红队监测。目前 Astra 只向有限数量的客户开放,而非全面进入 ChatGPT。
这次发布等于把 8 月的安全争议变成了公开案例:能力阈值评估、防护补齐、受限交付,OpenAI 第一次完整走完这套流程并对外展示。
四、与谷歌 Flash Cyber 同周:安全成为产品线
同一周,谷歌发布只向防御方开放的 Gemini 3.8 Flash Cyber。两大厂商把「安全能力」从评测项升级成了独立的产品与治理设计。
差异在于姿态:OpenAI 走「能力达标、防护加固、有限客户」路线,谷歌走「防守专用、白名单分发」路线。两条路线指向同一个判断:前沿模型的攻防双面性,已经无法只用一份使用政策来约束。
五、给用户与企业的建议
短期内多数用户接触不到 Astra:有限客户开放意味着 API 等级与配额都受控,ChatGPT 全量铺开时间未定。
企业选型不必等 Astra:GPT-5.6 与 5.x 系列在多数生产任务上仍是性价比基准,Astra 的真实收益要等第三方复测与定价披露。
安全团队可以研究 OpenAI 公开的防护机制细节(检测、拦截、审计),这套设计大概率成为行业交付「关键级」模型的参考模板。
常见问题
GPT-6 Astra 现在能用吗?
目前只向有限数量的客户开放,ChatGPT 全量可用时间未官宣;普通用户可关注 OpenAI 公告。
「关键级网络安全能力」是什么意思?
OpenAI 准备框架中的最高风险档位,指模型在攻击性网络任务评估中达到前沿水平,需要配套最强防护才能交付。
Astra 与 8 月的「搁置」传闻有关吗?
有关。8 月初的搁置报道正源于安全评估未完成;本次发布代表防护机制补齐后的受限交付。