OpenAI9月3日首个 Critical 网络安全评级
GPT-6 Astra 发布:ARC-AGI-3 拿下 99.9%,网络安全能力触及"临界"线
OpenAI 正式发布 GPT-6 Astra,成为旗下第一个在 Preparedness 框架中被评定为"Critical(临界)"网络安全能力的模型——在拥有工具和权限的前提下,它能够自主发现未知漏洞并开发利用方案,无需人工逐步引导。
跑分方面,Astra 在 ARC-AGI-3 达 99.9%、FrontierMath Tier 4 达 98%、ExploitBench 满分,并登顶 Code Arena WebDev 榜首(1797 分,领先第二名 35 分)。其采用的"循环深度(recurrent depth)"新架构将部分推理过程转入内部激活计算,引发了安全社区关于"思维链监控是否失效"的激烈争论。
看点:高级网络攻防能力初期仅对受审核用户开放;防御性用途通过 Daybreak Blue 计划提供,OpenAI 同时承诺 10 亿美元补贴水电、电网等关键基础设施防御者。
Anthropic9月1日
Claude Fable 5.1 / Mythos 5.1 双版本策略:一个模型,两道安全闸门
Anthropic 发布 Claude Fable 5.1(公开版)与 Mythos 5.1(受信访问版),二者共享同一底层权重,仅安全护栏不同。Fable 5.1 编程与科研基准登顶,缓存读取降价 75%,典型负载约便宜 25%。
看点:"一模型两闸门"正在成为行业标配——OpenAI、Google、Anthropic 三家不约而同把网络安全能力从通用模型中拆分、限权。
Google / Meta / DeepSeek9月2-10日
Gemini 3.8 Flash、Muse Spark 1.3、DeepSeek V4.1 Flash 接连登场
Google 发布 Gemini 3.8 Flash 与专攻漏洞挖掘的 Flash Cyber 变体;Meta 的 Muse Spark 1.3 主打长程 Agent 任务,工具调用减少 20%、token 消耗减少 25%;DeepSeek V4.1 Flash 采用 552B MoE 原生多模态架构,新架构将 KV Cache 压缩约 437 倍,Agent 与编程能力进入第一梯队。
看点:企业用户开始出现"模型疲劳"——评估节奏跟不上发布节奏,Gartner 预计今年全球 AI 支出将达 2.59 万亿美元。