OpenAI 即将发布新模型 Astra,称其在能力与对齐上均大幅进步。Astra 是首个被认定达「临界」网络安全能力阈值的模型,可在无人工逐步引导下发现并利用多个防护严密系统的未知漏洞;在 ExploitBench 获 100% 满分,内部测试中还发现两个零日漏洞。
为降低风险,OpenAI 已推迟部分开发与发布并加强防护,Astra 对网络越狱请求的拒绝率从 GPT-5.6 Sol 的 59% 升至 91.5%。其高级网络安全能力初期仅向少数测试者开放,后续通过 Daybreak Blue 扩大防御性使用。
Sam Altman(@sama) | OpenAI
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel