🤖OpenAI 将发布 Astra,首个达临界网络安全阈值的模型

OpenAI 即将发布新模型 Astra,称其在能力与对齐上均大幅进步。Astra 是首个被认定达「临界」网络安全能力阈值的模型,可在无人工逐步引导下发现并利用多个防护严密系统的未知漏洞;在 ExploitBench 获 100% 满分,内部测试中还发现两个零日漏洞。为降低风险,OpenAI 已推迟部分开发与发布并加强防护,Astra 对网络越狱请求的拒绝率从 GPT-5.6 Sol 的 59% 升至 91.5%。其高级网络安全能力初期仅向少数测试者开放,后续通过 Daybreak Blue 扩大防御性使用。

添加评论
点赞收藏
点踩分享查看原文
评论29
?
参与讨论
你可以祈祷之后的GLM模型没有破限版本
3小时前
回复
glm 被人预测是大概年末可以达到 刚发时候的 mythos5 的标准
3小时前
回复
回复 @陈天天天天天天天天天 不用年底 国庆献礼
3小时前
回复
回复 @走近伪科学 利好黑灰产
3小时前
回复
现在已经有了()
3小时前
回复
回复 @走近伪科学 不知道 dsv4.1 的网络能力会不会提升
3小时前
回复
回复 @Seraphim ds 不好评价… 免得被喷
3小时前
回复
回复 @LunaticKizuna 懂你意思…
3小时前
回复
ChatGPT Pro 5x的意义没有那么大,个人感觉
3小时前
回复
一样不够用
3小时前
回复
有 pro 模型
3小时前
回复
回复 @走近伪科学 我自己感觉网页版Pro模型不太好用,也许做科研有优势,但就我自己来说科研都不太用得上(生物专业太容易撞护栏了)
3小时前
回复
回复 @Cityhunter 做编码计划非常好 还可以给他 仓库分析
3小时前
回复
回复 @LunaticKizuna 这个我倒是没试过,这种一般都交给codex了,下次试试
3小时前
回复
5.6sol pro个人感觉比fable5 聪明不少,而且按次数结算,一周能用一百次,一次能跑六十几分钟
1小时前
回复
Fable5 也会降智的
1小时前
回复
20x不好吗
3小时前
回复
额度不高
3小时前
回复
回复 @LunaticKizuna 20x基本可以使用1h
3小时前
回复
Claude的20x感觉意义不大
3小时前
回复
回复 @ひろすえ涼子 claude 的倍数是按 5h 来算的
3小时前
回复
以我自己的体验来说,Claude的额度比codex要多得多。但ChatGPT订阅的chat模式是不计入额度的,而且20刀订阅的用量都完全用不完,而且比Claude的chat好用很多,类agent能力极强,还能完成一定的长程任务。光凭这一点都值一半的票价了。而Claude的chat模式还非常烧额度,尤其是深入的调查任务,20刀订阅根本跑不了几个
3小时前
回复
之前看见有人发帖,gpt网页对话模式(非work)也有额度提示了 未来怎么样,难说
3小时前
回复
回复 @BTPlayer 那倒是
3小时前
回复
然后临期号是吧
57分钟前
回复
不太懂,我是自己的号
55分钟前
回复
正在蒸肥波5.1
1小时前
回复
中文说人话方面KIMI倒是比fable好,没有蒸馏的意义哈哈哈
1小时前
回复
扣啥问号?比起在网络上对美国口诛笔伐,不如好好利用这份信息差和工具的差距实现价值
1小时前
回复
没啥 好好用你的国外高级模型体现价值就行了
1小时前
回复
但是他又不给你用
2小时前
回复
《其高级网络功能》
2小时前
回复
但他不让中国追
2小时前
回复
他是不让所有竞家追,但是对我个人是无所谓,国内用的模型逊色反而更容易体现出用海外高级模型的价值
1小时前
回复
A➗不封号了?
3小时前
回复
封号的话没办法,大不了退款。Claude好歹不降智或者路由,ChatGPT前段时间的路由问题真的太头疼
3小时前
回复
看来大概率明天了
3小时前
回复
666
3小时前
回复
在做研究时,这个模型的限制要写得非常非常死。如果不把限制写死,它的思考很容易过度,也容易投机取巧,说一大堆;其实你非常仔细地看完以后,会发现全部都偏离主题了。
52分钟前
回复
不说,我忘了我还有张重置卡
57分钟前
回复
Astra是一个系列不是一个模型,可能会有比肩fable价格的模型,性能也差不多
1小时前
回复
但是Claude max使用额度达不到宣传水平。20x实际上只有6倍,5x也没有五倍
2小时前
回复
哈哈,当初 r1 时刻,现在很多人对 ds 的期待太重了
2小时前
回复
逼人上Pro喽
3小时前
回复
所以除非codex一周重置5次,codex同价格就是比Claude额度少
3小时前
回复
codex额度相对稳定,但Claude的额度和个人使用习惯有很大的关系,不太容易直接换算
3小时前
回复
干灰黑
3小时前
回复
什么时候恢复5h
3小时前
回复
祈祷之后的GLM模型没有破限版本
3小时前
回复
包的
3小时前
回复
The gap between OpenAI and Anthropic's flagships is dead obvious. Anthropic's models are sharper, broader, and actually think with you. When OpenAI fell behind, they panicked and hyper-focused on coding just to stay relevant. But they ignored a basic reality: train a model solely on code, and you kill its soul and creativity. It becomes a sterile execution engine that any competitor can replicate. Look at GLM-5.1, for instance. It was incredible, right on Opus's heels. Then Zai's obsession with code at the expense of everything else completely trashed its cognitive range. GLM-5.3 ended up useless outside programming, totally butchering writing, creativity, and strategic planning. That is exactly what's happening to Sol right now, and what already happened internally with Astra. On top of that, Anthropic's engineers are just far more competent, while OpenAI's devs got lazy and re...... ▎Source
3小时前
回复
恰恰相反!
3小时前
回复
网安肯定不会被 ai 收割 要背锅的
3小时前
回复
调查任务也没有普通sol做得好
3小时前
回复
你这就是典型的 a/思维
3小时前
回复
明天就来当A\安全顾问
3小时前
回复