都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos覆辙
TL;DR · AI 摘要
OpenAI因安全风险推迟发布Astra模型,重蹈Mythos覆辙,引发行业对AI安全策略的质疑。
核心要点
- Astra模型在网络安全能力评估中达到OpenAI定义的'Critical'级别
- OpenAI为Astra部署了沙盒执行、权重加密等五项强化安全措施
- 用户普遍质疑OpenAI以安全为由限制模型访问的商业动机
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Astra模型发布争议
- 模型能力
- 数学突破10项难题
- 网络安全Critical级别
- 安全措施
- 沙盒执行
- 权重加密
- 风险监控
- 行业影响
- 重蹈Mythos覆辙
- 用户质疑安全叙事
金句 / Highlights
值得收藏与分享的关键句。
Astra一次性解决10项长期悬而未决的数学难题,引发数学界震动。
达到Critical级别的模型可自主设计端到端新型网络攻击策略。
用户评论区质疑声占多数,认为安全叙事是排除开源竞争的策略。
都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos覆辙 – 量子位
扫码关注量子位
<div class="top_search"> <form role="search" method="get" class="search-form" action="https://www.qbitai.com/" id="search"> <label> <input type="search" class="search-field" placeholder="搜索…" value="" name="s"> </label> <button type="submit" class="search-submit"></button> </form> </div>
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
articlead begin
articlead end
都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos覆辙
Jay
2026-08-08
12:33:53
来源:
量子位
摘要样式
唉,赶紧整完快点发布吧。。。
Jay 发自 凹非寺 量子位 | 公众号 QbitAI
不er,闹呢?
刚刚,奥特曼发文,宣布推迟最强模型 Astra 的发布。
Astra是一个强大的模型,我们正努力让它向所有用户开放。 我们认为,把强大的模型只提供给少数特定人群使用,并不是一个好的策略。 不过,考虑到Astra具备网络安全方面的能力,我们还需要多花一点时间,以确保能够安全地开放它。
是的,被「囚禁」了,哈哈哈哈(无力)…… 又要走一遍Mythos的流程 。
Astra的披露之旅
所以Astra,究竟是个啥?
这是OpenAI的 最新模型类别,踩在Sol、Terra 和Luna之上 。
你可以理解为,这是OpenAI的Fable系。
上周,是这只大怪兽的初次亮相。奥特曼在华盛顿向政府介绍了Astra,重点展示了 多个 Agent长时间协同工作的能力 ,旨在展示该模型在处理复杂项目方面的潜力,比如——
数学。
果然,几乎是消息出来第二天,OpenAI便官宣了Astra相关的数学突破——
一次性拿下了 10项长期悬而未决的数学与理论计算机科学公开难题 ,横跨高维几何、编码理论、群论、算子代数、量子复杂度和极值组合学等领域。
数学圈直接炸了,一度引起不少数学家惊呼,甚至有人将这一突破定义为「菲尔茨奖」级。
还有一个大家怀疑比较多的,就是之前 Hugging Face事件 。
也是很神了,OpenAI自己公开认领了一项「安全事故」,说自家模型在接受网络安全测试,不小心(并非)逃出了内部隔离环境,一路闯进了Hugging Face的家门,直接原地开黑。
给Hugging Face也是整无语了,只能拿起 GLM 5.2 自卫。
具体是哪个模型,OpenAI当时没说,但 后来不少人将这个锅丢在了Astra上 。
这次倒是表态了,说是Astra确实很危险,但跟Hugging Face这茬没关系嗷。
但无论如何吧,也是吊足了大家胃口,虽然没Mythos那次整那么神,但也算OpenAI这几个月来最受瞩目的一款模型了吧。
谁能想到,又来Mythos那一套啊!!!
OpenAI表示,考虑到Astra网络安全方面的风险,将暂缓这个模型的发布。
「恐怖如斯」的Astra
所以Astra,到底触发了什么?
OpenAI专门写了篇博客,故事是这样的。
过去几天,OpenAI对Astra进行了最新一轮内部评估。
结果显示,该模型在智能体编码和网络安全方面取得了「显著进展」。
结合专家评估意见,公司于昨晚得出结论,无法排除Astra在 Preparedness Framework 下达到「关键(Critical)」级网络能力的可能性。
什么,你问这串英文是个啥玩意儿。
hmm,简单来说就是OpenAI于2023年末修的一个「安全警报器」,初衷是为能力进展提供识别指南,并据此规划应对措施。
此前发布的模型,包括GPT-5.6 Sol,均在前沿网络能力评估中被评定为「高(High)」级别,从未触及Critical线。
那Critical线在哪?
根据OpenAI的定义,一个模型达到Critical的标准是:
能在无人干预的情况下,自主识别并开发针对众多经过加固的现实世界关键系统的全等级功能性零日漏洞利用,或仅凭一个高层目标描述,就能自主设计并执行针对加固目标的端到端新型网络攻击策略。
Astra基本就是这个级别。
不过,OpenAI也打了补丁,目前Astra的基准测试和评估仍在继续,初步结果虽然已经差不多实锤,但并不等于已经确认。
同时官方澄清, Astra并未参与此前Hugging Face被攻击事件 。
基于上述评估,OpenAI已在内部 采取以下措施:
1、对高能力模型及相关活动实施更严格的安全控制,包括隔离测试环境、限制网络和工具访问、增强模型权重保护和加密、部署额外监测与检测能力、推行沙盒化执行。
2、暂停所有尚未达到上述强化安全标准的Astra内部活动。
3、在Astra所有智能体应用(含训练和评估环节)中部署通用风险行为监控,审查模型思维链,在高风险活动发生时触发安全响应并中断操作。
4、相关政府机构和选定的AI安全组织合作,对Astra进行外部能力测试。
5、向第三方测试伙伴提供推荐的安全控制指南,用于安全运行更高风险的评估和工作负载。
其实吧,归根结底就一句话——
寄了。
哈哈!
真那么吓人?
唉,此情此景,我咋总感觉这么眼熟呢。
奥特曼,你这宣发流程,简直和Mythos 5一模一样啊。。。
今年4月,Anthropic以网络安全风险为由推迟了其旗舰模型Mythos的公开上线,仅通过「Project Glasswing」计划向约40家合作伙伴提供访问权限。
当时奥特曼曾在播客节目中公开批评此举为「恐惧营销」,称这显然是一种令人难以置信的营销手段,告诉别人我们造了一颗炸弹,马上就要扔到头上了,但公司有一套价值1亿美元的地堡可以卖给你。
如今同样的炸弹落到了OpenAI自己头上。
所以为啥又打脸了?
业界有观点认为,「安全威胁叙事」正成为前沿AI公司针对 DeepSeek、Kimi等开源模型 的竞争策略,当市场普遍接受当前模型确有风险的说法后,公司便能以安全管制为由将开源对手排除出竞争赛道。
好消息是,从评论区来看,用户对这一套说辞并不太买账,每次涉及安全威胁话题,讨论区的质疑声都占了多数。
黄仁勋此前在开源倡议书中也指出,对开源模型的攻击大部分是无稽之谈,如果真为安全着想,最好的方式是公开发布、集众人之力解决问题。
谁能想到,OpenAI还是如此执着于打安全牌。。。
那还说啥了,等着呗。
关于发布时间,奥特曼在文中表示正在努力让Astra向所有用户开放, 但未给出新的时间表 。
求求了,安全管制可以,但至少保证下使用体验,别阉割着玩。
Fable 5大家也看到了,安全边界做的不好,基本上就只能写写代码,问个生物学问题都能被路由成Opus 4.8。。。
唉,赶紧整完快点发布吧。
参考链接: [1]https://x.com/sama/status/2085862292311396515 [2]https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/
版权声明
版权所有,未经授权不得以任何形式转载及使用,违者必究。
OpenAI
作者文章列表
- 奥特曼的ChatGPT育儿大法,捅了马蜂窝 2026-08-08
- 中国NeoLab时刻:EverMind用3篇论文,交出全栈自进化首份答卷 2026-08-08
- 刚刚,ChatGPT免费版史诗升级!GPT-5.6可以无限白嫖了 2026-08-07
- 没有人靠段子永载GitHub,除非谷歌姐夫 2026-08-06
左侧分享
扫码分享至朋友圈
相关阅读 start
相关阅读
#### 奥特曼最新访谈认可“套壳”:多数改变世界的公司,最初都是这样
“当前对软件的需求远大于供应”
一水
2025-04-07
#### 突发!GPT论文一作Alec Radford离职,前两代GPT作者全部离开OpenAI
初代GPT到GPT-4o都有参与
克雷西
2024-12-20
#### ChatGPT再进化!全工具All in One,网友:多少创业项目死于今天
最新支持PDF上传分析
明敏
2023-10-30
ChatGPT
#### OpenAI智能体新线索曝光!网友:新ChatGPT时刻要来了
多个基准跑分超过Claude智能体
2025-01-21
#### SearchGPT第一波评测来了!响应速度超快还没广告,“OpenAI杀手锏”
“对谷歌影响巨大”
2024-07-28
#### Ilya曝光70页OpenAI绝密文件
llya:奥特曼这人撒谎成性
梦瑶
2026-04-07
相关阅读 end
热门文章 start
热门文章
#### 突发,Jeff Dean离职创业!谷歌股价应声蒸发1.34万亿
2026-08-06
#### 阿里Qwen3.8正式发布,编程与办公再进化,推理更快更稳定
2026-08-03
#### 刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude
#### Artificial Analysis榜单:阿里Qwen3.8Agentic能力得分全球第一
#### 等等,MiniMax H3不是刚发布吗?怎么就卷到几分钱的价格了……
2026-08-05
<form role="search" method="get" class="search-form" action="https://www.qbitai.com/"> <label> <span class="screen-reader-text">搜索:</span> <input type="search" class="search-field" placeholder="搜索…" value="" name="s" /> </label> <button type="submit" class="search-submit"><span class="screen-reader-text">搜索</span></button> </form>
热门文章 end
底部版权
- 关于量子位
- 加入我们
- 寻求报道
- 商务合作
<a href="/?page_id=183"target="_blank"><i class="weixin_icon"></i></a>
追踪人工智能新趋势,报道科技行业新突破
<p>量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1</p>
量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1