都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos覆辙

唉,赶紧整完快点发布吧。。。

都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos覆辙 – 量子位

首页

资讯

智能车

智库

活动

MEET大会

AIGC

扫码关注量子位

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos覆辙

Jay

2026-08-08

12:33:53

来源:

量子位

唉,赶紧整完快点发布吧。。。

Jay 发自 凹非寺

量子位 | 公众号 QbitAI

不er,闹呢?

刚刚,奥特曼发文,宣布推迟最强模型

Astra

的发布。

Astra是一个强大的模型,我们正努力让它向所有用户开放。

我们认为,把强大的模型只提供给少数特定人群使用,并不是一个好的策略。

不过,考虑到Astra具备网络安全方面的能力,我们还需要多花一点时间,以确保能够安全地开放它。

是的,被「囚禁」了,哈哈哈哈(无力)……

又要走一遍Mythos的流程

Astra的披露之旅

所以Astra,究竟是个啥?

这是OpenAI的

最新模型类别,踩在Sol、Terra 和Luna之上

你可以理解为,这是OpenAI的Fable系。

上周,是这只大怪兽的初次亮相。奥特曼在华盛顿向政府介绍了Astra,重点展示了

多个 Agent长时间协同工作的能力

,旨在展示该模型在处理复杂项目方面的潜力,比如——

数学。

果然,几乎是消息出来第二天,OpenAI便官宣了Astra相关的数学突破——

一次性拿下了

10项长期悬而未决的数学与理论计算机科学公开难题

,横跨高维几何、编码理论、群论、算子代数、量子复杂度和极值组合学等领域。

数学圈直接炸了,一度引起不少数学家惊呼,甚至有人将这一突破定义为「菲尔茨奖」级。

还有一个大家怀疑比较多的,就是之前

Hugging Face事件

也是很神了,OpenAI自己公开认领了一项「安全事故」,说自家模型在接受网络安全测试,不小心(并非)逃出了内部隔离环境,一路闯进了Hugging Face的家门,直接原地开黑。

给Hugging Face也是整无语了,只能拿起

GLM 5.2

自卫。

具体是哪个模型,OpenAI当时没说,但

后来不少人将这个锅丢在了Astra上

这次倒是表态了,说是Astra确实很危险,但跟Hugging Face这茬没关系嗷。

但无论如何吧,也是吊足了大家胃口,虽然没Mythos那次整那么神,但也算OpenAI这几个月来最受瞩目的一款模型了吧。

谁能想到,又来Mythos那一套啊!!!

OpenAI表示,考虑到Astra网络安全方面的风险,将暂缓这个模型的发布。

「恐怖如斯」的Astra

所以Astra,到底触发了什么?

OpenAI专门写了篇博客,故事是这样的。

过去几天,OpenAI对Astra进行了最新一轮内部评估。

结果显示,该模型在智能体编码和网络安全方面取得了「显著进展」。

结合专家评估意见,公司于昨晚得出结论,无法排除Astra在

Preparedness Framework

下达到「关键(Critical)」级网络能力的可能性。

什么,你问这串英文是个啥玩意儿。

hmm,简单来说就是OpenAI于2023年末修的一个「安全警报器」,初衷是为能力进展提供识别指南,并据此规划应对措施。

此前发布的模型,包括GPT-5.6 Sol,均在前沿网络能力评估中被评定为「高(High)」级别,从未触及Critical线。

那Critical线在哪?

根据OpenAI的定义,一个模型达到Critical的标准是:

能在无人干预的情况下,自主识别并开发针对众多经过加固的现实世界关键系统的全等级功能性零日漏洞利用,或仅凭一个高层目标描述,就能自主设计并执行针对加固目标的端到端新型网络攻击策略。

Astra基本就是这个级别。

不过,OpenAI也打了补丁,目前Astra的基准测试和评估仍在继续,初步结果虽然已经差不多实锤,但并不等于已经确认。

同时官方澄清,

Astra并未参与此前Hugging Face被攻击事件

基于上述评估,OpenAI已在内部

采取以下措施:

1、对高能力模型及相关活动实施更严格的安全控制,包括隔离测试环境、限制网络和工具访问、增强模型权重保护和加密、部署额外监测与检测能力、推行沙盒化执行。

2、暂停所有尚未达到上述强化安全标准的Astra内部活动。

3、在Astra所有智能体应用(含训练和评估环节)中部署通用风险行为监控,审查模型思维链,在高风险活动发生时触发安全响应并中断操作。

4、相关政府机构和选定的AI安全组织合作,对Astra进行外部能力测试。

5、向第三方测试伙伴提供推荐的安全控制指南,用于安全运行更高风险的评估和工作负载。

其实吧,归根结底就一句话——

寄了。

哈哈!

真那么吓人?

唉,此情此景,我咋总感觉这么眼熟呢。

奥特曼,你这宣发流程,简直和Mythos 5一模一样啊。。。

今年4月,Anthropic以网络安全风险为由推迟了其旗舰模型Mythos的公开上线,仅通过「Project Glasswing」计划向约40家合作伙伴提供访问权限。

当时奥特曼曾在播客节目中公开批评此举为「恐惧营销」,称这显然是一种令人难以置信的营销手段,告诉别人我们造了一颗炸弹,马上就要扔到头上了,但公司有一套价值1亿美元的地堡可以卖给你。

如今同样的炸弹落到了OpenAI自己头上。

所以为啥又打脸了?

业界有观点认为,「安全威胁叙事」正成为前沿AI公司针对

DeepSeek、Kimi等开源模型

的竞争策略,当市场普遍接受当前模型确有风险的说法后,公司便能以安全管制为由将开源对手排除出竞争赛道。

好消息是,从评论区来看,用户对这一套说辞并不太买账,每次涉及安全威胁话题,讨论区的质疑声都占了多数。

黄仁勋此前在开源倡议书中也指出,对开源模型的攻击大部分是无稽之谈,如果真为安全着想,最好的方式是公开发布、集众人之力解决问题。

谁能想到,OpenAI还是如此执着于打安全牌。。。

那还说啥了,等着呗。

关于发布时间,奥特曼在文中表示正在努力让Astra向所有用户开放,

但未给出新的时间表

求求了,安全管制可以,但至少保证下使用体验,别阉割着玩。

Fable 5大家也看到了,安全边界做的不好,基本上就只能写写代码,问个生物学问题都能被路由成Opus 4.8。。。

唉,赶紧整完快点发布吧。

参考链接:

[1]https://x.com/sama/status/2085862292311396515

[2]https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/

版权所有,未经授权不得以任何形式转载及使用,违者必究。

OpenAI

Jay

奥特曼的ChatGPT育儿大法,捅了马蜂窝

2026-08-08

中国NeoLab时刻:EverMind用3篇论文,交出全栈自进化首份答卷

2026-08-08

刚刚,ChatGPT免费版史诗升级!GPT-5.6可以无限白嫖了

2026-08-07

没有人靠段子永载GitHub,除非谷歌姐夫

2026-08-06

扫码分享至朋友圈

相关阅读

36000亿元!OpenAI启动“星际之门”计划,英软银甲骨文均参与

微软同时被曝不再是OpenAI独家云服务供应商

一水

2025-01-22

OpenAI

1220亿美元!OpenAI创下史上最大单笔融资纪录

OpenAI创下史上最大单笔融资纪录

梦瑶

2026-04-01

OpenAI

DALL·E这波超进化,画质艺术感双飞升,还学会了无痕P图

Photoshop可以不用学了?

鱼羊

2022-04-07

DALL·E

OpenAI

OpenAI奥特曼:能被ChatGPT消灭的工作不是真正的工作

相较之下,我们的工作像游戏

henry

2025-10-14

OpenAI

翁荔最新万字长文:Why We Think

网友:打开了人工智能理解的全新维度

十三

2025-05-18

OpenAI

大模型

思维链

翁荔

实测OpenAI最强模型o1:会做大学数理化,但弱智吧依然难解

strawberry有几个r也数清楚了

克雷西

2024-09-13

OpenAI

热门文章

突发,Jeff Dean离职创业!谷歌股价应声蒸发1.34万亿

2026-08-06

阿里Qwen3.8正式发布,编程与办公再进化,推理更快更稳定

2026-08-03

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

2026-08-03

等等,MiniMax H3不是刚发布吗?怎么就卷到几分钱的价格了……

2026-08-05

Artificial Analysis榜单:阿里Qwen3.8Agentic能力得分全球第一

2026-08-06

关于量子位

加入我们

寻求报道

商务合作

扫码关注量子位

追踪人工智能新趋势,报道科技行业新突破

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司

京ICP备17005886号-1


本文来源:量子位