Jay 发自 凹非寺
量子位 | 公众号
不er,闹呢?
刚刚,奥特曼发文,宣布推迟最强模型Astra的发布。
Astra是一个强大的模型,我们正努力让它向所有用户开放。
我们持有这样的看法, 将强大的模型仅仅给予少数特定的人群去使用, 这并非是一种良好的策略。
然而, 鉴于Astra拥有网络安全领域的能力, 我们仍得再多耗费些许时间, 从而保证能够安全地将它开放。

是的,被「囚禁」了,哈哈哈哈(无力)……又要走一遍的流程。

Astra的披露之旅
所以Astra,究竟是个啥?
这属于最新的模型类别, 它凌驾于Sol之上,它凌驾于Terra之上, 它还凌驾于Luna之上。
你可以理解为,这是的Fable系。
在前一周的时候, 作为这只身形巨大的怪兽的首次登场亮相情形。奥特曼于华盛顿的地点向政府方面介绍有关Astra的情况, 着重突出呈现了好些Agent长时间进行协同工作的能力表现, 其目的在于展现该模型在处理复杂项目之时所具备的潜力状况, 诸如——。
数学。
确实, 几乎就是在消息发布的次日, 便公布了与Astra相关的数学方面的突破, ——。
一下子就将十项长久以来未得到解决的数学以及理论计算机科学方面的公开难题给攻克了, 这些难题跨越了高维几何领域、编码理论领域、群论领域、算子代数领域、量子复杂度领域以及极值组合学领域。
数学领域一下子就像爆炸了一样, 在一段时间之内, 引发了好多数学家发出惊叹之声, 甚至还有人把这一项突破界定为是那种能获得「菲尔茨奖」的级别。

还有一个大家怀疑比较多的,就是之前 Face事件。
也真是够神奇的了, 自己公然认领了一项“安全事故”, 宣称自家模型在进行网络安全测试之时, 并非不小心逃出了内部隔离环境, 就此一路闯入了Face的家门, 还直接在原地开启了黑局。
给 Face也是整无语了,只能拿起GLM 5.2自卫。

究竟是哪一个模型, 那个时候并没有讲, 可是后来有好多人把这个责任甩给了Astra。
这回算是做出表态了, 宣称Astra着实存在很大危险性, 然而和Face这方面的情况并无关联呦。
不过不管怎样, 确实是把大家的胃口充分吊起, 虽说不像那次搞得那般神奇, 可也算是这几个月以来最受关注的一款模型了。
谁能想到,又来那一套啊!!!
表达称, 鉴于Astra网络安全领域存在的风险, 会延迟该模型的问世 , 会推迟这个模型的推出。

「恐怖如斯」的Astra
所以Astra,到底触发了什么?
专门写了篇博客,故事是这样的。
过去几天,对Astra进行了最新一轮内部评估。
结果呈现出这样的情况, 那个模型于智能体编码这一方面, 以及网络安全这个领域, 均获取到了「显著进展」。
将专家评估意见予以结合时, 公司是昨晚得出结论的, 对于Astra在下能达至「关键()」级网络能力这种可能性, 没有办法排除掉。

什么,你问这串英文是个啥玩意儿。
嗯, 简要来讲, 是于二零二三年年末修建的一个「安全警报器」, 它最先的想法是为能力发展给出识别参考, 并且依据这个去计划应对办法。
此前所发布的模型, 其中涵盖GPT-5.6 Sol, 都在前沿网络能力所进行的评估当中, 被评判认定为「高(High)」这样的级别, 从来都未曾触及到线。
那线在哪?
根据的定义,一个模型达到的标准是:
在没有任何人进行干预的状况之下, 能够独立自主地识别, 并且去开发针对众多经过加固处理的现实世界关键系统的全等级功能性零日漏洞利用, 或者仅仅凭借一个高层目标描述, 就能够独立自主地设计, 并且执行针对加固目标的端到端新型网络攻击策略。
Astra基本就是这个级别。
不过, 也加以了修补, 此时Astra的基准测试以及评估依旧在持续进行, 初步得出的结果尽管差不多确凿无疑了, 然而这并不等同于已然被确认。
同时官方澄清,Astra并未参与此前 Face被攻击事件。
基于上述评估,已在内部采取以下措施:
1、对具备高能力的模型以及与之相关的各类活动, 实施更为严格的安全方面的控制, 其中涵盖隔离测试的环境, 限制对于网络以及工具的访问权限, 增强对于模型权重的保护措施以及加密手段, 部署额外的监测跟检测的能力, 推行沙盒化的执行方式。
2、暂停所有尚未达到上述强化安全标准的Astra内部活动。
3、在Astra的全部智能体应用里, 涵盖训练以及评估环节, 要实施通用风险行为监控, 对模型思维链展开审查, 在高风险活动出现的时候, 触发安全响应, 进而中断操作。
4、与相关政府机构合作的选定的AI安全组织, 针对Astra开展外部能力测试。
5、给第三方测试伙伴, 提供被推荐的安全控制指南, 以用于安全运行, 针对更高风险的评估及工作负载。
其实吧,归根结底就一句话——
寄了。
哈哈!
真那么吓人?
唉,此情此景,我咋总感觉这么眼熟呢。
奥特曼,你这宣发流程,简直和 5一模一样啊。。。
今年4月, 因网络安全风险的缘故, 将其旗舰模型的公开上线予以推迟, 仅仅是通过「 」计划, 向大约40家合作伙伴给予访问权限。
当时, 奥特曼在播客节目里, 公开批评那个举动, 称其是「恐惧营销」, 还表示那明显是一种让人难以相信的营销手段, 说告诉别人我们制造了一颗炸弹, 马上就要扔到头上了, 然而公司有着一套价值1亿美元的地堡, 能卖给你。
如今同样的炸弹落到了自己头上。
所以为啥又打脸了?
在业界存在这样一种观点, 即「安全威胁叙事」正演变成前沿AI公司用以针对诸如Kimi等这样的开源模型的竞争方法, 当市场广泛接纳当前模型确实存在风险这一说法之后, 这些公司就能够借助安全管制的缘由把开源对手排斥在竞争赛道之外。
一个好消息是, 就评论区显示的情况而言, 用户对于这一套表述方式并没有太大的认可, 在每次涉及到安全威胁相关话题的时候, 讨论区域当中发出质疑声音的都居于多数。
黄仁勋先前于开源倡议书中亦表明, 针对开源模型的攻击大多属毫无根据的言论, 要是真心出于安全考量, 最恰当的做法乃是公开予以发布, 凭借众人的力量来处理问题。

谁能想到,还是如此执着于打安全牌。。。
那还说啥了,等着呗。
于发布时间方面, 奥特曼表明其正致力于使Astra能够面向全部用户予以开放, 然而却并未公布全新的时间表。
求求了,安全管制可以,但至少保证下使用体验,别阉割着玩。
“寓言5”大家也瞧见了, 其安全边界搞得不咋地, 大体上就仅仅能够编写编写代码, 问个关于生物学方面的问题居然都会被路由成“作品4.8”。
唉,赶紧整完快点发布吧。

参考链接:
Tech|掌声散去之后,一代人的共同选择
上海科技大学 MARS 实验室的技术成果促进了多起 AI 创...(164 )人阅读时间:2026-08-08
都学坏了!奥特曼亲手封锁最强模型Astra,重蹈Mythos
OpenAI宣布推迟最强模型Astra的发布,以加强网络安全...(181 )人阅读时间:2026-08-08
苹果Mac简体中文支持文档更新,“Apple智能”阿里千问扩
苹果官网支持文档确认 Apple 智能可配合阿里巴巴千问模型...(54 )人阅读时间:2026-08-08
NUS新导师招生!邢小涵课题组开放医疗AI全奖博士生名额
邢小涵博士,香港中文大学博士,斯坦福大学博士后,即将入职新加...(109 )人阅读时间:2026-08-08