三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?

时间:2026-10-01人气: 作者: 佚名

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图1)

新智元报道

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图2)

就在刚刚,GPT-6成功通关了「我不是机器人」游戏中的全部48个关卡!

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图3)

这些被称为的机制,是互联网安全的一道重要闸门。

它基于这样一个常识:有些简单的常识和视觉逻辑,人类一眼就能看懂,但对AI来说却难如登天。

结果,现在GPT-6把它们全部通关了,准确率100%!

从此以后,AI也会点上「我不是机器人」了。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图4)

给人类的验证码

「我不是机器人」,是开发者 Neal 在 neal.fun 上做的网页游戏。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图5)

随着关卡推进,下一关任务会变得越来越离谱。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图6)

这套由顶尖安全团队设计的极限测试,从第1关开始,就已经是对传统视觉大模型(甚至GPT-4V)的降维打击。

第一阶段:看懂,不只是看清(第1-14关)

前14关还是熟悉的验证码题型,比如找停车标志、认车牌、找威利、打地鼠。但每关都有个小陷阱:答案不在像素里,要靠常识。

比如第12关找「松饼」。题目要求在九宫格里选出所有吉娃娃,干扰项是长得几乎一样的蓝莓松饼,棕色的圆脸加上三个黑点,算法很容易认错。

Astra 不到两秒就勾出了所有狗脸,一格没错。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图7)

第二阶段:从看到动手(第15-26关)

题目开始要求「操作」:倒车入库、画圆、把石头推上山、合成 钻石镐、侧方停车。只能看不能动的模型,这一段过不去。

比如,第17关要求徒手画一个准确度至少 94% 的圆,考的是连续的手部控制,不是认图。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图8)

Astra 一笔画完,最终 95.8%,页面还弹出了「New best score」。

第三阶段:规则、策略与计算(第27-38关)

这一段考推理和决策:连网线、排数学表达式、玩消消乐、在限定条件下做取舍。每一步都会影响后面的结果,不能只看当下这一步。

比如,第28关「日内交易员」 要求在一条随机波动的股价曲线上做买卖,赚够 2500 美元,考的是择时和仓位判断。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图9)

Astra 从 293 美元现金起步,低点买入、高点卖出,大约 10 秒把利润做到 2761 美元。

第四阶段:像一个人(第39-48关)

最后十关考的是 AI 天生没有的东西:表情、哀悼、跳舞、组装宜家椅子,还有和「深蓝」风格的对手下国际象棋。

比如,第39关「面部检查」要求对着摄像头依次做出开心、难过、生气、惊讶的表情,并由系统打分。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图10)

Astra没有脸,所以画面下方的字幕都是它发给镜头前真人的指令,比如「Hold a broad smile」(保持大笑)、「 your brow and press your lips 」(皱眉、抿嘴)。这一关是人机配合过去的。

但第39关不是 AI 独立通关。 画面里是 Astra 在指挥真人做表情。这个细节放进文章反而是个好看点。

为什么这48关对AI来说曾经是死穴?

在AI领域,有一个著名的「莫拉维克悖论」:「让电脑在智力测试中表现出成人水平相对容易,但让电脑掌握一岁婴儿的感知和运动技能却极其困难。」

解微积分、写几万字的代码、背诵全套《大英百科全书》,对大模型来说易如反掌;但「明白玻璃杯掉在地上会碎」,或者「知道把大象装进冰箱需要三步」,这种常识对AI来说却形同天书。

过去几年,我们看到的大模型本质上是「随机鹦鹉」 。它们通过海量文本训练,学会了「词语接龙」。

它们说出「玻璃会碎」,不是因为它们真的理解物理世界,而是因为在人类文本中,「玻璃」和「碎」这两个词经常连在一起出现。

但「我不是机器人」这48个关卡,彻底剥离了语言的伪装,直接考验AI对真实世界运作规律的理解。

它要求AI有具身认知。

它要求AI有因果推理能力,而不是简单的相关性匹配。

它要求AI能够处理长序列的延迟满足,在复杂的环境中执行多步操作而不迷失目标。

这48关的设计初衷,就是用人类最底层的「物理本能和常识直觉」来筑起一道高墙,把只会算计的机器挡在外面。

然而,Astra 翻过了这道墙。

Astra 通关背后的技术革命:从「旁观者」到「世界体验者」

Astra 为什么能做到?

Astra 的胜利,主要归功于两点极其硬核的技术突破:

第一:原生多模态与实时流处理。

以前的AI,处理图片是先用一个视觉模型把图片翻译成文字(比如「这里有个鸡蛋」),再把文字交给语言模型处理。这种「翻译」过程会丢失大量信息(比如鸡蛋的质感、光影、重心)。

而 Astra 是原生多模态的。它的神经网络从第一天起就是同时看图片、听声音、读文字长大的。当它「看」到那个第15关的鸡蛋时,它处理的不仅仅是像素,而是一个多维的张量,里面包含了形状、材质和物理属性。加上其实时流处理能力,Astra 的反应速度和连续帧理解能力达到了人类级别。

第二:初步觉醒的「世界模型」。

这是AI通向AG的圣杯。

Astra 在训练中不仅学习了「是什么」,更学习了「为什么」和「会怎样」。它通过预测视频的下一帧、模拟物理引擎的碰撞,在自己内部建立了一个简陋但有效的「虚拟物理世界」。

当它面对第37关那个打翻水杯的视频时,它的世界模型在后台瞬间模拟了几十种未来的可能性,从而倒推出人类原本的意图。它不再是仅仅通过统计学规律来蒙答案,而是开始真正「理解」这个世界的运行法则。

潘多拉魔盒已经打开:Astra通关的深远意义

Astra 完美通关这48关,绝不只是在游戏界刷新了记录,它在互联网安全、商业生态乃至人类哲学层面上,投下了一枚核弹。

互联网验证体系的全面崩塌, 宣告死亡

「我不是机器人」这个勾选框,曾经是各大网站防范恶意爬虫、黄牛抢票软件、垃圾邮件发送者的终极武器。

Astra 的通关意味着,人类基于「认知壁垒」建立的数字防线彻底失效了。 如果AI能通过极其复杂的物理和逻辑验证,那么现在的数字验证码对它们来说简直就是纸糊的。

未来,各大网站可能不得不放弃图灵测试,转而采用更侵入式的方法来验证「你是人」——比如生物识别(扫脸、指纹)、设备硬件指纹,甚至是类似 那样的「视网膜虹膜扫描」。

我们在互联网上隐匿身份的权利,将因为AI的强大而被迫终结。

「超级自动化」时代的彻底降临

想一想,为什么以前的RPA(机器人流程自动化)总是显得笨笨的?因为只要网页弹出一个复杂的验证码,或者UI界面做了一点点非标的改动,机器人就会卡死。

如今,Astra 证明了AI不仅能看懂最复杂的交互逻辑,还能像人一样执行长序列的鼠标和键盘操作(第48关)。

这意味着,「无障碍浏览互联网」的全能智能体即将大规模爆发。

你可以对你的AI说:「帮我登录东航官网,找下个月去巴黎最便宜的机票,用我的信用卡买下来,顺便把那些烦人的反爬虫验证码都填了。」

AI接管人类繁琐的数字劳作,将不再有任何技术阻碍。

跨越莫拉维克悖论,通向AGI的关键里程碑

过去,很多人嘲笑AI「懂相对论却不懂怎么叠毛巾」。Astra 破解这48关的物理与空间难题,证明了AI大模型完全有能力演化出「常识」。

一旦AI掌握了物理直觉和空间推理,下一步是什么?是具身智能——把 Astra 的大脑装进波士顿动力的机器狗,或者特斯拉的擎天柱机器人里。

一个既懂庞大人类知识库,又拥有如同人类般物理常识和意图理解能力的系统,正在模糊人类与机器最后的边界。

结语:当机器比你更懂得「如何做一个人」

在电影《银翼杀手》中,人类用一种名为「-」的共情测试机来辨别复制人和真实的人类。

Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?(图11)

而今天,我们自己设计的极其复杂的48关图灵测试,已经被 Astra 轻松破解。

当游戏屏幕上闪烁着那句 「You are NOT a robot」 时,这既是系统对 Astra 通关的判定,也是一句充满黑色幽默的隐喻。

在互联网的另一端,当机器能够完美地模仿人类的直觉、物理常识甚至动机判断时,我们该如何向网络证明,坐在屏幕前敲击键盘的,是一个有血有肉的人?

Astra 的通关,不是游戏的结束,而是全新时代的序章。在这个时代,单纯的智力、逻辑和常识,都不再是人类专属的特权。

人类之所以为人,或许不仅仅在于我们能解开多难的逻辑题,更在于我们在面对未知时,能够感受到爱、痛苦与敬畏。

而这些,将是我们在这场人机赛跑中,需要死死守住的最后一块阵地。

参考资料: