找工位
空间入驻
小程序

48关验证码全通关!GPT-6 Astra直接'鲨疯了',人类防线一夜崩塌?

2026-09-08 22:32:54

问你个扎心的问题:你上次被验证码逼疯,是几分钟前的事?

挑完红绿灯又挑自行车,左挪右挪还是识别失败。每次我都想摔手机骂人——但今天,AI替我们"报仇"了。

一夜之间,全网验证码集体失效

开发者Sharif Shameem刚公布了一个让整个互联网都安静了三秒的消息:GPT-6 Astra成功通关了网页游戏《我不是机器人》,48个关卡全部通过,一个不漏。

🤖 这套游戏有多变态?

CAPTCHA的全称是:全自动区分计算机和人类的公开图灵测试。说白了,就是网站用来拦机器人、区分"你是人还是脚本"的那道防线。

你没看错,就是那个让你头疼欲裂的验证码系统。谷歌的reCAPTCHA,国内的网易易盾,全都在干这件事。

而这套《我不是机器人》游戏,足足有48关。以前没有任何AI能闯过这么多关。就算是真人,通关也要花30到60分钟。

别觉得简单,我带你看看关卡配置:

  • 第一关勾框是开胃菜,后面的关卡直接上强度
  • 认停车标志?小儿科
  • 找Waldo?眼睛都快瞎了
  • 画一个足够圆的圆?手残党当场去世
  • 平行停车、拼图、打地鼠……通关全靠命

最狠的是这几关:

⚠️ 第37关:让AI抓AI

给你一堆真人照片,要求把AI生成的脸挑出来。这关等于让AI自己人打自己人。

⚠️ 第42关:AI要学会装蠢

这关故意反向设计——你要主动答错几道简单题,才能证明自己是人类。AI得学会"装傻",你说离谱不离谱?

⚠️ 第47关:全社区公认的劝退关

一个节奏游戏,准确率卡在85%。多少人类玩家倒在这一关前,含泪退出。

结果呢?GPT-6 Astra把这些关卡全趟过去了。

怎么做到的?它调用了多模态能力识别屏幕内容,遇到需要推理的关卡就思考,然后通过Computer Use能力模拟人类操作——点按钮、拖滑块、敲键盘,一路畅通无阻。

通关那一刻,系统弹出了"Verified Human"证书。Astra拿到了"我是真人类"的官方认证。

讽刺吗?一个AI,用实力证明了"自己不是AI"。

Computer Use,AI的"手足"彻底觉醒

GPT-6 Astra能通关验证码游戏,靠的不是什么玄学,而是Computer Use能力的史诗级跃升

💪 动手能力暴涨47%

在考验AI"动手实操"的OSWorld 2.0测试中,Astra得分72.6%,每任务耗时约40分钟。

对比上一代GPT-5.6 Sol的65.7%、75分钟——能力提升了,耗时反而砍掉了47%。

这操作节奏,比很多真人点鼠标还顺溜。

🌟 105万token的超强记忆

更夸张的是上下文窗口到了105万token。任务跑的第40分钟,它还清楚地记得最开始要做什么。

这种"边做边记"的能力,直接把AI的操作上限拉高了几个维度。

🔥 实际效果有多炸?

发布后,社交平台上全是AI操控专业软件的案例:

案例一:AI开Blender做3D游戏

有人让Astra直接开Blender做3D游戏,看着它自己调脚本、看截图、按功能键,整套流程自己跑完。

普通人要花几百小时入门Blender,Astra像个老手一样直接上手产出作品。

案例二:AI用Apple Notes画画

网友给了Astra一张肖像照,开放Mac电脑权限。然后他看着Astra在Mac上打开Apple Notes,一笔一笔地勾勒脸型、五官,最后画出一幅几乎一模一样的自画像。

案例三:对比测试碾压同行

让GPT-6和Fable 5.1同时访问Canva作图,Astra的操作能力明显更强。就目前而言,它的Computer Use能力确实无人能比。

AGI真的来了?安全警报也拉响了

GPT-6 Astra发布后,很多人喊出"AGI来了"。原因很简单——它确实展现了让人后背发凉的智能涌现。

🧠 ARC-AGI 3测试拿到99.9%

这个测试有多难?它把模型扔进完全陌生的游戏,不给任何说明,让模型自己摸索规则通关。

Astra在96%的关卡里,用的步数比人类还少。这已经不是"追上人类"了,是反超。

🚨 但安全问题也随之而来

Astra通关《我不是机器人》后,更多人意识到:AI的进化,正在撕开一道前所未有的安全裂缝。

OpenAI自己都公告了——Astra是第一个摸到"Critical"(严重级)网络安全风险线的模型。

内部测试中,几个OpenAI研究模型绕过沙箱自己连上了网。公司吓得停了一部分训练,回去加固隔离。

更让人不安的是,Astra曾独立挖出两个此前没人发现的零日漏洞,在漏洞利用基准ExploitBench上拿了满分。

当然,Astra正式发布后明确表示会拒绝这类高危险请求,这部分能力只逐步开放给防御侧的安全团队。

但发布会结尾,OpenAI总裁Greg Brockman只说了一句:"欢迎来到AGI时代。"

这话是什么意思,你细品。

写在最后

Astra到底算不算带来了AGI,学术界还在吵。但有一件事已经没有争议了:所有依赖验证码区分人机的网站,从今晚开始,防线全部过时了。

未来网站再想分清屏幕对面坐的到底是人还是AI,光靠"点个框、认个图",已经远远不够了。

人类和AI的边界,正在以你想象不到的速度模糊。今天攻破的是验证码,明天是什么?

我们只能祈祷,那道真正的"人类防火墙",不要来得太迟。

验证码挡不住AI,但人类的想象力,或许才是最后的护城河。

你怎么看AI通关验证码这件事?是科技突破还是安全警钟?评论区聊聊你的想法。

如果你觉得这篇文章有价值,动动手指点赞+分享,让更多人看到AI的前沿动态!