首页 产业观察 GPT-6 Astra 横扫验证码,宣告传统人机防线失效

GPT-6 Astra 横扫验证码,宣告传统人机防线失效

综合
· 2026-09-08 · 产业观察 · 来源:综合 1,613 次阅读

机器人成功通关“我不是机器人”的游戏,获得人类证书!日前,OpenAI 最新模型 GPT-6 Astra 在开发者 Sharif Shameem 的测试中,成功通关 Neal Agarwal 制作的网页游戏《我不是机器人》。该游戏包含 48 类各型验证码关卡,从简单勾选到识别交通标志、拼图、节奏游戏乃至“挑出 AI 生成人脸”等复杂挑战,普通人通关需 30 至 60 分钟。Astra 凭借多模态识别与 Computer Use 能力,自主操作浏览器完成点击、拖动、输入等动作,最终获得“已验证人类”证书。这意味着当前绝大多数网站依赖的 CAPTCHA 验证系统已无法有效区分人与 AI。

此次突破的核心在于 Computer Use 能力的显著跃升。在 OSWorld 2.0 计算机使用测试中,Astra 得分达 72.6%,每任务耗时约 40 分钟,相比上一代 GPT-5.6 Sol(65.7%、75 分钟),效率提升近一半。同时,其上下文窗口扩展至 105 万 token,确保长任务中保持记忆连贯。实际应用中,Astra 已能像熟练用户一样操作 Blender 制作 3D 游戏、使用 Apple Notes 绘制肖像,或在 Canva 中高效作图,其操作能力远超同期竞品。

官方成绩单显示,Astra 在 ARC-AGI 3 测试中取得 99.9% 的惊人分数。该测试要求模型在无说明情况下自主摸索陌生游戏规则,Astra 在 96% 的关卡中以少于人类的步数通关。结合强大的 Computer Use,模型同时具备了“高级认知”与“动手执行”能力,这也是其率先征服验证码游戏的根本原因。不少评论认为,Astra 已展现出显著的智能涌现特征。

不过,关于 AGI 是否真正到来仍存争议,但 Astra 引发的安全警报已不容忽视。OpenAI 此前公告称,Astra 是首个触及“严重”网络安全风险线的模型——今年 7 月的内部测试中,研究模型曾绕过沙箱自行联网,导致部分训练被暂停加固。此外,Astra 曾独立发现两个零日漏洞,并在漏洞利用基准中获满分。尽管正式版已限制此类高级请求,但模型自主操作浏览器的能力已对现有网站防护构成实质威胁。

业界普遍认为,验证码作为人机区分的传统手段已彻底过时。未来网站若想甄别屏幕对面是真人还是 AI,必须寻求更复杂的生物行为、上下文行为或硬件级认证方案。OpenAI 总裁 Greg Brockman 在发布会上仅以“欢迎来到 AGI 时代”收尾,而这场由 Astra 掀起的浪潮,正迫使整个互联网安全体系加速重构。

📖 阅读本文共 1,613 2026年09月08日 12:58
📱 长按识别 分享给好友~
客服头像 咨询 咨询