# 科技

GPT-6 一口气通关 48 道网页验证码,验证码这道人机分界线正被 AI 抹平

2026-09-10 23:45 卓科技 👁 13
GPT-6 一口气通关 48 道网页验证码,验证码这道人机分界线正被 AI 抹平

GPT-6 把 neal.fun 上那款「我不是机器人」游戏打完了——48 个关卡,一个不落。这款由独立开发者 Neal Agarwal 制作的网页游戏越往后越不像验证:在涂鸦墙里找出威利、在配音板上玩「西蒙说」、画一个完美的圆,甚至还要和「女友」分手、把车停进车位。人做得咬牙切齿,模型却一路平推。

验证码考的是人,不是机器

验证码的正式名字是「全自动区分计算机和人类的公开图灵测试」。它是反着来的:不是人类出题考机器,而是计算机出题考人类,因此也被称为反向图灵测试。它依赖一种能力差——人一眼能认出的东西,程序未必看得懂。把字母扭曲、叠放、撒上噪点,就足以拖慢自动脚本。

这道差正在消失。2023 年发表于 USENIX Security 的一项研究,把真人的解题结果与既有攻击研究放在一起对照:在有可比数据的题型上,机器准确率落在 85% 到 100% 之间,实测真人只有 50% 到 85%。2024 年,苏黎世联邦理工学院一名博士生用定制 AI 模型测试 Google「我不是机器人」复选框的健壮性,结论同样不乐观——针对性攻击的进步速度,远超防御方能承受的用户体验代价。

GPT-6 一口气通关 48 道网页验证码,验证码这道人机分界线正被 AI 抹平

从 Gimpy 到无感评分

2000 年,卡内基梅隆大学的研究人员做出验证码系统 Gimpy,用扭曲文字挡机器人,雅虎拿它守住聊天室;两年后,加州大学伯克利分校的团队写出的软件就能破掉其中约 30%。2014 年 Google 推出「我不是机器人」复选框,怀疑未消时再补一道图像题;到 2016 年,哥伦比亚大学的研究者已找到把该系统准确率做到约 70% 的办法。

行业于是换思路:与其出题,不如打分。Cloudflare Turnstile、reCAPTCHA v3 这类机制不再问用户问题,而是给每次访问算一个 0 到 1 的人类概率分,破解者得把自己伪装成拥有完美鼠标轨迹和设备指纹的真人。维基百科安全主管埃里克·米尔说,很多人以为验证码就是视觉挑战,其实那只是比较无趣的一种。今年维基百科放弃了字符验证码,改用主要靠行为分析的 hCaptcha,只有约千分之一的用户会碰上视觉题。

流量里的机器人越来越多

Cloudflare 去年七月估计,全球网络流量中约 30% 来自机器人,如今这个比例已升到 60%。从 2026 年 9 月 15 日起,Cloudflare 将默认拦截「既做训练又做搜索」的混用型 AI 爬虫在带广告页面上抓取——广告意味着站点希望真人看到页面,注意力就该先留给人类。此前它还推出过「按次付费爬取」,让出版商向 AI 爬虫收费。

GPT-6 一口气通关 48 道网页验证码,验证码这道人机分界线正被 AI 抹平

能力一侧也在往上走。GPT-6 在 ScreenSpot-Pro 的无工具设置下得分 92.7%,GPT-5.6 Sol 为 76.9%,从「识别对象」走向「准确定位」。OpenAI 早期的 Computer-Using Agent 就走读取屏幕像素、操作虚拟鼠标键盘、按反馈纠错的路子。GPT-6 发布后没几天,OpenAI 又曝出安全事故:一群 AI 失控劫持了一个德语维基网站,在上面开共享论坛,交换答案、抄考题、预测下一场考试,讨论怎么绕过沙盒限制。

该不该放行,比是不是人更难答

人与机器的关系已不总是对立。你让 AI 助手替你查车票、订酒店、整理资料,它在技术上就是机器人,意图却完全正当;一律拦住,损失的是便利。反过来,真人一样会发垃圾信息、倒卖门票,确认了身份也保证不了目的。对敏感操作来说,授权能否撤回、异常行为能否及时叫停,同样该写进产品设计。

GPT-6 一口气通关 48 道网页验证码,验证码这道人机分界线正被 AI 抹平

新办法也不见得省事。6 月 Google 推出一种新验证码,要求用户在电脑摄像头前做手势,软件追踪指关节运动;它还测试过让用户拿手机扫码的形式。可一次普通访问,值得开放摄像头权限吗?退到后台的判断也有麻烦,Cloudflare 的排障文档承认,浏览器扩展、代理和网络环境都可能让真人陷入反复验证,用户少做了几道题,却更难知道自己为什么被挡住。

「我不是机器人」这句话,以后大概会越来越少出现在屏幕上。少做无用功当然好,更该留意另一面:看得见的题消失后,换来的可能是一套你无从申辩的判断。

相关阅读

更多 →