给图片写替代文本、把按钮标成按钮、让页面能用键盘操作,本来都是为了让残障用户顺利上网。Michael Buckley 在《The accessibility paradox》中指出,这套清晰结构也意外成了机器的“阅读指南”:屏幕阅读器需要理解页面的名称、角色和状态,AI 爬虫同样受益;看不见图像的用户依靠替代文本,图像模型也能借它建立文字与画面的对应关系。
最具体的例子是 LAION-5B。文章称,这个大型公开图文数据集从 Common Crawl 收集网页图片,并用原本为无障碍访问撰写的 HTML 替代文本与图片配对,后来成为 Stable Diffusion、DALL·E 等模型的重要训练来源。换句话说,为人类补上的语义,也降低了 AI 理解网页的门槛。
矛盾随之出现:网站用 CAPTCHA、限流和浏览器验证阻挡自动采集,却可能先难住依赖屏幕阅读器或行动不便的人。文章援引 WebAIM 的长期调查称,CAPTCHA 十多年来一直被受访屏幕阅读器用户列为最棘手的网页障碍。无障碍设计没有做错;真正的问题是,网站若只把“挡机器”当目标,代价往往仍由人承担。