Bot 防护公司 DataDome 周三(9/22)发布《2026 Bot 与 Agent 安全状态报告》,分析超过 1 兆次请求、75,000 多个客户站点的 12 个月资料,结论很残酷:2025 年 7 月到 2026 年 6 月,恶意 Bot 流量成长了 124%,同期人类真实流量只成长了 13.2%——坏流量增速是人类流量的 9 倍。AI Agent 与 LLM 爬虫的流量同期成长 82.3%,也是人类流量的 6 倍以上。
换句话说:你网站进来的请求,正在快速变成「不是人」的请求。这些请求不买东西、不读文章,它们抓资料、撞密码、压垮你的服务器——然后照样消耗你的 CDN 流量与频宽。
Bad Bot 流量里,Web 爬虫(Scraping)一家独大,占比 70.9%,年增 185%。背后逻辑很简单:AI 模型训练与 RAG 应用对「大规模资料」的需求暴增,爬虫工具的取得成本又不断降低——抓资料变成了一门低门槛、高回报的生意。
其次是帐密撞库(Credential Stuffing)。报告指出它呈现明显的「波浪式」攻击节奏:大规模灌入 → 收手更新帐密清单、更换基础设施 → 再以全规模回击。还有抢购(Scalping)、垃圾流量、DDoS,全在同期成长。
值得注意:报告的 30 天抽样中,「简单 Bot」占最大比例——就是那种开发成本极低、对几乎所有网站都有效的基础自动化脚本。意思是,只要你「什么都没做」,就是攻击者眼里最好下手的那一个。
报告里最警讯的一句:2026 上半年,登入页面的 AI Bot 流量增加了超过 8 倍。合法用途当然存在——AI 助手替用户查订单、查帐号、代下单——但攻击者完全可以用同样的手法做帐密测试与帐号盗用。DataDome 威胁研究 VP Jerome Segura 说得很准:「组织被要求做出更细致的判断,但防线还大多建在『放行或封锁』的二元选择上。」
更麻烦的是仿冒:恶意软体可以直接抄一个知名 AI 服务的 User-Agent,伪装成「受信任的爬虫」,让为合法 AI 流量设定的放行规则被反向利用。单一请求看不出差别,要看的是行为序列、速度、数量与上下文——这正是人工规则写到几万条也写不完的部分。
DataDome 对 21,491 个热门网站首页施放了 10 类模拟 Bot(简单脚本、伪装 AI 服务的 Bot、伪造浏览器指纹、自动化真实浏览器,从美加法三地住宅 IP 发出),结果:
这代表「大企业=安全」的直觉是错的:复杂架构、工具碎片化、 legacy 系统留下的缝隙,比预算大小更重要。
很多老板只把 Bot 当「安全问题」,但它首先是一道钱的问题:每一只成功进站的爬虫都在消耗你的 CDN 流量、频宽、后端 CPU 与资料库查询。124% 的增速放在帐单上,就是你网站的「有效流量」占比正在被稀释,而你还在为全部流量付钱。
正确的做法不是写更长的封锁清单(攻击者换 UA、换 IP 只要一分钟),而是把识别与决策自动化:行为序列分析、指纹比对、风险分级、秒级自动阻挡——这正是 24/7 AI 运维的核心价值之一。合法 AI 爬虫放行、恶意自动化秒杀、异常流量即时清洗,不需要任何人半夜看告警。
坏流量增速 9 倍,代表「被爬、被撞、被压」不再是意外,而是每天的日常。雷飞数位的做法是把 Bot 识别、WAF 防御、DDoS 清洗全部放在机器层 24/7 自动运行——你的服务器只对真正的人与合法的 AI 开门,其余的在边界就被挡下,帐单与稳定性一起守住。