ホスティングのダッシュボードを開くと、何も悪くないように見える。uptimeは安定、ページ表示は速い、ここ数週変更もしていない。しかし帯域使用量は少しずつ積み上がり、PHPワーカーは以前より忙しく、次の請求書には見知らぬ超過料金が一行混入している。あなたのトラフィックは増えていない——では誰がサーバーを食っているのか。答えが「お客様ではない」ことが増えている。その正体はAIクローラーであり、今もあなたのサイトを巡回している可能性がある。
これは仮説ではない。Cloudflareの2026年8月データによると、HTMLページリクエストの過半数はもはや人間から来ていない。Impervaの年間Bad Bot Reportでは、自動トラフィックがWeb活動全体の51%を占め、そのうち「悪質Bot」が37%とされています。増加速度も加速しており、TollBitの出版者ネットワーク追跡では、AIクローラー対人間の訪問者比率が2025年初の1:200から第4四半期には1:31へ——わずか1年で6.5倍に悪化しています。あなたのサイトは、この洪水の中の一滴です。
普通のBotがキャッシュを悩ませる程度なら、AI学習クローラーはサーバーに無給の労働を強いる。真に痛いのはその振る舞いパターンです:
ホスティングパネルは帯域・ディスク・CPUを表示するが、「誰が消費しているか」は教えてくれない。火曜午後の帯域急増は、マーケティングが成功したのか、それともClaudeBotが商品カタログを全部巡回したのか。Botレベルの可視化がなければ見分けがつかず、直しようもない。多くのサイトオーナーは「サイトがプランに追い付かなくなった」と判断してアップグレードするが、実は招待もしていないクローラーの大軍に代金を払っていたのだ。
Bot防御で最も重要な一筋の光:Botがオリジンに到達する前に止めろ。Botがサーバーに届いた時点で、PHPは既に実行済み、クエリは既に完了、帯域は既に焼けている——その時点でプラグインや.htaccessで遮断するのは、ドアを蹴破られた後に鍵を取り付けたようなものだ。正しい順番はCDN/WAFのエッジ層で識別・遮断すること。リクエストはエッジノードで消え、オリジンは存在すら知らず、コストはゼロ。
robots.txtはどうなのか?それは礼儀上の提案に過ぎない——GPTBotやClaudeBotのような「规矩ある」クローラーは概ね従うが、偽装者と無良なスクレイパーは無視する。本物の強制力はネットワーク層にある。「何を止め、何を残すか」は判断が必要だ:純粋な学習クローラーはコンテンツを持ち去り何の返礼もない——止めるべき。AI検索クローラー(OAI-SearchBot、PerplexityBot)はあなたのページを引用して参照トラフィックをもたらす——残しておく価値がある。
過半数のトラフィックが人間でなくなった今、請求書の肥大は事故ではなく既定路線だ。雷飛数位のAI運用保守サービスはエッジ層で24/7、無効Botトラフィックを自動検知・遮断——止めるべきは秒で止め、参照価値のあるものは残す——CDNとサーバーへの支出が、本当に本物の顧客のために使われるようにする。