AIボットを装った大規模脆弱性スキャンが発生中
Someone is running mass vulnerability scans, spoofing AI bots like ClaudeBot

Known Agentsのデータによると、ClaudeBotやGPTBotなどのAIボットを装った不正なスキャナーが、Webサイトに対して大規模な脆弱性スキャンを実行している。このレポートは、5,000以上のサイトを分析し、AI関連ボットのトラフィックが増加している一方で、robots.txtを尊重するボットは98.5%に上ることを明らかにしている。また、AIスクレイピング、AIフェッチ、AI検索インデックスなどの活動をエージェントタイプ別に分類し、主要なエージェントとその割合を示している。
AI関連のボットトラフィックは前90日間と比較して11%増加し、全ボットトラフィックの28%を占めています。
HNでの議論
228- yabones
ポート80/443が開いているすべてのサーバーには、毎日何千ものアクセスがランダムなボックスからあり、WordPressのログインページを探しています。唯一新しいのは、彼らが別の種類の迷惑ボットを装っていることです。洗練と偽装の新しい層がありますが、それは私たちが常に対処してきた同じジャンクトラフィックです。
- binaryturtle
平均して、約100の(TCP)リクエストが毎分私のホームルーターにヒットし、さまざまなプローブやスキャンを行っています。明らかにtelnetポートをチェックするものが多いです。時々、完全に異なるIPの群れが全ポート範囲をスキャンしているのを見ることがあります(ポートを1つずつプローブ)。deepfield、censys-scanner、visionheight.com、shadowserver.ioなどが多く見られますが、中国やロシアのIPというおなじみの容疑者もいます。OpenWRTでは、次のようなものを使っています: `tcpdump -i pppoe-wan 'inbound and tcp[tcpflags] & (tcp-syn|tcp-ack) == tcp-syn'`、または、トレントクライアントが実行されている場合(例えばここではポート44000)は、結果を台無しにするので、代わりに `tcpdump -i pppoe-wan 'inbound and tcp[tcpflags] & (tcp-syn|tcp-ack) == tcp-syn and not port 44000'` を使います。これが最善の方法かどうかはわかりませんが、ルーターに何が跳ね返ってくるかは確かに啓発的です。
- Bender
リストされているユーザーエージェントの多くは偽造されていることがよくあります。それらのIPがどのASNに属しているかを調べてください。ほとんどのVPSプロバイダーをブロックすれば、偽のボットのほとんどは消えます。それでも、ハイジャックされたコード(実際には単なるリーダーではなく、多目的プロキシであるリーダー)を使用して、住宅用や電話から実行されているものもあります。その点で、リンクされたソースコードを信頼せず、むしろあなたの電話で実行されているライブコードを逆コンパイルし、AIに分析させるべきです。
- walrus01
大規模な自動脆弱性スキャンは、2001年のこれの出現よりずっと前から非常に一般的なことでした:
https://en.wikipedia.org/wiki/Code_Red_(computer_worm)
'code red'が広まったとき、それが私のapacheサーバーログの内容を台無しにする効果があったのを覚えています。楽しい時代でした。
例えば:
GET /default.ida?NNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNNN%u9090%u6858%ucbd3%u7801%u9090%u6858%ucbd3%u7801%u9090%u6858%ucbd3%u7801%u9090%u9090%u8190%u00c3%u0003%u8b00%u531b%u53ff%u0078%u0000%u00=a HTTP/1.0
- Tharre
なぜ自ら進んでAIボットを装うのでしょうか?それらはすでにブロックされる可能性がはるかに高いのに。まったく非生産的に思えます。
思いつく最良の仮説は、何とかしてAI企業を悪く見せることですが、彼らはすでに誰もを毎時何百回もスクレイピングすることで、それ自体で素晴らしい仕事をしているようです。
- tomveber
声を大にして言う価値があります: ユーザーエージェントは身元ではありません。AIクローラーを逆DNSまたはプロバイダーの公開IP範囲で検証してください - 入れる価値のあるものはすべてそれらを公開しています。
- nate-gehringer
私は最近、この種のトラフィックと戦うために開発したCloudflare Workersについてブログに書きました: https://code.backwater.systems/blog/#2026-06-29T23:40:00.000...
- oasisbob
ここでも非常に似た経験をしています。7月30日に始まり、8月6日まで続き、その時から大幅な量の増加(約5倍)が始まりました。
トラフィックのほとんどはGCPから発生しています。Google CloudのIPスペース(AS396982)から、毎分約7万リクエストを持続的に受けています。GCP Abuseに報告しましたが、今のところ応答はありません。
主な特徴は、正当なAIトレーニングボットのUserAgent文字列の束が再利用されていることです。何千ものIPアドレスにわたって同時に量が変化するため、トラフィックが同じ集中管理下にあることは明らかです。