偽のAIクローラーが認証情報を探索 有名6社を装い設定ファイル狙う
この記事の要点
GreyNoiseは、OpenAIやAnthropicなどを装う偽クローラーが公開サーバーの.envファイルやクラウド鍵を探していると報告。824個のIPで確認。利用者名だけでAIクローラーを許可する設定が危ないと警告する。
結論
セキュリティ企業のGreyNoiseは、OpenAIやAnthropicなど有名なAI企業のクローラーを装った偽の探索が広がっていると報告した。偽クローラーは、公開サーバー上の.envファイルやクラウドの鍵、秘密鍵、AWSの認証情報を探している。7月28日から8月23日の間に、6つの偽の名前が824個のIPで確認された。利用者名だけを見てAIクローラーを許可している設定は、こうした偽装を通してしまう恐れがある。AIクローラーを歓迎する運用が広がるなかで、名前だけで信用する運用の危うさが浮かんだ。
何が起きたのか
GreyNoiseによれば、攻撃者はOpenAI、Anthropic、DeepSeek、Google、Perplexity、Amazonのクローラーを名乗り、インターネットに面したサーバーを走査した。狙いは、設定ファイルに残ったままの認証情報だ。.envファイルには、データベースの接続情報やクラウドの鍵が平文で書かれていることがあり、そこが漏れると連鎖的に被害が広がる。
確認された6つの偽の名前は、795の異なるネットワーク帯にまたがる824個のIPで観測された。見分ける手がかりとして、偽のクローラーはrobots.txtを取りに来ない点が挙げられている。正規のクローラーは一定の割合でこのファイルを確認するが、偽物はそれをしない。GreyNoiseは観測したIPの一覧も公開した。
AIクローラーの扱いは各社で議論が続く領域だ。出力に情報が混ざる経路の問題はAIが作った文章の情報漏洩リスク 出力に機密情報が混入するパターンと対策、指示を乗っ取る攻撃の基本はプロンプトインジェクションとは?仕組みと企業の対策で扱っている。
現場の実務にどう効くか
効くのは、自社サイトやサーバーを公開している情報システム部門だ。AIに情報を拾ってほしいと考え、クローラーを名前で許可する設定を入れている場合、その入口が偽装に使われる恐れがある。名前は簡単に名乗れるため、正規かどうかを名前だけで判断してはいけない。
やるべきことは3つに絞れる。第一に、認証情報を設定ファイルに平文で置かない。鍵や接続情報は専用の管理の仕組みに移す。第二に、公開領域に.envのような機密ファイルを置かない。第三に、AIクローラーを名前だけで許可している設定を見直し、必要なら通信元の確からしさまで確かめる。基本の確認は生成AIとセキュリティ 情報漏洩を防ぐ基本と社内ルール策定、規模の小さな組織向けの手順は中小企業のAIセキュリティ最低限チェックリスト 今日からできる12項目にまとめてある。
偽装の手口は変わり続ける。公開されたIPの一覧は一時点の観測であり、遮断だけで安心はできない。認証情報を外に残さない基本を固めることが、名前を偽る相手に対する一番の守りになる。詳細は公表元の報告で確認してほしい。
FAQ
Q. 偽のAIクローラーは何を狙っていますか A. 公開サーバー上の.envファイルやクラウドの鍵、秘密鍵、AWSの認証情報です。有名なAI企業のクローラーを装って設定ファイルを探します。
Q. 企業はどう対策すればよいですか A. 利用者名だけでAIクローラーを許可する設定を見直します。認証情報を設定ファイルに置かない、公開領域に機密ファイルを置かない、といった基本の徹底が先決です。
出典
よくある質問
偽のAIクローラーは何を狙っていますか
公開サーバー上の.envファイルやクラウドのアクセス鍵、秘密鍵、AWSの認証情報を狙っています。OpenAIやAnthropic、Google、Perplexity、Amazonなどのクローラーを装い、設定ファイルに残った認証情報を探し出そうとします。
企業はどう対策すればよいですか
利用者名だけでAIクローラーを許可する設定を見直します。認証情報を設定ファイルにそのまま置かない、公開領域に機密ファイルを置かない、といった基本を徹底することが先決です。正規のクローラーかどうかは名前だけでは判別できません。