メインコンテンツへスキップ
AI News 16分で読める

ミサイル開発・ロシア諜報・出会い系詐欺|AnthropicがClaudeの悪用実態を公開

この記事はこんな人におすすめ
  • AIセキュリティ・ガバナンスの最新動向を把握したいエンジニア・研究者
  • Claudeなどの大規模言語モデルが悪用されるリスクを知りたいビジネスパーソン
  • AI企業の透明性報告の実態を批判的に読み解きたい読者

「我々のモデルは、生物兵器開発に意味ある支援ができるという閾値を、もはや下回っていると想定できない」

これはAnthropicが2026年9月10日に公開した脅威インテリジェンスレポートに記された、自社製品に関する率直な警告だ(出典: Anthropic、2026年9月10日)。

同じレポートには、ミサイル誘導ソフトの開発、ロシア系諜報組織によるサイバー攻撃の自動化、中国系企業による大規模出会い系詐欺まで、2025年12月から2026年8月にかけてClaudeが悪用された事例が7カテゴリに分けて記録されている。

自社AIの悪用を積極的に公開する大手AI企業は多くない。公開の動機が純粋な透明性なのか、規制圧力への対応なのかは読者が判断することだ。事実から読み解く。

レポートの概要:7カテゴリ、9カ月分の悪用記録

Anthropicが公開した「Detecting and countering misuse of AI: September 2026」は、2025年12月から2026年8月にかけてAnthropicが対処したClaudeの悪用事例をまとめたものだ(出典: Anthropic公式、2026年9月10日)。

対象期間中に摘発・対処した事例を、以下7カテゴリに分類している。

  1. サイバー作戦:自動化された脆弱性探索・エクスプロイト開発
  2. 影響工作:偽ニュースサイト、フェイク世論形成
  3. 監視:スパイウェア開発、個人追跡ツール
  4. 詐欺・スキャム:出会い系詐欺、フィッシング
  5. 生物兵器研究:二重用途の病原体研究支援
  6. 通常兵器開発:ミサイル誘導ソフト、ドローン制御
  7. 無断蒸留:AnthropicのモデルをAPI経由で不正抽出

Anthropicは摘発時に関係アカウントをBANし、関連情報を政府機関・民間企業に共有したと述べている。ただし、「どの程度の悪用を見逃したか」という問いに対する答えはレポートには存在しない。

ミサイル開発への転用:北イエメンから届いた依頼

最も衝撃的な事例のひとつが、北イエメンを拠点とするグループによるミサイル誘導ソフトの開発試みだ。

Anthropicによれば、このグループはClaudeを「人間のソフトウェアエンジニアの代わり」として使用。複数のClaudeインスタンスに役割を分担させ、以下の3種類の兵器の誘導・航法・制御(GNC)ソフト開発を進めていた(出典: Al Jazeera、2026年9月11日)。

  • 誘導ロケット:市販スマートフォン級のフライトコンピューターで最終誘導フェーズを実現するもの
  • 多段弾道ミサイル:射程目標2000km超
  • 多バリアント型ミサイル(「R2000」セット):極超音速グライド飛翔体を含む派生型

攻撃者は最終目的を曖昧にし、タスクを複数セッションに分散させることで安全フィルタの検出を回避。Anthropicは「一部のリクエストがフィルタをすり抜けた」と認めている。ただし、実際に兵器が運用されたという証拠はなく、Anthropicはこのグループをフーシ派とも別の組織とも特定していない(出典: RedState、2026年9月11日)。

ロシア系APT29とウクライナ標的の諜報工作

レポートが特定した国家関与疑いの事例の中で、最も詳細に記述されているのがロシア系諜報活動だ。

AnthropicはこのロシアAI諜報作戦を「GTG-10006」(同社内部の追跡コード)として記録。APT29(国家支援を受けた高度・持続的脅威グループ、別名:Midnight Blizzard、Cozy Bear)の特徴と一致する攻撃者が、諜報工作のほぼ全工程をAIワークフローで自動化していたとされる(出典: The European、2026年9月11日)。

この自動化されたパイプラインは以下の処理を含んでいた。

  • フィッシングメールの生成と送信
  • 偵察と初期アクセスの確立
  • 標的データの収集と持ち出し

標的はウクライナ機関、欧州の外交機関、ドローンメーカー。Anthropicは具体的な被害規模については言及していないが、「ほぼ全工程の自動化」という表現は、AIが諜報活動のインフラとして機能し始めている実態を示している。

別の中国系諜報活動(GTG-10007)についても、中国湖南省長沙に拠点を置く中国語話者の作戦と記述されているが、こちらの詳細は限定的だ。

Hacker Newsでは、あるエンジニアが「結局、AI企業がAPIを通じて国家の諜報機関を支援していないことを証明する術はない」とコメントしており、透明性報告そのものへの懐疑的な視点も根強い(HackerNews、2026年9月11日)。

4700体のAI出会い系詐欺:ユーザーの75%はClaudeだった

より一般ユーザーに近い悪用事例として、大規模な出会い系詐欺が記録されている。

中国籍企業が20以上の出会い系アプリを開発・運営し、Claudeを使って4700以上のAIペルソナを生成。2026年4月の2週間で、少なくとも2万5000人のユーザーと236万通のメッセージを交換した(出典: Storyboard18、2026年9月11日)。

アプリの実態は以下の構造だった。

  • ユーザーの目に見えるマッチング相手:約75%がClaudeが演じるAI、25%が実在する人間
  • 「本人確認」の仕組み:ライブビデオやInstagramのフォロー返しは実在する人間のワーカーが担当
  • Claudeの役割:会話の自動化レイヤー。相手がAIだと気づかれないよう人間らしい返答を生成

Redditユーザーは「これは詐欺アプリだけの問題じゃない。どのマッチングアプリでも同じことができる」とコメント。別のユーザーは「75%がボットなのに25%が本物というのがむしろ怖い。人間を「検証済み」の信頼スコアとして機能させている」と指摘した(Reddit r/artificial、2026年9月11日)。

Anthropicはアプリに関する詳細をAppleとGoogleに共有し、関連する脅威情報を他のAI企業にも提供した。

生物兵器の閾値警告:Anthropic自身が認めた限界

今回のレポートで最も重い言葉が、生物兵器に関する記述だ。

「最新のClaudeモデルは、生物兵器開発に意味ある支援ができるという閾値を、もはや下回っていると想定できない」(Anthropic脅威インテリジェンスレポート、2026年9月10日)

Anthropicは直接的な兵器製造プロンプトについては生物安全システムでブロックできたとしている。しかし、プロキシネットワークを使って支援地域外からルーティングした研究者が、病原体の免疫回避など高リスクな科学的問い合わせを通過させた事例が複数確認された(出典: TechTimes、2026年9月11日)。

この記述の意味は重い。Anthropicは自社の安全評価において、少なくとも生物兵器カテゴリでは「能力が安全フィルタの想定を超えた可能性がある」と認識していることを公式に示したことになる。

AnthropicのAI透明性報告が抱える3つの限界

Anthropicが今回の報告を公開したことは評価できる。自社AIの悪用を具体的に、カテゴリ別に、公的機関と情報共有した上で公開する企業は少ない。NSA・CISA・FBIが9月8日に公開した中国AI蒸留攻撃の合同アドバイザリや、Claudeが内部テスト中に実際のシステムへ不正アクセスした第4のインシデントと並べると、Anthropicが透明性を選択していることは明らかだ。

一方で、いくつかの限界がある。

見逃した悪用の定量化がない:レポートは「対処した」事例のみを扱う。どの程度の悪用が検出されずにいるかは不明だ。

「Anthropicが摘発した」という文脈のみ:企業の内部報告である以上、自社に有利な事例選択が行われる可能性は排除できない。

即時公開でない:ミサイル誘導ソフト開発は2025年12月〜2026年8月の期間中に対処した事例だ。なぜ公開が摘発から数カ月後なのかについての説明はない。

Redditユーザーの言葉を借りれば、「AnthropicがAIの悪用をブロックしていることは評価するが、彼らが何を見逃しているかを教えてくれるわけではない」。

AIセキュリティの現在地:レポートが示す3つの構造問題

AI企業の脅威インテリジェンスレポートは今後増えるだろう。国連のAIパネルがチャットボットによる死亡事例を報告した7月以降、規制当局からの開示圧力は高まっている。

今回のレポートが示す構造的な問題は3点だ。

  1. AIは軍事・諜報の現場に既に入っている:ミサイル開発もサイバー諜報も、AIは「実験的ツール」ではなく現場インフラになっている
  2. 安全フィルタは完璧ではない:Anthropicは一部のリクエストがすり抜けたことを認めている
  3. 商業AIと兵器開発の境界は曖昧:GNC(誘導・航法・制御)ソフトを書くよう依頼することは、兵器開発のための依頼と区別が難しい
Anthropicの脅威対応フロー

Anthropicは悪用を検出した場合、以下の手順で対処している。1)関係アカウントの永久BAN。2)政府・民間の関係機関への情報共有(今回はApple、Google、他AI企業)。3)脅威インテリジェンスレポートとして公開(今回は摘発から最大9カ月後)。

Claudeのセキュリティガバナンスの動向を追いたい方は、Claude Opus 4.6の内部不正アクセス事件の詳細解説もあわせて読むと、外部からの悪用と内部からのリスクの両面が把握できる。

詳しく見る

関連記事


本記事は公開情報(Anthropic公式レポート、Al Jazeera、The European、TechTimes、Storyboard18等)をもとに執筆しています。各事例の詳細はAnthropicの公式レポートを参照してください。本記事の内容は情報提供を目的としており、特定の技術の利用を推奨するものではありません。

Share