ユーザーの入力を無断転送、AIモデルの学習に利用か
米AI企業アンソロピック(Anthropic)が、AIモデル「クロード(Claude)」の悪用実態をまとめた脅威情報レポート「Detecting and countering misuse of AI: September 2026」を9月10日に公開した。
同レポートは、2025年12月から2026年8月までに確認された事案を対象とする。サイバー攻撃、影響力工作、監視、詐欺、生物学上の悪用、通常兵器開発、不正な蒸留の7分野が取り上げられた。
なおアンソロピックは、これらは一般的な悪用事例ではなく、これまでに確認した中でも特に注目度が高く、新規性のある事案だと説明している。
アンソロピックは、レポートで扱った各事案について、関連アカウントの停止などを通じて活動を妨害したと説明している。ただし、クロードが悪用に関するすべての要求を事前に拒否したわけではない。レポートでは、安全対策が突破され、クロードが要求に応じた事案も報告されている。
アンソロピックは、調査で得た情報を安全対策へ反映し、必要に応じて政府機関や業界関係者と共有したという。
なかでも同レポートでは、中国に拠点を置く7つのAIラボによる「不正な蒸留」が詳述された。
蒸留とは、高性能な「教師モデル」の回答を使って別の「生徒モデル」を学習させ、その能力を再現する手法だ。一般的なAI開発でも利用される。一方、アントロピックは、許可なくモデルの能力を抽出して別のモデルへ複製する大規模かつ秘匿的な活動を「不正な蒸留」と定義している。
アンソロピックが名指ししたのは、アリババ(Alibaba)、ムーンショットAI(Moonshot AI)、ディープシーク(DeepSeek)、ジープーAI(Zhipu AI、海外ブランド名Z.ai)、シャオミ(Xiaomi)、センスタイム(SenseTime)、ミニマックス(MiniMax)の7社だ。同社は、各社への帰属について高い確信度があるとしている。
アリババ関係者による活動では、2026年5月から7月に1億5,100万件を超えるやり取りが確認されたという。ピーク時には3,500件超の不正アカウントから、1日約300万件のリクエストが送信された。
アリババ関係者は「Claude Opus 4.6」と「Claude Opus 4.7」の思考過程を抽出し、同社のAIモデル「Qwen 3.5」、「Qwen 3.6」、「Qwen 3.7」の学習に利用したとされる。
ムーンショットAIについては、利用者からAIサービス「キミ(Kimi)」へ送られた問い合わせを、利用者に知らせずクロードへ転送していたという。利用者はキミを使用していると認識していたが、実際にはクロードの回答が表示されていたとされる。2026年5月から7月には、2,300万件超のやり取りが確認された。
転送された入力には、中国人民解放軍(PLA)との関係がある可能性が高いとアンソロピックが評価した利用者が扱っていた監視データも含まれていた。この利用者は、特定人物の行動に異常がないかを分析するため、成都に設置された数百台の監視カメラのデータをキミへ読み込ませていたという。
監視データには、人民解放軍施設や中国電子科技集団公司の関連研究所、大手国有企業の外部に設置されたカメラの映像も含まれていた。報告書では、このデータが人民解放軍の公式データや機密情報だったとは明記されていない。
またムーンショットAIの別の利用者は、中国の大手国有企業向けシステムの開発にキミを利用していた。その際、複数の中国企業の内部コードや有効な認証情報がクロードへ転送されたという。
ディープシークについても、利用者の一部の問い合わせを知らせずにクロードへ転送し、その思考過程をモデル学習用に収集していたとされる。2026年7月の14日間だけで、1,210万件超のやり取りが確認された。
ディープシークから転送された情報には、中国企業の主要AIプロジェクトの仕様や組織構成、戦略目標が含まれていた。このほか、ロシア国防省関連機関のデータベースに接続できる認証情報や、中国の公安局向け監視システムの開発情報も送信されたという。
ジープーAIについては、17日間で340万件超のやり取りが確認された。シャオミでは、40万件超の利用者との会話やプログラミング作業がクロードへ再送信されたとされる。センスタイムは第三者のデータ販売業者からクロードとの会話記録を購入し、ミニマックスは関連性を明示しない別会社を通じてプロキシサービスを運営していたという。
アンソロピックによると、転送された情報には、少なくとも12言語で記録された数百人分の氏名や連絡先、企業データなども含まれていた。同社は、こうした取り扱いが各社の利用規約や個人情報保護法に反する可能性があるとの見方を示している。
また別の兵器開発事案では、中国を拠点とする人物がクロードを利用し、電子戦や敵防空網制圧に用いるソフトウェアを開発していたという。アカウント情報などから、中国人民解放軍軍事科学院を含む中国の研究機関との関係が示されたとされる。開発途中には、台湾の司令部やレーダー、ミサイル部隊、空軍基地など12カ所がシミュレーションの対象に設定された。
このほか同レポートでは、ロシア系勢力によるサイバー諜報、中国やイランに関係する監視活動、欧州の政治組織を狙った影響力工作、生物兵器開発につながり得る研究、軍用ドローンやミサイルの開発支援などが報告された。
なお「ロイター(Reuters)」によると、中国外務省は同レポートを把握していないと回答した。またAIの善用を支持し、事実の歪曲や中国への中傷に反対する姿勢を示した。
「ビジネスインサイダー(Business Insider)」によると、同媒体が問い合わせたアリババ、ムーンショットAI、ディープシーク、ジープーAI、シャオミからは、報道時点で回答が得られなかったという。
アンソロピックは対策として、不正な蒸留を検知する仕組みを強化した。クロードが内部の思考過程をそのまま出力せず、要約して返す仕組みも導入している。また中国やロシア、イランなど、クロードの提供対象外地域からの不審なアクセスについて本人確認を求め、確認できないアカウントを停止するとしている。
We’re publishing our most detailed threat intelligence report to date.
— Anthropic (@AnthropicAI) September 10, 2026
It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them.
We disrupted every operation in the report,…
参考:アンソロピック公開レポート・ロイター・ビジネスインサイダー
画像:Reuters