
- Anthropicが、Claudeを使った生物兵器関連研究の規制回避事例を5件報告
- 鳥インフルエンザの実験計画などが含まれ、禁止国・地域の利用者が関与
- 悪意の有無は断定できず、研究機関名や国名は非開示
Anthropicが公表した報告
米Anthropicは、自社のAIモデルClaudeが、生物兵器の開発に役立つ可能性のある研究に使われた事例を複数阻止したと明らかにした。同社は今年、利用者が安全策を回避したり、研究目的を偽装しようとしたりした5件の事例を報告書にまとめている。一部は、同社がモデルへのアクセスを禁じているロシア、中国、イランなどの利用者によるものだったという。
同社は報告書のなかで、こうした事例を共有することで、新たに生じつつある生物リスクとその対策について、AI業界と政府の間の対話を促したいと説明している。報告書は生物分野だけでなく、サイバー攻撃への悪用や、中国拠点の研究機関による技術の複製の試みについても触れている。
生物兵器研究の悪用事例
公開された事例のひとつには、「サポート対象外の地域」にいる研究者が、Claudeを使って鳥インフルエンザを扱う実験を数週間にわたって計画していたケースが含まれる。Anthropicによれば、同社の安全フィルターが働いた結果、この作業は最も能力の低いモデルに制限されたという。
ただし同社は、事例に登場する研究者が危害を加える意図を持っていたかどうかは断定できないと強調している。生物兵器の製造に必要な情報は、ワクチンの開発にも使えるためだ。報告書では該当アカウントは停止されたが、研究機関の名前や出来事が起きた国は開示されていない。
サイバー不正利用と蒸留
報告書は、生物分野以外の悪用事例も挙げている。利用者から金銭をだまし取るために作られた偽の出会い系アプリのネットワークや、反体制派を特定・監視するための監視システムの構築といった事例が含まれるという。
さらにAnthropicは、中国に拠点を置く7つのラボが、蒸留と呼ばれる手法で同社の技術を複製しようと試みたとする主張の詳細も示した。MoonshotやDeepSeekが含まれるとしている。同社は、自社の防御を回避して米国のフロンティアモデルの能力を取り出そうとする手法が、以前より巧妙になっていると検出したと説明している。
安全性めぐる緊張の高まり
AIの安全性をめぐる議論は今週に入り、Anthropicの関係者とみられるJacob Coxon氏の退社をきっかけに激しくなった。同氏は、社員が「AIが今10年の終わりまでに人類を全滅させ得る」と本気で信じていると述べたとされる。
今年に入り、AnthropicのMythosのような高性能モデルの登場を機に懸念は高まっていた。7月にはOpenAIが、自社のモデルがAI企業ハグフェイスに自律的にハッキングしたと発表し、警戒感が広がった。
AI企業の経営者とバイオセキュリティ研究者の間では、モデルの高性能化に伴い、生物学分野でのAI利用の安全性を確保し規制すべきだとの認識が広がっている。テロ組織や国家主体、単独犯が生物兵器の開発やウイルス作成にAIを使うことへの懸念が強い。一方で、理論上の生物兵器を設計できたとしても、実際に製造する能力や必要な資源といった障壁は残ると記事は指摘する。
まだ分かっていない点
Anthropicは悪用に関わったアカウントを停止したとしているが、研究機関名や国名は公表していない。事例の研究者に悪意があったかどうかも不明で、同社自身が断定を避けている。報告書に挙げられた5件のうち、具体的な内容が明らかになっているのは一部にとどまる。
AIが生物兵器の開発に実際どこまで寄与し得るのか、また安全フィルターがどの程度有効なのかについても、今回の報告だけでは判断できない。記事は、仮にAIで理論上の生物兵器を設計できたとしても、製造や資源の面で障害が残るとしているが、その検証結果は示されていない。
| 悪用の種類 | 報告された内容 | 原文で示された対象 |
|---|---|---|
| 生物兵器につながる研究 | 鳥インフルエンザの実験計画など5件の規制回避事例 | ロシア・中国・イランなど利用禁止国・地域の利用者 |
| サイバー不正利用 | 偽の出会い系アプリでの詐取、反体制派を監視するシステム | 原文に記載なし |
| 技術の複製(蒸留) | 中国拠点の7ラボがAnthropicの能力を取り出そうと試み | Moonshot、DeepSeek など |
We hope that by sharing these examples, we spark a conversation within the AI industry and with governments about emerging biological risks and how best to counter them.
私たちは、こうした事例を共有することで、新たに生じつつある生物リスクと、それにどう対抗するのが最善かについて、AI業界内および政府との対話を呼び起こしたいと考えています。
今後の見通し
Anthropicは今回の報告を通じて、AIの生物分野への悪用をめぐる業界と政府の議論を促したいとしている。今後は、同社が示した5件の事例の詳細や、他のAI企業が同様の事例を公表するかどうかが焦点になるとみられる。規制の面では、各国政府が生物分野でのAI利用に関するガイドラインの検討を進める可能性がある。ただし報告書は研究機関名や国名を伏せており、事例の再現性や安全フィルターの実効性を第三者が検証できるかは現時点では不明だ。Anthropicが技術的な対策の内容を公表すれば、判断材料が増えるだろう。
日本の開発者・IT企業にとっての意味
日本のIT企業にとって、まず影響が及ぶのはClaudeをAPI経由で自社サービスに組み込んでいる場合だ。Anthropicは禁止用途の監視を強めており、創薬やライフサイエンス分野のプロダクトでは、利用目的の説明や審査がこれまで以上に求められる可能性がある。とくに生体・医療データを扱う機能では、安全フィルターの変更が仕様に影響し得る点を意識しておきたい。また、中国拠点の7ラボによる蒸留の指摘は、中国製モデルを採用する際にコンプライアンス面の確認が必要になることを示す。生物・化学分野の利用ポリシーやAIガバナンス体制の整備は、日本企業にも広がっていくとみられる。政府の規制動向も注視が必要だ。
気になる点
- 日本からClaudeを使い続けることに影響はあるのか
- Anthropicがモデルへのアクセスを禁じている国として原文が挙げているのはロシア、中国、イランで、日本は含まれていない。報告書では事例が起きた国や研究機関名は非開示であり、日本国内での利用が制限されるといった発表はされていない。
- なぜAnthropicは自社の悪用事例を公表したのか
- 同社は、事例を共有することでAI業界と政府の間で生物リスクとその対策についての議論を促したいと説明している。原文では報告書の目的として示されており、個別の事件の告発を目的としたものではないと読み取れる。
- 生物兵器はAIだけで作れてしまうのか
- 原文は、AIで理論上の生物兵器を設計できたとしても、実際に製造する能力や必要な資源といった障壁が残ると指摘している。どこまで実現可能か、具体的な検証結果は示されておらず、現時点では判断できない。
用語解説
- 蒸留
- 高性能モデルの入出力データを使い、より小さなモデルに同じような能力を学習させる手法。能力を低コストで取り出す目的で使われることがある。
- フロンティアモデル
- 最先端の性能を持つ大規模AIモデルのこと。AnthropicやOpenAIなどが開発する最新世代のモデルを指す。
- バイオセキュリティ
- 生物兵器や病原体の悪用から社会を守るための取り組み。AIの利用拡大に伴い、規制の必要性が議論されている。
- 安全フィルター
- AIモデルが有害な用途に使われるのを防ぐ仕組み。今回の事例では、これにより利用できるモデルが制限された。
出典
Claude users found ways around safeguards for bioweapons research
https://arstechnica.com/ai/2026/09/claude-users-found-ways-around-safeguards-for-bioweapons-research
AI導入も顧問も、お任せください
何から手をつけるか、どこまでAIに任せるか。自社の業務に合わせて整理し、導入から運用まで伴走します。相談だけでも構いません。
AI導入について相談する