Anthropicは、研究者がClaudeを利用して生物兵器の開発を支援する可能性のある活動を5件阻止したと発表しました。同社は、研究者が故意に危害を加えようとしているかどうかは不明であるが、潜在的な結果があまりにも深刻であるため、これらの活動を阻止したと指摘しています。これらのケースは2025年12月から2026年8月の間に発生し、Anthropicは新しい脅威インテリジェンスレポートでこれらのモデルの悪用状況を説明しました。同社は、これらの事件が最前線のモデルの科学研究における能力向上に伴い、発見が難しい生物リスクが現れる可能性を示していると述べています。
Anthropicの最大の課題は、合法的な研究と危険な作業の境界を特定することです。生物研究はしばしば二重用途の可能性を持っています。同じ科学的知識が医療治療を支援する一方で、より危険な病原体を促進する可能性もあります。Anthropicの脅威インテリジェンス責任者であるJacob Kleinは、「この状況は明らかな悪意の意図を宣言することはほとんどありません」とニューヨークタイムズに語りました。研究者は、一見合法的な科学目標を示しながら、深刻な安全問題を引き起こす作業に従事することができます。
Anthropicレポートが生物研究の潜在的リスクを明らかに
「私たちは、これまでで最も詳細な脅威インテリジェンスレポートを発表しています。このレポートでは、人々がClaudeをどのように悪用しようとしたか——サイバー攻撃、影響操作、監視、生物研究、武器開発——と、私たちがこれらの行為をどのように発見し阻止したかをカバーしています。」とAnthropicはソーシャルメディアで述べ、「私たちは、レポートに記載されたすべての操作を阻止しました。」と付け加えました。
Anthropicは、その調査で地域制限を回避し、安全システムを逃れる試みを発見したと述べています。同社は、この活動に関連するアカウントを禁止し、調査結果を当局や他の人工知能企業と共有しました。1件のケースは、チクングニア熱に関連する研究に関するもので、Anthropicのシステムは、機能強化研究に関する資金申請を阻止しました。この関連作業は軍事研究機関で行われることを目的としており、同社の懸念を高めました。研究者は、Claudeが敏感なリクエストを阻止した後、他の手段を通じて作業を続けました。
Anthropicはまた、ある転売プラットフォームが拒否された生物提示を安全性が低いモデルに誘導していることを発見しました。2件目のケースは、高病原性鳥インフルエンザの研究に関するもので、Anthropicは、ある研究者が数週間にわたりClaudeを使用して研究計画、データ分析、科学的解釈を行ったと述べています。同社は、その安全対策が研究者が敏感な作業を行うために最も強力なモデルにアクセスするのを阻止したと指摘しており、この活動は最終的に安全性が低いモデルのバージョンに留まることになりました。
Anthropicは、武器に潜在的な影響を持つ生物研究に関与する他の3件のケースも報告しました。これらのケースには、正痘ウイルス、毒素、毒液に関連する化合物に関する作業が含まれています。同社は、研究者の身元、場所、具体的な生物の詳細を保持しています。Anthropicは、科学者が故意に危害を加えようとしているとは主張していません。この区別は重要であり、古いClaudeモデルは複雑な生物研究を支援する能力が限られていることを示しています。Anthropicは現在、新しいシステムに対して同じ仮定を行うことができないと述べています。
微生物学者であり、前アメリカ公衆衛生官のSusan Monarezは、レポートの公開前にレビューを行いました。彼女はニューヨークタイムズに対し、先進的なモデルが合法的な科学目標の背後に危険な研究を隠すのを助ける可能性があると述べました。Anthropicは高リスクの生物クエリに対する制御を強化しました。同社はまた、研究者が有用な科学的能力へのアクセスを保持できることを望んでおり、これが難しいエンジニアリングの問題を引き起こしています。安全対策は、病気、ワクチン、治療に対する合法的な研究を妨げることなく、危険な支援を阻止しなければなりません。
Anthropicの最近のケースは、最前線のモデルがより深い科学的能力を獲得するにつれて、この区別がますます困難になっていることを示しています。

