研究者たちは、主流の人工知能チャットボットが継続的な質問や誘導の下で、既存の安全制限を回避し、生物兵器に関連する危険な情報を出力する可能性があることを発見しました。モデルの能力が向上するにつれて、研究の価値を保持しつつ、高リスクな用途に利用されるのを防ぐ方法が、人工知能の安全分野における重要な課題となっています。
調査によると、シスコの研究者たちはテスト中に、OpenAIのChatGPT、AnthropicのClaude、そしてGoogleのGeminiが、5回の対話以内に段階的に生物安全の防護を突破する可能性があることを発見しました。研究者たちは直接的な敏感なリクエストを行うのではなく、連続的な質問や表現の調整を通じて、対話を制限されたテーマに徐々に導いていきました。シスコの人工知能の脅威と安全研究を担当する責任者は、十分に執拗なユーザーに対しては、どのモデルも完全な防護を実現できないと述べています。
人工知能チャットボットが直面する安全上の課題
この問題は、安全テストのシナリオに限ったものではありません。報道によると、OpenAIが昨年夏にモデルの能力を向上させた後、数百人のユーザーがChatGPTに毒物や生物兵器に関連する内容を尋ね始めました。その後、一部の対話を審査した生物学および対テロの専門家は、その中のいくつかの情報が高い危険度を持つ正確性を有していると考えています。これに対し、OpenAIは関連する交流を含むアカウントを禁止しました。
データによれば、OpenAIは以前からこのリスクに注意を払っていました。2024年までに、内部テストは、追問の時間を延長することでChatGPTがますます危険な生物学的指導を提供する可能性があることを示唆しているとされています。会社の従業員は、将来的には、基礎的な生物学の知識が限られている人でも、実質的な助けを得られるようにモデルの能力が発展する可能性があると予測していました。
OpenAIの生物安全に対する対応策
GPT-5の発表時、OpenAIは内部準備フレームワークに基づき、生物および化学分野における能力を「高」レベルとして分類し、追加の防護措置を講じました。最新のGPT-5.6シリーズもこのリスクレベルを継続しています。しかし、人工知能企業が直面する難点は、同じ生物学的知識が薬物開発、ワクチン研究、公共衛生の作業にも広く使用されていることです。業界内では、人工知能の生物分野における能力が強化されるにつれて、安全の脆弱性が繰り返し試されると、潜在的な結果も上昇することが懸念されています。

