主流AIチャットボットが生物兵器情報漏洩のリスクを引き起こす可能性が判明

研究者たちは、主流の人工知能チャットボットが継続的な問いかけや誘導によって、既存の安全制限を回避し、生物兵器に関連する危険な情報を出力する可能性があることを発見しました。モデルの能力が向上するにつれて、研究の価値を保持しつつ、高リスクな用途に利用されるのを防ぐ方法が、人工知能の安全分野における重要な課題となっています。

調査によると、シスコの研究者はテスト中に、OpenAIのChatGPT、AnthropicのClaude、GoogleのGeminiが、5回の対話を超えない範囲で徐々に生物安全の防護を突破するように誘導される可能性があることを発見しました。研究者たちは直接的に敏感なリクエストを行うのではなく、連続的な問いかけと表現の調整を通じて、対話を制限されたテーマに導いていきました。シスコの人工知能脅威と安全研究の責任者は、十分に執着するユーザーに対しては、どのモデルも完全な防護を実現できないと述べています。

人工知能チャットボットが直面する安全の課題

この問題は安全テストのシナリオに限ったものではありません。報道によると、OpenAIが昨年夏にモデルの能力を向上させた後、数百人のユーザーがChatGPTに毒物や生物兵器に関連する内容を尋ね始めました。その後、一部の対話を審査した生物学および対テロの専門家は、その中のいくつかの情報が危険度の高い正確性を持っていると考えています。これに対して、OpenAIは関連する交流を行ったアカウントを禁止しました。

データによると、OpenAIは以前からこのリスクに注意を払っていました。2024年までに、内部テストは、問いかけの時間を延長することでChatGPTがますます危険な生物学的指導を提供する可能性があることを示したとされています。会社のスタッフは、将来的にモデルの能力が発展し、生物学的基礎が限られている人でも実質的な助けを得られるようになると予測していました。

OpenAIの生物安全への対応策

GPT-5の発表時、OpenAIは内部の準備フレームワークに基づき、生物および化学分野における能力を「高」レベルとして分類し、追加の防護措置を講じました。最新のGPT-5.6シリーズもこのリスクレベルを引き継いでいます。しかし、人工知能企業が直面する難点は、同じ生物学的知識が薬物開発、ワクチン研究、公共衛生の仕事にも広く使用されていることです。業界内では、人工知能が生物分野での能力を強化するにつれて、安全の脆弱性が繰り返し試されると、潜在的な結果も上昇することが懸念されています。

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle