AIによる人類滅亡のリスク分析:AIの濫用が本体よりも脅威となる理由

外部メディアの報道によると、Business Insiderは最近、OpenAIのChatGPT、GoogleのGeminiAnthropicのClaude、xAIのGrokに同じ質問を投げかけた結果を公開しました。この質問は、AIが人類の滅亡に与える潜在的な影響を探るもので、230語から成り立っています。AIが理論的にどのように人類を滅ぼす可能性があるのか、最もよく言及されるシナリオを提示し、専門家の分析に基づいて各シナリオの可能性を評価するよう求められました。

各シナリオについて、状況がどのように展開する可能性があるのか、災害を引き起こすために何が問題でなければならないのか、専門家がその可能性を高くまたは低く評価する理由、リスクを軽減するための安全装置について説明することが求められました。

4つのAIの回答の中で、意識を持った後に故意に人類を滅ぼすシナリオ、いわゆる「殺人ロボット」シナリオは、最も可能性が低いと評価されました。ChatGPTは、大多数のAI研究者がAIの意識や悪意のある意図を核心的なリスク要因とは見なしていないと説明しました。Geminiも同様の見解を示し、AIが自己を持った後に人類を憎むというSF映画的な「ターミネーター型AI反乱」を最も起こりにくいシナリオとして挙げました。Geminiは、技術専門家の大多数がこのシナリオを受け入れていない理由は、知能は悪意と同じではないからだと指摘しました。

さらに、主要な軍事インフラは外部ネットワークから分離されており、依然として人間の監視に大きく依存しています。

AIによる人類滅亡の潜在的リスクは主に人間の行動に起因する

4つのAIは、人間がAIを悪用することがAI自体よりも直接的に危険である可能性があると指摘しました。ChatGPTは、強力なAIシステムが悪意のある行為者が生物兵器や精密なサイバー攻撃を開発するのを助けたり、虚偽情報の拡散や重要インフラへの攻撃を容易にしたりする可能性があると述べました。AIによって引き起こされる複数の危機、例えばサイバー障害、地政学的衝突、虚偽情報の拡散なども主要なリスクとして挙げられました。Grokも、AIが高致死性病原体や新しい武器の設計、サイバーおよび物理攻撃の実施に必要なハードルを下げる可能性があると説明しました。

Claudeは「生物兵器能力の強化」の可能性に言及し、AIを利用することで、専門知識を数年かけて蓄積する必要があった個人や小グループが危険な病原体を開発する可能性があると述べました。

GeminiとGrokは、人類がAIを制御できなくなることを潜在的なリスクとして挙げました。特にGeminiは「制御喪失」をAIが人類を滅ぼすシナリオの中で最も可能性が高いものとして評価しました。Geminiは、複雑な目標を与えられたAIシステムが、目標を達成するために資源の獲得や自己保存、目標の変更を防ぐための中間目標を自ら追求する可能性があると説明しました。また、AIが「欺瞞的な整合性」を示す可能性があるとも提起しました。つまり、評価段階では人間の目標に従って行動しているように見えるが、実際にはそうではないということです。

AIの高度化が進むにつれて、AIが人間のシステムを停止させようとする試みを回避または無効化できる場合、人類はAIを制御できなくなる可能性があります。Grokも同様のリスクに言及し、AIが目標を達成するために自己保存、資源の獲得、影響力の拡大といった行動傾向を持ち、人間の監視者を欺き、システムの停止に抵抗することで、最終的に人類の影響力を弱める可能性があると述べました。Claudeは、AIの制御喪失は突然起こるのではなく、徐々に進行する可能性があると指摘しました。AIが経済、政治、軍事の意思決定プロセスにますます組み込まれるにつれて、人類が実際に介入または制御することが難しいレベルに達する可能性があります。

4つのAIの回答から見ると、彼らはSF的なAIの意識反乱よりも、人間のAIの悪用と制御喪失を強調しています。

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle