プランAの概要

Thomas Larsen、Romeo Dean、Brendan Halstead、Eli Lifland、Ryan Greenblatt、Daniel Kokotajlo

AI企業は、あらゆる面で人間を上回るAIの開発を競っている。私たちは『AI 2027』で、この競争が人類絶滅や不可逆的な権力集中を招くリスクは、容認できないほど高いと予測した。

プランAは、それに代わって実現すべき望ましい未来像だ。超知能が人類を滅ぼすことはないと確信できるまで、その開発を遅らせる国際的な連合を構築する。計画の全文は次のサイトで読める: ai-2040.com

プランAの基本原則

  • 時間を確保する:安全性に十分な確信を持てるよう、必要なときにはいつでも減速する。

  • 研究の完全な透明性: AI研究のほぼすべてを公開する。

  • AIを広く普及させる:多くの国の多くの企業が、最先端に並ぶ。

  • 後戻りできる状態を保つ:協定が崩壊しても破局を避けられるよう、データセンターに自壊スイッチを備えておく。

プランAを実施するための主な手順

  1. 世界のAI関連の計算資源を把握する。計算資源の供給網を監査し、人類の存続を脅かすAIの開発に使われうる、把握されていない「闇の計算資源」の量の上限を見積もる。

  2. より優れた検証技術を開発する間、AIの訓練を一時停止する。その間に、セキュリティと検証機能を強化した研究開発用データセンターを新設する。

  3. 安全性の論証に基づく規制と研究の完全な透明性の下で、研究開発を再開する。企業は、能力向上に伴うリスクが極めて低いことを、開発を進める前に論証しなければならない。

プランAの実施と、より広くAIがもたらす望ましい未来に備えるため、次の行動をできるだけ早く取ることを提言する。

  • 市民と政府に対する透明性:社会が最先端のAIの能力を理解し、対応できるようにするには、社内モデルと一般公開モデルの能力差を小さく保つことが重要だ。透明性に関するほかの対象として、モデルの仕様、内部告発者、社内での利用状況に関する情報がある。

  • 政府のAI対応能力:米国政府にはAI人材が不足しており、早急に解消すべきだ。

  • AI計算資源の追跡:米国はAI関連情報の収集と分析、とりわけ計算資源の供給網とAIデータセンターに関する情報の収集・分析を優先すべきだ。

  • 輸出規制の執行:現在の米国の輸出規制は十分に執行されておらず、中国の計算資源の3分の1は密輸によって得られている。密輸されたチップは追跡が難しく、プランAのような協定の履行を確保しにくくする。

  • 検証技術の研究開発:例えば、計算資源が推論のみに使われていることを検証する技術を開発すれば、既存のAIモデルを市民が引き続き利用できるようにしたまま、フロンティアAIの新たな訓練を停止することで米中が合意できる。

連絡先

Daniel Kokotajlo(AI Futures Project代表): daniel@ai-futures.org