AI 2040

プランD

Thomas Larsen, Romeo Dean, Brendan Halstead, Eli Lifland, Ryan Greenblatt, Daniel Kokotajlo

AI企業は、あらゆる面で人間より賢いAIの開発を競っている。私たちは『AI 2027』で、その行き着く先は人類の絶滅か、後戻りできない権力集中のどちらかだと予測した1。

プランAは、そうならないために本来何が起きるべきかを描いた、私たちの前向きなビジョンだ。

このシナリオで人類は、超知能の開発を2040年まで遅らせ、AI研究をすべて公開し、世界の数十社が最先端に追いつけるようにし、計算資源の相互確証破壊という体制にあえて踏み込む。

プランAは、AIによる存亡の破局を人類が避け、繁栄する未来にたどり着くための、私たちの前向きなビジョンである。 米国の主要なフロンティアAI企業の専門家との対話、OpenAIでの実務経験、机上演習、そして政策立案者や国家安全保障の専門家、AI政策のリーダーとの議論をもとにしている。私たちが提言するのは、超知能をめぐる危険な開発競争を避けるための国際協定だ。協定の柱は、AI研究開発における研究の完全な透明性である。それによって世界各国は何が起きているかを把握し、歯止めを守らせることができる。その結果、複数の国の複数の企業が、秘密裏に競い合うのではなく、足並みをそろえてゆっくりと安全に超知能へとスケールしていく。

プランAは、主として予測ではなく提言である。 このシナリオは、未来が実際にどうなるかについての私たちの最善の推測ではない。政策提言を伝え、その強度を試すための手段だ。プランAが実施されること自体は提言であって、実際にそうなると予想しているわけではない。しかし、その後に描かれる影響は予測である2。

このAI 2040シナリオでは、プランAは不完全ながら、ぎりぎりのところで実施に成功する。

プランAの対照として、4つの代替案(B、C、D、S)も用意した。超知能という難題に米国がどう応じるか(あるいは応じないか)の主な道筋を、それぞれ描いたものだ3。

AI企業はおそらく、人間より賢いAIシステムを作るという公言どおりの目標を、今後1〜10年のうちに達成する。

業界は、超知能AIの制御など走りながら考えればよいと思い込んでいて、まともと呼べる計画をまるで持っていない。私たちはこの状況をひどいものだと考えているし、このままでは全員があっさり命を落としかねない4。「開発競争に勝った」者が大きなリードを得るとは思えないし、その勝者が存亡リスクを減らすために自ら減速するとも思えない5。この競争が続けば6、AIが超知能になったときに人間がそれを実効的に制御し続けられる見込みは薄い7。

さらに、AI企業がどうにかAIをアラインできたとしても、その結果は前例のない権力集中になる。ごく少数の人々、場合によってはたった一人が、世界で唯一の超知能の軍団を数か月にわたって事実上支配する。そして超知能たちは、今後どう進めるかについていくつもの選択肢を差し出す。その中には、事実上世界を乗っ取ることに等しいものも含まれる8。

私たちの推測する限り、OpenAI、Anthropic、xAI、Google DeepMindのCEOたちはこのことを理解したうえで、それでも突き進んでいる。自分たちはより小さな悪であり、習近平やライバルのCEOとは違って、この巨大な権力を責任をもって使うはずだと考えているのかもしれない9。

一般論として、より小さな悪を選ぶのが正しいという点には同意する。それでも、人類の絶滅や世界規模の独裁につながる確率がこれほど恐ろしく高い戦略を、私たちが支持すべきだとは思わない。私たちが訴えたいのは、本当に良いと言えるものだ。十分な数の人が同じように声を上げれば、それは実現しうる。

そこで、その実現しうる世界を描くシナリオを書いた。

「計画は無価値だが、計画することがすべてだ」――ドワイト・D・アイゼンハワー(Dwight D. Eisenhower)

AI政策の提案の多くは、シナリオによる精査にかけると崩れてしまう、と私たちは考えている。その提案が成功する詳細でもっともらしいシナリオを書き出そうとすると、それが意外に難しいことに気づく。そして、計画が思ったほどうまくいきそうにないことや、提唱者が認める以上に厄介な副作用があることが見えてくる。

AI政策の世界でシナリオによる精査がめったに行われないのは、そのせいかもしれない。誰もが、自分の推す政策は素晴らしい結果をもたらし、対立する陣営の政策はひどい結果をもたらすと言いたがる。自分の推す政策をシナリオで精査すれば、都合の悪い問題が浮かび上がりかねない。かといって、対立陣営の政策を精査するのは、手間がかかるわりに論戦で得るものが少ない10。

もっと多くのAI政策提案がシナリオによる精査にかけられれば、議論の質は上がるはずだ。だから私たちは、批判を招くのを承知のうえで、自分たちの提案から始める。批判する人には、AIへの移行を乗り切るための既存の計画のうち最良のもの(そんなものが見つかればの話だが)と比べて評価してほしい。誰も難しい選択を迫られないのに、たぶん万事うまくいく――そんな漠然とした心地よい空想と比べるのではなく。

超人的なAIに近づきつつある世界で、自分たちの政策がどんな効果をもつかを予測するのは途方もなく難しい。その点はどうなのか。これは第三次世界大戦の最善の戦い方を予測するようなもので、しかも過去の事例からの隔たりはそれ以上に大きい。それでも、試みる価値はある。米軍が台湾有事のシナリオを気の遠くなるほど細かく検討することに価値があるのと同じだ。ほかにも前例はある。情報機関、気候関連機関、パンデミック対策機関は、いずれもさまざまな形のシナリオ・プランニングに頼っている。

プランAは、何をすべきかについての私たちの野心的な提案だ。残された時間がどれだけあるのか分からない以上、これに近いものが早く実施されてほしいと願っている11。とはいえ、具体的なシナリオを書くには具体的なタイムラインが要る。

このシナリオのタイムラインは次のとおり。

  • 2029年、米国と中国は、超知能をめぐる無謀な開発競争を避けることで合意する。

  • 2030年、本来ならAI研究開発は完全に自動化されていたはずで、年末までに超知能に至っていた。協定のおかげで、それは避けられる。

  • 2030年から2035年にかけて、人間の能力の範囲内で、人間のトップ専門家とほぼ同等の能力をもつAIまでスケールする。

  • 2035年、人間による制御を保つため、人間のトップ専門家並みのAIの段階で一時停止する。

  • 2040年、一時停止を解除し、超知能までスケールする12。(題名の「AI 2040」はここから来ている)

以前のシナリオ『AI 2027』では、2027年にAIが、より賢いAIを作る工程を完全に自動化し、知能爆発を経て、その年のうちに超知能が生まれた。このシナリオとの違いは2つある。(1)何も手を打たなかった場合のデフォルトのタイムラインが2030年になったこと、(2)ガバナンス上の措置によって、全般的に超人的なAIが初めて現れるのが2040年になったことだ。

デフォルトのタイムラインを変えたのは、一連のシナリオ全体に、AIのタイムラインをめぐる私たちの不確実性を反映させたいからだ。 『AI 2027』の題名の年を選んだのは、執筆を始めた時点で、ダニエル・ココタイロ(Daniel Kokotajlo)が、事態がそれほど速く、あるいはそれ以上に速く進む確率をおよそ50%と見ていたからだ13。プランAの執筆を始めた時点で、トーマス・ラーセン(Thomas Larsen)にとってそれに当たる年が2030年だった。ダニエルは現在、このシナリオで描いたよりもいくらか速く事態が進む可能性が高いと考えている。 タイムラインに関する私たちチームの見解は、こちらとこちらで詳しく読める。

ガバナンス上の措置を変えたのは、このシナリオが主として予測ではなく提言だからだ。 全速力で知能爆発を進めるのは常軌を逸した無謀であり、権力を極端なまでに集中させる。

2027年:予兆

米国には今、2つの労働力がある。1つは人間で、その数は1億6,500万人。もう1つはAIエージェントだ。何百万ものコピーが毎時間立ち上げられては停止され、昼夜を問わず超人的な速さで働いている。

その仕事の大半は粗悪な出力にすぎない。それでも使えるものが十分にあるので、人々は月に100億ドルを払っている。少なくとも理屈のうえでは、従業員がコンピューターでできることなら何でもこなせるAIに対してだ。

AI企業には、何よりも自動化したい仕事がある。自分たち自身の仕事だ。まだ成功してはおらず、今のところ再帰的自己改善は起きていない14。だが着実に近づいているようで、しかも自分たちが上ってきたはしごを引き上げ始めている。最強のコーディングAIは、競合他社のAI研究開発には手を貸さないのだ15。最も強気な社員でさえ、予定より少し時間がかかっていると認める。その一方で懐疑派は、いつもの一蹴の言葉が空々しく響き始めていることに気づいている。AIには自分の仕事が絶対にできないと言える理由は、正確には何だったか? 越えられない壁って、何だっけ?

連邦議会が関心を強め始めている。 議員たちは以前からAIの話を耳にしてきた。データセンターが水を使いすぎていること16、チャットボットが自殺をそそのかしたこと、MythosがNSAのシステムをハッキングしたこと。そしてもちろん、テック業界のロビイストたちの警告もある。少しでも規制の気配があれば、米国はたちまち中国との競争に負け、その後の歴史をずっと中国共産党の朝貢国として過ごすことになる、と17。

いま議員たちは一歩引いて問いかける。私たちはこれでどこへ向かっているのか? 5年後、10年後、15年後の世界はどうなっているのか? 仕事はまだあるのか? なかったらどうなるのか?

とりわけ重くのしかかる問いがある。これだけのAIを、誰が制御するのか?

議会はその答えの重要な一部に行き着く。おそらく、自分たちではない。18

議会はAIをめぐって緊迫した公聴会を重ねる。議員たちは、デミス・ハサビス(Demis Hassabis)が独裁者になるのを防ぐためにOpenAIを設立した経緯を論じた、2016年のOpenAIのメールを読む19。では、サム・アルトマン(Sam Altman)やイーロン・マスク(Elon Musk)が独裁者になるのは、誰が防ぐのか? 既存の答えに議会は納得しない。

この目覚めから生まれたのが「2027年AI透明性法」だ。多くのことを盛り込んだ包括法案で、良い点も悪い点もあるが、状況を根本から変えるものではない20。

漸進的なAI政策の要望リスト

私たちの主な提言は、プランAのようなものの交渉をできるだけ早く始めることだ。しかしこのシナリオでは、プランAは不完全な形で、ぎりぎりのところで実現する。そこで、野心は控えめでも、なお役に立つアイデアを挙げておく。

2028年:選挙の争点はAI

2028年の選挙戦は、いつものように白熱している。最大の争点はAIだ。建設中のデータセンターの費用は、米国の軍事予算全体の2倍に達する23。

ホワイトカラーの職業の多くが、2026年にソフトウェアエンジニアリングが経験したような激変にさらされている。そうした仕事の中心は、今やAIエージェントの管理だ。AI企業は学習のプロセスを工業化した。経営陣が「今年は○○の分野に進出しよう」と言えば、会社はその職業の専門家に話を聞き、データを買い、学習環境を作り……と、AIが足場を築くまで続ける。するとAIは、その分野で広く使われて現実のデータを蓄積するにつれ、急速に改善していく。

ほかの国々は恐れと怒りを募らせ始めている。一握りの米中企業が、ホワイトカラーの仕事をすべて自動化しようとしているように見えるのだ。権力は米国に、なかでも大統領と一握りのテック企業CEOに集中しつつある。

AIの専門家たちは、知能爆発が近いと警告する。AIがAI研究を加速させればAIはさらに有能になり、研究はいっそう速まり、AIはさらに有能になる、という具合だ。この過程がどれだけ速く進み、どこで終わるかは、ボトルネックやハードウェアの限界をめぐる複雑な力学で決まる。だが、きわめて速く進み、とてつもなく遠いところまで行き着きそうに見える。

このまま進めば、次の大統領の任期中には、人間の水準をはるかに超えるAIが登場する。そのAIを作るのはすべてAIで、そのAIもまたすべて別のAIが作ったものであり、数世代前から人間はまったく関与していない。そうしたAIは従順で、アラインされているのか? なぜそう言えるのか? だとして、誰がそれを制御するのか? いったいどうすれば、これが良い結末を迎えるというのか?

人類をこの道に乗せたAI企業は、それで構わないと考えている。だが、ほとんどの人はそうは思わない。大統領は、自分のレガシーどころではなく、退任して世界が変貌したあと自分自身がどうなるかを考え始めている24。両候補はAIにどう対処するのかを繰り返し問われ、選挙運動のなかで、ますます大胆な案を試しに打ち出していく。議論は、以下に示すすべての選択肢のあいだを、さらにはそれ以外の案にまで揺れ動く。

最終的に、大統領とその後継と目される候補は一つの計画にまとまり、野党の候補は別の計画にまとまる。そして投票日を迎える。

2029年:道を選ぶ

「そうだ。実際それでいいし、 そもそもそうするしかない」
「は? いや、正気じゃない!」
「いや、しない」
「する」
「する。そして 中国も減速させる」
(ありうる多くの協定のうちの2つ)
中国より速く、AIに自己改善させ、より多くのもの(データセンター、工場、兵器)をAIに任せて、知能爆発を突き進む?
安全性とガバナンスのために、少なくとも多少は減速する?
中国と協定を結ぼう。でも、どんな協定を?

「AIはおそらく世界の終わりにつながる。だが、それまでのあいだに素晴らしい企業がいくつも生まれるだろう」――サム・アルトマン(Sam Altman)

大統領は、AIイノベーションを優先するため、AI規制は緩やかなものにとどめると表明する。

重大な問いに対する暗黙の答えは、どうやら次のようなものらしい。

  • 大手AI企業は減速するのか? しない。AI研究開発を自動化し、互いに競い合いながら知能爆発を突き進み、それを「責任あるスケーリング」と呼ぶ。超人的なAIは、市場と法律が許すのとほぼ同じ速さで、あるいは政府がお役所仕事を多少なりとも省ければそれ以上の速さで、あらゆるものに組み込まれていく。

  • 透明性は? ああ、おこぼれ程度ならどうぞ。各社には、長大なモデルカードの公開と、行政府や第三者監査機関への説明とアクセスの提供が義務づけられる。とはいえ、より広い科学界を招き入れてセーフティケース(安全性の論証)を批判的に検証してもらったり、アラインメント研究に加わってもらったりする必要まではない。そんなことをすれば機密性の高い知的財産が明るみに出てしまうので、論外だ。

  • 中国は? 人工超知能(ASI)で中国に勝たねばならない。心配はいらない。こんなことで戦争を始めるなど正気の沙汰ではないし、仮に始めたとしても、それならなおさら、より優れたAIを軍に組み込む必要がある。

その結果は、おおよそこのようになる。

AIによるソフトウェア研究開発の加速倍率(現在比)1×10×100×1,000×10,000×202620272028202920302031自動コーディングAI2030年初め · 5×超人的AI研究者2030年半ば · 25×人間のトップ専門家を凌駕するAI2030年末 · 250×超知能AI研究者2030年末 · 2,000×人工超知能2031年初め · 10,000×
競争下のテイクオフ:AI研究開発の加速倍率(aifuturesmodel.com) - ai-2040.com

つまりこういうことだ。1年後の2030年、AI企業はAI研究開発の完全自動化に成功する。知能爆発が始まり、2031年の初めには超知能が登場する。

それはどんな姿になるのか。この先どうなるのか。実は、それについてはすでにシナリオを書いている。『AI 2027』だ。そこではテイクオフが2030年ではなく2027年に起きるが、戦略的な状況も、下される選択も非常によく似ている。ぜひ今読んでみてほしい。分岐点に来たら、「競争」エンディングを選んでほしい。

プランDはひどい計画だと、私たちは考えている。主な理由は三つある。

第一に、AI企業がほぼ全速力で競争するなら、知能爆発のさなかに自社のAIを制御し続けられるとは思えない47。

第二に、万一その見立てが外れ、できあがった超知能がしっかりとアラインされていたとしても、「誰に対してアラインされているのか?」という問いが残る。この問いに対するプランDの答えは、受け入れがたいものだと私たちは考えている。CEOや大統領がAGIを後ろ盾に独裁者となる誘惑にかられる機会が、あまりにも多すぎる。もっと広く言えば、この計画は史上類を見ないほど常軌を逸した権力集中を招きそうだ。

最後に、第三次世界大戦のリスクが高すぎる。プランDのもとで、中国はどう受け止めればいいのか。ロシアは? インド、ヨーロッパ、ブラジルは? どの国もいずれ、米国が知能爆発を起こそうとしている、あるいはすでに起こしつつあると気づく。そして、その先に起こることを恐れる。ミスアラインメントやAGI独裁を心配していない国でも、米国に経済的・軍事的に支配されることは心配するだろう。

緊張は一気に高まる。エスカレーションの可能性は高い。非難の応酬、制裁、妨害工作、そして(協定が結ばれなければ)最終的には、おそらく戦争へ。

プランAを読む