計算資源予測

Romeo Dean|2025年4月

訓練の実行訓練計算量(FP16のFLOP、対数目盛)GPT-4 (2e25)GPT-4.5 (2e26)GPT-4の1000倍(2e28)2024年12月2025年6月2025年12月2026年6月2026年12月2027年6月2027年12月10^2510^2610^2710^28Agent-1Agent-0Agent-2Agent-3Agent-4
ai-2027.com

図1:AI 2027に登場する訓練ラン。その想定は、本補遺の計算資源の生産、計算資源の配分、計算資源の用途の各節を根拠にしている。

概要

計算資源は、AIの進歩を左右する主要な投入要素の一つである。この補遺ではAI関連の計算資源だけを扱う。補遺全体を通じてH100換算(H100-equivalents、H100e)という単位をたびたび使う。これは、AI関連の計算資源の処理性能を、NvidiaのH100 GPU何台分にあたるかに換算したものである。処理性能が最も直接に関係するのは訓練計算量だが、推論計算量のよい代理指標にもなる。

第1節では、サプライチェーンのボトルネックを調べてAI関連の計算資源の生産をモデル化する。そのうえで、世界で利用できるAI関連の計算資源は、2025年3月と比べて2027年12月までに10倍に増え(年2.25倍)、1億H100eに達すると見積もる。

チップの効率
1.35x
チップの生産量
1.65x
世界のAI計算資源
2.25倍/年
効率×生産量の複合効果
2025年3月 1000万H100e
2027年12月 1億H100e
= 1M H100e
ai-2027.com

図2:AI関連の計算資源の世界全体の保有量は、2027年12月までに10倍に増えると予測する。

第2節では、関係する主体のあいだで計算資源がどう配分されるかをモデル化し、計算資源の所有者と、計算資源を借りるか自ら所有して使うエンドユーザーの両面から内訳を示す。計算資源の利用は、トップクラスのAGI企業(OpenAI、Anthropic、xAIなど)と、大手テック企業内部のAGI開発部門(Google、Metaなど)に集中していくと予想する。そのうち上位2〜3社は、2027年末までにそれぞれ世界で利用できるAI計算資源の15〜20%(約1500万〜2000万H100e)を占めるようになる。現在のシェアは5〜10%(約50万H100e)である。

AI企業別の計算資源の内訳2024年の推定値と2027年の予測値(H100換算)0M5M10M15M20M25MOpenBrainAGI開発で米国2位AGI開発で米国3位AGI開発で米国4位米国のその他とAGI開発以外DeepCent中国のその他とAGI開発以外世界のその他7%6%5%5%49%1%11%14%20%16%14%9%20%10%2%9%2024年12月の推定値2027年12月の予測値
ai-2027.com

図3:AI関連の計算資源の世界的な配分は、トップクラスのAI企業に集中していく(世界の計算資源保有量に占める各社のシェアはおよそ3倍になる)と予測する。中国は世界の計算資源に占めるシェアをほぼ一定(約12%)に保つが、それを単一の国家的AI開発に集約していく。

世界の計算資源
2.25x
世界に占める割合
1.5x
首位のAI企業の計算資源
3.4倍/年
世界の計算資源×シェアの複合効果
2024年12月 50万H100e
2027年12月 2000万H100e
= 125K H100e
ai-2027.com

図4:首位のAI企業が使える計算資源は、2027年12月までに40倍に増えると予測する。そのうち約10倍は世界のAI関連計算資源の保有量の増加により、約4倍は保有量全体に占める同社の利用シェアの拡大による。

世界のAI計算資源と首位企業のシェアH100換算(対数目盛)年2.25倍年3.4倍2023年12月2024年12月2025年12月2026年12月2027年12月100K1M10M100M世界のAI計算資源米国の首位企業
ai-2027.com

図5:2027年12月までの、世界の計算資源の増加傾向(年2.25倍)と、首位のAI企業が使うシェアの拡大(年1.5倍)。両者を掛け合わせると、首位のAI企業の計算資源は年3.4倍で増える。FLOPの数値はモデルFLOP利用率40%を前提とする。

第3節では、トップクラスのAI企業が自社の計算資源をどう使うと予想されるかを述べる。事前学習と外部展開から、事後学習、合成データの生成、社内展開(つまり研究の自動化と研究用の実験)へと重心が移っていく。首位のAI企業の中では、計算資源の用途が研究の自動化に集中していくと予測する。AIの実行そのものに使われる割合は比較的小さく(5〜10%)、合成訓練データの生成(20%)と、AIに与える潤沢な研究実験用の計算予算(35%)が大きな割合を占める。実際の訓練ランと外部展開が占める割合はより小さい(20%)が、絶対量で見れば、それぞれに使われる計算資源は依然として2024年の20倍を超える。

OpenBrainの計算資源の配分(2024年と2027年)20242027推定値予測値研究のための実験 訓練データ生成外部展開研究のための実験AIアシスタントの稼働訓練データ生成外部展開
ai-2027.com

図6:計算資源の用途は研究の自動化へ集中していく。データ生成も増える。

第4節では、2027年に予想されるAI研究の自動化について推論計算量を分析し、運用されるAIモデルのコピー数と速度を見積もる。2027年末までにアルゴリズムの効率が大きく進歩すれば、首位のAI企業は計算資源の6%を使い、主に推論専用チップによって、人間の50倍の思考速度(毎秒500語)で動く超知能AIのコピーを約100万体運用できるようになると予想する。

研究自動化における展開のトレードオフ2027年3月2027年6月2027年9月速度(トークン/秒)並列コピー数101001,00010,00010K100K1M10M20万コピー人間の30倍の速度30万コピー人間の50倍の速度人間の思考速度毎秒10語人間の10倍の思考速度人間の100倍の思考速度
ai-2027.com

図7:推論専用チップを使った、2027年の研究自動化のためのAI研究アシスタントの運用見込み。緑の線は、首位のAI企業のH100e計算資源の6%を使う場合を示す。

第5節では、2027年までの首位のAI企業について、訓練ラン、総費用、総収益、総電力使用量の予測を具体的に見る。収益と費用の伸びはどちらも年約3倍と予測する。首位のAI企業の電力使用量は2027年12月までに約10GWに達し、米国の電力容量の約0.8%を使うことになる。AI全体では世界で60GW、米国で50GWを使い、これは予測される米国の電力容量(現在の1.28TWから増えて1.35TW)の約3.5%にあたる。

世界のAI設備投資
2兆ドル
稼働中の計算資源の保有コスト

2027年の主要指標

世界のAI電力
60GW
ピーク電力
OpenBrainの売上
1400億ドル
2027年通年
設備投資の総額
4000億ドル
OpenBrainの稼働中の計算資源の保有コスト
米国の電力に占めるAIの割合
3.5%
総容量1.35TWのうち50GW
OpenBrainの計算資源コスト
1000億ドル
2027年通年
OpenBrainの必要電力
10GW
ピーク電力
ai-2027.com

図8:第5節の予測のまとめ。

すべての推計は公開情報にもとづいているが、公開情報は乏しく不確かである。大まかに言えば、第1節と第2節は比較的根拠がしっかりしており、AI 2027のシナリオからも独立している。一方、第3節・第4節・第5節は、AI 2027で起こる急速なAI能力の向上をはるかに強く前提にしている。

第1節:計算資源の生産
計算資源はどれだけ生産されるのか?
計算資源の生産
第2節:計算資源の配分
計算資源は誰の手に渡るのか?
OpenAI
Google
Anthropic
その他
第3節:計算資源の用途
何に使われるのか?
訓練
外部展開
社内
第4節:推論計算資源
社内エージェント
第5節:業界の指標
売上
コスト
電力

謝辞:David Schneider-Joseph、Erich Grunewald、Konstantin Pilz、Lennart Heim、Mauricio Baker、Tao Lin。

はじめに

計算能力は、AIの進歩を左右する主要な投入要素の一つである。AIの訓練と推論に使われる計算の大半は並列に実行できる。AIチップ(AIアクセラレータ)は、こうした並列計算を特に効率よくこなす計算装置(GPUなど)であり、そのためAIの計算処理ではCPUのような従来型プロセッサよりはるかに高い性能を発揮する。

実際、この補遺で扱うのはAI関連の計算資源だけである。これは具体的には、総処理性能(Total Processing Performance、TPP)が4,000以上、かつ性能密度(Performance Density, PD = TPP / ダイサイズ)が4以上を達成できる計算ユニットと定義する。この基準は、2021年時点のNVIDIAの最先端チップであるA100 SXM GPUをわずかに下回るように設定した。参考までに、NvidiaのH100 GPUの公称値はTPP約15,800、PD 19.4である。直感的には、この定義は「H100の少なくとも¼の効率があるものはすべて数に入れる」と考えればよい。

補遺全体を通じて、AI関連の計算資源の単位としてH100換算(H100e)をたびたび使う。これは、計算の処理性能(TPP)を、H100の処理能力(約15,800 TPP)の何台分かに換算したものである。TPPに注目するため、本補遺の分析が最も直接に関係するのは訓練計算量だが、推論計算量のよい代理指標にもなる。ただし、研究エージェントを動かすための推論計算量を扱う節では、TPPではなくメモリ帯域幅で計算する。

第1節:計算資源の生産

確度:不確実だが、根拠はある。この節は公開情報にもとづく、根拠のある予測である。

チップの効率
1.35x
チップの生産量
1.65x
世界のAI計算資源
2.25倍/年
効率×生産量の複合効果
2025年3月 1000万H100e
2027年12月 1億H100e
= 1M H100e
ai-2027.com

図9:計算資源の生産予測のまとめ。

世界のAI関連計算資源の総保有量は、今後3年間で年2.25倍に伸び、現在の1000万H100eから2027年末までに1億H100eに達すると予想する。この推計では、H100eで測った計算資源の総量の伸びを、(A)チップの効率の向上と(B)チップの生産量の増加に分解する。それぞれの基準となる伸び率は1.35倍と1.65倍である。

20232024202520262027
生産される平均的なチップの性能密度(PD)の倍率(H100 = 1倍).66x.9x1.22x1.64x2.4x
生産されるAIチップの総面積(H100サイズのチップ = 1)3M5.5M9M16M25M
生産されるAIチップの総量(H100eの処理性能(TPP)換算)2M5M11M25M60M
利用可能なH100eの累計4M8.5M18M40M100M
H100eあたりの総所有コスト$50k$40k$25k$20k$15k
AIデータセンターへの総支出$110B$270B$400B$600B$1T
H100eあたりのデータセンター総所要電力1.3kW1.0kW750W700W550W
AIデータセンターの総所要電力5GW9GW15GW29GW62GW

スプレッドシートのモデル全体も参照のこと。

チップの効率

チップの効率(性能 / 面積)の向上については、Epoch AIが示した年1.35倍という過去の傾向を外挿した。この値は、NVIDIAのGB200のように今後登場するチップについてすでに報じられている性能とも、以下で詳しく述べるRubinシリーズの噂されている計画とも整合する。

性能に比例
ダイサイズに比例
H100
(1 x 10^15 FLOP/s)
B200
(2.5 x 10^15 FLOP/s)
R200*
(6 x 10^15 FLOP/s)
2023
2025
2027
*見込み
ai-2027.com

2024年に広く採用されている最先端のGPUはNVIDIAのH100で、素の性能はFP16で1e15 FLOPである。3年後に広く採用されている最先端のGPUは、NVIDIAのRubin GPU(R200)になると予測する。R200は、B200(2025〜2026年に広く使われる)の約2.4倍に向上し、FP16で6e15 FLOPの性能に達すると見込む。この向上は、ダイサイズの1.2倍の拡大、TSMCのN4プロセスからN3プロセスへの移行による1.7倍、その他の細かな改良による1.1倍によって実現すると考える。

効率の向上とダイサイズの拡大を混同しないよう、H100からR200への最先端GPUの性能の向上(全体で6倍)から、両チップ間のダイサイズの拡大(約2.4倍)の分を差し引く必要がある。すると、今後3年間のチップの効率の向上は全体で2.5倍となり、年1.35倍という過去の傾向と一致する。最先端のNVIDIA GPUの傾向は、毎年利用できる平均的なGPUの傾向のよい代理指標になると仮定する。その理由は、NVIDIAのGPUがチップの大半を占めるからというだけではない。他の人気チップ(GoogleのTPUシリーズなど)の性能も、TSMCの製造プロセスの進歩のように、相関の強い上流の要因に左右されるはずだからである。

チップの生産

AIチップ生産予測のまとめ(2025〜2027年)チップ製造チップ設計生産量1.6倍、割合1倍生産量1.1倍、割合1.5倍生産量1.6倍、割合1倍SK HynixMicronSamsungTSMCその他TSMCその他NvidiaGoogleAmazonAMDHBMウェハーパッケージング凡例AI関連AI以外
ai-2027.com

図10:チップ生産モデルのまとめ。

チップの生産量の増加については、生産を左右する3つの主要な要素にさらに分解する。(B.1)ウェハーの生産(主にTSMCのN5・N3プロセスが担う)、(B.2)先端パッケージングの生産能力(これも主にTSMCのCoWoS技術が担う)、(B.3)広帯域メモリ(HBM)(主にSK Hynixが供給し、MicronとSamsungの供給も増えている)である。

2023年にNvidiaが出荷したのは120万H100eで、これがAI計算資源市場全体の約60%を占めたと推計する。残りの大半は、Broadcomの支援を受けたGoogleの自社製TPUの生産による。合計すると、2023年は200万H100eになる。2024年には500万H100eに増え、やはりその約60%をNvidiaが占めたと見込む。

主にTSMCとSK Hynixの生産量に注目する。両社はそれぞれの市場で約90%と約60%のシェアを占めており、市場の残りの部分も同様の傾向をたどると予想するからである。全体として、今後3年間のAIチップの生産は、先端パッケージングとHBMの生産がボトルネックとなり、年約1.65倍に抑えられると予測する。

ウェハーの生産

NvidiaのBlackwell世代のGPUには、TSMCの4Nノード(N5プロセスの一種)が採用された。2026年後半に量産が始まると見込まれるRubin GPUには、おそらくN3プロセスが使われる。2023年にAIアクセラレータが使ったのは、TSMCのN5とN3の生産ライン全体のうち、おそらく多くて3%である。これらの生産ラインは稼働率がわずか70%にとどまることもあると報じられており、今後3年間にウェハーの生産がAIチップ生産のボトルネックになる可能性はきわめて低い。たとえAIチップの生産量が毎年倍増しても、新たに稼働する生産能力(年約15%の拡大)を考えに入れなくてさえ、2027年までにAIチップの生産が製造能力の約40%を超えることはないはずである。ただし、2027年より先には、ウェハー生産の限界によって、チップ生産の伸びが年1.65倍から約1.25倍へ鈍ると予想する。

先端パッケージング

AIアクセラレータには、AIの処理に必要な高いスループットを実現するため、ロジックとメモリを高密度に接続する先端パッケージングが欠かせない。現在、TSMCの先端パッケージングの生産能力は大半がAIアクセラレータに使われており、2023年から2024年にかけて2.5倍に拡大したと報じられている。TSMCはAI需要の伸びを年50%と見込んでいるので、これらの生産ラインをそれほど積極的には拡大しないだろうと予想する。実際、TSMCは2026年まで生産能力を年1.6倍で増やす計画を発表している。とはいえ、2024年に約2.5倍の拡大が見られたことから、生産量そのものの拡大は予想を上回り、年約2倍で続くと見込む。一方で、チップの効率を高めるには、製造プロセスの難しさも予想を上回るほど増していく(具体的には3Dパッケージングや、その先の技術への移行)。そこで、生産能力そのもの(難度の上昇を無視したもの)は年2倍で伸びるとモデル化したうえで、製造の難しさ(歩留まりの低下や、新たな要件に合わせた生産ラインの変更など)の分として年1.2倍を差し引き、今後3年間の伸びを全体で年1.65倍とした。

広帯域メモリ

AIの処理は大量のメモリを必要とし、高価で高速な広帯域メモリ(HBM)を要する。HBMの生産は、複数のDRAMチップを精密に積み重ねて接続する高度な工程である。SK Hynixはこの技術を最初に開発し、最新世代のHBM3eを最初に生産している。MicronとSamsungも追い上げており、HBM4以降の世代でSK Hynixと競えるロードマップを描いている。HBMの生産ラインは、2024年に2023年比で2.5倍に拡大されたと報じられているが、SK Hynixは今後の需要の伸びを1.6倍としか見込んでいない。先端パッケージングと同様に、HBMの生産(難度の上昇を無視したもの)はこの見込みを上回って年2倍で伸びると予想する。ただし、ここでも製造の難しさの増加(特に8-Hiから12-Hi、16-Hiの積層への移行)を考えて1.2倍を差し引き、今後3年間の伸びを年1.65倍とする。

ハードウェア研究開発の自動化

AIの能力全般と、AI研究開発についての私たちの予測に沿って、2027年にはトップクラスのAI企業が専用チップの設計を自動化し、自社でのチップ生産を増やすと予想する。そうした野心の兆しはすでに見えている。たとえばOpenAIは、実績豊富なGoogle TPUの設計者を採用し、2025年に初の自社チップを設計する計画を立てている。とはいえ、チップの効率を年1.35倍で高め続けることはますます難しくなっている。また、研究の自動化は主に別の方面に向けられると私たちは予想している。そのため、こうした取り組みの大半は平均的なチップの効率をわずかに押し上げる程度にとどまり、平均効率はH100の2.4倍(基準となる傾向どおりなら2.2倍)になると予想する。その押し上げは主に、推論に特化したチップの生産の波によってもたらされる。

第2節:計算資源の配分

確度:不確実だが、根拠はある。この節は、限られた公開情報にもとづく、根拠のある予測として読んでほしい。

最終利用者別の計算資源の内訳(H100e)OpenAIGoogleのAGI開発Googleのその他Metaのその他米国のその他中国のその他世界のその他OpenAIAnthropicGoogleのAGI開発xAIMetaのAGI開発米国のその他中国のAGI開発世界のその他0.5M0.6M1.3M0.7M2.0M1M1.5M20M14M16M9M7M10M10M9M20242027推定値予測値
ai-2027.com

図11:計算資源のエンドユーザーへの配分予測のまとめ。

この節では、2027年までについて、世界のAI関連計算資源のうち計算資源の提供者が所有するシェアと、エンドユーザーが利用するシェアを予測する。計算資源の所有者とは、AI計算クラスターを所有・運用する主体である。エンドユーザーとは、自らのAI処理のために計算クラスターを使う主体である。提供者とエンドユーザーを兼ねる場合もある(Google、Meta、xAIなど)。一方、所有者が計算資源の大半を他の主体に貸し出す場合もある(MicrosoftがOpenAIに、AmazonがAnthropicに、OracleがOpenAIに貸し出す場合など)。所有者とエンドユーザーは、次の網羅的な分類で整理する。

関係する主体の分類

所有者エンドユーザー
MicrosoftOpenAI
GoogleAnthropic
AmazonGoogleのAGI開発
MetaGoogleのその他
xAIMetaのAGI開発
OracleMetaのその他
中国の大手4社(Bytedance、Alibaba、Tencent、Baidu)xAI
首位のAI企業中国のAGI開発
米国のその他米国のその他
その他の国々その他の国々

私たちの予測では、トップクラスのAI企業が持つAI計算資源は、絶対量で見て2024年12月と比べ2027年12月までに20〜40倍になる。そのうち10倍は、すでに述べた計算資源の利用可能量の増加による。3倍は、トップクラスのAI企業とそのAGI開発部門へ計算資源の集中が進むことによる。

計算資源の所有者

近年の状況

計算資源の生産の節では、世界で利用できるAI関連の計算資源を、2023年末に400万H100e、2024年末までに850万H100eと推計した。Epoch AIによる先行研究(Can scaling continue through 2030? の付録B)は、2024年初めの時点でMetaとMicrosoftがそれぞれ15万〜60万H100e、GoogleとAmazonがそれぞれ40万〜140万H100eを保有していたと推計している。2024年初め(2023年12月31日)についての私たちの点推計は、公開情報が乏しいため不確かだが、Epoch AIの推計幅の中ほどに収まり、重なり合う複数の情報源とも整合する。2024年の生産量と購入量についてのこの報道をもとに、その結果として生じる2024年12月時点の配分を推計した。

計算資源の所有者別の内訳の推移推定値(H100e)0K500K1000K1500K2000KMicrosoftGoogleAmazonMetaxAI米国のその他中国の大手4社世界のその他300K800K600K450K10K500K300K450K1.1M1.8M1.3M1.0M200K1.4M800K800K2023年12月2024年12月
ai-2027.com

図12:計算資源の所有者ごとの、AI計算資源の内訳の推計(H100e、過去の実績)。

Omdia(Financial Timesの報道による)によれば、2024年にAIサーバーへの支出が多かった米国企業の上位5社は下表のとおりである。あわせて、各社が取得したH100eの量と、そこから求めたH100eあたりの支出額の私たちの推計も示す。Googleの支出効率が高いのは、すでに第6世代に達した自社製TPUがあるからである。AmazonとMetaにも本格的な自社設計のチップがあるが、研究開発の段階はまだ早い。MicrosoftとxAIが購入したのは、ほぼすべてNvidiaのチップである。

2024年のAIサーバーへの支出2024年のH100e増加量(2023年比)H100eあたりの支出
Microsoft$32B800K$39k
Amazon$26B700K$37k
Google$22B1M$22k
Meta$20B550K$36k
xAI$7B200K$37k

2025年の中間予測

2025年のAIサーバーへの支出(予測)2025年のH100e増加量(2024年比)2025年のH100eあたりの支出
Microsoft$56B2.4M$23k
Amazon$48B2.2M$22k
Google$44B2.2M$20k
Meta$35B1.6M$22k
xAI$30B1.3M$23k

2025年の計算資源の配分を予測するため、AIへの支出額が多い米国の上位5社と、2024年に各社の支出のうちAIサーバーが占めた割合を調べた。結果は次のとおりである。

計算資源の所有者別の内訳の予測予測値(H100e)0M5M10M15M20MMicrosoftGoogleAmazonMetaxAI米国のその他中国の大手4社世界のその他首位のAI企業3.5M4M3.5M2.6M1.5M2M1.5M1.3M7.5M7.5M6.5M4.6M4M4M3.5M2.5M1.5M18M18M18M9M9M9M8M5M6M2025年12月2026年12月2027年12月
ai-2027.com

図13:計算資源の所有者ごとの、AI計算資源の内訳の予測(H100e)。

2027年の予測

所有者別の計算資源の内訳(H100e)MicrosoftGoogleAmazonMeta米国のその他中国の大手4社世界のその他MicrosoftGoogleAmazonMetaxAI米国のその他中国の大手4社世界のその他首位のAI企業1.1M1.8M1.3M1M1.4M0.8M0.8M18M18M18M9M9M9M8M5M6M20242027推定値予測値
ai-2027.com

図14:AI計算資源の所有者別シェアの予測(値はH100e)。

計算資源の生産の節では、2027年までに利用可能な計算資源の総量が1億H100eに増えると見込んだ。これは年2.25倍の増加にあたる。これほど爆発的な伸びがあれば、計算資源の配分はたやすく塗り変わると考えるべきだろう。この伸びを牽引するのは、エンドユーザーであるAI開発企業からの持続的な需要だと予想する。これらの企業は、自社のAIモデルで年間数百億ドル規模の収益を上げはじめる。

私たちの予測は次のとおりである。

  • Microsoftは(OpenAIとの関係に後押しされて)積極的に規模を拡大し、世界の計算資源に占めるシェアを13%から18%に伸ばす。

  • Googleはすでに計算資源に余力があるため拡大のペースが遅く、計算資源のシェアは21%から18%へわずかに下がる。

  • Amazonは積極的に規模を拡大する。Anthropicからの持続的な需要と自社のAI事業が積極的な設備増強を正当化し、シェアは18%までじわりと上がる。

  • Metaの12%のシェアは9%に下がる。主にオープンソースで公開しているAIモデルからの収益が伸び悩み、2026年と2027年に他社と同じほど積極的な設備増強を正当化できないからである。ただし、それでもMetaの計算資源は絶対量で110万H100eから750万H100eへと7倍に増える。

  • xAIは積極的に規模を拡大する。そこそこのAI収益とElon Muskの後ろ盾に支えられ、ハードウェアへの設備投資の総額は2027年までに約1000億ドルに達し、計算資源のシェアは2%から9%に伸びる。

  • 米国のその他には、OracleやCoreweaveのような比較的大きな事業者のほか、小規模な提供者や所有者が含まれる。これらはいくぶん押しのけられ、大手と同じほど積極的に規模を拡大する経済的な動機もやや弱い。全体として、米国のその他のシェアは18%から9%に下がる。

  • 中国の大手4社は、輸出規制のために、AI計算資源の確保にやや苦労するようになる。ただし、中国の国内生産が拡大し、Nvidiaにおよそ3年遅れる品質のチップを大量に生産する。それでも、米国の輸出規制は相変わらず十分に執行されないため、大手4社のシェアは9%から8%へわずかに下がるだけである。また、他の中国企業へも大量に密輸されるため、中国国内の計算資源の総量はこれよりかなり多くなる。SMICを通じた国内生産も拡大するが、効率では数年遅れている。

  • その他の国々も、米国の小規模事業者と同様の理由でいくぶん押しのけられ、シェアは9%から5%に下がる。

  • 最後に、将来の「首位のAI企業」は、2026年の終盤から2027年にかけて自社のデータセンターを建設すると決めると予想する。これは、同社の収益が2026年末までに年換算で500億ドルに達し、そのAI能力が2027年に自社専用GPUの開発を後押しすることと整合すると考える。全体として、同社は約900億ドルの支出で、世界のAI計算資源の約6%を効率よく取得すると予測する(自社チップ設計の研究開発費は含まない)。

計算資源のエンドユーザー

近年の状況

  • OpenAIの最近の費用に関する報告によれば、同社は2024年を通じて平均約25万台のH100を借りている。後半ほど多く、年末には46万台に達すると予想する。主な供給元はMicrosoftで、OracleやCoreweaveとの契約も使っている。これにより、年末時点でOpenAIのシェアは世界全体の850万H100eのうち約5%になる。

  • Anthropicの計算資源の利用は、収益とユーザー数がより少なく、そのため資金へのアクセスも限られることから、やや少ない4%と見込まれる。年末までに約36万H100eを利用できると予想し、その多くは最近Amazonが提供した40万基のTrainium2クラスターによるものである。

  • xAIは拡張中の20万台のH100クラスターを持ち、シェアは2%になる。

  • GoogleとMetaのAI計算資源は、それぞれ世界の21%、13%を占める。ただし、AGI開発に使われるのはこれらのクラスターの約30%にとどまると予想する。GoogleとMetaのAI計算資源の残りの大半は、世界中で使われる膨大な数の推薦アルゴリズムの開発と運用に充てられている。

  • AmazonとMicrosoftの残りの計算資源や、ネオクラウド、小規模な提供者の計算資源に対するクラウドサービス需要の大半は、米国のその他とその他の国々の企業やスタートアップが使うと予想する。シェアはそれぞれ約20%になる。

  • 中国は、中国の大手4社が所有する計算資源の実質的にすべてを使うと予想する。さらに、「その他の国々」の区分が所有する計算資源の約半分も使う。この区分の計算資源の多くはマレーシアとシンガポールに集中しており、それらはおそらく中国によって使われている(あるいは中国へ直接密輸されてさえいる)からである。これにより、中国の計算資源の利用は合計で14%と推計される。2024年後半にはそのうち20%がAGI開発に充てられると予想し、中国のAGI開発のシェアは合計で3%になる。

2027年の予測

この節では便宜上、2027年の首位のAI企業をOpenAIと仮定する。したがって、ここでの予測は、OpenAIが首位のAI企業であり続けるシナリオで計算資源の内訳がどうなるかを示す一例にすぎない。 **

最終利用者別の計算資源の内訳(H100e)OpenAIGoogleのAGI開発Googleのその他Metaのその他米国のその他中国のその他世界のその他OpenAIAnthropicGoogleのAGI開発xAIMetaのAGI開発米国のその他中国のAGI開発世界のその他0.5M0.6M1.3M0.7M2.0M1M1.5M20M14M16M9M7M10M10M9M20242027推定値予測値
ai-2027.com

図15:AI計算資源のエンドユーザー別シェアの予測(値はH100e)。

  • OpenAIとAnthropicはどちらも積極的に規模を拡大する。それが出資者であるMicrosoftとAmazonの積極的な設備増強を促し、やがて両社は自社のデータセンターもいくつか所有するようになる。世界のAI計算資源に占めるOpenAIの利用シェアは、2024年末の5%から20%へと跳ね上がり、Anthropicは4%から14%になる。

  • xAIは、計算資源の所有者の項で説明した自社所有の計算資源をすべて使い続けるため、利用シェアも2%から9%に伸びる。

  • GoogleとMetaは、今や計算資源のそれぞれ90%と80%をAGI開発に充てる。そのため、GoogleのAGI開発のシェアは6%から16%に、MetaのAGI開発のシェアは4%から6%に伸びる。

  • 中国の計算資源の総シェアは約13%にとどまるが、AGI開発に充てる割合が40%から90%に上がるため、中国のAGI開発のシェアは2%から12%に伸びる。

  • 最後に、提供者の項と同様の理由で、米国のその他とその他の国々のエンドユーザーは押しのけられ、利用シェアはそれぞれ23%から11%、18%から11%に下がると予想する。

計算資源の最終利用者別の内訳の予測予測値(H100e)0M5M10M15M20MOpenAIAnthropicGoogleのAGI開発Googleのその他xAIMetaのAGI開発Metaのその他米国のその他中国のAGI開発中国のその他世界のその他2.0M1.3M2.2M1.8M1.5M1.3M1.3M3.6M404K1.6M2.6M6.0M4.0M5.6M1.9M4.0M3.2M1.4M5.2M2.2M1.8M4.6M20M14M16M2M9M7M2M10M10M2M9M2025年12月2026年12月2027年12月
ai-2027.com

図16:AI計算資源のエンドユーザー別内訳の予測(H100e)。

第3節:計算資源の用途

確度:探索的で不確実。この節は根拠のある予測ではなく、最善の推測である。

OpenBrainの計算資源の配分(2024年と2027年)20242027推定値予測値研究のための実験 訓練データ生成外部展開研究のための実験AIアシスタントの稼働訓練データ生成外部展開
ai-2027.com

図17:計算資源の用途予測のまとめ。

首位のAI企業の社内での計算資源の用途の内訳は、次のようになると予想する。根拠は、現在の用途についての公開情報と、今後の開発・展開・研究の優先度の相対的な変化についての、知識にもとづく推測である。この節の残りでは、次の表の値を1行ずつ根拠づけていく。

202420252026Q1 ‘27Q2 ‘27Q3 ‘272027年第4四半期(競争)
計算資源の総使用量と費用期間中に使われた計算資源の平均 (H100e)250K1M4M7M9M12M15M
→ 期間中の計算資源への支出$5.4B$12.5B$30B$20B$25B$30B$45B
→ fp16 FLOP換算の計算予算(利用率30%)2.5e271e284e282e282.5e283e284e28
内訳
訓練1) 訓練ラン40%40%40%30%27%22%20%
→ 事前学習の割合60%50%40%10%8%5%5%
→ 事後学習40%50%60%90%92%95%95%
社内の処理2) 合成データの生成20%20%20%27%23%22%22%
3) 研究実験4%5%6%14%21%28%35%
4) 研究の自動化1%3%4%6%6%6%6%
社内の合計25%28%30%47%51%57%63%
→ 能力向上の割合95%96%97%97%97%97%97%
→ アラインメントの割合5%4%3%3%3%3%3%
外部向けの推論5) 外部展開33%30%28%20%19%18%13%
その他6) 監視2%2%2%3%3%3%4%

計算資源の総使用量と費用

これらの行は、計算資源の生産と配分についての全体的な予測にもとづき、世界の計算資源の利用に占めるシェアが2024年から2027年にかけて約5%から約20%に伸びる、典型的な首位のAI企業を描いたものである。それらの節では、首位のAI企業が使うAI計算資源は年3.4倍で増え、計算の価格性能比(FLOP/$)はおおよそ年1.4倍で向上すると予測した。費用の予測について詳しくは財務の節を参照のこと。

訓練ランへの計算資源の使用

2024年、OpenAIは計算資源の平均40%を訓練に使ったと推計する。そのうち大部分(約60%)は次世代の事前学習ランへの規模拡大の試みに、残り(約40%)は推論能力とエージェント性に重点を置いた、強化学習による事後学習に使われたと予想する。これは、fp16で約3e26 FLOPの事前学習ランを1回実施したこと(H100 10万台を4か月使うことに相当し、過去のスケーリングの傾向と一致する)と、平均10万台のH100を強化学習の処理に2.5か月使ったことと整合する。OpenAIは約10万台のH100からなる単一のクラスターを比較的集中的に使えるようだ。一方で、計算資源をCoreweave、Oracle、Microsoftという少なくとも3つの提供者から調達していることを考えると、これより大きな訓練ランを可能にするほどチップが集中し、データセンター間で十分に接続されているとは考えにくい。さらに、OpenAIには社内展開と外部展開で大きな計算資源の需要があり、総量の残りはそちらに充てられていると考えるほうが妥当である。

今後については次のように予想する。

  • 今後2年間、訓練に使われる割合は40%前後で推移する。

  • 訓練計算量のうち事後学習に充てられる割合が、ますます大きくなる。

  • 2027年には大規模な事前学習ランは行われず、訓練計算量はほぼすべて、2026年に訓練された大規模モデルの事後学習の処理に向けられる。

合成データの生成

2024年には、OpenAIの計算資源のおおよそ20%が合成データの生成に使われると予想する。主な用途はおそらく、報じられている「Orion」モデルや、より弱いベースモデルから、推論時の手法(木探索にもとづくものなど)で出力を引き出し、評価と選別(棄却サンプリングなど)を通じて、o1や最近発表されたo3のようなモデルの事後学習に使うデータを作ることだろう。これは、年間を通じて平均5万台のH100を使うこと、つまりfp16で2.5e26 FLOPに相当する。使い方の一例としては、Orionで5兆回(Orionはfp8精度で運用される、密モデル換算2兆パラメータのモデルと仮定する)、GPT-4oで500兆回のフォワードパスを実行することが考えられる。私たちの推測では、Orionのフォワードパスは選別されず、そのまま5兆トークンの高品質な訓練データとして使われる。一方、GPT-4oのフォワードパスは、(探索と評価を経て)高品質なトークン1個を得るのにおおよそ16回を要し、さらに30兆トークンを生み出す。こうして生成されるトークンは合計35兆で、おそらくo1とo3の事後学習に使われる。これでGPT-4oの事後学習に約1e26 FLOPを使えることになる。合成データの生成は、事後学習の処理とともに重要性を増していき、約20%を保ったのち、2027年には約30%に伸びると予想する。

研究実験

2024年には研究実験がかなりの優先事項だったと予想する。2024年を通じて平均1万台のH100が使われた。これは合計でfp16の約1e26 FLOPに相当する。相当な量であり、大小さまざまな訓練やアーキテクチャの実験ができたはずである。重点が訓練ランと外部展開からAI研究開発の自動化へ移るにつれ(特に2027年)、この割合は着実に伸びると予想する。アルゴリズム研究の取り組みが拡大し、実験予算のより大きな割合を必要とするからである。研究の労働がますます自動化されると、実験用の計算資源が進歩のボトルネックとしてますます重要になる。そのため、この用途の割合は2024年の4%から、2027年初めには15%、2027年後半には35%へと急増すると予測する。これは、2027年の実験用計算資源がfp16で2e28 FLOPを超えることに相当する。

研究の自動化

2024年の時点では、社内での研究の自動化はごく限られていたと予想する。従業員が研究作業の補助にo1やo3のようなモデルを先行利用する程度だった。平均1000台のH100、つまりfp8で2e25 FLOPあれば、Orion(私たちの最善の推測では密モデル換算2兆パラメータ)や、推論コストが同程度かもしれないo1やo3のようなモデルで、2500億回のフォワードパスを実行するのに十分である。検算として、従業員を1000人と仮定すると、これは従業員1人あたり2億5000万トークン、1日あたりにしておよそ80万トークンになる。思考の連鎖の比率を8:1、スループットを毎秒100トークンとすると、従業員1人あたり1日に約1000秒、つまり16分の生成時間にあたる。平均としては妥当な値に思える。今後、社内のモデルの能力が上がるにつれて、この利用は大幅に拡大すると予想する。従業員1人あたりに動かすモデルのコピー数も、モデルを運用する際の典型的な足場(スキャフォールディング)の方式(したがって推論時の計算量の倍率)も大きくなる。これは特に2027年、高価なモデルを使って研究開発のワークフローを自動化しようとする動きにともなって急増し、現在の1%から約6%に達する。ただし、それ以上には伸びない。それ以上に増やせば研究の労働力が余り、実験用の計算資源が足りなくなるからである。

外部展開への計算資源の使用

OpenAIは2024年を通じて計算資源のおおよそ30%を外部展開に使っており、これは年間平均で7万5000台のH100にあたると予想する。運用中のモデル(リクエストをまとめて処理するのが難しいと見込まれる)で、推論の利用率が平均10%(出力トークンと入力トークンの合計で)に達するとすれば、これはGPT-4oの約800兆回のフォワードパス、つまり1日あたり約2兆トークンに相当する。

これはおおよそ妥当に思える。2024年2月、Sam AltmanはOpenAIが1日に1000億語を生成しているとツイートした。これが年央までにおおよそ3倍の4000億トークンになり(利益率がやや縮むため、収益の伸びをわずかに上回る)、推論計算量を不釣り合いに多く使うo1-preview、o1、o1-proの公開によってさらにおおよそ4倍の1.6兆トークンになったと仮定する。入力と出力のトークン比を平均1:1(文書などの入力があるため)と仮定すれば、年間を通じた平均は入力と出力それぞれ1日あたり約1兆トークン、合計2兆トークンになる。

今後については次のように予想する。

  • この割合は2025年を通じてほぼ変わらず、その後は減りはじめる。社内での優先事項が増えるうえに、AIの能力によって社内のAI研究開発の生産性が大きく高まるため、2027年の最先端モデルの公開が遅れるからである。

  • 今後3年間で、収益に占める割合は企業顧客へとますます移っていくと予想する。ビジネスモデルの中心が「オンラインのチャットボット」から「すぐに業務に組み込めるリモートワーカーのサービス」へ移るからである。

  • なお、割合は減っても、絶対量では依然としてきわめて大きな伸びになる。2024年の7万5000台のH100から、2027年には200万台になる。これは私たちが予想する収益の伸びとほぼ比例している。

監視への計算資源の使用

ごく大まかな目安として、平均推論コストが運用中のモデルの平均推論コストの約10分の1のモデルが、さまざまな場面で全入出力トークンのおおよそ半分を検査すると予想する(外部展開の監視や、後年には研究の自動化も含む、より広範なAI制御の仕組みなど)。そこで、外部展開と研究アシスタントの割合を足して20で割り、監視に使う計算資源の割合を推計した。その結果、この割合は期間を通じて約2〜4%でほぼ一定に保たれる。

第4節:AI研究の自動化

確度:不確実だが、根拠はある。この節は公開情報にもとづく、根拠のある予測である。

研究自動化における展開のトレードオフ2027年3月2027年6月2027年9月速度(トークン/秒)並列コピー数101001,00010,00010K100K1M10M20万コピー人間の30倍の速度30万コピー人間の50倍の速度人間の思考速度毎秒10語人間の10倍の思考速度人間の100倍の思考速度
ai-2027.com

図18:研究の自動化への計算資源の使用の節で予測したとおり、OpenBrainがH100e計算資源の6%を使う場合に直面すると予想される、AI研究エージェントの運用のトレードオフのまとめ。

この小節では、AIモデルを運用する際の、速度と並列コピー数のあいだの推論のトレードオフを分析する。対象は、AI 2027でAI研究の自動化に使われるかもしれないと私たちが考える、具体的なAIモデルである。推論の処理では、総メモリ帯域幅が性能を最も直接に表す指標となる。トークンを逐次デコードするには、増え続けるKVキャッシュを高速メモリに保持し、トークンを1つ生成するたびに、それをモデルの重みとともにプロセッサへ読み込まなければならないからである。そこでこの節では、H100帯域幅換算(H100-bandwidth-equivalents、H100-Be)を単位とする。これは総帯域幅3.6TB/sを1単位とするものである(H100 NVLとH100 SXMがほぼ同数生産されたと仮定し、両者の中間値を基準にした)。

既存のハードウェアのロードマップ

Nvidia GPU

GPUの帯域幅H100-Beメモリ容量メモリの世代利用のピーク所有コスト
NVIDIA H100~3.6 TB/s190 GBHBM32023-2024$40k
NVIDIA H2004.8 TB/s1.3141 GBHBM3e2024-2025$40k
NVIDIA B2008 TB/s2.2192 GB8x8Hi HBM3e2025-2026$50k
NVIDIA R200 Ultra19.2 TB/s5.3768 GB12x16Hi HBM42027$100k
NVIDIA R300 Ultra25.6TB/s7.11TB16x16-Hi HBM42027-2028$120k

ウェハースケールの推論チップ

GPUの帯域幅H100-Beメモリ容量メモリの種類利用のピーク所有コスト
Cerebras WSE-321,000 TB/s580044 GBSRAM2025-2026$2-3M
WSE-202734,000 TB/s950072 GBSRAM2027-2028$3-4M

2027年の自社製推論チップ

この表は、首位のAI企業が利用できる2027年の典型的な推論チップ(2027-IC)の予測である。ハードウェア研究開発の自動化の小節で述べたとおり、2027年にはトップクラスのAI企業が専用チップの設計を自動化し、自社でのチップ生産を増やすと予想する。そうした野心の兆しはすでに見えている。たとえばOpenAIは、実績豊富なGoogle TPUの設計者を採用し、2025年に初の自社チップを設計する計画を立てている。

TSMCのプロセスダイサイズH100eGPUの帯域幅H100-Beメモリ容量メモリの世代所有コスト
2027 -IC3nm60xH100100720 TB/s20017.8 TBHBM4e$600k
性能に比例
ダイサイズに比例
H100
(7.2 TB/s)
2027-IC
(720 TB/s)
2023
2027
*見込み
ai-2027.com
Q1 2027Q2 2027Q3 20272027年第4四半期(競争)
研究の自動化に使われる計算資源研究の自動化の割合6%6%6%6%
研究の自動化のための計算予算(H100e)400K600K800K1M
研究の自動化のための帯域幅予算(2027-IC)4K6K8K10K
研究の自動化のための帯域幅予算(H100-Be)800K1.2M1.6M2M
内訳
運用のトレードオフ運用されるコピー数(インスタンス数 × 平均バッチサイズ)300K400K500K600K
平均の素の速度(毎秒のフォワードパス数)230290360430
モデルの規模(パラメータ数、fp8、密モデル換算、運用中のモデルの平均)10T10T5T2T
AI研究開発の進歩
AI研究開発の進歩への効果(期間中の平均)研究能力水準のマイルストーン超人的コーダー超人的コーダー超人的AI研究者人工超知能
AI研究開発の進歩倍率4x10x50x2000x

最先端モデルの規模とアーキテクチャ

計算資源の用途の推計にもとづけば、2027年初めには最先端の訓練ランが約2e28 FLOP(fp8精度では4e28 FLOP)に達すると予想する。GPT-4との比(約1000倍)から素朴に考えると、そのようなAIモデルのアクティブパラメータはおおよそ10兆になると予測される。 AI 2027が予測するほどAI研究の自動化が進めば、蒸留の効果が大きく働き、同じ水準の能力を、はるかに小さく効率的なモデルで再現できるようになると予想する。AI企業は、さまざまな小型モデルと、事後学習を続けて能力を高めている最大モデルの新しいチェックポイントとを、どちらも幅広く運用するだろう。それでも、話を簡単にするため、速度とコピー数の計算は密モデル換算で10兆パラメータに固定したモデルを単位として行う。混合エキスパート(mixture of experts)などの将来のアーキテクチャは、推論の経済性にもとづいて「密モデル換算」のパラメータ数に換算できると仮定する。そのうえで、後の期間については、モデルの規模の縮小に合わせて速度とコピー数の計算を調整する。特に、最も賢いモデルの規模は、2027年末までに密モデル換算で約10兆パラメータから2兆パラメータへと縮小すると予想する。その間、モデルの質的な能力は、人間の研究者の中央値並みから、はるかに超知能的な研究者へと高まっていく。これは、アルゴリズムの効率が爆発的に向上し、知能の限界に近づくからである。

利用できる計算資源とメモリ

私たちの計算資源の配分予測によれば、2027年の首位のAI企業は世界の計算資源の15〜20%を持つ。また社内での用途の予測によれば、そのうち6%を研究の自動化のためにAIを動かすことに使う。これは帯域幅予算にして、2027年第1四半期に約4000基、2027年第4四半期までに1万基の2027年自社製推論チップ(2027-IC)にあたる。計算は2027年自社製推論チップ1000基(2027-IC 1000基)を単位として行う。これは計算能力でH100 10万台、帯域幅でH100 20万台に相当する。そのうえで、第1四半期から第4四半期までの運用のトレードオフ曲線を逆算する。

並列コピー数と速度のトレードオフ

推論を実行するときは、並列コピーを増やして速度を落とすことも、その逆もできる。このトレードオフには、メモリのボトルネック(コピーを増やす場合)とレイテンシのボトルネック(コピーを減らして速度を最大化する場合)という限界がある。言い換えれば、GPUサーバー(または密に接続されたGPUサーバー群)のHBMの総メモリに収まる以上に並列コピーを増やすと、より低速なメモリ帯域幅の接続を使わざるをえなくなり、大幅な速度低下が起きはじめる。一方、バッチサイズを減らしたり、テンソル並列・モデル並列の度合いを上げたり(モデルをより多くのGPUに分散させること)して、あまりに極端にコピーを減らすと、各リクエストがクラスター内のより多くのチップを行き来しなければならなくなり、通信のボトルネックが生じる。

並列コピーを増やす場合

推論をfp4精度で実行すると仮定すると、10兆パラメータには5TBのメモリが必要になる。2027-ICチップ1基では、これでHBMが12.8TB空く。そのうち1.8TBをその他の用途に確保し、11TBをKVキャッシュに回すと仮定できるだろう。平均シーケンス長を2万トークン、隠れ次元を5万、層の総数を250とすると、最大バッチサイズは440になりうる。したがって、インスタンスが1000個(2027-ICチップ1基に1個)なら、44万の並列コピーに相当する。1バッチあたり1トークンにつき16TBの帯域幅が必要になるので、推論速度は毎秒45トークンになる。

並列コピーを減らす場合

理論上は、1000台のサーバー全体で1つのモデルインスタンスだけを動かすまで減らすこともできるが、そうすると通信のボトルネックに大きく苦しむことになる。より現実的には、1つのモデルインスタンスを2027-ICチップ10基に分散させ、バッチサイズをわずか10にすると仮定できるだろう。この場合、並列コピーはわずか1,000になる。1バッチあたり1トークンにつき5.3TBの帯域幅が必要になるので、10基のチップ間の接続が十分で、チップ間通信のボトルネックがないと仮定すれば、推論速度は毎秒1,350トークンになる。

運用のトレードオフの予測

この「並列コピーを増やす」と「並列コピーを減らす」という両極端を組み合わせれば、その間のさまざまな運用の選択肢を計算でき、図16に示すように、各期間の平均的な運用のトレードオフ曲線が得られる。これらの曲線は、現在または将来の並列化手法やチップ間通信のボトルネックを十分に考慮して計算したものではない。ただし、それらが曲線に大きく影響する可能性は低いと、比較的強く確信している。

研究自動化における展開のトレードオフ2027年3月2027年6月2027年9月速度(トークン/秒)並列コピー数101001,00010,00010K100K1M10M20万コピー人間の30倍の速度30万コピー人間の50倍の速度人間の思考速度毎秒10語人間の10倍の思考速度人間の100倍の思考速度
ai-2027.com

図19:研究の自動化への計算資源の使用の節で予測したとおり、OpenBrainがH100e計算資源の6%を使う場合に直面すると予想される、AI研究エージェントの運用のトレードオフ。

素朴な推測だが、2027年を通じて、並列コピー数の多さと速度の高さはおおよそ同程度に好まれ、運用のトレードオフは平均して約30万コピー、平均速度は人間の思考速度の約20倍に落ち着くと考える。本稿の範囲外だが、2028年には好みがやや逐次的な処理のほうへ移ると予想する。知能の限界に近づくにつれて、モデルのコピーを増やすことの収穫逓減が強まり、2027年半ば〜後半に生まれた新しいハードウェアの発明も、製造されて広く使われるだけの時間を経るからである。

Q1 2027Q2 2027Q3 2027Q4 2027
並列コピー数300K400K500K600K
速度230 tok/sec290 tok/sec360 tok/sec430 tok/s
パラメータ10T10T5T2T

第5節:業界の指標

確度:不確実だが、根拠はある。この節は公開情報にもとづく、根拠のある予測である。

この節では、2028年までの首位のAI企業の最先端の訓練ランを予測し、それにともなう費用、収益、所要電力の予測を論じる。

訓練ラン

訓練の実行訓練計算量(FP16のFLOP、対数目盛)GPT-4 (2e25)GPT-4.5 (2e26)GPT-4の1000倍(2e28)2024年12月2025年6月2025年12月2026年6月2026年12月2027年6月2027年12月10^2510^2610^2710^28Agent-1Agent-0Agent-2Agent-3Agent-4
ai-2027.com

図20:AI 2027に登場する訓練ラン。

私たちの計算資源の生産予測では、世界のAI関連計算資源は2024年から2027年にかけて年2.25倍で伸びる。首位のAI企業が世界の保有量に占めるシェアは年1.4倍で伸び、社内で訓練ランに使う割合は2027年まで40%を保ち、2027年に20%へ下がる。これらをすべて組み合わせて、次のような訓練ランを予測する。

モデル訓練期間訓練期間中の世界の計算資源(H100e)世界の計算資源に占めるシェア社内での用途に占める割合訓練計算量
Agent-02024年10月〜2025年5月10M6%40%1e27
Agent-12025年7月〜2026年2月18M9%40%4e27
Agent-22026年4月〜2027年3月38M14%36%2e28
Agent-32027年3月〜2027年8月60M16%24%+1e28^
Agent-42027年8月〜2027年12月80M18%20%+1e28^^

使用されるチップ

計算資源の生産と計算資源の配分の節をもとに、2027年までに首位のAI企業が使うと予想されるチップを示す。大半はNvidiaのチップで、2027年には自社製推論チップが加わると予想する。

チップの種類別のGPU展開2025年1月2025年7月2026年1月2026年7月2027年1月2027年7月2028年1月H100換算(H100e)2.0M4.0M6.0M8.0M10.0M12.0M14.0M16.0M18.0M20.0MH100sGB200sGB300sVR200s推論用チップ
ai-2027.com

図21:2027年12月までに首位のAI企業が使うチップ。

財務

この小節では、2027年までの首位のAI企業の費用と収益を予測する。2025年より前の傾向を把握するためにOpenAIを基準とし、そのうえで他の予測を使って先を外挿する。

首位のAI企業の売上とコストの予測金額(ドル)2025年1月2025年7月2026年1月2026年7月2027年1月2027年7月2028年1月0500億ドル1000億ドル1500億ドル2000億ドル年換算の売上年換算の計算資源コスト年間2024$4B$6B年間2025$14B$20B年間2026$50B$50B年間2027$150B$120B
ai-2027.com

図22:首位のAI企業OpenBrainの、費用と収益のおおよその予測。

計算資源の費用の予測

New York Timesの報道によれば、OpenAIは2024年の計算コストを54億ドルと見込んでいる。また、2022年半ばに3か月かけて訓練されたGPT-4の訓練費用は約1億ドルと推計されている。GPT-4の訓練がその年の計算資源への支出の20〜40%だったと仮定すると、2022年から2024年にかけて、OpenAIの計算資源への支出はおおよそ年11〜22倍で増えたことになる。

一方、計算の価格性能比(FLOP/$)は、A100からH100にかけて16か月で倍増した。これは、最先端のAIチップにおける年約1.4倍に近い傾向からの、やや外れた値だったと考える。今後については、首位のAI企業の計算資源についての年3.4倍という予測から、FLOP/$の1.5倍の向上分を差し引くと、首位のAI企業によるAI計算資源への支出は平均で年2.4倍という予測が得られる。ただし、この伸びは最初の1〜2年はより速く、その後は自社設計チップの競争力が高まるにつれて鈍ると予想する。

収益の予測

OpenAIの2023年の収益10億ドルと2024年の収益約40億ドルをもとに、短期の傾向を組み立てる。この傾向は徐々に鈍ると予想するが、エージェント型のモデルが「すぐに業務に組み込めるリモートワーカー」のような製品で高額の契約者を引きつけるため、2027年まで持続的な指数関数的成長が続くと見込む。

20232024202520262027
年間収益$1B$4B$14B$45B$140B
収益の前年比成長率-300%250%221%211%
年間の計算コスト$1.8B$6B$16B$40B$100B
計算コストの前年比成長率-233%166%150%150%

FutureSearchは、OpenBrainの収益がどのように伸びて2027年半ばに1000億ドルに達しうるかを予測した。FutureSearchは、10億ドルから1000億ドルへと最も速く成長した企業群の全体的なスピードを調べ、その移行にかかる期間が時代とともに短くなってきたことを見いだした。首位の企業がわずか4年でこの飛躍を遂げれば史上最速になるが、それも傾向の延長線上にある。さらにFutureSearchは、最も需要が高くなりそうなエージェントの種類(顧客サービス担当者から研究開発の研究者まで)とその価格帯を検討し、OpenBrainの収益がどこから生まれる可能性が最も高いかを詳しく描き出した。詳しくはFutureSearchの報告書の全文を参照のこと。

所要電力

最後に、2028年までに首位のAI企業が使う計算資源の所要電力をモデル化する。根拠は、使われると予想されるNvidiaの主要チップについて、報じられている電力効率と予測される電力効率である。これを使えば、首位のAI企業が必要とする総電力と、そこから導かれる世界全体のAIデータセンターの総電力使用量を逆算できる(首位のAI企業の電力使用効率は平均的だと仮定する)。

性能(fp16、FLOP/s)利用のピークデータセンターのピーク電力使用量エネルギー効率
NVIDIA H100/200 GPU1 x 10152023-20241000W1.0
NVIDIA B100/200 GPU2.5 x 10152025-20261700W1.47
NVIDIA R100/200 GPU6 x 10152027-2028~3300W1.81
世界・米国・首位企業のAI電力必要な電力容量2025年1月2025年7月2026年1月2026年7月2027年1月2027年7月2028年1月010 GW20 GW30 GW40 GW50 GW60 GW0.5%1.5%2.5%3.5%世界のAI電力米国のAI電力米国の首位のAI企業米国の電力に占めるAIの割合2024年12月10 GW7 GW0.5 GW2027年12月60 GW50 GW10 GW
ai-2027.com

図23:2027年12月までの所要電力の予測。