Research
「AIアライメント」小史――用語の発祥と歴史的背景|ALIGN寄稿
AI Summary
- bioshokが、AIアライメントをめぐる議論の背景を、Friendly AIやValue Alignmentなどの用語の系譜から説明した外部寄稿です。
- MIRI、LessWrong、Eliezer Yudkowsky、Stuart Russell、Paul Christiano、Rob Bensingerらの議論をたどり、AI Alignmentという表現が定着してきた過程を整理します。
- AI Alignment、Intent Alignment、AI Control、Value Alignment、Beneficial AI、AI Safety、AIガバナンスの射程の違いを比較します。
- 用語の定義には現在も幅があるため、厳密な主張、年次、引用、参照文献は原文で確認する必要があります。
この論考の背景
このページは、bioshokがALIGNへ寄稿した外部記事の紹介です。原文はAIの深刻なリスクをめぐる議論の背景から、AIアライメントという用語の歴史、定義、周辺概念との関係までを扱っています。
同じ「アライメント」という言葉でも、技術的な目標整合、価値選択、AI Control、AI Safety、ガバナンスをどこまで含めるかは論者によって異なります。AGI Hubの紹介ではその違いを読み分けるための入口だけを示し、本文、引用、参考文献はALIGNの原文へ案内します。
論考のポイント
- 用語の系譜 — Friendly AIからValue Alignment、AI Alignmentへと議論の中心語が変化してきた背景を、関連人物とコミュニティの動きに沿って紹介します。
- 定義と境界 — 人間の意図に沿う目標追求、望ましい価値の選択、能力の制御、制度的なガバナンスを同じ問題として扱わず、それぞれの射程を比較します。
- 原文の位置づけ — 2024年6月20日にALIGNで公開されたbioshokの寄稿です。AGI Hubでは本文を転載せず、論点の案内と原文への導線を掲載します。
AGI Hubとつながる
AGI・AIセーフティについて、講演・寄稿・取材のご相談を受け付けています。解説動画と最新のリサーチもあわせてどうぞ。