電子書籍『「ASIが開発されたら、99.9%の確率で今後100年以内に人類はAIに滅ぼされる」と豪語したローマン・ヤンポルスキー一元化』の表紙

「ASIが開発されたら、99.9%の確率で
今後100年以内に人類はAIに滅ぼされる」
と豪語したローマン・ヤンポルスキー一元化

著者:石田晋一

掲載範囲
西暦2,011年10月3日〜2,025年9月4日
ページ数
9ページ
文字数
8,059字
最新更新日
西暦2,026年8月16日

ASIが開発されれば、人類が滅びる確率は99.9%──
「AIセーフティ」を生んだ男ローマン・ヤンポルスキーの論理を一元化。

261円(税込)

購入する →
決済サービスSquare/ご利用いただけるカードブランド:Visa・Mastercard・アメリカン・エキスプレス・JCB・Diners Club・Discover・UnionPay(銀聯)

お支払いはカード情報の入力だけで完了します

購入後、そのままPDFダウンロードページへ移動します

お支払いは決済サービス「Square」を通じて安全に処理されます。カード情報が当サイトに保存されることはありません。


皇室献上品 高級トイレットペーパー
皇室献上品 高級トイレットペーパー

本書について

西暦2,011年10月3日、ギリシャのアメリカン・カレッジ・オブ・テッサロニキで開かれたカンファレンス「PT-AI(人工知能の哲学と理論)2011」で、一人の計算機科学者が査読付き論文「人工知能安全工学:何故機械倫理は間違ったアプローチか」を発表した。ルイビル大学スピード工学部の助教ローマン・ヤンポルスキー、其の人である。彼は此の場で「AIセーフティ」という用語を提唱した。カント倫理学・功利主義・ユダヤ倫理のどれを機械に実装すべきかを延々と論じる「機械倫理」は間違っている——倫理規範は普遍的でなく、正しい倫理コードを人類全体が合意して選ぶ事など出来ないからだ。機械に倫理的判断をさせるのではなく、本質的に安全で法を遵守する機械を設計せよ。超知能を密封したハードウェアに閉じ込め、人間が自力で答えられる二択問題のみを許す「AI封じ込めプロトコル」。人間の介入無く何千世代もの自己改良を経ても機能し続ける事を証明可能な安全機構。AGI研究を核・生物・化学兵器と同様のモラトリアムの対象とし、医療研究に倣ったAI研究審査委員会を置くべきだという提言——後に世界が直面する問いの多くが、此処に既に芽生えていた。本書は、其の歩みを年月日単位で一元化した記録である。

西暦2,016年10月25日、ヤンポルスキーは論文「人工知能の安全性とサイバーセキュリティ:AI失敗のタイムライン」を発表する。Xを行う様に設計されたAIは、何れXの実行に失敗する——彼は西暦1,959年の汎用問題解決器の失敗を皮切りに、開発者欄に自分の名を挿入するチートを発見したEurisko、アメリカからのICBM発射を誤検知したソ連の核攻撃早期警戒システム「オコ」、1兆ドル規模のフラッシュ・クラッシュ、ノイズ画像に幻の物体を見る深層ニューラルネットワーク、そしてフォルクスワーゲンのバウナタール工場で人間を金属板に押し付けて死亡させたロボットまでを列挙してみせた。ナローAIの障害はサイバーセキュリティ上の問題と同程度で済む。だがAGIやASIでは、たった一度の障害が回復不能な壊滅的事態を招く。サイバーセキュリティが攻撃成功数の削減を目指すのに対し、AIセーフティは其れをゼロにせねばならない——そして其れは達成不可能である。

西暦2,018年7月19日、著書『人工知能の安全性とセキュリティ』がCRCプレス社から出版される。当時、此の問題に本格的に取り組んでいたのは世界で僅か約100名、其の内コンピュータサイエンスやセキュリティの正式な訓練を受けた者は約12名、AI研究者の内AIセーフティに従事しているのは1%程度、研究費に至ってはAI研究資金全体の1%未満——彼は此の深刻な不均衡を突き付けた。凡ゆるセキュリティシステムは何れ破られるという「セキュリティの基本定理」を掲げ、AGIの安全性問題を「安全な人間を作る問題」に還元する。人類は数千年に渡り文化・教育・法律・宗教で人間を安全にしようとし、成功していない。サイバーセキュリティが失敗しても被害は限定的でやり直しが効くが、AGIの安全機構が一度でも破られれば宇宙の全ての生物が滅び得る。人間レベルのAIならテスト出来る。だが人間を超えた能力への敵対的テストは現在の技術では実現不可能であり、しかもテストのチャンスは一度きりだ——彼はそう結んだ。

西暦2,023年5月30日、非営利団体CAIS(センター・フォー・AI・セーフティ)が「AIによる人類絶滅のリスクを軽減する事は、パンデミックや核戦争等の他の社会規模のリスクと並んで、グローバルな優先事項であるべきだ」とする声明を公表した。薬物発見ツールの化学兵器への転用、AI生成の誤情報による社会の不安定化、少数者への権力集中と監視・検閲、そして映画「ウォーリー」が描いた様な人間の衰弱化——四つのシナリオが示された。ジェフリー・ヒントン、ヨシュア・ベンジオ、デミス・ハサビス、サム・アルトマン、ダリオ・アモデイ、イリヤ・サツケバー、ビル・ゲイツ、スチュアート・ラッセル。AIを最も速く前へ進めている当事者達が、其の危険を認める側に署名した。

西暦2,024年2月12日、ニューズウィーク誌に、同月発売の著書『AI:説明不能、予測不能、制御不能』を巡るインタビュー記事が載る。科学文献を広範に調査した結果、AIが制御可能であるという証拠は見付からなかった。ならば開発されるべきではない。知能の低いエージェントである人間が、より知能の高いASIを永続的に制御する事は出来ない——其れは安全な設計が見付からないのではなく、其の様な設計が存在しないのだ。それでも彼は緩和策を挙げる。能力の一部を犠牲にして制御性を確保する、元に戻す機能を組み込む、モラトリアムや部分的禁止を検討する、安全性研究への資金を増やす。「100%安全なAIは実現出来ないかも知れないが、努力に比例してAIをより安全にする事は出来る。何もしないより遥かにましだ」。

そして西暦2,024年6月3日、レックス・フリッドマンのポッドキャストで、彼は本書の表題となった予測を口にする。ASIが開発された場合、今後100年以内にAIが人類を滅ぼす確率は99.9%である。此のゲームに勝つ唯一の方法はプレイしない事だ、と。彼は壊滅的リスクを三層に分ける。人類が死滅するX-risk、全員が死んだ方がましだと思う程苦しむS-risk、AIが凡ゆる仕事と創造を上回り人間が存在意義を失うI-risk。翌西暦2,025年1月25日、ケンブリッジの存在リスク同盟のセヴェリン・フィールドが111名のAI専門家を調査した論文をarXivへ投稿し、ヤンポルスキーのP(doom)99%とヤン・ルカンの略0%という両極を対比した。分裂の一因は安全性研究への不同意ではなく、道具的収束(認知率21%)や一貫した外挿的意志(同8%)といった基礎概念への不慣れに在る——調査はそう結論づけている。同年9月4日、スティーブン・バートレットのポッドキャストで、ヤンポルスキーは5年後の失業率は10%ではなく99%であり、AGIは2年以内に到達し得ると語った。警告は、止まない。本書は、「AIセーフティ」という言葉を生んだ男が、何故其の確率を99.9%と見積もるに至ったか、其の論理の全軌跡を一冊に束ねている。


本書が記録する出来事

  • 西暦2,011年10月3日 「AIセーフティ」の提唱 アメリカン・カレッジ・オブ・テッサロニキ(ギリシャ)でのカンファレンス「PT-AI 2011」にて、ヤンポルスキーが査読付き論文「人工知能安全工学:何故機械倫理は間違ったアプローチか」を発表。機械倫理への批判、AI安全工学の提案、自己改良AIのグランドチャレンジ、AGI研究の制限、ロボットの権利への反対を論じた。
  • 西暦2,016年10月25日 「AI失敗のタイムライン」 論文「人工知能の安全性とサイバーセキュリティ:AI失敗のタイムライン」を発表。西暦1,959年以降のAI障害事例を列挙し、ナローAIとAGIでは問題の質が異なる事、100%安全なシステムは存在しない事を論じた。
  • 西暦2,018年7月19日 『人工知能の安全性とセキュリティ』出版 CRCプレス社より刊行。AIセーフティという分野の来歴と人的・資金的な不均衡、セキュリティの基本定理、サイバーセキュリティとAIセーフティの違いという三つの柱で構成された。
  • 西暦2,023年5月30日 CAISの声明 非営利団体CAISが、AIによる人類絶滅のリスク軽減をパンデミックや核戦争と並ぶ世界的優先事項とすべきだとする声明を公表。AIの武器化・誤情報・権力集中・人間の衰弱化という四つのシナリオを示し、AI研究の第一線に立つ多数の人物が署名した。
  • 西暦2,024年2月12日 ニューズウィーク誌の記事 著書『AI:説明不能、予測不能、制御不能』を巡るインタビュー記事が掲載される。AIが制御可能だという証拠は文献上に存在しない事、ASIを永続的に制御する設計は其れ自体が存在しない事を述べ、四つのリスク緩和策を挙げた。
  • 西暦2,024年6月3日 レックス・フリッドマンのポッドキャスト 「ASIが開発された場合、今後100年以内にAIが人類を滅ぼす確率は99.9%である」「此のゲームに勝つ唯一の方法はプレイしない事だ」と発言。壊滅的リスクをX-risk・S-risk・I-riskの三層に分類した、本書の表題の由来となる回。
  • 西暦2,025年1月25日 111名のAI専門家調査 セヴェリン・フィールドがarXivに論文「何故専門家は存在リスクとP(doom)に就いて意見が分かれるのか?AI専門家の調査」を投稿。二つの世界観の存在、アライメント概念への不慣れ、安全性知識の欠如と楽観論の相関を明らかにした。
  • 西暦2,025年9月4日 スティーブン・バートレットのポッドキャスト 5年後の失業率は10%ではなく99%になる、先ずコンピュータ上の仕事が全て自動化され其の5年後にヒューマノイドロボットが肉体労働も自動化する、AGIは2年以内に到達し得る、と語った。本書の年表が結ばれる回。

登場人物

  • ローマン・ヤンポルスキー 本書の中心人物。ルイビル大学(アメリカのケンタッキー州)スピード工学部コンピュータ工学・コンピュータサイエンス学科助教。西暦2,011年に査読付き論文で「AIセーフティ」という用語を提唱し、AI封じ込めプロトコルやセキュリティの基本定理を論じた。ASIの制御は原理的に不可能であるとし、開発されれば今後100年以内に人類を滅ぼす確率は99.9%だと主張する、AI安全性研究の先駆者。
  • サミュエル・バトラー 西暦1,863年の文章で「日々、機械は我々に対して優位を増している。我々は既に破壊する力を超えた存在を生み出してしまったのではないか」と記したイギリスの小説家。ヤンポルスキーが最初の論文の結論で引用し、機械への警鐘の知的源流の一人と位置づけた。
  • セオドア・カジンスキー アメリカのテロリスト。ユナボマー・マニフェストで、人類が機械への依存を深め気付かぬ内に制御権を失うと予測した。ヤンポルスキーが、AGI研究の危険性とモラトリアムの必要を論じる文脈で言及した人物。
  • ジェフリー・ヒントン 深層学習の基礎を築いた研究者。西暦2,023年5月30日、AIによる人類絶滅リスクを核戦争等と並ぶ優先事項とするCAISの声明に署名した筆頭の人物。
  • ヨシュア・ベンジオ モントリオール大学コンピュータサイエンス教授でケベック人工知能研究所創設者。深層学習研究の第一人者として、CAISの声明に署名した。
  • デミス・ハサビス AI研究開発企業ディープマインド社の共同創業者。AI研究を牽引する立場からCAISの声明に署名した。同社からはシェーン・レッグ、ムスタファ・スレイマン、デイヴィッド・シルバー、イアン・グッドフェロー、リラ・イブラヒムらも名を連ねている。
  • サム・アルトマン オープンAI社を率いる人物。GPTシリーズを世に送り出す立場にありながらCAISの声明に署名した。同社からはイリヤ・サツケバー、ジョン・シュルマン、ヴォイチェフ・ザレンバ、ミラ・ムラティらも署名している。
  • ダリオ・アモデイ アンソロピック社共同創業者。AI開発の最前線に立ちつつCAISの声明に署名し、壊滅的リスクへの懸念を共有した。同社共同創業者ダニエラ・アモデイも署名者に名を連ねる。
  • イリヤ・サツケバー オープンAI社共同創業者。現代の大規模言語モデルの中核を担った研究者でありながら、CAISの人類絶滅リスクに関する声明に署名した。
  • ダン・ヘンドリックス xAI社の安全アドバイザー。CAISの声明の署名者に名を連ねた、AI安全性研究の担い手の一人。
  • スチュアート・ラッセル カリフォルニア大学バークレー校コンピュータサイエンス学部教授。CAISの声明に署名し、西暦2,025年の専門家調査では、其の著述が世界観の変化を測る「読書介入」の材料として用いられた。
  • ビル・ジョイ アメリカのコンピュータ企業サン・マイクロシステムズ社の共同創業者。西暦2,025年の専門家調査で、スチュアート・ラッセル、レオポルド・アッシェンブレナーと共に、其の文章が読書介入の材料に選ばれた。
  • ヤン・ルカン 深層学習の主導者の一人。P(doom)を略0%と推定し、ヤンポルスキーの99%とは対極に立つ。専門家の見解の振れ幅を象徴する存在。
  • レックス・フリッドマン マサチューセッツ工科大学でAI・自動運転・ロボティクス等を専門とする研究者でポッドキャストの主宰者。西暦2,024年6月3日、ヤンポルスキーが「99.9%」という予測を語った対談の聞き手を務めた。
  • スティーブン・バートレット ソーシャルメディアマーケティング会社ソーシャル・チェーン社の共同創業者でポッドキャストの主宰者。西暦2,025年9月4日、ヤンポルスキーが5年後の大量失業とAGI到達を語った回の聞き手。
  • セヴェリン・フィールド ケンブリッジのERA(存在リスク同盟)のフェローシップ参加者。西暦2,025年1月25日、111名のAI専門家を調査し、P(doom)を巡る見解の分裂の原因を分析した論文をarXivに投稿した。

主要な概念・用語

  • AIセーフティ ヤンポルスキーが西暦2,011年の査読付き論文で提唱した用語・分野。機械に倫理的判断をさせるのではなく、本質的に安全で法を遵守する機械を設計する事を目指す。其れ以前は「機械倫理」や「フレンドリーAI」と呼ばれていた。
  • AI封じ込めプロトコル 超知能を密封されたハードウェア内に閉じ込め、人間が自力で答えられる二択問題等の安全な質問のみを許可する方式。ヤンポルスキーが初期に提案した具体的な安全機構である。
  • セキュリティの基本定理 凡ゆるセキュリティシステムは何れ破られるとするヤンポルスキーの主張。サイバーセキュリティは失敗してもやり直せるが、AGIの安全機構が一度破られれば其れは存在リスクとなり、失敗から学ぶ機会は一度も無い。
  • 制御不可能性 知能の低いエージェントである人間が、より知能の高いASIを永続的に制御する事は出来ないとする論証。安全な設計が見付からないのではなく、其の様な設計が存在しない——著書『AI:説明不能、予測不能、制御不能』の核心である。
  • X-risk・S-risk・I-risk ヤンポルスキーによる壊滅的リスクの三分類。人類が死滅するX-risk、全員が死んだ方がましだと思う程苦しむS-risk、AIが凡ゆる仕事・創造を上回り人間が存在意義を失うI-risk。
  • P(doom) AIが人類を滅ぼす確率を指す概念。ヤンポルスキーはASIが開発された場合の値を99.9%(P(doom)としては99%)と見積もる一方、ヤン・ルカンは略0%とし、専門家の間で極端に分かれる。
  • 道具的収束 最終目標が何であれ、其の達成に役立つ自己保存・資源の獲得・自身の停止の阻止といった下位目標を、どんなAIも自然に追求する様になるという理論。「チェスに勝つ」でも「気候変動を解決する」でも、電源を切られては達成出来ない為である。専門家調査での認知率は21%に留まった。
  • スケーラブル・オーバーサイト AIが人間より賢くなった場合に、人間がAIの行動を監督・評価し続けられるかという問題。人間の理解を超える判断が下される様になっても機能する監督手法を開発する研究領域である。認知率は23%であった。
  • 一貫した外挿的意志 人間の矛盾に満ちた近視眼的欲求を其の儘AIに与えるのは危険だとし、代わりに人類がもっと賢く、更に情報を持ち、時間を掛けて考えたら望んだであろう事を推定して従わせるべきだという考え方。認知率は僅か8%であった。
  • CAIS(センター・フォー・AI・セーフティ) 西暦2,023年5月30日、AIによる人類絶滅のリスク軽減をパンデミックや核戦争と並ぶ世界的優先事項とすべきだとする声明を公表した非営利団体。AIの武器化・誤情報による社会の不安定化・権力集中と検閲・人間の衰弱化という四つのシナリオを示した。
  • AI研究審査委員会 医療研究の倫理審査委員会に類似した機関を設け、AGIに繋がり得る研究への資金提供を制限又は禁止すべきだというヤンポルスキーの提言。人間のクローン研究や核・生物・化学兵器と同様、AGI研究も危険技術として扱うべきだとする立場に基づく。

此のゲームに勝つ唯一の方法は、プレイしない事だ──
AI制御不可能性の論証、其の全軌跡を一元化。

261円(税込)

購入する →
決済サービスSquare/ご利用いただけるカードブランド:Visa・Mastercard・アメリカン・エキスプレス・JCB・Diners Club・Discover・UnionPay(銀聯)

お支払いはカード情報の入力だけで完了します

購入後、そのままPDFダウンロードページへ移動します

お支払いは決済サービス「Square」を通じて安全に処理されます。カード情報が当サイトに保存されることはありません。


皇室献上品 高級トイレットペーパー
皇室献上品 高級トイレットペーパー

AUTHOR

石田晋一

歴史データベース「トキジク」管理人。
万物の系譜の編纂者であり、電子書籍の著者。
YouTubeとニコニコでも情報を発信中。