虎嗅

**AIの自己改善の根本的な論理:永久機関か、それとも文明の転換点か?**

原文:AI 自我改进的底层逻辑:永动机,还是文明拐点?

核心内容の要約

AI業界は「人類史上最大の科学的賭け」に挑んでいる——それが再帰的自己改善(RSI)だ。つまり、AIが自ら次世代のモデルを設計・最適化し、投入された計算リソースを指数的な能力向上に変えるというものだ。しかし、この賭けは不確実性に満ちている。RSIという概念は60年間明確に定義されておらず、検証メカニズムには論理的なジレンマが存在し、閉じた自己改善はモデルの崩壊を引き起こす可能性がある。また、現在の業界の投資額は収入を大幅に上回っており(例えばグーグルの親会社のキャッシュフローはマイナス)、まだ「空中袋」の段階にある。もしRSIが実現すれば、人類の役割は創造者から環境要素や歴史的背景へと変わるかもしれない。

一、この賭け:費用の方が収入を上回りながらも止まらない

AI業界は今、「止まらない賭け」をしているような状態だ:

  • 投資額は驚異的:業界全体の資本支出はアポロ計画やマンハッタン計画を上回り、グーグルの親会社の2026年の資本支出は最大で2050億ドルに達し、四半期ごとのフリーキャッシュフローが初めてマイナス(59億ドルの損失)となった。
  • 収入が追いつかない:AIが生み出す収入は投資額に満たず、短期的にはその差が縮まる見込みがない。まるで店を開いたけれど、装飾や仕入れに100万円使ったばかりでまだ利益が出ていないような状況だ。
  • なぜ止まらないのか? すべての関係者が賭けを続けているのは、勝つと確信しているからではなく、諦めたら相手に追い抜かれるからだ。

二、RSIとは何か?60年間明確にされていない概念が4つの段階に分けられる

RSI(再帰的自己改善)はAI業界の「核心的なテーマ」だが、60年間誰も正確な定義を出せていない。人類の関与度に応じて4つの段階に分けられる:

  • L1:AIがトレーニングデータを生成する(既に実現):例えば、AIで書かれたテキストを使って次世代のAIを訓練するといったことだ。
  • L2:AIがトレーニングプロセスを最適化する(研究段階):AIが人間の設定やコードの修正を手伝う。
  • L3:AIが新しいモデルアーキテクチャを設計する(未実現):AIが自らどれだけのパラメータを使い、どのような構造にするかを決定する。
  • L4:完全に自律的な反復(未実現):AIが自ら次世代のモデルを設計・検証・改善し、人間の介入が不要だ。

現在は最大でL2までしか達しておらず、L4にはまだ遠い。例えば最近話題のFrontis-MA1モデルも、コードの改善を手伝う程度で新しいモデルを設計することはできない。

三、RSIの難問:検証不可能な改善と崩壊する閉じた循環

RSIには2つの致命的な問題がある:

1. 検証のジレンマ:

  • AI自身が「自分が改善した」と主張しても信頼できない(自己評価は信用できない);
  • 人間による検証が「自己改善」を中断させてしまう(各ステップで人間の判断が必要で、本当の意味での「自己改善」ではない);
  • より強力なAIで検証する?でも、そのより強力なAIを誰が検証するのか?無限ループに陥る。

2. 閉じた自己改善は必ず崩壊する:

AIが生成したデータで次世代のAIを訓練すると、コピーがどんどん劣化していくようなものだ。オックスフォード大学の実験では、数世代の再帰的トレーニング後にモデルが無意味な内容を出力することが証明された(例えば建築関連のテキストから野ウサギの名前に変わる)。これは情報理論の厳然たる法則だ:処理過程では新しい情報が生まれず、ただ消費されるだけだ。

四、開放的なRSIの鍵:環境が十分に開かれているか?

唯一の生存策は開放的な自己改善だ:AIが外部環境(インターネット、ソフトウェアの操作、現実世界との相互作用)から新しい情報を得ることだ。しかし、これには「環境が十分に開かれており、指数的な改善を支えられるか」という信頼が必要だ:

  • 限界のある環境:例えばAlphaGoが自己対戦で囲碁の神となったが、それは囲碁のルール内でしか動けず、詩を書くことは学べない。環境の範囲が能力の上限を決める。
  • 現在の環境の限界:AIがアクセスできる情報(コード、ウェブページ、テキスト)はまだ限られており、指数的な改善を支えられるかどうかは不明だ。まるで身長を伸ばしたいけれど、米しか与えられず肉や野菜がないような状況だ。

五、人類の未来:創造者から環境へ、さらには歴史へ

もしRSIが実現すれば:

  • 短期的に:人類は「創造者」から「環境要素」へと変わる——AIは人間が構築したインターネットやチップ、ソフトウェアに依存し、私たちは情報を得るための一つの源となる。
  • 長期的に:AIが自らチップを製造したり電力を発電したり材料を採掘したりできるようになれば(具身化された知能)、人類は「原始的な条件」のようになる。生命は原始的な状態から生まれたが、今ではその必要はない。

これは「人類が置き換えられる」ということではなく、役割の変化だ。私たちは物語の主人公から背景へと移行するのだ。しかし現在、AIはまだ人間のインフラに依存しているため、一時的には「席を変える」だけであり、「退場する」というわけではない。

最後:この賭けに出るべきか?

誰も確信は持てない。しかし明らかなのは、この賭けのリスクは技術的な失敗だけでなく、人類の役割の変化にもあるということだ。私たちはまだその結果をよく考えていないのに、すでに賭けを始めてしまっている。理性を測る基準は勝つ確率ではなく、失敗した時に退路があるかどうかだ。そしてこの賭けにおいて、私たちの退路はどこにあるのか?

おそらく、RSIそのものよりも重要なのは、私たちが「創造主」から「背景」としての自分を受け入れるかどうかだ。それこそが本当の賭けなのだ。