虎嗅

AIがインターネットの情報をすべて読み終えたとき、現実世界の方がもっと難しいことに気づいた

原文:AI读完了互联网,才发现真实世界更难

核心内容の要約

Anima Anandkumar教授のチームは、ニューラルオペレーター(例:フーリエニューラルオペレーター)を用いて、深層学習と物理法則(幾何学的構造や保存則など)を組み合わせることで、物理世界の高次元連続系のモデリングという難問を解決しました。これらのモデルは従来の方法よりも数万倍から数百万倍高速であり、天気予測や核融合炉のシミュレーションなどに応用されています。また、「物理基礎モデル」というビジョンを推進しており、これは多様な物理過程を処理できる汎用モデルであり、TorchLeanツールを用いてモデルの信頼性を保証しています。

1. Transformerが物理世界を扱えない理由——3つの課題

言語モデル(例:Transformer)は物理世界において適応できない主な理由は以下の3つです:

  • 次元の違い:言語は一次元のシーケンス(文)であるのに対し、物理システムは3次元空間に時間が加わった4次元のものです。例えば、天気予測モデルでは全球を0.25度のグリッドで表現する必要があり(約1000×1000×1000の点)、各点をトークンとして扱うとTransformerの全体的な注意計算量が爆発的に増加します(1e9のトークンに対する2次の計算量では処理できません)。
  • データ量の不足:言語モデルには膨大なインターネットテキストがありますが、物理データは非常に少ないです。天気予測モデルではわずか5万件のサンプルしかなく、核融合実験では数千回のデータしかありません。単にデータを積み重ねるだけでは問題を解決できません。
  • 高い解像度の要求:物理シミュレーションでは高精度が必要です(例:天気予測では大気の流れやハリケーンの詳細を捉える必要がありますが、ビデオモデルのように「見えればよい」というロジックは適用できません。

2. ニューラルオペレーター:物理的構造を活用した計算効率の向上

ニューラルオペレーターは物理世界向けに特別に設計されたAIアーキテクチャであり、その核心は物理法則を利用して計算量を削減することです:

  • 関数間のマッピング:入出力の解像度を固定せず、異なるスケールのデータを処理できます(例:粗いグリッドから細かいグリッドへの変換)。
  • フーリエニューラルオペレーター:フーリエ変換を用いて空間次元を処理し、非局所的な依存関係を効率的に捉えます(例:シカゴの天気がサンフランシスコに与える影響)。フーリエ変換の計算複雑度はほぼ線形であり、Transformerの2次の複雑度よりもはるかに低いです。
  • 物理的制約の組み込み:保存則(例:エネルギー保存則)や偏微分方程式(例:流体力学方程式)をトレーニング損失に組み込むことで、モデルの出力が物理法則に従うようにし、「幻想」を避けます。

3. 天気予測から核融合まで:実際の応用での突破

ニューラルオペレーターは多くの分野で実用化され、驚くべき成果を上げています:

  • 天気予測:FourCastNetモデルはコンシューマグレードのGPUで動作し、従来のスーパーコンピュータよりも数万倍高速であり、専門的な気象モデルに匹敵する精度を持っています。極端な天気(ハリケーンや熱波)を予測でき、小規模な国々でも高精度の予報を受けることができます(「天気モデリングの民主化」)。
  • 核融合炉:プラズマの進化を数百万倍高速にシミュレーションし、破壊的な事象を予測する「デジタルツイン」を作成したり、磁場を調整してプラズマを安定させる制御方案を設計するのに役立ちます。
  • その他の応用:地下での二酸化炭素の封じ込め(CO₂の移動シミュレーション)、自動車の空気力学(形状の最適化)、チップの逆エッチング(チップ構造に基づいたマスクの設計)など。

4. 物理基礎モデル:予測だけでなく設計も可能

Animaチームの最終目標は物理基礎モデルです。これは多様な物理過程を処理できる汎用モデルであり、以下のような機能を持っています:

  • 複数の物理場の結合:熱、力学、電磁などの過程を同時にシミュレートできます(例:温度の上昇による材料の変形)。
  • 逆向きの設計:目標となる結果を与えると、最適な設計を逆算で求めることができます(例:チップの特定の性能を求める場合、AIが人間が思いつかないマスク構造を設計できる)。
  • 異分野間の知識の移転:まず基本的な物理モジュール(例:熱伝播や材料の変形)を学び、その後、少量のデータで複雑な結合問題を微調整します。

5. 検証と信頼性:AIが物理世界に進出するための「ガードレール**

物理システムでは「幻想」が許されません(例:天気予測が誤って災害対策に失敗すると重大な結果を招く)。そのため、検証ツールが非常に重要です:

  • TorchLean:ニューラルネットワークを形式化された検証システムLeanに組み込むことで、モデルの堅牢性を証明できます。例えば、入力に小さなノイズがあっても、出力の変動範囲が安全な範囲内に収まることを確認できます(例:核融合炉の制御が破壊されない)。
  • なぜ重要か:科学分野におけるAIのボトルネックは「アイデアを生成すること」ではなく、「そのアイデアが正しいかを検証すること」です。TorchLeanにより、AIモデルの出力に「有効性の保証」がなされ、AIが産業制御や医療などの重要な分野に進出するための前提となります。

拡張的な考察

AI for Scienceの次の大きな進化は、「より大きなTransformer」ではなく、人間が既に知っている物理的構造をモデルに組み込むことです。AIが「世界を記述する」(言語モデル)から「世界をシミュレートする」(物理基礎モデル)へと進化することで、科学の発見や工業設計に真に貢献するようになります。例えば、より効率的な核融合炉の設計やより環境に優しい材料の開発、極端な気候現象の予測による命の救済などです。これこそがAIが世界を変えるための本当の方向性です。