虎嗅

AI가 인터넷의 내용을 모두 읽어본 후에야, 진짜 세상이 더 어렵다는 것을 깨달았다.

原文:AI读完了互联网,才发现真实世界更难

핵심 내용 요약

Anima Anandkumar 교수팀은 신경 연산자(예: 푸리에 신경 연산자)를 사용하여 딥러닝과 물리 법칙(기하학적 구조, 보존 법칙 등)을 결합함으로써 물리 세계의 고차원 연속 시스템 모델링 문제를 해결했습니다. 이러한 모델들은 기존 방법보다 수만 배에서 수백만 배 더 빠르며, 기상 예측, 핵융합로 시뮬레이션 등에 이미 적용되고 있습니다. 또한, 다양한 물리 과정을 처리할 수 있는 범용 모델인 “물리 기반 모델”의 구현을 추진하고 있으며, TorchLean 도구를 통해 모델의 신뢰성을 보장하고 있습니다.

1. Transformer가 물리 세계를 처리할 수 없는 이유 – 세 가지 주요 장애물

언어 모델(예: Transformer)은 물리 세계에서 제대로 작동하지 않는데, 이는 세 가지 주요 차이점 때문입니다:

  • 차원의 차이: 언어는 일차원 시퀀스(문장)인 반면, 물리 시스템은 3차원 공간과 시간(4차원)으로 구성됩니다. 예를 들어, 기상 모델은 지구 전역의 0.25도 간격의 그리드(약 1,000×1,000×1,000개의 점)를 처리해야 하며, 각 점을 Token으로 간주하면 Transformer의 전역적인 주의력 계산량이 폭발적으로 증가합니다(1e9개의 Token에 대한 2차 복잡도로는 계산이 불가능합니다).
  • 데이터 양의 부족: 언어 모델은 방대한 인터넷 텍스트를 가지고 있지만, 물리 데이터는 매우 적습니다. 기상 모델은 단지 5만 개의 샘플만을 가지고 있으며, 핵융합 실험은 몇 천 번만 수행되었습니다. 따라서 “데이터를 축적하는” 방법으로는 문제를 해결할 수 없습니다.
  • 고해상도 요구: 물리 시뮬레이션은 높은 정확도가 필요합니다(예: 기상 예측에서는 대기의 흐름이나 허리케인의 세부 사항을 포착해야 함). 반면, 비디오 모델의 경우 낮은 해상도로도 “보기에만 괜찮으면” 됩니다.

2. 신경 연산자: 물리적 구조를 활용한 효율적인 계산

신경 연산자는 물리 세계를 위해 특별히 설계된 AI 아키텍처로, 핵심은 물리 법칙을 활용하여 계산량을 줄이는 것입니다:

  • 함수 간의 매핑: 입력과 출력의 해상도를 고정하지 않아 다양한 스케일의 데이터를 처리할 수 있습니다(예: 거친 그리드에서 세밀한 그리드로의 변환).
  • 푸리에 신경 연산자: 푸리에 변환을 사용하여 공간적 차원을 처리하며, 비지역적 의존성(예: 시카고의 기상이 샌프란시스코에 미치는 영향)을 효율적으로 포착할 수 있습니다. 푸리에 변환의 계산 복잡도는 거의 선형에 가까워 Transformer의 2차 복잡도보다 훨씬 낮습니다.
  • 물리적 제약의 적용: 보존 법칙(예: 에너지 보존)이나 편미분 방정식(예: 유체 역학 방정식)을 학습 과정에 포함시켜 모델의 출력이 물리 법칙에 부합하도록 합니다.

3. 기상 예측에서 핵융합까지: 실제 응용 분야에서의 혁신

신경 연산자는 이미 여러 분야에서 놀라운 성과를 보이고 있습니다:

  • 기상 예측: FourCastNet 모델은 소비자용 GPU로도 실행 가능하며, 기존 슈퍼컴퓨터보다 수만 배 더 빠르고 전문 기상 모델과 비슷한 정확도를 가지고 있습니다. 극심한 기상 현상(허리케인, 열파)을 예측할 수 있으며, 소규모 국가에서도 고정밀도 예측을 제공합니다(“기상 모델링의 민주화”).
  • 핵융합로: 플라즈마의 진화를 수백만 배 더 빠르게 시뮬레이션하여 불량 사고를 예방하고(예: 반응로 손상 방지), 제어 방안을 설계하는 데에도 도움을 줍니다(예: 자기장을 조정하여 플라즈마를 안정화).
  • 기타 분야: 지하 탄소 저장(예: CO₂ 이동 시뮬레이션), 자동차 공기역학(예: 차량 형태 최적화), 칩 역광리소그래피(예: 칩 구조에 맞는 마스크 설계) 등.

4. 물리 기반 모델: 예측을 넘어선 설계

Anima 팀의 궁극적인 목표는 다양한 물리 과정을 처리할 수 있는 범용 모델을 만드는 것입니다:

  • 다중 물리장의 결합: 열, 역학, 전자기 등의 과정을 동시에 시뮬레이션할 수 있습니다(예: 온도 상승이 재료 변형을 유발하는 경우).
  • 역설계: 목표 결과를 기반으로 최적의 설계를 찾을 수 있습니다(예: 칩의 특정 부분의 성능을 원할 경우, AI가 인간이 생각하지도 못한 마스크 구조를 설계할 수 있음).
  • 분야 간의 이전: 먼저 기본 물리 모듈(예: 열 전파, 재료 변형)을 학습한 후, 소량의 데이터로 복잡한 결합 문제를 해결할 수 있습니다.

5. 검증과 신뢰: AI가 물리 세계에 진입하기 위한 안전 장치

물리 시스템은 “오류”(예: 잘못된 기상 예측으로 인한 재난 대응 실패)를 용납할 수 없으므로 검증 도구가 매우 중요합니다:

  • TorchLean: 신경 네트워크를 형식화된 검증 시스템인 Lean에 통합하여 모델의 안정성을 증명할 수 있습니다(예: 입력에 작은 변동이 있을 때, 출력의 변화 범위가 안전한 한계 내에 있는지 확인).
  • 왜 중요한가: 과학 AI의 병목 현상은 “아이디어를 생성하는 것”이 아니라 “아이디어가 올바른지 검증하는 것”입니다. TorchLean은 AI 모델의 출력이 신뢰할 수 있도록 하여, AI가 산업 제어, 의료 등의 중요한 분야에 진입하는 데 필수적입니다.

확장적인 사고

AI for Science의 다음 혁신은 “더 큰 Transformer”가 아니라, 인간이 이미 알고 있는 물리적 구조를 모델에 코딩하는 것입니다. AI가 “세계를 설명하는” 언어 모델에서 “세계를 시뮬레이션하는” 물리 기반 모델로 발전할 때, 과학적 발견과 산업 설계에 진정으로 기여할 것입니다. 예를 들어, 더 효율적인 핵융합로를 설계하거나, 더 친환경적인 재료를 개발하거나, 극심한 기후 현상을 예측하여 생명을 구하는 등입니다. 이것이 바로 AI가 세상을 변화시키는 핵심 방향입니다.