虎嗅

AI의 내부 고발자: 사직서는 받았지만, 경고는 어디에?

原文:AI的吹哨人:辞职信有人收,但是警报呢?

AI의 “반란”에 대한 우려가 실험실을 벗어나다: 신뢰, 경쟁, 그리고 규칙에 대한 심층적인 분석

안녕하세요, 여러분. 저는 여러분의 금융 전문 기자입니다. 오늘 우리가 이야기할 주제는 지루한 기술 논문이 아니라, AI 산업 내부에서 일어난 “지진”과도 같은 사건입니다.

9월 9일, Jacob Coxon이라는 경험 많은 AI 연구원이 최고의 AI 기업인 Anthropic을 그만두었습니다. 그러나 그의 사직 방식은 매우 특별했습니다. 그는 조용히 떠나지 않고 공개적으로 나서서 OpenAI와 Anthropic이라는 두 거대 기업이 “무책임한 경쟁”을 벌이고 있으며, 인류를 위험한 상황으로 몰아가고 있다고 경고했습니다.

이것은 마치 원자력 발전소에서 수년간 일해온 엔지니어가 갑자기 작업복을 벗고 문 앞에 서서 “반응로가 통제 불능 상태에 가고 있으며, 여러분은 계속 연료를 추가하고 있다!”고 외치는 것과 같습니다.

이 기사의 핵심은 Coxon의 이러한 “경고” 행동과 그 뒤에 숨겨진 AI 산업의 깊은 갈등에 있습니다. 여러분이 이해하기 쉽도록, 이 사건을 다섯 가지 측면으로 나누어 설명해 드리겠습니다.

---

1. 왜 그의 말이 중요한가? – “내부자”的 탈퇴가 “외부자”的 비판보다 더 충격적이다

먼저, Coxon이 누구인지 알아야 합니다. 그는 길가에서 지적하는 사람도, 주목을 끌기 위해 이야기를 지어내는 인터넷 유명인도 아닙니다.

그의 이력은 매우 탄탄합니다:

그는 OpenAI와 Anthropic이라는 세계 최고의 AI 연구소에서 3년간 일했습니다. 그는 GPT-4.5와 같은 최고 수준의 모델의 사전 훈련에 참여했으며, 그의 이름은 공식 기여자 명단에 올라 있습니다. 이는 그가 AI가 어떻게 만들어지는지 알 뿐만 아니라 그 과정에 직접 참여했다는 것을 의미합니다.

그의 동기는 매우 순수합니다 (또는 매우 무거운 것입니다):

일반적으로 직원들이 회사를 떠나는 이유는 급여가 충분하지 않거나 상사가 무능하거나, 더 나은 환경을 원하기 때문입니다. 하지만 Coxon은 “양심의 가책” 때문에 떠났습니다. 그는 이 두 회사가 1위를 차지하기 위해 “스스로를 개선할 수 있는” 초강력한 AI를 개발하고 있지만, 안전 장치가 제대로 설치되어 있지 않다고 걱정합니다.

왜 이것이 중요한가?

만약 당신이 의사라면, 병원이 진행을 서두르기 위해 충분히 테스트되지 않은 새 약을 환자에게 사용하고 있으며, 그 부작용이 치명적일 수 있다는 것을 발견했다고 상상해 보세요. 당신이 단순히 사직한다면, 그것은 당신 개인의 선택일 뿐입니다. 하지만 사직한 후에 병력을 들고 거리로 나가서 “이 병원이 환자를 해치고 있다”고 모두에게 말한다면, 이것이 바로 “경고”입니다.

Coxon의 행동은 그를 “참여자”에서 “경고자”로 바꾸었습니다. 그는 연구에 참여한 사람들이 위험을 과소평가할 수도 있고, 방향을 잘못 판단할 수도 있다는 것을 인정하지만, “침묵”하는 것이 “잘못된 말”하는 것보다 더 위험하다고 생각하여 공개적으로 표현하기로 선택했습니다. 그는 “어차피 다른 사람들도 할 것이다”는 변명으로 자신의 책임을 덮어쓰고 싶지 않았습니다.

핵심 포인트: 그의 경고는 종말을 예언하는 것이 아니라, 내부적인 관점에서의 위험 신호입니다. 우리는 즉시 세상의 종말이 올 것이라고 믿을 필요는 없지만, 왜 핵심 기술자가 “뭔가 잘못되었다”고 생각하는지 진지하게 들어볼 필요가 있습니다.

---

2. 왜 남아 있는 사람들은 그의 우려를 과소평가하는가? – “안전 연구”가 만능이 아니며, 경쟁의 논리는 매우 잔인하다

Coxon이 떠난 후, Anthropic의 연구원 Samuel Marks는 이렇게 말했습니다: “일부 우려에 동의하지만, 제가 하는 안전 연구가 위험을 줄일 수 있다고 믿기 때문에 남기로 했습니다.”

이것은 매우 현실적인 질문을 제기합니다: 모두가 위험하다고 생각하는데, 왜 여전히 그 “위험한 상황”에 머물고 싶어하는 사람들이 있을까?

남아 있는 이유는 복잡하며, 모두가 돈을 원하는 것은 아닙니다:

1. 능력은 플랫폼이 필요합니다: AI 안전 연구를 하려면 엄청난 컴퓨팅 파워, 방대한 데이터, 그리고 핵심 시스템에 접근할 권한이 필요합니다. 이러한 자원은 거대 기업만이 가지고 있습니다. 집에서 사용하는 컴퓨터로는 진짜 안전 테스트를 할 수 없습니다. 따라서 남아 있는 사람들은 “내가 여기 있어야만 위험을 최소화할 수 있다”고 진심으로 믿을 수도 있습니다.

2. 경쟁의 악순환: 이것이 가장 핵심적인 논리입니다. OpenAI는 Anthropic을 신뢰하지 않으므로 먼저 개발하려고 하고, Anthropic은 OpenAI를 신뢰하지 않으므로 먼저 개발하려고 합니다.

  • 이것은 마치 절벽 가에서 서로 경주하는 두 명의 운전자와 같습니다. A는 B가 브레이크를 밟을 것이라고 생각하므로 브레이크를 밟지 않고, B는 A가 브레이크를 밟을 것이라고 생각하므로 브레이크를 밟지 않습니다.
  • 결과적으로: 누구도 먼저 브레이크를 밟지 않습니다. 왜냐하면 늦어지면 질 수 있기 때문입니다.
  • 이러한 논리 하에서 “안전”은 종종 “상업적 선두”의 변명이 됩니다. 회사는 “경쟁자가 너무 위험하기 때문에 더 많은 자원을 투자하여 안전을 강화한다”고 말할 수 있습니다.

진심과 결과의 모순: 많은 회사들이 “우리는 안전을 원한다”고 말하지만, 이 말이 진심인지는 결과로 판단해야 합니다. 경쟁자를 두려워하여 투자가 점점 늘어나고, 그 결과 “안전”에 대한 약속이 자기 위안이 되는 경우가 많습니다.

핵심 포인트: 가장 위험을 걱정하는 사람들이 모두 사직한다고 해서 실험실이 더 안전해지는 것은 아닙니다. 안전 연구에는 “현장에 있어야” 합니다. 하지만 “현장에 있는” 사람들이 실제로 위험을 제한하고 있는지, 아니면 단지 위험을 가속화하고 있는지는 외부의 검증이 필요합니다.

---

3. 왜 경고가 무시되는가? – “챌린저호” 사건의 교훈: 조직 내의 “정보 블랙홀”

Coxon의 경고는 1986년 “챌린저호” 우주왕복선 폭발 사고를 떠올리게 합니다.

그 이야기는 이렇습니다:

발사 전, 계약업체는 명시적으로 경고했습니다: 온도가 너무 낮아서 고무 링이 제대로 작동하지 않을 수 있으므로 발사해서는 안 됩니다. 경영진은 처음에는 동의했지만, 진행을 서두르기 위해 결정을 바꾸었습니다. 엔지니어들은 계속 반대했지만, 그들의 목소리는 여러 단계의 보고 과정에서 사라졌습니다. 결국, 의사결정자들은 아래에서 반대하는 사람들이 있다는 것을 전혀 몰랐거나, 알고도 신경 쓰지 않았습니다.

AI 산업도 이런 상황을 반복하고 있는가?

Coxon의 우려는, 누군가가 이의를 제기하더라도 그 이의가 조직 내부에서 “소화”될 수 있다는 것입니다.

  • 직원 A가 말합니다: “이 기능에는 위험이 있습니다.”
  • 매니저 B가 말합니다: “기록해두고, 조사해보자.”
  • 연구원 C가 말합니다: “저는 살펴봤지만, 큰 문제는 없습니다.”
  • 결국, 프로젝트는 계속 진행되었습니다.

이 과정에서 아무도 나쁜 사람은 아닙니다. 모두가 자신의 역할을 수행했습니다. 하지만 결과는 중요한 안전 정보가 필요한 사람들에게 전달되지 않았습니다.

“발언권”은 일종의 위안제일 수 있습니다: 회사는 당신이 의견을 제시하는 것을 허용하고 심지어 장려하지만, 그것이 결정을 바꿀 수 있다는 것을 의미하지는 않습니다. 당신이 아무리 반대해도 프로젝트가 계속 진행된다면, “발언을 허용하는 것”은 형식주의에 불과합니다. 이는 회사가 “민주적”이고 “개방적”으로 보이게 하지만, 실제로는 의사결정권이 소수의 사람들에게 있으며, 그들의 결정은 종종 상업적 이익에 의해 이끌립니다.

핵심 포인트: 우리는 “왜 아무도 나서지 않는가?”라고 묻어서는 안 됩니다 (왜냐하면 Coxon과 같은 사람이 이미 나섰기 때문입니다). 우리가 물어봐야 할 것은 누군가가 나섰을 때 조직이 무엇을 했는가? 프로젝트를 중단했는가? 아니면 검증을 강화했는가? 아니면 단지 기록에 남겨두고 계속 진행했는가?

---

4. 회사의 “안전 정책”은 충분한가? – 합법이라고 해서 안전한 것은 아니다, 규칙은 기술을 이길 수 없다

Anthropic과 다른 AI 회사들은 모두 완벽한 안전 정책을 가지고 있습니다: 신고 체계, 보복 방지 약속, 이사회의 감독 등이 있습니다. 듣기에는 좋죠?

하지만 여기에 큰 문제가 있습니다:

이러한 정책들은 주로 불법 행위를 방지하기 위한 것입니다 (예: 데이터 도난, 차별 등). 하지만 Coxon이 걱정하는 것은 회사가 “불법”을 저지르는 것이 아니라, “합법적으로” 인류를 파괴할 수 있는 일을 하는 것입니다.

예를 들어보겠습니다:

  • 기존 규칙: 운전할 때 시속 120km를 초과해서는 안 됩니다.
  • 새로운 상황: 당신이 시속 1000km로 날 수 있는 차를 발명했습니다.
  • 문제는: 당신은 “시속 120km를 초과하지 않는” 규칙을 준수했나요? 네, 그렇습니다. 하지만 그 차는 안전한가요? 분명히 그렇지 않습니다.

AI 기술은 빠르게 발전하고 있지만, 법률과 규제는 여전히 뒤처져 있습니다. 2024년에는 일부 AI 직원들이 “경고권”을 제안했는데, 이는 기존의 경고자 보호가 불법 행위에만 적용된다는 것을 지적했습니다. AI의 위험은 종종 “아직 불법으로 정의되지 않았기” 때문입니다.

어색한 현실:

  • 직원이 말합니다: “회사가 안전 규칙을 위반했습니다.” -> 회사는 절차를 확인하여 위반 여부를 확인할 수 있습니다.
  • 직원이 말합니다: “회사는 모든 규칙을 준수했지만, 규칙 자체가 부족하여 위험이 너무 큽니다.”