한국어 분석:
1. 핵심 내용 요약
이 기사는 현재 전 세계 대형 모델 업계에서 가장 중심적인 “동문 간의 경쟁”에 대해 자세히 다루고 있습니다. 오픈AI가 최근에 출시한 GPT-6 Astra가 업계 통합 능력 테스트에서 다시 “세계에서 가장 똑똑한 모델”이라는 타이틀을 되찾았지만, 지난 1년 동안 오픈AI의 핵심 직원들이 떠나서 설립한 앤서로픽(Anthropic)은 기업들이 가장 많이 비용을 지불할 의향이 있는 코드 개발 시나리오를 미리 선점함으로써 시장 점유율, 연간 수익, 평가 가치에서 오픈AI를 완전히 앞질렀습니다. 이제 두 회사 간의 경쟁은 단순히 “누가 더 높은 점수를 받는가”라는 초보적인 단계를 넘어서서 “누가 AI를 기업의 실제 업무 흐름에 효과적으로 통합하여 장기적으로 안정적인 수익을 창출하는가”라는 새로운 단계로 진입했습니다. 단순히 모델 성능이 뛰어나다고 해서 상업적 경쟁에서 승리할 수는 없습니다.
---
2. 5가지 측면에서의 설명
1. 오픈AI가 되찾은 “1위”는 단지 “시험 점수 1위”에 불과합니다
많은 사람들이 오픈AI가 자신들을 세계에서 가장 지능적인 모델이라고 주장하는 것을 보고 시장을 다시 장악했다고 생각하지만, 이 “1위”의 가치는 실제로는 절반으로 줄어들었습니다.
소위 97.6%의 수학 점수, 99.9%의 상식 추론 점수, 100%의 해킹 방어 테스트 만점은 업계 전체가 통일적으로 사용하는 표준화된 시험 문제입니다. Astra는 이 시험에서 거의 만점에 가까운 점수를 받았으며, 이전에는 앤서로픽의 Claude 시리즈가 이 시험에서 오픈AI를 앞질러 “기술적으로 1위”라는 이미지를 차지했습니다. 이번에 Astra가 시험에서 반격하여 기술적인 명성을 되찾았습니다.
하지만 이 “1위”는 시장에서의 1위와는 전혀 다릅니다. 현재 제3자의 독립적인 순위에서 Astra는 앤서로픽의 최신 모델과 공동으로 1위를 차지하고 있으며, 시험 점수가 높다고 해서 사용자들이 돈을 지불할 의향이 있다는 것을 의미하지는 않습니다. 새로운 스마트폰의 성능이 경쟁 제품보다 20% 높다고 해도 실제로 더 잘 팔릴 수 있는지는 전혀 다른 문제입니다.
2. 앤서로픽이 오픈AI를 앞질러낸 이유는 무엇일까요? 바로 돈을 기꺼이 지불하는 고객을 타겟으로 했기 때문입니다
앤서로픽의 창립자는 오픈AI의 연구 부문에서 2인자였으며, 2020년에 핵심 직원들을 이끌고 회사를 설립했습니다. 지난 몇 년 동안 오픈AI를 따라다니다가 지난해에는 전혀 다른 분야로 전환하여 오픈AI를 앞질렀습니다.
앤서로픽은 일반 소비자들을 대상으로 한 채팅 시장을 놓고 경쟁하는 대신, 대형 모델 상용화가 가장 성숙한 “프로그래머의 코드 작성” 시나리오에 집중했습니다. 현재 실리콘밸리 기업들이 AI에 지출하는 370억 달러 중 40억 달러가 코드 작성을 위한 AI에 사용되고 있으며, 앤서로픽은 이 시장을 완전히 장악했습니다. 현재 모든 기업이 대형 모델 API를 구매하는 총 지출 중 앤서로픽이 40%를 차지하는 반면, 오픈AI는 27%에 불과합니다. 전문 코드 AI 시장에서는 앤서로픽이 54%를 차지하고 오픈AI는 21%에 불과합니다.
수익 차이는 매우 큽니다. 현재 월 수익으로 계산하면 앤서로픽은 연간 650억 달러를 벌고, 오픈AI는 400억 달러를 벌고 있으며, 앤서로픽의 평가 가치는 9650억 달러로 오픈AI의 8520억 달러보다도 높습니다. 이제는 국내 벤처 투자 커뮤니티에서도 “중국판 앤서로픽”을 찾고 있으며, 대형 모델 상용화의 기준으로 여기고 있습니다.
3. 오픈AI가 앤서로픽을 추격하는 것은 단순히 점수를 높이기 위함이 아니라 “기업의 업무 권한”을 얻기 위함입니다
오픈AI가 Astra를 출시한 것은 일반 ChatGPT 사용자를 위한 것이 아니라 앤서로픽의 강점을 겨냥한 것입니다. 오픈AI는 자신들의 채팅 기능이 재미있다는 점을 강조하는 대신, 코드 작성에 능숙하고 컴퓨터 내의 다양한 소프트웨어를 직접 조작할 수 있으며, 요구 사항을 받은 후에 모든 작업을 단계별로 완료할 수 있다는 점을 강조합니다.
실제로 오픈AI는 이전에 ChatGPT를 통해 소비자 시장의 이점을 누렸으며, 이제는 앤서로픽이 개척한 경로를 따라가고 있습니다. 올해 오픈AI는 기업 내부 데이터와 시스템을 연동할 수 있는 에이전트 플랫폼을 출시했으며, 맥킨지, PwC, 액센츄어와 같은 전 세계적으로 기업 서비스를 잘 판매하는 컨설팅 회사들과 협력하여 고객을 확보하고 있습니다. 이전에 출시한 코드 도구 Codex는 이미 1500만 명의 주간 활성 사용자를 보유하고 있으며, 그 중 절반은 프로그래머가 아닌 운영자, 분석가, 투자자와 같은 일반 직원들입니다.
두 회사의 목표는 완전히 다릅니다. 최첨단 대형 모델의 수익은 단순히 채팅 도우미로서 얻는 것이 아니라 기업의 실제 업무 흐름에 직접 통합하여 기업이 해야 할 일을 대신 처리하는 것입니다. 누가 더 많은 기업의 “업무 권한”을 얻을 수 있을지가 진정한 승자를 결정할 것입니다.
4. 대형 모델 업계의 새로운 불문율: 점수가 높다고 해서 실제 수익이 보장되지 않습니다
많은 사람들이 이해할 수 없는 것은, 앤서로픽의 모델 점수가 Astra보다 낮음에도 불구하고 기업들이 여전히 앤서로픽에 돈을 지불하는 이유입니다. 기업이 AI를 구매하는 논리는 일반 소비자가 새 스마트폰을 구매하는 것과는 완전히 다릅니다.
일반 소비자는 성능이 조금 더 좋은 새 제품을 위해 몇 천 달러를 더 지불할 의향이 있지만, 기업은 최신 제품을 추구하지 않습니다. 데이터에 따르면 앤서로픽의 최신 모델은 전체 기업 고객 사용량의 6%만을 차지하며, 94%의 기업은 성능은 조금 낮지만 가성비가 높은 기존 모델을 선호합니다. 즉, 최첨단 대형 모델의 능력이 이미 “80%의 작업을 완료할 수 있는” 수준을 넘어선 후에는 기업들은 나머지 20%의 성능 향상을 위해 몇 배의 비용을 더 지불할 의향이 없으며, 오히려 다음과 같은 사항을 더 중요하게 생각합니다: 내 민감한 데이터가 내 서버에 안전하게 보관될 수 있는가? 당신의 AI가 내가 이미 사용하고 있는 CRM, 스프레드시트, 오피스 소프트웨어와 원활하게 연동될 수 있는가? 내가 몇 달 동안 팀의 업무 프로세스를 당신의 AI에 맞게 조정했는데, 다른 제품으로 바꾸면 마이그레이션 비용이 너무 많고 번거롭지 않은가?
이러한 성능과 무관한 요소들이 이제 점수보다 훨씬 더 중요합니다. 설령 오픈AI의 모델 점수가 앤서로픽을 앞질렀다고 해도 앤서로픽의 기존 고객을 한 번에 빼앗을 수는 없습니다.
5. 다음 라운드의 경쟁은 “누가 더 똑똑한 모델을 가지고 있는가”가 아닙니다
이제 두 회사가 경쟁하는 것은 단순히 “어떤 모델이 더 똑똑한가”가 아니라 더 장기적인 목표를 위한 것입니다. 앞으로 기업 내에는 하나의 AI만 있는 것이 아니라 수십 개, 수백 개의 다른 AI가 각자 다른 업무를 할 것입니다. 코드를 작성하는 AI, 보고서를 만드는 AI, 고객을 관리하는 AI, 디자인을 하는 AI 등이 있으며, 이러한 AI들이 사람의 지시 없이도 서로 협력하여 복잡한 작업을 완료할 수 있도록 하는 것이 다음 라운드의 핵심 경쟁 포인트입니다.
오픈AI는 모든 기업 내부의 AI를 통합하여 관리하는 플랫폼을 개발하고 있으며, 앤서로픽은 다양한 브랜드의 AI들이 서로 연동될 수 있는 통용 프로토콜을 개발하고 있습니다. 미래에 누가 이러한 AI들을 모두 연결하여 안정적으로 협력할 수 있게 만들 수 있을지가 진정한 업계 리더가 될 것입니다. 그때가 되면 지금 모두가 경쟁하는 “점수 1위”는 더 이상 핵심 경쟁력이 되지 않을 것입니다.