虎嗅

코덱스(Codex)의 한도가 점점 더 빨리 소진되고 있다는 것을 눈치채셨나요?

原文:有没有发现,Codex 的额度越来越不经用了

핵심 내용 요약

이 기사는 현재의 AI 프로그래밍 구독 서비스(예: OpenAI Codex) 뒤에 숨겨진 잔인하고 은밀한 비즈니스 논리를 밝혀냅니다. 고정 월정액을 지불하지만, 실제로 얻을 수 있는 “컴퓨팅 성능”과 “작업 시간”이 제조업체에 의해 모델 업그레이드, 요금 체계 조정 등의 방법으로 조용히 줄어들고 있습니다.

간단히 말해, 이전에는 구독 소프트웨어를 “뷔페”처럼 이용할 수 있었고, 낭비하지 않는 한 원하는 만큼 사용할 수 있었습니다. 하지만 이제는 “시간제 및 제한된 양의 패키지”가 되었으며, “레스토랑 주인”(AI 제조업체)은 언제든지 각 음식의 양을 줄일 수 있을 뿐만 아니라, 새로운 모델이 더 많은 컴퓨팅 자원을 소모하기 때문에 원래 일주일 분량의 작업이 이제는 반나절 만에 소진될 수 있습니다. 더욱 심각한 것은 이러한 “감소”가 명확하게 청구서에 표시되지 않고 복잡한 알고리즘과 모호한 진행 상황 표에 숨겨져 있어 사용자가 모르게 더 많은 돈을 지불하게 되며, “더 많은 돈을 주더라도 원하는 양을 얻을 수 없는” 상황에 처하게 됩니다.

---

자세한 분석: 왜 AI 구독 서비스가 점점 더 “쓸모없어지는가?”

이 현상을 완전히 이해할 수 있도록 다음 다섯 가지 측면으로 자세히 분석해 보겠습니다:

1. **“보이지 않는 감소”: 모델이 강해졌지만, 사용자의 비용은 줄어들었습니다**

많은 사용자들이 구독 등급이 변하지 않았음에도 불구하고 이전에는 완료할 수 있었던 작업이 이제는 절반만 해도 용량이 부족해진다는 것을 발견했습니다. 이는 착각이 아니라 모델의 진화로 인한 “컴퓨팅 성능 인플레이션” 때문입니다.

  • 이전의 논리: 구형 모델(예: 초기 GPT-4 또는 Sol)은 작업을 처리할 때 생각 과정이 짧고 사용하는 도구가 적어 “직선적인” 방식으로 작업을 했으며, 작업 속도가 빠르고 자원 소모가 적었습니다.
  • 현재의 논리: 새로운 모델(예: GPT-5.6 Sol 또는 Astra)은 더 똑똑하지만 더 많은 과정을 거칩니다. 더 정확한 답을 내기 위해 더 긴 추론 과정을 거치고 다양한 도구를 반복적으로 사용합니다. 이는 마치 작업자가 “직접 작업”하는 것에서 “먼저 설계를 하고, 재료를 찾고, 시도해 보고, 수정하는” 것으로 변한 것과 같으며, 각 단계마다 사용자의 “자원(토큰/용량)”을 소모합니다.
  • 결과: 공식적으로 “지속 시간이 18% 증가했다”고 하지만, 이는 단일 작업의 효율성 향상만을 의미할 수 있습니다. 전체 작업 흐름을 고려하면 단일 작업에 소모되는 자원이 크게 증가하여 원래 일주일 분량의 자원이 이제는 반나절 만에 소진될 수 있습니다. 이것이 사용자가 용량이 “줄어들었다”고 느끼는 이유입니다. 숫자가 변한 것이 아니라 단위당 가치가 변한 것입니다.

2. 요금 체계의 혼란: 사용자가 보는 “백분율”은 사실상 제조업체의 “블랙박스”

기사는 사용자가 실제로 얼마나 많은 돈을 지불했는지 정확히 알 수 없는 핵심 문제점을 언급합니다. 사용자는 모호한 진행 상황 표만 볼 수 있습니다.

  • 진행 상황 표의 속임수: OpenAI와 같은 제조업체는 “사용된 백분율”만 표시하고 구체적으로 얼마나 많은 토큰이 소모되었는지 또는 그것이 얼마의 돈에 해당하는지는 표시하지 않습니다. 이는 주유소의 계기판이 “남은 연료가 반 바퀴”만 보여주지만 그 연료가 92호인지 98호인지, 심지어 연료 탱크가 몰래 줄어들었는지도 알려주지 않는 것과 같습니다.
  • 제3자 도구의 등장: NerfTrack과 같은 도구가 인기 있는 이유는 사용자가 자신의 추측을 확인하기 위해 환산을 하고 싶기 때문입니다. 하지만 제조업체가 구체적인 요금 공식(예: 다른 모델, 다른 도구의 사용 가중치 계수)을 공개하지 않기 때문에 사용자는 여전히 정확하게 계산할 수 없습니다.
  • 모호성의 힘: 이러한 요금 체계의 모호성은 제조업체에게 큰 조작 여지를 줍니다. 사용자가 “용량이 줄었다”고 불평하면 제조업체는 “소모가 빨라졌다”고 주장할 수 있으며, 이는 “용량이 줄었다”는 것이 아닙니다. 이러한 정의권의 독점은 사용자가 자신의 권리를 주장할 때 절대적으로 불리한 상황을 만듭니다.

3. 비즈니스 전략: 구독제 뒤에 숨겨진 “손실 위험점”과 “사용자 선별”

제조업체가 이렇게 하는 이유는 AI 컴퓨팅 자원의 비용이 매우 높고 구독료는 상대적으로 고정되어 있어 큰 이익 차이와 손실 위험이 존재하기 때문입니다.

  • SemiAnalysis의 분석: 연구 기관의 계산에 따르면, 사용자의 사용률이 특정 임계값(예: Plus 등급의 11.4% 이상)을 초과하면 OpenAI는 손실을 보기 시작합니다. 이는 **이 가격 모델이 처음부터 “대부분의 사용자가 만족하지 못할 것”을 가정하고 설계되었다는 것을 의미합니다.
  • 고객 선별: 작가와 같이 매일 AI를 사용하여 코드를 작성하는 “고객”에게는 제조업체가 “손실을 보면서도 홍보 효과를 얻거나” 더 비싼 등급으로 업그레이드하도록 강요합니다.
  • 동적 조정 전략:
  • 가격 인하의 함정: 4월에 Business 패키지가 인하되었지만, 실제로는 용량도 함께 줄어들어 실제 가성비가 향상되지 않았습니다.
  • 구매 제한 및 중단: 9월에 Pro 20X의 신규 구독이 중단되었는데, 이는 “컴퓨팅 자원이 부족하기” 때문이라고 하지만 실제로는 비용을 통제하고 고가치 고객이 자원을 차지하는 것을 방지하기 위함입니다.
  • 결론: 제조업체는 용량을 동적으로 조정하고, 특정 기능을 제한하며, 고급 서비스를 중단하는 등의 방법으로 컴퓨팅 자원 비용의 위험을 사용자에게 전가하거나 더 높은 가격을 지불할 의향이 있는 사용자를 선별하여 수익을 유지하고 있습니다.

4. 규칙의 급격한 변화: “무제한 사용”에서 “초당 요금”으로의 사용자 경험의 단절

기사는 휴대폰 데이터, 소프트웨어 구독, AI 구독의 차이점을 비교하여 AI 구독이 사용자 경험에서 크게 후퇴했다고 지적합니다.

  • 전통적인 구독의 확실성:
  • 휴대폰 데이터: 10GB는 10GB이며, 다 사용하면 서비스가 중단됩니다. 규칙이 명확합니다.
  • 소프트웨어 구독: 1년을 구매하면 365일 동안 무제한으로 사용할 수 있습니다. 규칙이 안정적입니다.
  • WeChat 독서: 월정액이 고정되어 얼마나 많은 책을 읽을지 사용자가 결정합니다. 규칙이 간단합니다.
  • AI 구독의 불확실성:
  • Fast Mode의 함정: 속도가 1.5배 빠르지만 소모량은 2.5배입니다. 이는 고속도로 요금과 같아서 속도가 빠를수록 요금이 비례적으로 증가하며, 상한선이 없습니다.
  • 규칙의 자주 변경: 7월에는 5시간 제한이 없어졌다가 8월에 다시 도입되었고, 4월에는 가격이 인하되었지만 용량이 줄어들었습니다. 이러한 계약 정신의 부족은 사용자가 자신의 작업 리듬을 계획할 수 없게 만듭니다.
  • 심리적 불만: 사용자는 “구독하면 소유한다”는 기대를 가지고 있지만, 이제는 “몬스터를 잡고 레벨을 올리는” 게임을 하는 것처럼 느낍니다. 몬스터(코드 작성)를 해야 할 뿐만 아니라 계속해서 자원(용량)을 주시해야 하며, 자원이 소진되면 작업을 중단해야 합니다. 이러한 불안감은 전통적인 소프트웨어 구독에서는 경험할 수 없는 것입니다.

5. 사용자의 어려움: “인질”이 된 개발자와 다양한 플랫폼에서의 “게릴라 전쟁”

마지막으로, 기사는 현재 개발자들의 실제 상황을 지적합니다: AI 없이는 작업할 수 없지만, AI 제조업체에 의해 통제받고 있습니다.

  • 기술적 의존성: 이제는 AI Agent 없이는 효율적인 코드를 작성할 수 없습니다. AI는 “보조 도구”에서 “핵심 생산성 도구”로 변했습니다. 이러한 의존성으로 인해 사용자는 제조업체의 불합리한 규칙에 대해 협상력이 부족합니다.
  • 무력한 대응 전략:
  • 다양한 플랫폼의 사용: 한 곳을 신뢰할 수 없다면 여러 곳을 대비해야 합니다. 작가는 여러 모델의 토큰 플랜을 설정하여 필요한 상황에 따라 적절한 모델을 사용하여 작업을 완료합니다. 이는 분산화된 생존 전략의 전형적인 예입니다.
  • 비용 비교: 모든 제조업체가 자원을 줄이고 있지만, 인간 프로그래머를 고용하는 것에 비해 AI의 비용은 여전히 저렴합니다. 따라서 사용자는 이러한 “착취적인” 상황을 받아들이고 여러 제조업체 사이에서 최적의 조합을 찾아야 합니다.
  • 미래 전망: AI 기술이 더욱 보편화됨에 따라 이러한 “구독제 + 동적 용량” 모델이 업계 표준이 될 수 있습니다. 사용자는 “변동 환율”을 관리하는 것처럼 자신의 AI 예산을 관리하는 법을 배워야 하며, “고정 가격”을 기대하는 것이 아니라 “변동 가치”를 받아들여야 합니다.

---

일반 사용자에게 드리는 조언

1. 월정액만 보지 말고 “단위 컴퓨팅 성능당 가격”을 확인하세요: 구독하기 전에 해당 모델이 다양한 작업에서 얼마나 많은 토큰을 소모하는지 파악하세요. 가능하다면 무료 용량이나 저가 등급을 사용하여 자신의 일반적인 작업 흐름을 테스트하여 일주일에 얼마나 많은 자원이 소모되는지 확인하세요.

2. 다양한 플랫폼을 준비하세요: 모든 자원을 한 곳에만 의존하지 마세요. 적어도 2~3개의 다른 제조업체의 AI 서비스를 준비하여 한 곳의 용량이 부족하거나 규칙이 변경될 때 신속하게 전환할 수 있도록 하세요.

3. **커뮤니티 피드백에 주