虎嗅

Avez-vous remarqué que la limite de crédit de Codex devient de moins en moins fiable (ou : que la capacité de Codex à fournir des ressources financières diminue) ?

原文:有没有发现,Codex 的额度越来越不经用了

Résumé des points clés

Cet article révèle une logique commerciale cruelle et cachée derrière les services de souscription à l’écriture de code par intelligence artificielle actuels (à l’exemple d’OpenAI Codex) : même si vous payez un forfait mensuel, la puissance de calcul et le temps de travail que vous pouvez réellement obtenir sont progressivement réduits par les fabricants grâce à des mises à jour de modèles et à des ajustements des règles de facturation.

En bref, auparavant, souscrire à un logiciel était comme acheter un buffet : tant que vous ne gaspilliez rien, vous pouviez en manger autant que vous le vouliez. Aujourd’hui, c’est comme commander un forfait limité dans le temps et en quantité, et le propriétaire du restaurant (le fabricant d’IA) peut à tout moment réduire la portion de chaque plat. De plus, comme les nouveaux plats (nouveaux modèles) nécessitent plus de ressources (puissance de calcul), ce qui signifie que ce qui vous suffisait pour une semaine ne dure peut-être plus que la moitié d’un jour. Pire encore, cette réduction n’est pas directement indiquée sur la facture, mais cachée dans des algorithmes complexes et des barres de progression floues, faisant en sorte que les utilisateurs dépensent plus d’argent sans s’en rendre compte, voire se retrouvant dans la situation où ils doivent payer plus sans pouvoir obtenir davantage de ressources.

---

Analyse approfondie : pourquoi vos abonnements à l’IA deviennent-ils de moins en moins efficaces ?

Pour que vous compreniez pleinement la situation, nous allons décomposer ce phénomène en cinq aspects :

1. **Réduction invisible** : les modèles s’améliorent, mais votre argent devient moins précieux

De nombreux utilisateurs se demandent pourquoi les projets qui pouvaient être réalisés avec leur forfait précédent ne le peuvent plus avec le même forfait. Ce n’est pas une illusion, mais plutôt une inflation de la puissance de calcul causée par l’évolution des modèles.

  • Logique précédente : Les anciens modèles (comme GPT-4 ou Sol) effectuaient les tâches de manière plus directe et utilisaient moins de ressources.
  • Logique actuelle : Les nouveaux modèles (comme GPT-5.6 Sol ou Astra) sont plus sophistiqués, mais aussi plus gourmands en ressources. Pour fournir des réponses plus précises, ils effectuent des raisonnements plus longs et utilisent fréquemment divers outils de validation. C’est comme si un ouvrier passait de travailler directement à dessiner des plans, chercher des matériaux, essayer de réaliser le travail, puis modifier le résultat, consommant ainsi plus de ressources à chaque étape.
  • Conséquence : L’annonce d’une augmentation de la durée de fonctionnement de 18 % peut simplement refléter une amélioration de l’efficacité d’une tâche individuelle, mais si l’on considère l’ensemble du processus, la consommation globale de ressources étant plus élevée, le forfait qui suffisait pour une semaine ne dure peut-être plus que trois jours. C’est pourquoi les utilisateurs ont l’impression que leur forfait est devenu plus limité : ce n’est pas le chiffre qui a changé, c’est la valeur réelle de chaque unité de ressource qui a diminué.

2. **Brume de la facturation** : les pourcentages que vous voyez sont en réalité un “boîtier noir” pour les fabricants

L’article souligne un problème majeur : les utilisateurs ne peuvent pas savoir précisément combien d’argent ils ont dépensé et ne voient qu’une barre de progression floue.

  • Manipulation de la barre de progression : Les fabricants comme OpenAI ne montrent que le pourcentage d’utilisation, sans indiquer le nombre exact de tokens consommés ou l’équivalent en argent. C’est comme si le compteur de carburant d’une station-service ne vous disait que “il reste encore la moitié du réservoir”, sans préciser si le carburant est du type 92 ou 98, ou même si le réservoir a été réduit sans que vous le sachiez.
  • L’émergence d’outils tiers : Des outils comme NerfTrack sont populaires car les utilisateurs veulent vérifier leurs suppositions en effectuant des conversions. Cependant, comme les fabricants ne divulguent pas les formules de facturation (comme les coefficients de poids pour différents modèles et outils), il est toujours difficile de calculer précisément les coûts.
  • Le pouvoir de l’ambiguïté : Cette incertitude dans la facturation donne aux fabricants un grand pouvoir de manœuvre. Lorsque les utilisateurs se plaignent que leur forfait est réduit, les fabricants peuvent prétendre que c’est à cause d’une consommation plus élevée des ressources (en raison de la complexité des modèles), plutôt que d’une réduction directe du forfait. Ce monopole de la définition des règles place les utilisateurs dans une position de faiblesse lorsqu’ils cherchent à obtenir des réparations.

3. **Calculs commerciaux** : le “point de perte” derrière le modèle de souscription et le “sélection des utilisateurs”

Pourquoi les fabricants agissent-ils ainsi ? Parce que le coût de la puissance de calcul par intelligence artificielle est très élevé, tandis que les frais de souscription sont relativement fixes, créant un écart de profit important, voire un risque de perte.

  • Les calculs de SemiAnalysis : Une étude a montré que lorsque le taux d’utilisation des utilisateurs dépasse un certain seuil (par exemple, plus de 11,4 % pour le forfait Plus), OpenAI commence à perdre de l’argent. Cela signifie que ce modèle de tarification suppose dès le départ que “la plupart des utilisateurs n’utiliseront pas pleinement les ressources”.
  • Sélection des utilisateurs intensifs : Pour les utilisateurs qui utilisent l’IA à haute intensité, comme l’auteur pour écrire du code, les fabricants perdent de l’argent, mais gagnent en attirant leur attention ou en les forçant à passer à des forfaits plus chers.
  • Stratégies d’ajustement dynamique :
  • Piège des réductions de prix : La réduction du prix du forfait Business en avril peut sembler avantageuse, mais elle s’accompagne généralement d’une réduction des ressources, ce qui n’améliore pas nécessairement le rapport qualité-prix.
  • Restrictions et suspensions : La suspension des nouveaux abonnements Pro 20X en septembre était justifiée par un manque de puissance de calcul, mais en réalité, c’était pour contrôler les coûts et empêcher les utilisateurs les plus valorisants de consommer trop de ressources.
  • Conclusion : Les fabricants transfèrent les risques liés aux coûts de calcul sur les utilisateurs en ajustant dynamiquement les forfaits, en restreignant certaines fonctionnalités ou en suspendant les services haut de gamme, ou en sélectionnant uniquement les utilisateurs prêts à payer plus cher pour maintenir leurs bénéfices.

4. **Changements soudains des règles** : le passage d’un “accès illimité” à une facturation “par seconde”

L’article compare les abonnements à l’Internet mobile, aux abonnements à des logiciels et aux abonnements à l’IA, soulignant un recul significatif de l’expérience utilisateur.

  • Certitude des abonnements traditionnels :
  • Internet mobile : 10 Go de données, c’est 10 Go ; une fois épuisées, l’accès est interrompu, les règles sont claires.
  • Abonnements à des logiciels : Vous payez pour 365 jours sans limite de nombre d’utilisations, les règles sont stables.
  • WeChat Reading : Le forfait mensuel est fixe, vous pouvez lire autant de livres que vous le souhaitez, les règles sont simples.
  • Incertitude des abonnements à l’IA :
  • Piège du mode rapide : La vitesse d’exécution est 1,5 fois plus élevée, mais la consommation de ressources est 2,5 fois plus importante. C’est comme une autoroute où le prix de l’essence augmente de manière exorbitante à mesure que vous conduisez plus vite, sans limite.
  • Changements de règles fréquents : Les restrictions de cinq heures ont été supprimées en juillet, puis réinstaurées en août ; les prix ont été réduits en avril, mais les ressources ont été réduites. Cette absence de stabilité rend difficile la planification des travaux.
  • Déception psychologique : Les utilisateurs s’attendaient à avoir un accès illimité avec un abonnement, mais maintenant ils se sentent comme s’ils jouaient à un jeu où ils doivent constamment surveiller leur “barre de vie” (leurs ressources) et arrêter de travailler dès qu’elle est épuisée. Cette sensation d’anxiété n’existe pas avec les abonnements à des logiciels traditionnels.

5. **La situation difficile des développeurs** : des développeurs “enlevés” et des stratégies de “guérilla” sur plusieurs plateformes

Enfin, l’article met en évidence la réalité des développeurs actuels : ils ne peuvent pas se passer de l’IA, mais ils sont également contrôlés par les fabricants d’IA.

  • Dépendance technologique : De nombreux développeurs ne peuvent plus écrire de code efficace sans l’IA. L’IA est devenue un outil essentiel à leur productivité. Cette dépendance les rend impuissants face aux règles irrégulières des fabricants.
  • Stratégies de survie :
  • Configuration sur plusieurs plateformes : Puisque un fabricant ne peut pas être fiable, ils utilisent plusieurs autres. L’auteur mentionne qu’il a configuré plusieurs plans d’utilisation de tokens pour différents modèles, choisissant celui qui convient le mieux à chaque tâche afin de terminer son travail.

Comparaison des coûts : Bien que tous les fabricants réduisent les ressources, le coût de l’IA reste inférieur à celui d’un programmeur humain. Ainsi, les utilisateurs doivent accepter cette situation de “exploitation” et passer d’un fabricant à l’autre pour trouver le meilleur rapport qualité-prix.

Avenir : Avec la généralisation des capacités de l’IA, ce modèle de “souscription + quantité de ressources dynamique” pourrait devenir la norme dans l’industrie. Les utilisateurs devront apprendre à gérer leur budget en fonction des fluctuations des prix de l’IA, plutôt que d’attendre des prix fixes.

---

Conseils pour les utilisateurs ordinaires

1. Ne vous fiez pas seulement au forfait mensuel, mais aussi au “prix unitaire de la puissance de calcul” : Avant de souscrire, essayez de comprendre le taux de consommation de tokens du modèle pour vos tâches typiques. Si possible, utilisez d’abord le forfait gratuit ou un forfait à bas prix pour tester votre flux de travail et voir combien de ressources vous consommez en une semaine.

2. Mettez en place une “réserve sur plusieurs plateformes” : Ne mettez pas tous vos œufs dans le même panier. Préparez au moins deux ou trois services d’IA de fabricants différents pour pouvoir passer rapidement d’un à l’autre en cas de pénurie de ressources ou de changements de règles.

3. Suivez les retours de la communauté : Les forums d’utilisateurs d’OpenAI, des outils comme NerfTrack sur GitHub, et divers forums de développeurs sont les meilleurs moyens de détecter les réductions invisibles des ressources. Les annonces officielles sont souvent tardives et floues, tandis que les données provenant de la communauté sont plus fiables.

4. Adaptez vos attentes : Acceptez le fait que les abonnements à l’IA ne sont pas “illimités”. Considérez-les comme des “services cloud facturés en fonction de l’utilisation”, plutôt que comme des licences de logiciels traditionnelles. Planifiez vos tâches de manière rationnelle pour éviter de devoir réorganiser votre travail lorsque les ressources sont limitées, et essayez de terminer vos tâches principales lorsque vous disposez de suffisamment de ressources.

En somme, les abonnements à l’IA dans l’ère de l’IA sont essentiellement une lutte pour le contrôle des coûts de calcul. Les fabricants cherchent à maximiser leurs profits, tandis que les utilisateurs cherchent à maximiser leur efficacité. Dans cette lutte, rester lucide et flexible est la clé pour les développeurs ordinaires pour survivre.