第一财经

Les appels d'IA dépassent ceux des États-Unis pendant 20 semaines consécutives : de quoi disposent les grands modèles chinois pour conquérir le marché ?

原文:AI调用量连续20周超美国,中国大模型靠什么抢市场?

Analyse approfondie des nouvelles financières : La seconde moitié de la « compétition féroce » des grands modèles d'IA, les modèles chinois remontent le terrain grâce à leur rapport qualité-prix

Résumé des points clés

Au cours des deux dernières semaines, l'industrie des grands modèles d'IA mondiaux est entrée dans une période d'itération rapide, avec des mises à jour hebdomadaires. Bien que les géants étrangers (tels qu'Anthropic, OpenAI, Meta) occupent toujours les cinq premières places sur les listes basées sur les capacités techniques pures, la structure du marché a connu un changement subtil mais significatif : les grands modèles chinois ont dépassé les États-Unis pendant 20 semaines consécutives en termes d'utilisation réelle par les développeurs, occupant plus de 70 % de la part sur la plateforme OpenRouter.

La logique sous-jacente de ce phénomène réside dans le déplacement de l'attention de l'industrie : on passe d'une simple quête de la « plus grande capacité » à une recherche du « rapport ROI des tokens » (rapport coûts-bénéfices). Pour la plupart des scénarios de développement et d'application quotidiens, les modèles chinois offrent des performances suffisantes pour les tâches à un prix seulement de 10 % à 20 % de celui des modèles phares étrangers. Cette caractéristique de « suffisance et de bon rapport qualité-prix » fait des modèles chinois le choix préféré des entreprises et des développeurs, surtout dans le contexte où le coût devient de plus en plus sensible lors de l'intégration à grande échelle de l'IA dans les processus d'affaires.

---

Interprétation détaillée

1. Accélération fulgurante : Les mises à jour des grands modèles passent de « annuelles » à « hebdomadaires », les développeurs ne peuvent pas suivre le rythme

Auparavant, on considérait que les mises à jour des grands modèles étaient un processus lent et méticuleux, peut-être seulement une fois tous les six mois ou un an. Mais au cours des deux dernières semaines (du 1er au 11 septembre), sept des principaux acteurs nationaux et internationaux ont lancé de nouveaux modèles, notamment Claude Fable 5.1 d'Anthropic, GPT-6 Astra d'OpenAI, Gemini 3.8 Flash de Google, ainsi que Qianwen, DeepSeek et Kimi en Chine.

Qu'est-ce que cela signifie ?

Cela indique que la concurrence dans le domaine de l'IA est entrée dans une phase aiguë de « course aux armements ». La vitesse d'itération des modèles dépasse même la capacité des développeurs à évaluer et à adapter leurs flux de travail. Auparavant, il pouvait prendre six mois à un an pour choisir un modèle ; maintenant, un nouveau modèle plus économique et plus rapide peut être disponible dès le mois suivant. Cette fréquence élevée d'itération crée une grande incertitude dans l'industrie et oblige les utilisateurs à rester très vigilants, prêts à changer d'outils à tout moment pour obtenir la meilleure solution.

2. Brouillard sur les classements : Les modèles étrangers dominent en termes de capacités, mais les Chinois en termes d'utilisation

Il existe un contraste intéressant qui est essentiel pour comprendre le marché actuel de l'IA :

  • En termes de capacités (tests d'intelligence) : Les cinq premiers modèles sur les listes mesurant le niveau d'intelligence sont tous étrangers. Claude Fable 5.1 d'Anthropic occupe la première place, suivi de GPT-6 Astra d'OpenAI. Le meilleur modèle chinois, GLM-5.3, se classe septième, et Kimi K3 neuvième. Cela montre que les modèles étrangers conservent un avantage technologique pour les tâches les plus complexes et les plus exigeantes en termes de raisonnement logique et de génération de code.
  • En termes d'utilisation réelle (chiffres concrets) : Sur la plateforme d'agrégation d'API OpenRouter, les modèles chinois ont dépassé les États-Unis en termes d'utilisation hebdomadaire pendant 20 semaines consécutives. Parmi les dix premiers modèles les plus utilisés, sept sont chinois, représentant plus de 70 % du total. Il y a un an, il n'y avait que deux modèles chinois dans ce top 10 ; maintenant, ils dominent presque entièrement la liste.

Pourquoi ce phénomène de « modèles pas nécessairement les plus puissants mais très utilisés » ?

Parce que la plupart des gens n'ont pas besoin de modèles « les plus puissants », mais de modèles « suffisamment bons ». C'est comme acheter une voiture : bien que la Ferrari soit la plus rapide, 99 % des gens choisissent une Toyota ou une BYD plus économique et fiable pour leurs déplacements quotidiens, car il n'est pas nécessaire de dépenser dix fois plus cher pour un avantage de seulement 10 % en performance. Les modèles chinois ciblent précisément ce marché de « suffisance ».

3. Logique fondamentale : Du « combat d'intelligence » au « combat du rapport qualité-prix », le ROI des tokens devient le nouveau mot-clé

Selon des analystes de UBS Securities, le focus de l'industrie au second semestre 2026 est passé de la « maximisation des tokens » (utilisation maximale de l'IA) au « ROI des tokens ».

Exemple pour comprendre :

  • Premier semestre : De nombreuses entreprises encourageaient leurs employés à utiliser l'IA sans limites, pensant que plus on en utilisait, plus c'était avancé, mais les factures explosaient et il était difficile de calculer précisément l'impact économique de l'IA sur l'entreprise.
  • Deuxième semestre : Les dirigeants commencent à faire des calculs. Ils se rendent compte que pour des tâches quotidiennes telles que l'écriture de code, le traitement de documents ou l'analyse de données simples, utiliser des modèles étrangers coûteux est inutile. Ils se tournent donc vers l'« optimisation des tokens », c'est-à-dire vers la réduction des coûts à chaque appel tout en garantissant la qualité.

Avantages des modèles chinois :

Les prix des API des modèles chinois principaux sont environ 10 % à 20 % moins élevés que ceux de leurs homologues internationaux. Par exemple, le coût de DeepSeek V4.1 Flash est très bas, parfois seulement 1/37 à 1/76 de celui des modèles de pointe. Pour les startups ou les entreprises qui déploient l'IA à grande échelle, cette différence de coût peut être décisive. Utiliser des modèles étrangers peut épuiser les fonds de démarrage, tandis que les modèles chinois permettent une mise en œuvre à grande échelle.

4. Cas concret : Les développeurs choisissent les modèles chinois, leur flux de travail est entièrement basculé

L'exemple du projet open-source mentionné dans les nouvelles est très représentatif :

  • Début de l'année : L'informaticien utilisait le modèle coûteux Claude comme modèle principal, ne recourant aux modèles chinois que pour des tâches simples.
  • Depuis mai : Son flux de travail a entièrement été basculé vers des modèles chinois (GLM 5.3 de Zhipu, Qianwen d'Alibaba, DeepSeek V4.1 Flash).
  • Raison : Il explique que « 99,99 % des tâches de programmation ne sont pas vraiment difficiles pour des modèles de niveau GLM 5.3 ». Sauf pour des tâches très complexes comme le développement de noyaux d'opérateurs ou d'engins de rendu, il n'est pas nécessaire de payer des prix exorbitants pour des modèles de pointe.

Tendance du marché :

De plus en plus d'entreprises technologiques leaders mondiales intégrent également des modèles open-source chinois dans leurs processus de travail. Ce n'est pas parce que les modèles chinois surpassent complètement les modèles étrangers sur le plan technique, mais parce qu'ils atteignent un excellent équilibre entre prix, vitesse et stabilité. Pour la plupart des scénarios d'application, cet équilibre représente la meilleure solution.

5. Perspective profonde : Le faible prix n'est pas un moyen de « perdre de l'argent pour augmenter l'utilisation », c'est la victoire de l'efficacité technique

Beaucoup se demandent si les modèles chinois, étant si bon marché, ne sont pas vendus à perte. La recherche d'UBS répond par la négative : les marges brutes des entreprises chinoises sur leurs services API se situent généralement entre 20 % et 40 %, elles ne « perdent pas d'argent » pour étendre leur marché.

Qu'est-ce que cela signifie ?

Cela montre que les entreprises chinoises ont réellement réduit les coûts grâce à des innovations dans la conception des modèles, à l'optimisation de l'entraînement et de l'efficacité de l'inference. Elles gagnent leur compétitivité grâce à l'efficacité technique, et non grâce à des subventions. DeepSeek V4.1 Flash peut traiter un trillion de tokens en 24 heures et devrait atteindre 2,8 billions en 48 heures, démontrant une capacité d'exploitation élevée et des coûts unitaires très bas, ce qui reflète leur force technologique.

Conclusion :

Les modèles chinois n'ont pas remporté la bataille pour le « sommet de la technologie », mais ils ont conquis le marché de l'**application à grande échelle ». Grâce à leur rapport qualité-prix exceptionnel, ils sont devenus l'entrée par défaut dans le processus d'intégration de l'IA. À l'avenir, à mesure que l'IA passera d'une phase d'expérimentation à une utilisation quotidienne, leur part de marché, sensible aux coûts, continuera à croître. Les modèles étrangers conserveront leur place sur les marchés de niche « haut de gamme », tandis que les modèles chinois domineront le marché de masse.