虎嗅

Les États-Unis accusent la Chine de « distiller » l’intelligence artificielle à grande échelle industrielle : il s’agit pas d’une guerre des droits de propriété intellectuelle, mais d’une guerre pour l’accès au marché.

原文:美国指控中国AI“工业规模蒸馏”:这不是知识产权战,是准入战

Analyse approfondie : Les États-Unis accusent la Chine de “pirater” en matière d'IA, mais de quoi s'agit-il réellement ?

Bonjour à tous, je suis votre journaliste financier et économiste. Aujourd'hui, nous allons aborder un sujet qui semble technique, mais qui est en réalité fortement teinté de politique.

Le 8 septembre, trois grandes agences américaines – l'Agence de sécurité nationale (NSA), le Bureau de la sécurité des réseaux et des infrastructures (CISA) et le FBI – ont publié une déclaration conjointe dans laquelle elles ont nommé six entreprises chinoises d'IA, dont DeepSeek et Alibaba, les accusant de mener des activités de “distillation du savoir” à grande échelle, ce qui revient en somme à “pirater” les capacités des meilleurs modèles d'IA américains.

Le ministère chinois du Commerce a répondu de manière ferme : “Il n'y a aucune preuve ni fondement juridique à ces accusations.” Le ministère des Affaires étrangères a même déclaré que cela reflète les efforts de la Chine pour s'auto-dépendre technologiquement.

Beaucoup de non-spécialistes se demandent sûrement : Qu'est-ce que la “distillation du savoir” ? Pourquoi les États-Unis sont-ils soudainement si indignés par le fait d'apprendre ? Quel est le véritable enjeu derrière cela ?

Ne vous inquiétez pas, nous allons décomposer cet article pour vous expliquer les choses clairement.

---

I. Qu'est-ce que la “distillation du savoir” ? Pourquoi les États-Unis considèrent-ils cela comme un acte de “piratage” ?

Tout d'abord, il est important de comprendre la technologie au cœur de ces accusations : la distillation du savoir.

Vous pouvez l'imaginer comme une situation où un enseignant enseigne à un élève.

  • Formation traditionnelle : L'enseignant montre une image et dit “Ceci est un chat, cela est un chien”, et l'élève mémorise cela par cœur.
  • Distillation du savoir : L'enseignant ne se contente pas de dire que c'est un chat, il explique également que “selon lui, l'animal ressemble à 80 % à un chat, à 15 % à un chien et à 5 % à un renard”. Ces jugements détaillés et probabilistes constituent ce qu'on appelle des “étiquettes souples”, qui révèlent la compréhension profonde de l'enseignant des relations entre les choses (ce qu'on appelle le “savoir caché”).

Le point clé est le suivant :

1. Il s'agit d'une technologie universelle : La distillation n'a pas été inventée par la Chine ; le lauréat du prix Nobel de 2015, Hinton, a introduit ce concept. Toutes les entreprises d'IA dans le monde, y compris les géants américains, l'utilisent.

2. Légal ou illégal ? Si vous achetez un livre et le lisez par vous-même, c'est légal. Mais si vous utilisez l'interface API de l'auteur pour poser des questions en masse et utiliser ses réponses pour entraîner vos propres modèles, cela constitue une violation des conditions d'utilisation.

Pourquoi les États-Unis sont-ils si inquiets ? Ils estiment que les entreprises chinoises ne se contentent pas de mener des recherches et développement normaux ; elles utilisent des “millions d'interactions” pour “absorber” les capacités des meilleurs modèles américains, tels que Claude et la série GPT.

La logique américaine est la suivante : “Vous utilisez beaucoup moins d'argent et de ressources que nous, et vous avez atteint notre niveau en ‘copiant nos travaux’. Nous ne voulons pas que vous poursuiviez cette voie.”

C'est comme si vous avez développé une recette exclusive à grands frais, et que votre concurrent ne l'a pas développée lui-même, mais qu'il vient tous les jours dans votre restaurant pour goûter les plats et les reproduire ensuite. Bien qu'il n'ait pas volé votre recette, il a “volé” votre saveur.

---

II. Les détails des accusations américaines : de la “bloqueur physique” à la “bloqueur du savoir”

La déclaration (AA26-251A) est très précise et peut même être considérée comme une accusation solide. Voici les “preuves” dont disposent les États-Unis :

1. Échelle massive : Les entreprises chinoises auraient mené des millions d'interactions avec des modèles, obtenant des “milliards de tokens” (une quantité énorme de données).

2 Méthodes discrètes :

  • Elles n'ont pas seulement utilisé les API officielles, mais aussi des plateformes tierces et des canaux d'intermédiation.
  • Elles ont acheté en masse des comptes avancés, les partageant entre plusieurs personnes et changeant automatiquement de canaux pour éviter les détecteurs.
  • Elles auraient même “contaminé les données d'entraînement des modèles” – c'est-à-dire qu'elles auraient intentionnellement fournies des données perturbées aux modèles pour observer leurs réactions.

3 Cibles spécifiques : Les modèles visés incluent la série Claude d'Anthropic, la série Gemini de Google, la série GPT d'OpenAI et la série Grok dxAI.

4 Extraction de capacités : Elles auraient non seulement extrait des capacités de dialogue de base, mais aussi des compétences de haut niveau telles que le droit et la raisonnement logique.

La logique sous-jacente : l'extension des mesures de blocage

  • 2022 : Interdiction des puces (entrée physique).
  • 2023 : Interdiction des machines à photolitographie (entrée de fabrication).
  • 2026 (actuellement) : Interdiction de l'exportation des modèles (entrée du savoir).

Les États-Unis ont constaté que, même s'ils bloquaient l'équipement, la Chine pouvait toujours rattraper leur niveau grâce à l'open source et à l'optimisation des algorithmes. Maintenant, ils veulent bloquer le “flux de connaissances”. Les puces représentent le “corps” des systèmes, tandis que les capacités des modèles constituent leur “âme”. Les États-Unis ne veulent pas que l'IA chinoise porte l'empreinte de la technologie américaine ; ou, pour être plus précis, ils ne veulent pas que la Chine obtienne des résultats technologiques de haute valeur à bas coût.

---

III. La riposte chinoise : Ce n'est pas un acte de “piratage”, mais un différend contractuel

Face à ces accusations, la Chine a répondu de manière calme et convaincante, avec trois arguments principaux :

1. Neutralité technologique : La distillation est une pratique courante dans l'industrie et n'est pas propre à la Chine. Les entreprises américaines utilisent elles-mêmes des modèles open source chinois (de nombreuses startups américaines effectuent des ajustements sur Llama ou Qwen). Vous m'accusez, mais vous en faites vous-même ; c'est une double norme.

2. Qualification juridique :

  • Point de vue américain : Cela constituerait un “vol de propriété intellectuelle”, un crime pénal, donc les agences de sécurité nationale sont mises en jeu.
  • Point de vue chinois/juridique : La distillation ne consiste pas à copier directement le code ou les données d'entraînement originales ; elle imite plutôt une forme de “connaissance”. Cela est difficile à qualifier de violation du droit d'auteur ou de brevet. Le fondement juridique le plus probable est une violation des conditions d'utilisation du service (défaut de contrat).
  • Une grande différence : Un défaut de contrat est un différend civil, qui peut être résolu par des dommages-intérêts ; un vol de propriété intellectuelle est un crime pénal, qui peut entraîner des sanctions.
  • Monopole commercial : Les entreprises américaines imposent des conditions abusives dans les contrats d'utilisation (comme l'interdiction d'utiliser les modèles pour des concurrents), et les agences de sécurité nationales les appliquent. Cela revient en fait à utiliser le pouvoir de l'État pour protéger des monopoles commerciaux.

En résumé : La Chine considère que les géants américains utilisent cette stratégie pour maintenir leur monopole sur le marché et transforment la concurrence commerciale en une question de sécurité nationale.

---

IV. Le timing et les enjeux : une démonstration de force avant le sommet

Le moment de cette annonce est très stratégique : il reste moins de trois semaines avant le sommet entre les dirigeants chinois et américains à Washington.

Dans les négociations internationales, une tactique classique consiste à montrer sa force en amont des discussions formelles, en augmentant la pression.

  • Objectif :
  • Tester les limites : Voir si la Chine fera des concessions dans le domaine de l'IA.
  • Créer de la pression : Faire sentir à la Chine qu'elle est sous pression pour qu'elle accepte des compromis dans d'autres domaines (comme le commerce ou la géopolitique).
  • Politique intérieure : Montrer aux électeurs et au Congrès américains que “nous protégeons l'avantage technologique des États-Unis”.

La Chine a également laissé la porte ouverte à des discussions : “Nous sommes prêts à dialoguer”, mais “si des mesures répressives sont mises en œuvre, nous riposterons”.

Cela montre que les deux parties ne veulent pas rompre complètement les relations, mais aucune ne veut céder la première. Il s'agit d'une situation où l'on “combat tout en négociant”.

---

V. Les conséquences futures : un “rideau de fer” sur l'écosystème de l'IA ?

Cet événement a des conséquences profondes :

1. Impact sur la méthode de distillation** :

Pour les entreprises chinoises d'IA qui dépendent encore des API américaines pour l'entraînement de leurs modèles, c'est une alerte rouge.

  • Risque : Les États-Unis pourraient légiférer pour contrôler l'exportation des modèles. Une telle mesure pourrait rendre l'utilisation des API américaines pour l'entraînement illégale.
  • Conséquence : Cette voie pourrait devenir impraticable, non pas à cause de la technologie elle-même, mais à cause de restrictions politiques et juridiques.

2. Accélération du “découplage” et de l’indépendance** :

  • Accélération de la substitution par des solutions nationales : Les entreprises chinoises seront forcées d'utiliser des ressources informatiques locales (comme Huawei昇腾) et des modèles open source chinois (tels que Qwen, DeepSeek, GLM) pour l'entraînement.

Indépendance de l'écosystème open source : La Chine pourrait promouvoir la création d'un écosystème de modèles open source indépendant des technologies américaines pour éviter d'être “piégée”.

Risque de contamination des données : La pratique suggérée par les États-Unis de “contaminer les données d'entraînement” signifie que même si vous pouvez encore accéder aux API, les données obtenues pourraient être défectueuses, affectant la performance de vos modèles. Cela forcera les entreprises à se défaire complètement de leur dépendance aux modèles américains.

3. Scission de l'écosystème mondial de l'IA** :

Si les États-Unis bloquent réellement l'exportation des capacités des modèles, l'IA mondiale se diviserait en deux camps :

  • Camp américain : Logiciel fermé, barrières élevées, coûts élevés, profits élevés.
  • Camp chinois : Logiciel open source, accès facile, coût-bénéfice élevé, itération rapide.

En conclusion

La déclaration AA26-251A n'est pas seulement un document sur la sécurité des réseaux ; elle marque le passage de la concurrence technologique entre la Chine et les États-Unis à une compétition basée sur les règles et les écosystèmes.

La distillation est une question technique, mais cet incident nous montre que dans le domaine de la technologie, il n'y a pas de problèmes purement techniques : il y a toujours des enjeux géopolitiques.

Pour le grand public, cela signifie que les produits d'IA que nous utiliserons à l'avenir pourraient suivre des trajectoires de développement et être soumis à des restrictions différentes en fonction de leur “origine”. Pour l'industrie de l'IA chinoise, il s'agit d'un processus difficile de “sevrage”, mais c'est aussi le chemin nécessaire pour atteindre l'indépendance réelle.

Rappelez-vous : lorsque votre adversaire commence à bloquer vos “entrées de connaissance”, vous devez apprendre à vous “sanguiner” vous-même.