第一财经

La bataille pour la distillation : il s’agit de disputer le droit au développement à l’ère de l’intelligence | Commentaires éclairés d’experts

原文:蒸馏之争,争的是智能时代的发展权|专家热评

Les trois agences américaines accusent la Chine de “distillation malveillante” d’IA ? Ne vous laissez pas manipuler, il s’agit en réalité d’un jeu de pouvoir

Bonjour à tous, je suis votre journaliste financier et économiste. Récemment, la communauté technologique a été secouée par une annonce conjointe de l’Agence de sécurité nationale américaine (NSA), du Bureau de la cybersécurité et de la sécurité des infrastructures (CISA) et du FBI, qui accusent des entreprises chinoises d’IA de mener une “distillation malveillante” à grande échelle, ce qui revient en somme à nous accuser de “voler” leur technologie.

Cela peut sembler effrayant, comme si nous avions commis un grave crime. Mais si l’on analyse attentivement la logique derrière cela, on se rend compte qu’il s’agit en fait d’un spectacle politique soigneusement mis en scène. Aujourd’hui, je vais vous expliquer clairement ce qui se passe.

Résumé : un jeu de double standard

En une phrase : Les États-Unis politisent une technique de “distillation du savoir” qui est en réalité neutre, et utilisent les plaintes de certaines entreprises pour tenter de maintenir leur monopole sur les capacités de calcul en IA et de freiner le développement de l’IA chinoise.

Chaîne logique principale :

1. La technologie est innocente : La “distillation” est une opération courante dans le domaine de l’IA, tout comme un étudiant qui utilise les livres d’un professeur ; ce n’est pas un vol.

2 Les accusations manquent de preuves : Les preuves américaines proviennent principalement des déclarations d’entreprises américaines (comme Anthropic) et manquent de preuves techniques solides, ce qui rend la chaîne logique fragile.

3 Les motivations sont douteuses : Alors que les États-Unis interdisent à la Chine d’utiliser des puces, ils l’accusent d’apprendre leur technologie dans le but de construire un “barrage de données” pour empêcher la Chine de rattraper leur niveau.

4 Double standard : Les entreprises américaines utilisent abondamment des modèles open-source chinois (tels que DeepSeek et Tongyi Qianwen) pour leur propre réinvention, mais elles accusent les entreprises chinoises d’apprendre leurs propres modèles.

5 Objectif final : Maintenir leur hégémonie technologique, en transformant la concurrence commerciale en une question de sécurité nationale et en trouvant des prétextes à des sanctions plus sévères.

---

Analyse approfondie : comprendre cette affaire sous cinq angles

1. Qu’est-ce que la “distillation” ? Est-ce vraiment un “vol” ?

Il faut d’abord clarifier ce qu’est la “distillation du savoir”. Dans le domaine de l’IA, il s’agit d’une technique très mature qui existe depuis longtemps.

  • Exemple simplifié : Imaginez un professeur expérimenté (un grand modèle) qui résume tout ce qu’il a appris dans un manuel concis (un petit modèle). L’étudiant (le petit modèle) peut ainsi maîtriser rapidement les connaissances essentielles sans avoir à lire tous les livres de la bibliothèque.
  • Nature de la technique : Il s’agit de faire en sorte que le grand modèle “enseigne” au petit modèle, afin que celui-ci soit plus compact, plus rapide et moins énergivore, et donc capable de fonctionner sur des appareils tels que les smartphones et les tablettes.
  • Faits historiques : Cette technique a été proposée dès 2015 par des lauréats du prix Nobel, dont Xavier Gontier. OpenAI a elle-même offert des services de distillation ; après la sortie de Qwen2 par Alibaba, elle a rapidement lancé la série DistilQwen2.
  • Consensus dans l’industrie : L’industrie américaine en est bien consciente. Le PDG d’NVIDIA, Jensen Huang, Microsoft, Meta et 25 autres organisations ont écrit ensemble pour indiquer que la distillation est une méthode courante d’amélioration des modèles et ne devrait pas être confondue avec un vol illégal.

Conclusion : La distillation est un accélérateur du progrès technologique et un moyen efficace de diffuser les connaissances. La qualifier de “vol malveillant” est tout aussi absurde que de dire qu’un étudiant qui prend des notes vole.

2. Les preuves américaines sont-elles solides ? En réalité, les États-Unis ont des doutes

L’annonce des trois agences américaines semble impressionnante, mais en y regardant de plus près, la chaîne de preuves est très fragile.

  • Source des preuves unique : Les preuves proviennent principalement des déclarations d’entreprises américaines comme Anthropic. C’est comme si un voisin vous accusait de lui avoir volé quelque chose, et que la police arrêtait quelqu’un sur la base de sa seule parole… est-ce raisonnable ?
  • Manque de preuves tangibles : Anthropic affirme que des dizaines de milliers de comptes ont accédé à leurs modèles, mais ils ne peuvent pas prouver que ces données ont été utilisées pour entraîner des modèles chinois. Les preuves fournies (adresses IP, métadonnées) sont indirectes.
  • Premier problème : Les adresses IP peuvent être falsifiées par des serveurs proxy ou des revendeurs, il est donc impossible de localiser précisément les entreprises concernées.
  • Deuxième problème : Accéder à des données ne signifie pas les utiliser. Vous pouvez consulter un site sans en télécharger le contenu pour l’entraîner un modèle ; cela peut juste être pour des tests, des évaluations ou de la simple consultation.
  • Problème des “boîtes noires” technologiques : Les grands modèles sont des “boîtes noires” ; une fois l’entraînement terminé, il est très difficile de déterminer les données utilisées. C’est comme manger un gâteau et essayer de savoir précisément d’où viennent chaque raisin.
  • Tests indépendants contredisent les accusations : L’Académie chinoise des communications et de l’information a mené des tests et a constaté que les similarités entre les modèles américains (comme les différentes versions de Claude) étaient plus élevées, tandis que les similitudes entre les modèles chinois et américains n’étaient pas significativement différentes. Cela montre que les réponses à des questions préétablies sont similaires, ce qui ne prouve pas de “copie”.

Conclusion : Les accusations américaines manquent de preuves techniques solides et reposent principalement sur des suppositions et les inquiétudes commerciales de certaines entreprises.

3. Le double standard des entreprises américaines : elles utilisent vos technologies tout en vous accusant

C’est le point le plus ironique. Les États-Unis accusent la Chine de “distillation malveillante”, mais elles-mêmes utilisent largement des modèles chinois pour leur propre développement.

  • Exemples concrets :
  • NVIDIA : Lors du développement de la série Nemotron, ils ont utilisé des millions de données générées par DeepSeek-R1 comme exemples d’entraînement et en ont fait part publiquement.
  • L’entreprise startup Perplexity : A ajusté son propre modèle R1-1776 en se basant sur DeepSeek-R1.
  • Hugging Face : A lancé le projet Open-R1 pour reproduire DeepSeek-R1.
  • Microsoft et Amazon Web Services : Ont intégré des modèles chinois tels que Tongyi Qianwen sur leurs plateformes et les proposent à l’échelle mondiale.
  • Comparaison des données : Il existe plus de 100 000 modèles dérivés de Tongyi Qwen, avec des taux de téléchargement élevés. En comparaison, les modèles américains sont beaucoup moins utilisés en Chine que les modèles chinois aux États-Unis.

Conclusion : Les entreprises américaines profitent des modèles open-source chinois tout en accusant les entreprises chinoises d’apprendre leurs modèles. Ce double standard révèle leur intention réelle de maintenir leur monopole.

4. L’objectif réel : de la “blockade des puces” à la “blockade des données”

Pourquoi les États-Unis font-ils tant de bruit maintenant ? Parce que la simple blocade des puces ne suffit plus ; ils cherchent à construire un nouveau obstacle.

  • Extension du monopole sur les capacités de calcul : Auparavant, les États-Unis utilisaient les puces (comme les GPU d’NVIDIA) pour limiter la capacité de la Chine à développer de grands modèles. Maintenant, ils constatent que la Chine parvient à créer des modèles performants malgré des restrictions sur les capacités de calcul grâce à des optimisations algorithmiques et à une écosystème open-source.
  • Construire un “barrage de données” : Si les sorties des modèles sont considérées comme des “actifs protégés”, tout comportement d’apprentissage de ces sorties pourrait être considéré comme une violation des droits d’auteur. Ainsi, seules les entreprises américaines les plus puissantes (comme OpenAI et Anthropic), détenant les modèles les plus avancés et les plus de données, pourraient iterer en toute sécurité, tandis que les nouveaux acteurs (y compris les entreprises chinoises et les petites et moyennes entreprises américaines) seraient confrontés à de grands risques juridiques.
  • Conflit commercial politisé : Regardez le calendrier : en février, OpenAI a exercé des pressions sur le Congrès ; en avril, la Maison Blanche a publié un mémorandum ; en juin, des demandes de coopération ont été faites ; en septembre, les trois agences ont publié leur annonce. Il s’agit d’une progression claire : pression des entreprises → approbation du gouvernement → mise en place de réglementations. Ils cherchent à transformer une simple concurrence commerciale (qui a la meilleure technologie) en une question de sécurité nationale, afin de justifier des sanctions plus sévères, des restrictions d’investissement et même des interventions militaires.

Conclusion : Il ne s’agit pas de protéger les droits d’auteur, mais de préserver leur part de marché et leur hégémonie technologique. Ils craignent pas que la technologie soit apprise, mais que les concurrents réduisent l’écart par des moyens légaux.

5. Les clauses abusives et les leçons de l’histoire : les blocades sont vouées à l’échec

L’une des principales preuves américaines est que les utilisateurs chinois auraient enfreint les conditions d’utilisation (ToS) d’entreprises américaines (comme Anthropic), notamment en raison de restrictions géographiques.

  • Clauses abusives : Une entreprise américaine décide unilatéralement que les entités chinoises ne peuvent pas utiliser ses services, puis accuse les utilisateurs qui contournent ces restrictions de “enfreindre la réglementation”. C’est comme si un restaurant affichait une pancarte disant “Interdiction d’accès aux citoyens de tel pays” et appelait la police pour arrêter ceux qui tentent d’entrer par des moyens détournés.
  • Absence de consensus dans l’industrie : Il n’existe aucune règle internationale interdisant la distillation. Le modèle Llama de Meta autorise explicitement l’utilisation de ses sorties pour entraîner d’autres modèles ; NVIDIA encourage même l’utilisation de données synthétiques. Cela montre que l’interdiction de la distillation n’est qu’une stratégie commerciale d’entreprises américaines et non une règle de l’industrie.
  • Loi de l’histoire : Des mesures de blocage telles que les codes régionaux des DVD et la DRM (gestion des droits d’auteur numériques) ont été contournées par le marché et la technologie. Les blocages technologiques ne peuvent que ralentir, mais pas empêcher la diffusion des connaissances et le progrès technologique.

Conclusion : Essayer de monopoliser la technologie par des clauses contractuelles et par la force de l’État va à l’encontre de la nature du développement technologique et de la tendance à la coopération internationale.

---

Conséquences pour le grand public

1. Restez rationnels et ne croyez pas aux rumeurs : Lorsque vous voyez des titres comme “Les États-Unis accusent la Chine de voler la technologie de l’IA”, ne paniquez pas et ne soyez pas aveuglément en colère. Analysez la logique politique et la nature réelle de la technologie.

2. Soutenez l’open source et l’ouverture : Le développement de l’IA en Chine est en grande partie dû à l’écosystème open source (comme Qwen, DeepSeek, Llama, etc.). L’open source permet à des développeurs du monde entier de participer à l’innovation, ce qui est l’arme la plus puissante contre le monopole.

3. Préférez l’indépendance et le contrôle : Bien que la distillation soit une technique normale, l’indépendance des capacités de calcul (puces) et des frameworks fondamentaux est cruciale. Les investissements au niveau national et les recherches et développement des entreprises sont essentiels pour une compétition à long terme.

4. Espérez le dialogue et la coopération : Les risques liés à l’IA (comme la falsification avancée et la sécurité biologique) sont mondiaux et nécessitent une gouvernance conjointe entre la Chine et les États-Unis, voire à l’échelle mondiale. Transformer l’IA en une arme géopolitique nuirait au bien-être de toute l’humanité.

En conclusion :

L’annonce des trois agences américaines est un spectacle politique soigneusement conçu qui masque leurs propres inquiétudes en matière d’innovation dans le domaine de l’IA et révèle leur ambition de maintenir leur hégémonie technologique. Pour la Chine, la meilleure réponse n’est pas une confrontation émotionnelle, mais de continuer à soutenir l’open source et l’ouverture, de renforcer ses capacités technologiques et de promouvoir une coopération internationale plus étendue, en laissant les faits parler.

La technologie n’a pas de frontières, mais le marché a des règles. Ceux qui respectent les règles, l’innovation et la coopération gagneront l’avenir.