IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Les autorités fédérales américaines accusent la Chine de procéder à une « distillation systématique » des modèles d'IA américains, en utilisant des systèmes sophistiqués

Le , par Jade Emy

275PARTAGES

5  0 
Les autorités fédérales américaines accusent la Chine de distillation « systématique » de modèles d’IA américains. Un avis conjoint allègue que des entreprises chinoises utilisent des systèmes sophistiqués pour acheminer des millions de requêtes de données vers des modèles d’IA américains via différents comptes et différentes plateformes. L’avis cite des entreprises chinoises telles que DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun et Z.AI, affirmant qu’elles ont dépensé des milliards de jetons au cours de millions d’échanges et de requêtes avec des modèles d’IA américains de pointe tels que Claude d’Anthropic, ChatGPT d’OpenAI, Gemini de Google et Grok de xAI, depuis au moins fin 2024. « La lutte contre la distillation à l’échelle industrielle mérite une réponse coordonnée à l’échelle de l’écosystème de l’IA, incluant un partage efficace des informations entre le gouvernement américain, le secteur privé et les nations alliées », précise l’avis.

En apprentissage automatique, la distillation de connaissances ou la distillation de modèles désigne le processus consistant à transférer des connaissances d’un grand modèle vers un modèle plus petit. Si les grands modèles (tels que les réseaux neuronaux très profonds ou les ensembles de nombreux modèles) disposent d’une plus grande capacité de connaissances que les petits modèles, cette capacité n’est pas toujours pleinement exploitée. L’évaluation d’un modèle peut s’avérer tout aussi coûteuse en ressources de calcul, même s’il n’utilise qu’une petite partie de sa capacité de connaissances. La distillation de connaissances permet de transférer les connaissances d’un grand modèle vers un modèle plus petit sans perte de validité. Les modèles plus petits étant moins coûteux à évaluer, ils peuvent être déployés sur du matériel moins puissant (comme un appareil mobile).

Le 23 avril 2026, l'administration Trump a officiellement accusé des entités chinoises de mener des campagnes organisées pour copier les modèles d'intelligence artificielle (IA) américains. La technique en cause, la distillation, se situe à la frontière floue entre pratique légitime et espionnage industriel. Pékin balaie ces accusations d'un revers de main et DeepSeek, visé implicitement, publie le jour suivant son modèle V4 en fanfare.

Récemment, le gouvernement américain a rappellé ces accusations en affirmant que les entreprises chinoises spécialisées dans l’IA menent une campagne délibérée et « systématique » visant à extraire illégalement les modèles d’IA de pointe américains et leurs capacités. Selon un avis conjoint sur la cybersécurité publié par l’Agence nationale de sécurité (NSA), l’Agence de cybersécurité et de sécurité des infrastructures (CISA) et le FBI, l’ampleur même de ces efforts depuis 2024 indique que la distillation constitue un élément essentiel de la politique industrielle chinoise en matière d’IA.

« Des entreprises chinoises spécialisées dans l’intelligence artificielle procèdent à une extraction systématique des fonctionnalités et capacités propriétaires des modèles des entreprises américaines d’IA par le biais de campagnes de distillation des connaissances à l’échelle industrielle qui constituent le cœur — et non un simple complément — de leur stratégie de développement en matière d’IA », ont écrit ces agences.


L’avis cite des entreprises chinoises telles que DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun et Z.AI, affirmant qu’elles ont dépensé des milliards de jetons au cours de millions d’échanges et de requêtes avec des modèles d’IA américains de pointe tels que Claude d’Anthropic, ChatGPT d’OpenAI, Gemini de Google et Grok de xAI, depuis au moins fin 2024. Les agences américaines ont déclaré que ces entreprises utilisaient les données issues de ces interactions pour renforcer leurs propres modèles nationaux, une pratique tacitement encouragée mais non dirigée par les dirigeants politiques de Pékin.

DeepSeek, par exemple, a exploité des modèles américains de pointe pour générer des données d’entraînement synthétiques destinées à ses modèles R1 et R3, notamment quatre versions différentes de Claude, deux versions de Gemini, cinq versions de ChatGPT et Grok 4. Ces modèles ont contribué à développer les capacités de DeepSeek dans des domaines tels que le fonctionnement agentique, l’optimisation des questions-réponses, la rédaction créative et professionnelle, entre autres.

Une autre entreprise chinoise, Moonshot AI, aurait distillé 18 modèles américains différents – dont Fable 5, le modèle actuel d’Anthropic, le plus avancé disponible sur le marché – pour entraîner ses modèles Kimi-K2 et Kimi K3. L’entreprise a utilisé des millions de requêtes destinées à extraire des capacités améliorées dans des domaines tels que le raisonnement agentique, le codage et l’analyse de données, la vision par ordinateur, les cadres logiques plus vastes, le traitement visuel et bien d’autres encore.


Les entreprises chinoises spécialisées dans l’IA gèrent un ensemble sophistiqué d’outils et de systèmes qui acheminent les requêtes et les invites par de multiples voies afin d’échapper à la détection. « La lutte contre la distillation à l’échelle industrielle mérite une réponse coordonnée à l’échelle de l’écosystème de l’IA, incluant un partage efficace des informations entre le gouvernement américain, le secteur privé et les nations alliées », précise l’avis.

L’avis énumère notamment les tactiques couramment observées chez les entreprises chinoises, notamment la répartition des requêtes entre différents comptes, modèles et plateformes, l’utilisation d’API natives, de fournisseurs de cloud à distance et d’agrégateurs tiers pour masquer les métadonnées des utilisateurs, ainsi que le recours à des proxys et aux marchés de la « gray tech » pour contourner les restrictions géographiques, les conditions d’utilisation et les mesures de sécurité intégrées aux modèles de pointe.

Présenté en septembre 2023, la distillation pas à pas est une méthode qui permet d'extraire des justifications informatives des grands modèles de langage (LLM) pour former efficacement des modèles plus petits spécifiques à une tâche. Cette approche réduit considérablement la taille du modèle et la quantité de données de formation nécessaires, surpassant ainsi les performances des LLM avec quelques instructions génératives (prompt). La recherche avait pour but d'offrir une solution économe en ressources pour le compromis entre la taille du modèle et les données de formation.


Depuis des décennies, les responsables américains de la sécurité nationale et les chefs d’entreprise occidentaux accusent la Chine de recourir à des cyberattaques, à des menaces internes et à d’autres formes d’espionnage économique pour dérober des technologies propriétaires ou sensibles aux entreprises américaines. En juin, Michael Kratsios, directeur du Bureau de la politique scientifique et technologique de la Maison Blanche, a porté une accusation similaire à l’encontre de MoonshotAI, l’accusant d’avoir exploité « Fable 5 » pour entraîner ses propres modèles, et a décrit un système « sophistiqué » similaire permettant de contourner les garde-fous et les restrictions d’utilisation.

L'avertissement récemment lancé formule des accusations similaires concernant le vol de technologies américaines par la Chine, mais à l'encontre d'entreprises pionnières de l'IA qui font elles-mêmes l'objet de poursuites judiciaires de la part d'artistes, d'auteurs, d'organismes de presse et d'autres parties affirmant que ces entreprises ont illégalement entraîné leurs modèles à partir d'œuvres protégées par le droit d'auteur ou par des marques déposées.

Même au sein du secteur très concurrentiel de l'IA, les entreprises et les organisations open source partagent couramment les paramètres de leurs systèmes d'IA, ou extraient des éléments d'autres systèmes d'IA dans le cadre de travaux ou de recherches légitimes. Les agences reconnaissent cette réalité, mais affirment que les entreprises chinoises se livrent à « des activités de distillation agressives, malveillantes et ciblées à l’échelle industrielle ».


Voici le résumé du communiqué de la CISA

Des entreprises chinoises spécialisées dans l’intelligence artificielle mènent des campagnes de distillation à l’échelle industrielle à l’encontre d’entreprises américaines du secteur de l’IA

Des entreprises chinoises spécialisées dans l’intelligence artificielle (IA) procèdent à l’extraction systématique des fonctionnalités et capacités propriétaires des modèles d’entreprises américaines du secteur de l’IA, par le biais de campagnes de distillation des connaissances à l’échelle industrielle qui constituent le cœur – et non un simple complément – de leur stratégie de développement en matière d’IA. Bien que la « distillation » soit reconnue comme une technique légitime et utile dans la recherche en IA, les entreprises chinoises du secteur mènent des activités de distillation agressives, malveillantes et ciblées à l’échelle industrielle, qui visent à extraire des fonctionnalités et capacités propriétaires soumises à des restrictions issues des modèles d’IA de pointe américains. L’Agence nationale de sécurité (NSA), l’Agence pour la cybersécurité et la sécurité des infrastructures (CISA) et le Bureau fédéral d’enquête (FBI) (ci-après dénommées « les agences auteurs ») publient cet avis conjoint sur la cybersécurité afin d’alerter les organisations sur ces activités et techniques malveillantes et de recommander des mesures d’atténuation visant à réduire leur impact potentiel.

Probablement avec la complicité du gouvernement chinois, DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun et Z.AI ont extrait des milliards de tokens à partir de millions d’échanges/de requêtes provenant de modèles d’IA de pointe américains, notamment des variantes de Claude, GPT, Gemini et Grok, depuis au moins fin 2024. DeepSeek mène depuis au moins 2024 des campagnes organisées ciblant les capacités de raisonnement, les optimisations spécialisées et les fonctions spécifiques à certains domaines afin d’entraîner ses modèles R1 et V3. Alibaba a exploité la distillation à l’échelle industrielle pour améliorer sa famille de modèles d’IA Qwen. Moonshot AI, MiniMax, StepFun et Z.AI se sont également livrés à une distillation malveillante des connaissances issues des modèles d’entreprises américaines spécialisées dans l’IA.

Les entreprises chinoises spécialisées dans l’IA acheminent leurs demandes de distillation par de multiples voies afin d’obtenir un accès non autorisé, enfreignant ainsi les conditions d’utilisation des entreprises américaines du secteur de l’IA. Ces voies comprennent des interfaces de programmation d’applications (API) natives, des fournisseurs de cloud à distance et des agrégateurs tiers qui masquent automatiquement les métadonnées des utilisateurs pour éviter toute détection. De plus, les entreprises chinoises...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !