Les experts doutent que le Kimi K3 chinois ait été construit en copiant le modèle d'IA d'Anthropic

Des responsables de la Maison-Blanche affirment que Moonshot a volé la technologie américaine pour construire sa puissante nouvelle IA. Les chercheurs disent que la chronologie rend cette histoire difficile à croire.

AI2Day NewsdeskUpdated Editor: Lee Brown4 min read
Photoreal news-editorial 16:9 image of a modern smartphone lying face-up on a polished dark surface, its screen casting a faint glow upward, surrounded by trans
Share

Points clés

  • Le conseiller scientifique de la Maison-Blanche, Michael Kratsios, a accusé la société chinoise d'IA Moonshot d'avoir copié le modèle Fable d'Anthropic pour construire Kimi K3.
  • Anthropic a lancé Fable le 1er juillet 2025, environ deux semaines avant l'apparition de Kimi K3, un délai que les chercheurs considèrent comme trop court pour la technique de copie alléguée.
  • Le secrétaire au Trésor Scott Bessent a déclaré que les responsables du gouvernement américain ont découvert des « filigranes » de modèles d'IA américains à l'intérieur de modèles chinois, sans préciser ce que sont ces filigranes.
  • Elon Musk a témoigné plus tôt cette année que sa propre entreprise a utilisé la même technique de copie sur les modèles d'OpenAI pour construire Grok, qualifiant cette pratique de courante dans l'industrie.
  • Les allégations distinctes selon lesquelles Moonshot aurait utilisé les puces Nvidia GB300, que le gouvernement américain interdit d'exporter vers la Chine, restent sans réponse de la part de l'entreprise.

Un haut responsable de la Maison-Blanche a accusé une startup chinoise d'IA d'avoir volé la technologie américaine. Les chercheurs qui étudient la construction des modèles d'IA disent que les preuves sont minces.

Quelle est exactement l'accusation ?

Michael Kratsios, conseiller scientifique de la Maison-Blanche, a déclaré que Moonshot, la société chinoise derrière Kimi K3, a construit le modèle par « distillation » du modèle Fable d'Anthropic tout en utilisant des puces que les États-Unis interdisent d'exporter vers la Chine. Comme nous l'avons rapporté le 16 juillet, Kimi K3 suscitait déjà des comparaisons avec le système fermé le plus capable d'Anthropic avant que ces accusations ne fassent surface.

La distillation signifie interroger systématiquement un modèle d'IA existant pour comprendre comment il réfléchit, puis utiliser ces réponses pour entraîner une copie moins chère. Pensez-y comme à l'ingénierie inverse d'une recette en goûtant un plat à plusieurs reprises jusqu'à ce que vous puissiez la reproduire vous-même.

Kratsios n'a pas partagé la source de ses allégations. Moonshot n'a pas répondu aux questions sur la façon dont il a entraîné Kimi K3. Le secrétaire au Trésor Scott Bessent a déclaré séparément que les responsables ont trouvé des « filigranes » de modèles américains à l'intérieur de modèles chinois, mais ni son bureau ni Anthropic n'ont expliqué ce que sont réellement ces filigranes.

Pourquoi les chercheurs sont-ils sceptiques ?

La chronologie est le problème. Anthropic n'a rendu Fable disponible au public que le 1er juillet 2025. Kimi K3 est apparu environ deux semaines plus tard.

« Vous ne pouvez pas distiller autant de données et les publier en deux semaines », a déclaré Braden Hancock, chercheur à l'Institut Laude et cofondateur de Snorkel AI, à TechCrunch. Il a ajouté que l'industrie a tendance à sous-estimer les équipes de recherche chinoises : « L'un des fondateurs de Moonshot était un doctorant de CMU. Ce sont des chercheurs et des ingénieurs légitimes qui font un travail solide. »

Nathan Lambert, chercheur en IA à l'Allen Institute for AI, a soulevé un point distinct. La distillation est devenue moins utile à mesure que les modèles chinois comblent l'écart avec les modèles américains, car la technique fonctionne mieux lorsque l'on copie un modèle beaucoup plus fort. Au niveau de capacité de Kimi K3, vous auriez besoin d'apprentissage par renforcement, où une IA note ses propres réponses à plusieurs reprises jusqu'à ce qu'elle s'améliore. L'exécution de ce processus via une API commerciale coûterait énormément et pourrait même ne pas produire de gain de performance.

Anthropic a précédemment accusé Moonshot et DeepSeek d'avoir distillé ses anciens modèles plus tôt cette année, affirmant qu'il avait trouvé des millions de requêtes inhabituelles traçables aux adresses IP de ces entreprises, distinctes d'une utilisation normale. Qu'une partie de cela s'applique spécifiquement à Fable reste sans réponse.

La distillation n'est pas une pratique réservée à la Chine. Musk a témoigné cette année que sa société l'avait utilisée sur les modèles d'OpenAI pour construire Grok, la qualifiant de pratique courante dans l'industrie.

Qu'en est-il de l'allégation concernant les puces ?

La deuxième accusation, selon laquelle Moonshot aurait obtenu les puces Nvidia Grace Blackwell GB300 par des canaux d'exportation interdits et aurait utilisé des serveurs en Thaïlande, est une préoccupation distincte. Un marché noir pour les puces restreintes existe. En mai 2025, le fondateur du fabricant américain de serveurs Supermicro a été inculpé pour contrebande de puces avancées vers la Chine.

Sam Bresnick du Centre de sécurité et de technologie émergente de Georgetown soutient que les centres de données du monde entier ont besoin de règles claires sur qui exécute de gros travaux de formation sur leur matériel. Une proposition de l'ère Biden pour de telles règles de « connaissance de votre client » n'a pas progressé sous l'administration actuelle.

Le contexte politique plus large compte ici. Notre histoire antérieure sur la lutte concernant l'IA open-source chinoise a révélé que la volonté de restreindre des modèles comme Kimi K3 concerne autant la protection des intérêts commerciaux que la sécurité. L'accusation de vol s'inscrit dans ce schéma : elle arrive alors que Washington débat d'interdire purement et simplement les modèles chinois à poids ouvert.

Questions courantes

La distillation compte-t-elle toujours comme un vol ?

Pas directement. La ligne entre la distillation et la création d'un ensemble de données synthétiques est floue. Les entreprises américaines, y compris celles ayant des fondateurs éminents, utilisent des techniques similaires régulièrement.

Dois-je m'inquiéter du fait que les modèles d'IA chinois sont moins dignes de confiance en conséquence ?

Ce différend concerne la façon dont les modèles sont entraînés, non leur comportement pour les utilisateurs. Les questions sur la confidentialité des données et la sécurité dans les outils d'IA méritent d'être posées pour tout modèle, indépendamment de son pays d'origine.

© 2026 AI2Day