OpenAI affirme avoir identifié une campagne d’extraction automatisée du raisonnement de ses modèles et relie une partie de cette activité à Moonshot AI, le laboratoire chinois qui conçoit Kimi. Moonshot fait profil bas.
La méthode reprochée porte un nom que les géants de l’IA prononcent désormais avec colère : la distillation massive. Il s’agit d’une technique consistant à bombarder un modèle frontière de requêtes pour récolter ses réponses, sa chaîne de pensée, puis à recycler ce matériau en fine-tuning supervisé sur un modèle concurrent. Des comptes multiples. Des scripts. Des réponses aspirées, triées, réinjectées. Le travail de milliards de dollars de calcul, récupéré au prix de plusieurs centaines d’abonnements.
OpenAI parle d’un lien avec une partie de l’activité observée, sans attribuer l’ensemble de la campagne au laboratoire de Pékin. OpenAI a t-il des preuves ? Disons plutôt un faisceau d’indices, suffisamment solides pour être rendus public et trop partiels pour en sûr à 100%. Les CGU d’OpenAI interdisent explicitement la distillation. C’est donc sur ce terrain contractuel que l’entreprise porte d’abord le combat, avant même celui de la propriété intellectuelle où sa posture paraîtrait beaucoup plus fragile.
Greg Brockman se montrait pourtant beaucoup plus prudent en juillet, quelques jours après la sortie de Kimi K3, un modèle open-weight que les utilisateurs ont immédiatement placé au niveau des meilleures offres américaines. Le président d’OpenAI admettait alors ne pas savoir si Moonshot s’était appuyé sur la technologie de ChatGPT : « C’est un plutôt bon modèle. Aucun doute là-dessus. » Deux mois et demi plus tard, il n’a quasiment plus de doutes.
La Maison-Blanche avait déjà tranché à sa manière dès l’été, lorsque Michael Kratsios, conseiller du président américain, accusait publiquement Moonshot d’avoir distillé Fable, le modèle de pointe d’Anthropic : « Nous disposons d’informations indiquant que Moonshot AI a distillé Fable d’Anthropic pour développer son modèle K3. Pour y parvenir, ils ont mis au point une plateforme sophistiquée de distillation à grande échelle contre les modèles américains, leur permettant de basculer rapidement entre plusieurs méthodes d’accès pour échapper à la détection. »
Anthropic a chiffré l’extraction en septembre avec près de 200 millions d’échanges liés à cinq campagnes de distillation. La part de Moonshot est plutôt modeste face aux 151 millions d’échanges attribués à Alibaba, avec près de 300 000 requêtes en dix jours via 5 000 comptes, principalement dirigées vers Opus. Anthropic y décrit des requêtes qui semblaient venir de l’armée chinoise (l’une demandait d’analyser des images de vidéosurveillance pour dire si un individu « se comportait anormalement »). Les attaquants rusent aussi. Un faux ordre de traduction en japonais katakana suffisait parfois à faire sortir au modèle ses chaines de raisonnement brutes.
Nvidia, Microsoft, Meta et Palantir ont signé en juillet une lettre avec plus de vingt autres entreprises pour mettre en garde contre des « restrictions prématurées » visant les modèles open-weight. Nvidia distille elle-même pour entraîner sa série Llama Nemotron.
OpenAI et Anthropic portent par ailleurs leur propre fardeau, empêtrés devant les tribunaux pour avoir entraîné leurs modèles sur des œuvres sans accord des auteurs. Les copieurs accusent les copieurs. Ça prêterait presque a sourire.

