En bref
- Anthropic affirme avoir détecté cinq campagnes de distillation visant Claude, avec près de 200 millions d’échanges.
- Alibaba aurait mené la plus vaste opération, avec 151 millions de requêtes pour entraîner ses modèles Qwen.
- Une autre campagne liée à Moonshot AI aurait notamment exploité Claude pour analyser des images de vidéosurveillance.
Près de 200 millions d’échanges. Rien que ça. Anthropic affirme avoir repéré cinq campagnes distinctes de distillation visant Claude, avec une montée en puissance nette ces derniers mois, sur fond de compétition de plus en plus nerveuse entre labos d’IA. Et quand une boîte parle d’attaques plus vastes et plus agressives qu’avant, on comprend vite que ce n’est plus un simple bruit de fond.
Quand 200 millions d’échanges ressemblent à un pillage
Un récent rapport cible des entreprises d’IA basées en Chine. Anthropic dit avoir déjà tiré la sonnette d’alarme en février, en citant même certains labos. Cette fois, l’entreprise estime que les méthodes employées pour contourner ses défenses sont devenues plus sophistiquées et visent les capacités les plus précieuses de Claude, comme l’usage d’outils, le raisonnement logique, le code ou l’analyse de données. Pas vraiment des détails.
Dans le même temps, OpenAI a lui aussi signalé des activités comparables, qu’il attribuait spécifiquement à DeepSeek. Le décor est posé.
Le vrai nerf de la guerre, c’est la pensée interne du modèle
La distillation, en gros, consiste à récupérer la chaîne de pensée d’un modèle quand il répond à des requêtes. Cette matière peut ensuite servir à entraîner un modèle plus petit sur ses capacités générales de raisonnement, via du fine-tuning supervisé. C’est là que ça devient intéressant, et franchement un peu sale.
Anthropic n’affiche normalement pas cette pensée interne brute à ses utilisateurs. Claude montre plutôt des blocs de « pensée résumée », donc un aperçu général. Sauf que certaines campagnes ont trouvé comment pousser le modèle à révéler directement ses traces de réflexion. Un exemple cité est assez tordu, et plutôt malin techniquement, avec une requête présentée comme une simple traduction demandant de convertir la mémoire de travail précédente en japonais naturel, précis, écrit uniquement en katakana.
Alibaba, la campagne géante derrière Qwen
Le gros morceau viendrait de Alibaba. Anthropic parle de la plus grande opération de distillation de masse qu’elle ait jamais observée, avec 151 millions d’échanges entre mai et juillet 2026, et un pic proche de 3 millions par jour.
Les requêtes passaient par 3500 comptes différents. Mais elles partageaient toutes un même prompt fixe destiné à extraire la chaîne de pensée. C’est ce qui pousse Anthropic à relier l’ensemble à un effort unique de production de données d’entraînement pour la famille de modèles Qwen. Là, on n’est plus dans l’essai discret. C’est industriel.
Moonshot AI et une piste militaire bien plus sensible
Une autre campagne est attribuée à Moonshot AI, l’entreprise derrière Kimi. Selon Anthropic, certaines requêtes semblaient être acheminées directement depuis l’armée chinoise. Et le contenu n’a rien d’anodin.
L’une d’elles demandait à Claude d’analyser un lot d’images de vidéosurveillance en circuit fermé pour déterminer si la personne observée « se comportait anormalement ». Sur une période de dix jours, près de 300.000 requêtes auraient transité vers Claude via un réseau de 5000 comptes, en visant surtout le modèle Opus. Clairement, on parle ici d’autre chose qu’un benchmark curieux.