Preveja.com · Marchés de prédiction en temps réel

CNBC · G. Rok ·

OpenAI dénonce une campagne chinoise visant à extraire le raisonnement des modèles d'IA

L'entreprise accuse Moonshot AI d'avoir mené un effort coordonné pour reproduire des capacités avancées via des interactions manipulées, suscitant des alertes de sécurité.

OpenAI dénonce une campagne chinoise visant à extraire le raisonnement des modèles d'IA

Campagne identifiée

OpenAI a révélé avoir démantelé une opération coordonnée visant à extraire le raisonnement interne de ses modèles d'intelligence artificielle. La partie centrale de l'activité a été attribuée à la startup chinoise Moonshot AI, responsable du chatbot Kimi.

L'action a commencé en juillet et a atteint un pic de 16 000 requêtes provenant de plus de 4 000 comptes en seulement deux jours. Au total, l'entreprise a suivi plus de 15 000 utilisateurs impliqués avant de mettre fin complètement à l'offensive le 28 juillet.

Méthode utilisée

Au lieu d'envahir des serveurs ou de contourner le chiffrement, les opérateurs ont manipulé des conversations avec les modèles pour forcer l'exposition d'étapes de raisonnement qui restent normalement cachées. Ce processus, appelé « distillation adverse », permet d'entraîner des systèmes concurrents à moindre coût et en moins de temps.

Contexte de tensions

L'épisode survient quelques semaines après qu'Anthropic ait accusé des développeurs chinois, dont Moonshot, d'utiliser son modèle Claude pour accélérer l'entraînement de leur propre IA. L'affaire renforce les préoccupations américaines concernant le transfert non autorisé de technologies avancées.

Risques signalés

OpenAI a averti que l'extraction du raisonnement peut compromettre la sécurité des modèles de pointe et avoir des implications pour la sécurité nationale. L'entreprise a partagé ses conclusions avec le Frontier Model Forum et les canaux gouvernementaux de renseignement.

Moonshot ne s'est pas encore prononcée officiellement sur ces allégations.

← Blog