Preveja.com · Prognosemärkte in Echtzeit

CNBC · G. Rok ·

OpenAI Enthüllt Chinesische Kampagne zur Extraktion von Reasoning aus KI-Modellen

Unternehmen beschuldigt Moonshot AI, koordinierte Bemühungen zur Replikation fortschrittlicher Fähigkeiten durch manipulierte Interaktionen anzuführen und Sicherheitswarnungen auszulösen.

OpenAI Enthüllt Chinesische Kampagne zur Extraktion von Reasoning aus KI-Modellen

Identifizierte Kampagne

OpenAI enthüllte, eine koordinierte Operation zerschlagen zu haben, die darauf abzielte, das interne Reasoning seiner KI-Modelle zu extrahieren. Der zentrale Teil der Aktivität wurde dem chinesischen Startup Moonshot AI zugeschrieben, dem Betreiber des Chatbots Kimi.

Die Aktion begann im Juli und erreichte einen Höhepunkt von 16 mil Anfragen von mehr als 4 mil Accounts innerhalb von nur zwei Tagen. Insgesamt verfolgte das Unternehmen mehr als 15 mil involvierte Nutzer, bevor es die Offensive am 28. Juli vollständig beendete.

Verwendete Methode

Anstatt Server oder Verschlüsselung anzugreifen, manipulierten die Betreiber Gespräche mit den Modellen, um Reasoning-Schritte offenzulegen, die normalerweise verborgen bleiben. Dieser Prozess, als „adversarial distillation“ bezeichnet, ermöglicht es, konkurrierende Systeme mit geringeren Kosten und Zeitaufwand zu trainieren.

Spannungskontext

Der Vorfall ereignet sich wenige Wochen, nachdem Anthropic chinesische Entwickler, darunter Moonshot, beschuldigt hatte, ihr Modell Claude zu nutzen, um das eigene KI-Training zu beschleunigen. Der Fall verstärkt amerikanische Bedenken über unbefugte Weitergabe fortschrittlicher Technologie.

Aufgezeigte Risiken

OpenAI warnte, dass die Extraktion von Reasoning die Sicherheit von Frontier-Modellen gefährden und Auswirkungen auf die nationale Sicherheit haben könne. Das Unternehmen teilte die Erkenntnisse mit dem Frontier Model Forum und Regierungsstellen für Nachrichtendienste.

Moonshot hat sich zu den Vorwürfen bisher nicht offiziell geäußert.

← Blog