Campaña identificada
OpenAI reveló haber desmantelado una operación coordinada que buscaba extraer el razonamiento interno de sus modelos de inteligencia artificial. La parte central de la actividad se atribuyó a la startup china Moonshot AI, responsable del chatbot Kimi.
La acción comenzó en julio y alcanzó un pico de 16 mil solicitudes provenientes de más de 4 mil cuentas en solo dos días. En total, la empresa rastreó a más de 15 mil usuarios involucrados antes de terminar completamente la ofensiva el 28 de julio.
Método utilizado
En lugar de invadir servidores o criptografía, los operadores manipularon conversaciones con los modelos para forzar la exposición de etapas de razonamiento que normalmente permanecen ocultas. Este proceso, llamado “destilación adversaria”, permite entrenar sistemas rivales con menos costo y tiempo.
Contexto de tensiones
El episodio ocurre semanas después de que Anthropic acusara a desarrolladores chinos, incluyendo a Moonshot, de usar su modelo Claude para acelerar el entrenamiento de su propia IA. El caso refuerza las preocupaciones estadounidenses sobre la transferencia no autorizada de tecnología avanzada.
Riesgos señalados
OpenAI advirtió que la extracción de razonamiento puede comprometer la seguridad de modelos de frontera y generar implicaciones para la seguridad nacional. La empresa compartió los hallazgos con el Frontier Model Forum y canales gubernamentales de inteligencia.
Moonshot aún no se ha manifestado oficialmente sobre las alegaciones.