Preveja.com · Mercados de predicción en tiempo real

CNBC · G. Rok ·

OpenAI Expone Campaña China para Extraer Razonamiento de Modelos de IA

La empresa acusa a Moonshot AI de liderar un esfuerzo coordinado para replicar capacidades avanzadas mediante interacciones manipuladas, generando alertas de seguridad.

OpenAI Expone Campaña China para Extraer Razonamiento de Modelos de IA

Campaña identificada

OpenAI reveló haber desmantelado una operación coordinada que buscaba extraer el razonamiento interno de sus modelos de inteligencia artificial. La parte central de la actividad se atribuyó a la startup china Moonshot AI, responsable del chatbot Kimi.

La acción comenzó en julio y alcanzó un pico de 16 mil solicitudes provenientes de más de 4 mil cuentas en solo dos días. En total, la empresa rastreó a más de 15 mil usuarios involucrados antes de terminar completamente la ofensiva el 28 de julio.

Método utilizado

En lugar de invadir servidores o criptografía, los operadores manipularon conversaciones con los modelos para forzar la exposición de etapas de razonamiento que normalmente permanecen ocultas. Este proceso, llamado “destilación adversaria”, permite entrenar sistemas rivales con menos costo y tiempo.

Contexto de tensiones

El episodio ocurre semanas después de que Anthropic acusara a desarrolladores chinos, incluyendo a Moonshot, de usar su modelo Claude para acelerar el entrenamiento de su propia IA. El caso refuerza las preocupaciones estadounidenses sobre la transferencia no autorizada de tecnología avanzada.

Riesgos señalados

OpenAI advirtió que la extracción de razonamiento puede comprometer la seguridad de modelos de frontera y generar implicaciones para la seguridad nacional. La empresa compartió los hallazgos con el Frontier Model Forum y canales gubernamentales de inteligencia.

Moonshot aún no se ha manifestado oficialmente sobre las alegaciones.

← Blog