Campanha identificada
OpenAI فاش کرد که عملیاتی هماهنگ برای استخراج استدلال داخلی مدلهای هوش مصنوعی خود را متوقف کرده است. بخش اصلی این فعالیت به استارتآپ چینی Moonshot AI، توسعهدهنده چتبات Kimi، نسبت داده شد.
این اقدام از ژوئیه آغاز شد و در دو روز به اوج ۱۶ هزار درخواست از بیش از ۴ هزار حساب رسید. در مجموع، شرکت بیش از ۱۵ هزار کاربر درگیر را ردیابی کرد پیش از آنکه حمله را کاملاً در ۲۸ de julho متوقف کند.
Método usado
بهجای نفوذ به سرورها یا رمزنگاری، عاملان مکالمات با مدلها را دستکاری کردند تا مراحل استدلال را که معمولاً پنهان میمانند، آشکار کنند. این فرآیند که «destilação adversária» نامیده میشود، امکان آموزش سیستمهای رقیب را با هزینه و زمان کمتر فراهم میکند.
Contexto de tensões
این رویداد چند هفته پس از آن رخ داد که Anthropic توسعهدهندگان چینی، از جمله Moonshot، را متهم کرد که از مدل Claude خود برای تسریع آموزش هوش مصنوعی خود استفاده کردهاند. این مورد نگرانیهای آمریکا درباره انتقال غیرمجاز فناوری پیشرفته را تقویت میکند.
Riscos apontados
OpenAI هشدار داد که استخراج استدلال میتواند امنیت مدلهای frontier را به خطر اندازد و پیامدهایی برای امنیت ملی داشته باشد. این شرکت یافتهها را با Frontier Model Forum و کانالهای اطلاعاتی دولتی به اشتراک گذاشت.
A Moonshot هنوز به طور رسمی درباره این اتهامات اظهارنظر نکرده است.