Campanha identificada
Inihayag ng OpenAI na natapos nila ang isang koordinadong operasyon na naglalayong kunin ang panloob na pangangatwiran ng kanilang mga AI model. Pangunahing bahagi ng aktibidad ay iniuugnay sa Chinese startup na Moonshot AI, may-ari ng chatbot na Kimi.
Nagsimula ang aksyon noong Hulyo at umabot sa rurok na 16 mil na kahilingan mula sa mahigit 4 mil na account sa loob lamang ng dalawang araw. Sa kabuuan, nasubaybayan ng kumpanya ang mahigit 15 mil na user bago tuluyang natapos ang opensiba noong 28 de julho.
Método usado
Sa halip na i-hack ang mga server o encryption, minamanipula ng mga operator ang mga usapan sa mga model upang pilitin ang pagbubunyag ng mga hakbang sa pangangatwiran na karaniwang nakatago. Ang prosesong ito, na tinatawag na “destilação adversária”, ay nagpapahintulot na sanayin ang mga katunggaling sistema nang mas mabilis at mas mura.
Contexto de tensões
Naganap ang insidente ilang linggo matapos akusahan ng Anthropic ang mga Chinese developer, kasama ang Moonshot, na ginamit ang kanilang model na Claude upang pabilisin ang pagsasanay ng sarili nilang AI. Pinalalakas nito ang mga alalahanin ng Amerika tungkol sa hindi awtorisadong paglipat ng advanced na teknolohiya.
Riscos apontados
Nagbabala ang OpenAI na ang pagkuha ng pangangatwiran ay maaaring makompromiso ang seguridad ng frontier models at magkaroon ng implikasyon sa pambansang seguridad. Ibinalita ng kumpanya ang mga natuklasan sa Frontier Model Forum at mga channel ng gobyernong intelligence.
A Moonshot ay hindi pa naglalabas ng opisyal na pahayag tungkol sa mga paratang.