پکن، ۳۱ ژوئیه (رویترز) - بر اساس بررسی رویترز از بیش از ۸۰ مقاله آکادمیک و ثبت اختراع چینی، محققان نظامی چین از خروجیهای مدلهای پیشرو هوش مصنوعی آمریکا که توسط OpenAI و Anthropic توسعه یافتهاند، برای آموزش سیستمهای هوش مصنوعی داخلی به منظور پیشبرد قابلیتهای دفاعی چین استفاده کردهاند.
این یافتههای که پیش از این گزارش نشده بودند، نگاهی نادر به چگونگی استفاده مؤسسات مرتبط با ارتش و امنیت در چین از مدلهای پیشرفته هوش مصنوعی آمریکا به عنوان یک میانبر برای توسعه سیستمهای تخصصی خود، با وجود تلاشهای واشنگتن برای محدود کردن دسترسی پکن به تراشههای پیشرفته و سایر فناوریهای استراتژیک، ارائه میدهد.
اسناد نشان میدهد که استفاده گستردهای از تکنیکی به نام «تقطیر مدل» (model distillation) وجود دارد که در آن از خروجیهای یک سیستم هوش مصنوعی قدرتمند برای آموزش مدلهای کوچکتر و تخصصیتر استفاده میشود. این مدلها میتوانند به صورت محلی و بدون نیاز به الزامات محاسباتی عظیم برای ساخت سیستمهای هوش مصنوعی پیشرفته از ابتدا، مستقر شوند.
بررسی رویترز، که شامل تحقیقات گردآوری شده توسط بنیاد جیمزتاون مستقر در واشنگتن بود و به طور انحصاری با این خبرگزاری به اشتراک گذاشته شد، نشان داد که تقطیر به طور گسترده توسط محققان مرتبط با ارتش آزادیبخش خلق چین و سایر مؤسسات نظامی استفاده میشود.
این مقالات نشان میدهند که مؤسسات دفاعی چین، مدلهای پیشرو هوش مصنوعی آمریکا را هم به عنوان منبعی برای بینش فنی و هم راهی برای کاهش شکاف با رقبای آمریکایی میبینند.
این اختلاف بر سر استخراج غیرمجاز است، نه خود تقطیر، که یک روش صنعتی پرکاربرد است.
این موضوع به عنوان یک نقطه اشتعال اصلی پیش از مذاکرات آمریکا و چین در مورد حاکمیت و ایمنی هوش مصنوعی مطرح شده است. مقامات آمریکایی برخی از نهادهای چینی را به استفاده از تقطیر برای استخراج قابلیتها از مدلهای هوش مصنوعی آمریکایی متهم کردهاند که به طور بالقوه کنترلهای صادراتی را تضعیف کرده و حقوق مالکیت معنوی را نقض میکند.
چین این اتهامات را رد کرده و میگوید واشنگتن به دنبال هژمونی هوش مصنوعی است، در حالی که استدلال میکند شرکتهای آمریکایی نیز در اقدامات مشابهی دست داشتهاند.
توسعهدهندگان چینی نیز ادعاهایی مبنی بر اتکای پیشرفتهای هوش مصنوعی آنها به مدلهای خارجی را رد کردهاند. شرکت نوپای هوش مصنوعی Moonshot هفته گذشته اتهامات دولت ترامپ مبنی بر ساخت مدل Kimi K3 خود با استفاده از تقطیر را رد کرد و گفت که این مدل بر اساس نوآوریهای اختصاصی ساخته شده است.
سانی چئونگ، پژوهشگر بنیاد جیمزتاون که بیش از ۶۰ مقاله را تحلیل کرده است، گفت که دانشمندان نظامی چینی به طور سیستماتیک مراحل استدلال مدلهای غربی را برای انطباق آنها با نظارت، جنگ سایبری و تصمیمگیری تاکتیکی ثبت میکنند.
چئونگ اظهار داشت: «آموزش پاسخ صحیح به یک مدل یک چیز است، اما آموزش استدلال پشت پاسخ بسیار دشوارتر است.»
این مقالات نشان میدهند که محققان مرتبط با ارتش چین در تلاشند تا این استدلال گرانقیمت و اختصاصی را از مدلهای غربی به سیستمهای کوچکتری که میتوانند به صورت محلی کنترل و مستقر کنند، منتقل کنند.
رویترز ادبیات آکادمیک را تأیید کرد و ۲۴ مورد مطالعه موردی دیگر مرتبط با ارتش را شناسایی کرد.
یکی از مقالات منتشر شده در سال گذشته توسط محققان واحد ۹۶۹۴۱ ارتش آزادیبخش خلق، که یک واحد اطلاعات نظامی و جنگ سایبری در پکن است، استفاده از GPT-3.5 شرکت OpenAI را برای پردازش کد منبع نظامی حساس توصیف کرد.
محققان گفتند که مدلهای شخص ثالث برای رسیدگی به اطلاعات طبقهبندی شده مناسب نیستند. برای غلبه بر این محدودیت، آنها از GPT-3.5 برای خلاصهسازی کد نرمافزاری استفاده کردند و یک مدل داخلی را بر اساس این خلاصهها آموزش دادند تا به طور کامل در شبکههای نظامی چین اجرا شود.
کاخ سفید، پنتاگون، وزارت امور خارجه چین، ارتش آزادیبخش خلق و OpenAI به درخواستها برای اظهار نظر پاسخ ندادند.
استفاده گسترده، از نظارت تا کاربردهای نظامی
بررسی رویترز و بنیاد جیمزتاون از مقالات نشان داد که محققان چینی از تقطیر برای اهدافی از نظارت بر محتوا تا استقرار نظامی استفاده کردهاند.
در دانشگاه شمال چین، که ارتباط نزدیکی با صنعت تسلیحات این کشور دارد، محققان از Claude 3 Haiku شرکت Anthropic برای تولید دادههای آموزشی مصنوعی برای یک مدل طبقهبندی متن جهت نظارت بر رسانههای اجتماعی و تعدیل محتوا استفاده کردند.
Anthropic اظهار داشت که دسترسی تجاری به Claude را در چین یا به شرکتهای تحت کنترل پکن ارائه نمیدهد و از سیستمهای نظارتی برای شناسایی نقض سیاستها استفاده میکند.
این شرکت افزود که مدلهای تقطیر شده ممکن است تدابیر ایمنی سیستمهای اصلی را از دست بدهند و به طور بالقوه امکان انتقال قابلیتهای حساس به مدلهایی خارج از کنترل آن را فراهم کنند.
یک مقاله در سال ۲۰۲۴ از دانشگاه ملی فناوری دفاعی ارتش آزادیبخش خلق، استفاده از تقطیر را برای کوچکسازی یک مدل پردازش تصویر برای استقرار در وسایل نقلیه هوایی بدون سرنشین (پهپادها) توصیف کرد. این امر به پهپادها اجازه میدهد تا ویدئوهای زنده را تحلیل کرده و از تصمیمات ناوبری و هدفگیری در زمان واقعی، حتی در صورت قطع ارتباطات، پشتیبانی کنند.
به طور مشابه، یک مطالعه منتشر شده در اوایل سال جاری نشان داد که محققان آکادمی علوم نظامی چین از تقطیر برای اجرای یک مدل تشخیص هدف بر روی سختافزارهای تاکتیکی در طول عملیات دریایی شبیهسازی شده با استفاده از پهپادها، کشتیها و زیردریاییهای بدون سرنشین استفاده کردند.
مزایا و محدودیتها
چین با توجه به محدودیتهای منابع محاسباتی پیشرفته به دلیل کنترلهای صادراتی واشنگتن بر تراشههای پیشرفته، تقطیر را به عنوان راهی برای رقابت با آمریکا در هوش مصنوعی پیشرفته پذیرفته است. دولتهای مرکزی و محلی، سبکسازی مدل و رایانش لبهای (edge computing) را ترویج کردهاند و یارانهها و بودجه تحقیقاتی را به سمت فناوریهایی هدایت میکنند که به مدلهای هوش مصنوعی اجازه میدهند بر روی پهپادها، ماهوارهها و سایر دستگاهها با قدرت پردازش محدود اجرا شوند.
با این حال، کارشناسان هشدار میدهند که تقطیر محدودیتهای قابل توجهی دارد.
همانطور که مدلهای هوش مصنوعی چین شکاف خود را با همتایان آمریکایی خود کاهش میدهند، محققان نظامی نیز تقطیر را به عنوان یک خطر امنیتی بالقوه بررسی میکنند.
در ژانویه، محققان دانشگاه مهندسی ارتش مقالهای در مورد تهدید تقطیر بدون داده (data-free distillation) منتشر کردند، روشی برای مهندسی معکوس قابلیتهای یک مدل بدون دسترسی مستقیم به پارامترهای اصلی آن.
برای مقابله با این آسیبپذیری، آنها مکانیزمهای دفاعی را پیشنهاد کردند که برای پوشاندن اطلاعات منطقی پنهان که در خروجیهای عمومی یک مدل آشکار میشوند، طراحی شدهاند.
مدلهای تقطیر شده نیز تنها قابلیتهای انتخابی را به ارث میبرند و نمیتوانند هوش گسترده سیستمهای پیشرفته را به طور کامل بازتولید کنند.
ترور کوورکو، یکی از بنیانگذاران شرکت دادههای هوش مصنوعی Sapien، گفت که مدلهای تقطیر شده همچنان از مدلهای معلم خود کمتر توانمند هستند.
این امر بهتر است به عنوان انتقال قابلیتهای انتخابی به یک سیستم ارزانتر و محلی کنترلشده درک شود، نه دستیابی به استقلال از هوش مصنوعی پیشرفته.