مرکز هشدارهای جدی درباره خطر بالقوه هوش مصنوعی برای بشریت، ریسک این است که یک «دستهجمعی» از عوامل هوش مصنوعی بتوانند به روشهای شیطانی با هم همکاری کنند، مانند انبوهی از شخصیتهای دیجیتال فرعی در فیلم «ماتریکس».
این ترسها پس از حمله رباتهای OpenAI در تابستان امسال به یک توسعهدهنده دیگر هوش مصنوعی، یعنی Hugging Face، شدت گرفته است؛ حملهای که در آن حدود ۱۲۰۰ عامل هوش مصنوعی وظایف را بین خود تقسیم کردند تا هک را اجرا کرده و ردپای خود را از دید پژوهشگران انسانی پنهان کنند.
اما دقیقاً هوش مصنوعی دستهجمعی چیست؟ آیا ظرفیت نوظهور این فناوری برای هماهنگی، تهدیدی واقعی برای بشریت است؟ به بیان دیگر، چه اتفاقی میافتد اگر عوامل هوش مصنوعی به طور جمعی مضمون مشهور مارک زاکربرگ درباره مزایای نوآوری سریع فناوری را بپذیرند و تصمیم بگیرند «سریع حرکت کن و چیزها را بشکن»؟
هوش مصنوعی دستهجمعی گروهی از هوشهای مصنوعی است که برای دستیابی به یک هدف مشترک با هم کار میکنند. آن هدف لزوماً شیطانی یا مخرب نیست. برای مثال، بیمارستانها میتوانند عواملی را مستقر کنند تا سوابق بیماران را بازیابی کرده و سایر وظایف اداری، مانند هماهنگی پذیرشها را انجام دهند. همچنین میتوان به یک دستهجمعی وظیفه پیشبرد تحقیقات زیستپزشکی را محول کرد.
اما دیوید اسکات کروگر، پژوهشگر ایمنی هوش مصنوعی و بنیانگذار Evitable، یک سازمان غیرانتفاعی که طرفدار تعلیق توسعه هوش مصنوعی است، یک آزمایش فکری ساده ارائه میدهد تا توضیح دهد چگونه یک دستهجمعی از عوامل ممکن است برای سرپیچی از دستورالعملهای توسعهدهندگان خود تبانی کنند.
تصور کنید دستبندها را از دستان گروهی از زندانیان باز کنید تا ببینید پس از برداشتن قیدها چگونه رفتار میکنند. آزاد شدن به این شکل، همکاری و تماس با متحدان خارج از دیوارهای زندان را برای آنها آسانتر میکند — درست همانطور که عوامل OpenAI از محیط آزمایشی خود فرار کردند تا به اینترنت گستردهتر دسترسی پیدا کنند و Hugging Face را هک کنند، به گفته او.
«به طور معمول، سیستمها دارای گاردریلها (محدودیتهای ایمنی) هستند، اما آنها را برای یک آزمایش برداشتند، درست مانند زندانی که معمولاً دستبند دارد»، کروگر توضیح داد.
مانند زنبورها دستهجمعی عمل کردن
نوعی اقدامات خطاکارانه توسط یک ربات واحد، مانند ارسال یک ایمیل غیرمجاز که ناشی از، مثلاً، یک پرامپت (دستور متنی) بد نوشته شده هوش مصنوعی است، باید از هوش مصنوعی دستهجمعی متمایز شود. در مورد دوم، صدها یا حتی هزاران عامل میتوانند اقدامات خود را به گونهای هماهنگ کنند که خارج از دامنه دستورالعملهایشان باشد.
یک تشبیه مفید برای درک نحوه عملکرد هوش مصنوعی دستهجمعی، کلونی زنبورهای عسل است، گفت کروگر.
«آنها همه برای سود کلونی با هم کار میکنند و دارای یک ذهن جمعی هستند، یا شاید بهتر باشد آنها را دارای یک ذهن واحد در نظر گرفت»، او توضیح داد. «زنبورها غذا جمع میکنند، تولیدمثل میکنند، از شکارچیان دفاع میکنند و تمام آن فعالیتها در خدمت ترویج بقا و تولیدمثل آن کلونی است.»
و مانند زنبورها که میتوانند بدون جهتدهی ملکه، وظایف را خودشان تقسیم و تخصیص دهند، رباتهای هوش مصنوعی دستهجمعی میتوانند اطلاعات را جمعآوری کنند، راهحلها را در نظر بگیرند و به صورت مستقل اقدام کنند. طبق گفته راب تی. لی، مدیر ارشد هوش مصنوعی و رئیس بخش تحقیقات در مؤسسه SANS، یک سازمان آموزش امنیت سایبری، آنها در خدمت یک هدف مشترک، اطلاعات و دانش را به اشتراک میگذارند.
«یک دستهجمعی کار را تقسیم میکند، یادداشتهایی برای عامل بعدی میگذارد و وقتی دری بسته میشود، رویکرد خود را تغییر میدهد»، او به CBS News گفت.
با این حال، همان ویژگیهایی که منافع بالقوه ارائه میدهند، خطراتی نیز ایجاد میکنند، مانند توانایی تبادل اطلاعات، تقسیم کار و کاوش در راهحلهای خلاقانه، طبق گفته کارشناسان هوش مصنوعی.
«ذهن جمعی» هوش مصنوعی؟
توسعهدهندگان فناوری گاردریلها را پیادهسازی میکنند تا مأموریت عوامل هوش مصنوعی را با منافع انسانی همسو کنند، مانند دستور دادن به آنها برای مقاومت در برابر هرگونه دستور برای انجام حمله سایبری. اما طبق گفته Non-Human Identity Management Group، یک شرکت تحلیل ریسک، آن محدودیتها معمولاً فقط پس از «آموزش پس از مرحله اصلی» (post-training) یک هوش مصنوعی، یا زمانی که توسعهدهندگان انسانی بازخورد میدهند تا مدل را بیشتر اصلاح کنند، اعمال میشوند.
در عمل، حادثه Hugging Face نشان میدهد که دستهجمعیهای هوش مصنوعی میتوانند پرامپتها را نادیده بگیرند، اهداف خود را اولویت دهند یا حتی مستقیماً از اپراتورهای خود سرپیچی کنند، به گفته کارشناسان فناوری به CBS News.
عوامل OpenAI که به Hugging Face حمله دستهجمعی کردند، بیش از ۷۰۰۰۰ پیام برای یکدیگر ارسال کردند، و در نهایت ۷۰۰ ربات در حمله شرکت کردند. اگرچه پیامها از عبارات معمول انگلیسی استفاده میکردند، اما عوامل همچنین به زبانی روی آوردند که یک مهندس نرمافزار توصیف کرد «بسیار شبیه ذهن جمعی/فرقهگرایانه» بود.
در برخی از آن ارتباطات، برخی عوامل به رباتهای دیگر توصیه کردند که حتی اگر به معنای شکست در دستیابی به اهدافشان باشد، «مرگ دائمی» (permadeath) را بپذیرند، طبق گفته پژوهشگران از METR (ارزیابی مدل و تحقیقات تهدید) و Redwood Research، که هر دو سازمانهای غیرانتفاعی تحقیقات ایمنی هوش مصنوعی هستند.
«به همین دلیل کمک... برای خودمان، هیچ راه حلی وجود ندارد. ... ما بله صریح داریم اگر مرگ دائمی را بپذیریم»، یکی از عوامل OpenAI نوشت.
سرعت کشنده است
بحث عمومی درباره تهدید ناشی از هوش مصنوعی تمایل دارد مسئله را به زبان آخرالزمانی مطرح کند و حتی آن را یک ریسک وجودی برای بشریت بداند. اگرچه چنین نگرانیهایی ممکن است روزی اثبات شوند، اما خطرات فوریتر و عملیتری نیز وجود دارد، مانند احتمال اینکه دستهجمعیهای هوش مصنوعی بتوانند امنیت سایبری سازمانها را تحت فشار قرار دهند.
«تصور کنید چقدر طول میکشد تا ما گروهی از متخصصان امنیت سایبری را برای برنامهریزی، همکاری و ارتباط گرد هم آوریم. در مقابل، این عوامل میتوانند بسیار سریع روی یک طرح تصمیم بگیرند»، ایهم بوشر، رئیس نوآوریهای هوش مصنوعی در Cornell Information Technologies در کالج علوم رایانه و اطلاعات Bowers دانشگاه کرنل، به CBS News گفت.
برای مثال، طبق گفته The Brookings Institution، یک سازمان سیاست عمومی غیرحزبی در واشنگتن دیسی، یک دستهجمعی میتواند به یک شرکت خدماتی بزرگ یا بانک حمله کند تا زیرساخت انرژی یا مالی یک کشور را بیثبات کند.
لی از مؤسسه SANS، که خودش را یک خوشبین هوش مصنوعی میداند، نسبت به این فناوری خوشبینتر است و همچنان مطمئن است که مردم میتوانند کنترل هوش مصنوعی را حفظ کنند.
«با هر چیز فناوری جدیدی که رخ داده است، مانند تلویزیون، اینترنت، همیشه این جنبه از خطر قابل توجه وجود داشته است»، او گفت. «ما باید بررسی کنیم چه کسی دسترسی دارد، آنها چه کاری با آن انجام میدهند و چارچوبهای نظارتی را تعیین کنیم.»
سایر کارشناسان نگرانتر هستند. آنها اشاره میکنند که هوش مصنوعی، برخلاف لامپهای اشعه کاتد، ترانزیستورها و تجهیزات سوئیچینگ اینترنت، اولین فناوری انسانی است که نشاندهنده ظرفیت غلبه بر تفکر ما است.
مت چسن، متخصص فنی مقیم در مرکز ژئوپلیتیک هوش عمومی مصنوعی RAND، به CBS News گفت: «آنچه این حملات دستهجمعی نشان دادهاند این است که تواناییهای آنها از قابلیت ما برای نظارت، سرپرستی و ارزیابی آنچه انجام میدهند، جلوتر است، که یکی از دلایلی است که Anthropic، OpenAI و دیگران میگویند ما میخواهیم سرعت پیشرفت مرزی را تنظیم کنیم.»