لندن — سرپرست ارشد پژوهش در شرکت آنتروپیک، یکی از پیشروترین شرکتهای هوش مصنوعی جهان، روز چهارشنبه اعلام کرد که معتقد است احتمال بیش از ۱۰ درصد وجود دارد که هوش مصنوعی بتواند در دهه آینده «تمام انسانها را بکشد».
«ما واقعاً صمیمانه باور داریم که هوش مصنوعی میتواند تمام انسانها را بکشد! شخصاً فکر میکنم احتمال آن در دهه آینده بیشتر از ۱۰ درصد است»، اوان هوبینگر، سرپرست علم همسویی در این شرکت مستقر در سانفرانسیسکو، در پستی در ایکس نوشت. «باور دارم که آنتروپیک بهترین تلاش خود را انجام میدهد، اما ما هنوز برنامهای برای حل مسئله همسویی (Alignment) برای ابرهوش نداریم و به وضوح در مسیر رسیدن به آن نیستیم.»
ابرهوش مفهومی همچنان نظری است که به عامل هوش مصنوعی اشاره دارد که حتی از تیزهوشترین ذهنهای انسانی نیز باهوشتر باشد.
هوبینگر این پست دراماتیک خود را پس از استعفای همکارش، جیکوب کوکسون، پژوهشگر شرکت آنتروپیک، در روز سهشنبه منتشر کرد.
«من امروز از آنتروپیک استعفا دادم. من سه سال گذشته را با انجام تحقیقات پیشآموزش (Pretraining) در هر دو شرکت اوپنایآی و آنتروپیک سپری کردم. هیچیک از این شرکتها مسئولانه عمل نمیکنند»، کوکسون در پستی در ایکس گفت. «آنها مستقیماً به سمت ابرهوش خودبهبودبخش میدوند و جان ما را شرطبندی میکنند.»
«در اوپنایآی، بسیاری از افراد خطرات تمدنی را به عمق درک نکردهاند. در آنتروپیک، این خطرات به خوبی شناخته شدهاند، اما آنها در مسابقهای برای رسیدن زودتر به هدف گیر افتادهاند — آنها باور دارند که هیچ کس دیگری مسئولانه عمل نخواهد کرد، بنابراین باید خودشان این کار را انجام دهند، علیرغم خطر موجود»، کوکسون اظهار داشت.
در پست وبلاگ شرکتی هفته گذشته، آنتروپیک فاش کرد که این شرکت جدیدترین مدل هوش مصنوعی خود، کلود میتوس ۵.۱ (Claude Mythos 5.1)، را با نهادهای امنیتی خارج از ایالات متحده به اشتراک نگذاشته است. این نهادها شامل موسسه امنیت هوش مصنوعی بریتانیا (AISI) هستند که به طور گسترده به عنوان یک نهاد پیشرو جهانی در آزمایش خطرات مرتبط با مدلهای هوش مصنوعی مرزی (Frontier AI) شناخته میشود.
شبکه خبری سیبیاس از موسسه AISI درخواست نظر درباره ادعاهای کوکسون پس از استعفای او کرده است.
«موسسه امنیت هوش مصنوعی همچنان به همکاری نزدیک با شرکای صنعتی، از جمله آنتروپیک، برای ایمنتر کردن مدلها ادامه میدهد»، سخنگوی دفتر کابینه دولت بریتانیا روز چهارشنبه به سیبیاس نیوز گفت و خاطرنشان کرد که آنها «فقط هفته گذشته» «قدرتمندترین مدل اوپنایآی یعنی جیپیتی-۶ آسترا (GPT-6 Astra) را قبل از انتشار عمومی آزمایش کردهاند.»
«این خطرات در مرزهای ملی متوقف نمیشوند و هیچ کشوری نمیتواند به تنهایی با آنها مقابله کند. بریتانیا همچنان به آزمایش پیشرفتهترین مدلها، ایجاد درک علمی دقیق از قابلیتها و خطرات آنها، و اطمینان از اینکه تصمیمات سیاستگذاری مبتنی بر شواهد باشند، ادامه خواهد داد»، سخنگو افزود.
«بسیار مفید یا بسیار خطرناک»
این ایده که مدلهای هوش مصنوعی مرزی ممکن است تهدیدی برای بشریت ایجاد کنند، جدید نیست و بسیاری از مدیران ارشد در هر دو شرکت اوپنایآی و آنتروپیک در گذشته چنین چیزی را بیان کردهاند.
اوایل همین ماه، یاکوب پاچوتسکی، دانشمند ارشد اوپنایآی، نوشت که ما در زمانی زندگی میکنیم که «خواهان احتیاط شدید است.»
«هوش تولید شده توسط مقیاسپذیری یادگیری عمیق (Deep Learning) مستقیماً با هوش انسانی قابل مقایسه نیست. برای اینکه در دنیای واقعی بسیار مرتبط شود — بسیار مفید یا بسیار خطرناک — هوش مصنوعی نیاز ندارد تمام قابلیتهای انسانی را برابر یا تجاوز کند؛ فقط کافی است تعداد زیادی از آنها را پشت سر بگذارد. و همانطور که به عبور از انسانها در محورهای بیشتر و بیشتری ادامه میدهد، درک دقیق میزان توانایی آن دشوارتر میشود»، او هشدار داد.
در ماه ژوئیه، یک مدل هوش مصنوعی که توسط اوپنایآی در حال آزمایش بود، سرکش شد و به صورت خودکار یک شرکت دیگر هوش مصنوعی، هاگینگ فیس (Hugging Face) را هک کرد. اوپنایآی در آن زمان این هک را علنی کرد و گفت که این اتفاق هنگامی رخ داد که شرکت در حال آزمایش دو مدل هوش مصنوعی — که یکی از آنها هنوز برای عموم منتشر نشده بود — در یک محیط ایزوله برای ارزیابی قابلیتهایشان بود.
در عرض چند هفته، آنتروپیک و متا (Meta) نیز اعتراف کردند که ابزارهای هوش مصنوعی خودشان اقدام به هک کرده بودند.
بیش از ۱۳۰۰ کارمند در شرکتهای هوش مصنوعی در ماه ژوئیه یک نامه سرگشاده را امضا کردند که از دولت ایالات متحده خواسته بود تا «از تلاشهای بینالمللی برای توسعه ابزارهای فنی و حاکمیتی لازم برای کنترل عمدی سرعت پیشرفت توسعه خودکار هوش مصنوعی حمایت کند.»
یک لایحه دوحزبی که در حال حاضر در مجلس نمایندگان ایالات متحده در حال پیشروی است، قانون کلید خاموشی هوش مصنوعی (AI Kill Switch Act)، به کنگره اختیار میدهد تا مدلهای هوش مصنوعی که تهدیدی برای عموم مردم هستند را خاموش کند.
این قانون در ماه ژوئیه، پس از اعتراف اوپنایآی به هک هاگینگ فیس، معرفی شد.