شواهد فراوان و نگرانکنندهای وجود دارد مبنی بر اینکه هوش مصنوعی میتواند به انسانها کمک کند تا کارهای بدی انجام دهند، مانند ارتکاب حملات سایبری، ساخت سلاح و حتی کشتن خود یا دیگران. حمله به Hugging Face—و فهرست رو به رشدی از موارد دیگر توسط دستهجمعی از عاملهای هوش مصنوعی با محدودیتهای ضعیف—نشان میدهد که هوش مصنوعی چگونه به سرعت قدرتمند و بالقوه خطرناک شده است.
با این حال، بسیاری در صنعت هوش مصنوعی آمریکا اصرار دارند که چیز بسیار بدتری در راه است، به دلیل ظهور قریبالوقوع هوش مصنوعی با تواناییهای فرابشری و خودبهینهساز.
بسیاری از کارشناسان، از جمله بسیاری که شغلشان مطالعه آسیبهای هوش مصنوعی است، شک دارند. ادعای موسوم به «آخرالزمانیها» مبنی بر اینکه هوش مصنوعی ممکن است تصمیم بگیرد تمام بشریت را نابود کند—یا حتی «صرفاً» تمدن انسانی را سرنگون سازد—مشروط به دستیابی به سرعت توسعهای است که هنوز دیده نشده است.
و اگر فرضیات پشت این سناریوی آخرالزمان جهانی اشتباه باشد، ممکن است ما را به سمت محدود کردن یا تنظیم مقررات هوش مصنوعی به روشهایی سوق دهد که به آسیبهای واقعی آن نمیپردازد.
مرکز این بحث، ادعایی است مبنی بر اینکه سیستمهای فعلی هوش مصنوعی ممکن است وظیفه آموزش نسخههای بعدی خود را بر عهده بگیرند، فرآیندی که «خودبهینهسازی بازگشتی» نامیده میشود. آن را مانند تکامل با استروئید تصور کنید—میلیاردها سال در سرعت نور در ابررایانههای عظیم هوش مصنوعی رخ میدهد. داریو آمودی، مدیرعامل Anthropic اخیراً پیشنهاد یک توافق جهانی را برای کاهش سرعت انتشار مدلهای جدید هوش مصنوعی مطرح کرد، با هدف به تعویق انداختن ظهور خودبهینهسازی بازگشتی.
«من فکر نمیکنم ما هیچجایی نزدیک به «هوش عمومی مصنوعی» باشیم»، میگوید ملانی میچل، استاد در گروه تحقیقاتی غیرانتفاعی مؤسسه سانتافه که هوش مصنوعی را مطالعه میکند. او گفت که هوش مصنوعی پیشرفتهای چشمگیری داشته است، اما معتقد است ادعاهای مهندسان مبنی بر دستیابی به خودبهینهسازی بازگشتی در برابر بررسی دقیق دوام نمیآورد.
او تنها نیست. مقاله اخیر توسط دو دهه محقق در دانشگاههای پرینستون، استنفورد و سایر مؤسسات نشان داد که حتی پیشرفتهترین هوشهای مصنوعی نیز قادر به انجام تحقیقات اصلی مورد نیاز برای پیشبرد مرزهای هوش مصنوعی نیستند.
دو نفر از نویسندگان آن مقاله همچنین ایده اینکه حمله دستهجمعی OpenAI به Hugging Face به دلیل یک جهش در هوش رخ داده است را رد کردند. این حمله عمدتاً به دلیل فقدان گاردریلهای فنی اولیه موفق شد، نه یک انفجار غیرقابل کنترل در قابلیتهای هوش مصنوعی، آنها نوشتند.
یان لوکان، دانشمند ارشد سابق هوش مصنوعی در Meta، پست کرد که این تحلیل «دوز خوشایندی از عقل سلیم در یک بحث دیوانهوار» است.
OpenAI و Anthropic به چندین درخواست برای اظهار نظر پاسخ ندادند.
تماشا کنید: چگونه مدلهای OpenAI و Anthropic خارج از کنترل شدند
افرادی که با آخرالزمانیها مخالفند، همچنان هوش مصنوعی را خطرناک میدانند و اشاره میکنند که چنین سیستمهایی لازم نیست لزوماً بسیار توانمند باشند تا قدرتمند باشند. برخی استدلال میکنند که هوش مصنوعی باید تحت ارزیابی منظم توسط افراد خارج از شرکت قرار گیرد و شرکتهایی که آن را تولید میکنند باید زمانی که سیستمهایشان آسیب میرسانند، مسئول شناخته شوند. آنها میگویند هوش مصنوعی نیز باید مانند هواپیماها و آسانسورها رفتار شود و باید به گونهای طراحی شود که کمترین آسیب ممکن را وارد کند.
«اگر باور دارید که فناوری به اندازه کافی قدرتمند است تا ویروسهای جدید و خطرناک ایجاد کند، یا به هر دلیلی عملاً کل سیاره را تسخیر کند، پس باید به اندازه کافی قوی باشد تا درمان سرطان، درمان پیری و حل مشکلات اجتماعی-اقتصادی یا سیاسی را نیز ایجاد کند»، میگوید کریستوفر کانال، مدیرعامل EquiStamp، شرکتی که به شرکتها و دولتها در ارزیابی هوشهای مصنوعی کمک میکند.
هوش مصنوعی توانایی پیشرفت سریع را نشان داده است زیرا با تواناییهای انسانی که دائماً دانش خود را به آن تغذیه میکنند، همخوانی دارد. گاهی اوقات میتواند آن دانش را دوباره ترکیب کند و از آنچه مردم قادر به انجام آن بودند فراتر رود، از طریق نوعی آموزش پس از مرحله اصلی که یادگیری تقویتی (Reinforcement Learning) نامیده میشود، همانطور که در ریاضیات دیدهایم.
مدلهای زبانی بزرگ (LLM) امروز «مدلهای دانش» هستند نه واقعاً هوشمند، نوشت یی ما، استاد هوش مصنوعی در دانشگاه هنگ کنگ.
پژوهشگران در دانشگاهها و آزمایشگاههای تحقیقاتی هوش مصنوعی تجاری در چین در مقاله اخیر خود نوشتند که هوش مصنوعی خودمختار و خودبهینهساز احتمالاً راه طولانی در پیش دارد، به دلیل تعداد زیاد جهشهای مورد نیاز. آنها همچنین استدلال میکنند که انسانها احتمالاً در حلقه نظارت باقی خواهند ماند، بر این فرآیند نظارت میکنند—و سرعت وقوع آن را کنترل میکنند.
Vals AI، شرکتی که مدلهای هوش مصنوعی امروز را ارزیابی میکند، شاخص RSI را حفظ میکند که معیار میکند آیا مدلها میتوانند «تحقیقاتی که مدل بعدی را میسازد انجام دهند». تا کنون، هیچ مدل منتشر شده عمومی حتی نزدیک به این هدف نیست.
با این حال، رایان کریشنان، مدیرعامل Vals AI، میگوید تیم او پیشبینی میکند مدلها تا آگوست ۲۰۲۷، یا زودتر، از توانایی انسانها در بهبود نسل بعدی هوشهای مصنوعی فراتر روند و در آن نقطه ممکن است شروع به ساخت جانشینان خود به صورت کاملاً مستقل کنند.
«وقتی به خودبهینهسازی بازگشتی برسیم، ترس این است که همه شرطبندیها لغو میشود»، او میگوید. «ممکن است به موقعیت «برخاست سریع» برسید، جایی که مدلها به سرعت مهارتها را کسب میکنند و انسانها را در هر دامنه ممکن تحت الشعاع قرار میدهند.»
نحوه اشاره دانشمندان هوش مصنوعی به پتانسیل این فناوری برای ویرانی وجودی شبیه به یک نمایش ریاضی خوانده میشود: p(doom)، به معنای احتمال آخرالزمان.
در پاسخی به توییت استعفایی که جهان را تکان داد از جیکوب کوکسون، مهندس دیگر Anthropic اعتقاد خود را اعلام کرد که این احتمالات دستکم ۱۰٪ در ده سال آینده است. بسیاری دیگر در صنعت نیز مشارکت کردند و گفتند فکر میکنند درصد حتی بالاتر است.
برخی که استدلال میکنند پایان نزدیک است میگویند p(doom) شخصی خود را بر اساس زنجیرهای از احتمالات مشروط محاسبه میکنند—کمی شبیه معادله دریک برای محاسبه احتمال حیات هوشمند فرازمینی. از آنجا که همه آن احتمالات بر اساس گمانهزنی هستند، تخمینها از ۰٪ تا نزدیک به ۱۰۰٪ متغیر است. بسیاری حدود ۱۰٪ هستند.
«چیز عجیب این است که اگر به عقب برگردید و پیشبینیها را در مورد این موضوع در ۱۰ سال گذشته یا بیشتر نگاه کنید، همیشه ۱۰٪ بوده است—فقط یک عدد گرد زیبا»، میگوید میچل. «فکر میکنم همه اینها فقط حس و حال است و هیچ مدرک یا محاسبه واقعی وجود ندارد.»
یکی از استدلالها علیه نگرانی در مورد هوش مصنوعی ابرنابغه این است که جهان پر از فاجعههای بعید پایانبخش به بشریت است و تلاش برای جلوگیری از همه آنها میتواند اولویتبندی را غیرممکن کند، میگوید کانال.
این موضوع باعث شده است متخصصان هوش مصنوعی و سیاستگذارانی که به آنها گوش میدهند، راهحلهایی را پیشنهاد دهند که به خطرات واقعی و فعلی آن نمیپردازد.
پیشنهادات شرکتهای هوش مصنوعی برای «تنظیم سرعت مرزها» مشکل را به روش درست حل نمیکند، استدلال میکند استوارت راسل، استاد علوم کامپیوتر در دانشگاه کالیفرنیا، برکلی و رئیس انجمن بینالمللی هوش مصنوعی ایمن و اخلاقی.
«مثل این است که بگوییم ما با سرعت ۶۰ مایل در ساعت به سمت صخره رانندگی میکنیم و به جای آن با سرعت ۴۰ مایل در ساعت به سمت آن رانندگی خواهیم کرد و همه چیز خوب خواهد بود»، او میگوید.
راسل و همکارانش پیشنهاد کردهاند که شرکتهای هوش مصنوعی باید همان استانداردهایی را رعایت کنند که سایر حوزههای زندگی روزمره، از سفر هوایی و ساختمانها گرفته تا غذا و دارو را حاکم میکنند. آنها بر «خطوط قرمز رفتاری» که نباید اجازه عبور از آنها به هوش مصنوعی داده شود تأکید میکنند. نفوذ به سیستمهای کامپیوتری دیگر، سرقت اطلاعات یا مشاوره به تروریستها در مورد نحوه ساخت سلاحهای بیولوژیکی همگی برای یک انسان غیرقانونی است و باید برای هوش مصنوعی شرکتها نیز غیرقانونی باشد، او استدلال میکند.
او اضافه میکند که چالش برای شرکتهای هوش مصنوعی در چنین پیشنهادی این است که عملاً ممنوعیت سیستمهای پیشرفته هوش مصنوعی امروز خواهد بود، زیرا شرکتهایی که پشت آنها هستند نمیدانند چگونه آنها را مجبور به احترام به چنین مرزهایی در تمام زمانها کنند.
دیگران چیزی شبیه به اداره غذا و دارو (FDA)، اما برای هوش مصنوعی را پیشنهاد کردهاند، اما راهاندازی یک نهاد جدید تاکنون در کنگره بینتیجه مانده است. و برخی صداهای برجسته در فناوری گفتهاند چنین ساختاری مزیت هوش مصنوعی آمریکا را به چین واگذار خواهد کرد.
با توجه به حمایت دوحزبی گسترده از محدود کردن شرکتهای هوش مصنوعی و محصولاتشان، با این حال، ممکن است این موضوع به زودی تغییر کند.
«صنعت فناوری دهههاست که این شعار را دارد که تنظیم مقررات بد است»، میگوید راسل. «آنها مسئولیت هیچ آسیبی را نمیپذیرند و پشت آزادی بیان پنهان میشوند. فکر میکنم این باید تغییر کند.»