آنچه زمانی آرزویی دور برای پژوهشگران فناوری بود، حالا امکان هوش مصنوعی برای آموزش خودکار به منظور افزایش کارایی و توانمندی، هر روز بیشتر به واقعیت نزدیک میشود.
با پیشرفت این فناوری، توسعهدهندگان میگویند که آن در حال نزدیک شدن به «خودبهبودی بازگشتی» یا RSI است؛ وضعیتی که در آن مدلهای هوش مصنوعی راههایی برای بهبود خود و ساخت نسخه جانشین پیدا میکنند. مدیران اجرایی شرکتهای فناوری میگویند این امر میتواند وعده پیشرفتهایی در علم و پزشکی را محقق کند، اما ریسکهایی نیز دارد.
عدم قطعیت درباره اینکه همه اینها به کجا ختم میشود، در قلب ترسهای فزاینده درباره فرار هوش مصنوعی از کنترل انسان و تهدیدات احتمالی علیه بشریت قرار دارد؛ موضوعی که منجر شد چند غول هوش مصنوعی در آخر هفته گذشته به فراخوانی برای کندی سرعت رشد این فناوری بپیوندند.
شرکت Anthropic این هفته جزئیاتی ارائه داد که نشان میدهد چگونه مدل کلاد (Claude) به شرکت کمک میکند تا نسخه بعدی و هوشمندتر خود را توسعه دهد. کلاد اکنون ۲۶ درصد از تحقیق و توسعه مدلهای Anthropic را هدایت میکند؛ چیزی که به گفته شرکت، یعنی این مدل میتواند اکثر وظایف را «به صورت کامل از یک دستور سطح بالا» انجام دهد، در حالی که همچنان تحت نظارت انسانی است. این مدلها کاملاً خودمختار کار نمیکنند — حداقل هنوز نه.
در اینجا نکات کلیدی درباره خودبهبودی بازگشتی آورده شده است.
خودبهبودی بازگشتی چیست؟
شرکتهای پیشرو هوش مصنوعی تعاریف متفاوتی برای خودبهبودی بازگشتی دارند. برخی آن را زمانی تعریف میکنند که هرگونه بازخوردی از هوش مصنوعی در مورد بهبود مدل وجود داشته باشد، در حالی که دیگران آن را به عنوان فعالیت هوش مصنوعی برای رسیدن به این هدف به صورت کاملاً خودمختار تعریف میکنند.
آنتونی آگیره، رئیس و مدیرعامل نهاد غیرانتفاعی Future of Life Institute و استاد فیزیک در دانشگاه کالیفرنیا، سانتا کروز، گفت: خودبهبودی بازگشتی خودمختار اساساً به معنای هوش مصنوعی است که میتواند خودش را بهبود بخشد، نسخه بعدی سیستم را طراحی کند، سپس نسخه بعدی را و الی آخر.
او افزود: «نکته بسیار مهم اینجاست که هرچه هوش مصنوعی بخش بیشتری از این کار را انجام دهد، فرآیند سریعتر میشود، زیرا هوش مصنوعی بسیار، بسیار سریعتر از انسانها عمل میکند.»
جان تیکستن، استادیار علوم رایانه در دانشگاه کرنل که روشهای کنترل رفتار مدلهای هوش مصنوعی را مطالعه میکند، گفت: ترس پیرامون RSI عمدتاً بر پایه ظهور یک ابر هوشمندی مهارنشدنی از این فرآیند استوار است. اما او افزود که دیدگاه واقعبینانهتر نشان میدهد نوعی از خودبهبودی بازگشتی مدتی است که در توسعه هوش مصنوعی در جریان بوده است.
او گفت: «ما سالهاست که از این مدلها در نقشهای حمایتی برای ایجاد نسخه بعدی این مدلها استفاده کردهایم. بنابراین مردم از نسل قبلی مدلها برای نوشتن کد سیستمهای هوش مصنوعی استفاده میکنند که سپس نسل بعدی را ایجاد میکنند.»
سالهاست که پژوهشگران برجسته هوش مصنوعی مانند آندری کارپاتی، همبنیانگذار OpenAI، آزمایشهایی را برای آموزش و بهبود سیستمهای جدید هوش مصنوعی توسط مدلهای موجود انجام دادهاند. تیکستن گفت که این تلاشها بهبودهای جزئی ایجاد کردهاند، اما جهشهای خلاقانه بزرگی نبودهاند.
اما به گفته آگیره، شرکتهای هوش مصنوعی امروز بسیار به دستیابی به آن جهشهای بزرگتر در بهبود نزدیکتر هستند.
او گفت: «در نمودارهای Anthropic در طول زمان مشاهده میکنید که بخش فزایندهای از تحقیقات توسط هوش مصنوعی انجام میشود و به سمت خودمختاری کامل پیش میرود. نتیجه این موفقیت، در نهایت چیزی است که فکر میکنم بسیار ترسناک است. به نظر من این احتمالاً بدترین ایده در تاریخ بشریت است. و بله، آنها در حال انجام آن هستند.»
برخی آزمایشگاههای هوش مصنوعی میگویند RSI دور نیست
اعلامیه اخیر Anthropic بینشهایی درباره پیشرفت RSI به عموم و سایر آزمایشگاهها ارائه داد و رقبا را تشویق کرد تا شاخصهای مشابهی را به اشتراک بگذارند. با این حال، این شرکت صراحتاً اعلام نکرده است که چقدر به دستیابی به بهبود مدل کاملاً خودمختار نزدیک است.
سازنده ChatGPT، یعنی OpenAI، ماه جاری اعلام کرد که یک «کارآموز پژوهشی» خودکار توسعه داده است؛ سیستمی که میتواند وظایف پژوهشی مشخصی را تحت راهنمایی انسان انجام دهد، از جمله «وظایفی که برای یک محقق ماهر چند روز طول میکشد». این شرکت گفته است که با هدف ایجاد یک «محقق» هوش مصنوعی خودکار تا مارس ۲۰۲۸ پیش میرود.
این شرکت در آن اعلامیه گفت که اگرچه RSI میتواند به همسو کردن اقدامات مدلها با ارزشها و نیات انسانی کمک کند، اما این به معنای آن نیست که «RSI سریع لزوماً نتیجهای است که باید دنبال کنیم».
این شرکت در یک پست وبلاگی اظهار داشت: «اینکه آیا و چگونه ادامه دهیم، باید به توانایی ما در حفظ کنترل انسانی و انتخابهای دموکراتیک آگاهانه درباره مزایا و ریسکها بستگی داشته باشد.»
ایلان ماسک به نظر میرسد مشتاقتر به پیشروی است. او در ماه مارس گفت که برای مدلهای Grok شرکت xAI، «انسانها به تدریج کمتر در حلقه بهبود مدل حضور دارند» و «هر مدل متوالی توسط مدل قبلی ساخته میشود»، اما توضیح داد که این فرآیند هنوز کاملاً خودکار نشده است. او اضافه کرد که این هدف ممکن است تا پایان امسال، «اما نه دیرتر از سال ۲۰۲۷» محقق شود.
مایکروسافت و برخی دیگر از شرکتهای پیشرو هوش مصنوعی به نظر میرسد رویکرد متفاوتی را در پیش گرفتهاند.
مصطفی سلیمان، مدیرعامل Microsoft AI، گفته است که شرکت در حال حرکت به سمت «ابر هوشمندی انسانمحور» است؛ یعنی قابلیتهای پیشرفته هوش مصنوعی که در خدمت مردم و بشریت به طور کلی باشند. سلیمان در مقالهای در سال ۲۰۲۵ گفت که این به معنای «یک موجود نامحدود و بیقید با درجات بالای خودمختاری» نخواهد بود، بلکه هوش مصنوعی است که «با دقت تنظیم شده، در زمینههای خاص و در چارچوب محدودیتها عمل میکند».
چگونگی تأثیر مذاکرات کندی توسعه بر RSI
یکی از چالشهای کلیدی که آزمایشگاهها با آن مواجه هستند — و عملاً از زمان پیدایش این فناوری با آن دست و پنجه نرم میکنند — اطمینان از پیشرفت تدابیر ایمنی همگام با قابلیتهای مدلها است.
اختلافاتی در صنعت فناوری درباره فراخوانها برای کندی هماهنگ هوش مصنوعی به دلیل ایمنی شکل گرفته است و هر بازیگر اصلی در فضای هوش مصنوعی به طور خاص درباره مسیر آینده خود با RSI اظهار نظر نکرده است.
Anthropic که یکی از صداهای پیشرو در فراخوانها برای تنظیم سرعت بوده است، گفته است که کار توسعه خود را کند یا موقتاً متوقف خواهد کرد — مشروط بر اینکه رقبای جهانی آن نیز چنین کاری کنند و این توقف به صورت «قابل راستیآزمایی» باشد.
OpenAI ماه جاری صراحتاً گفت که هنوز نمیداند چگونه میتوان «به طور ایمن به RSI کاملاً همسو رسید» و افزود که این شرکت «نمیتواند فرض کند که پیشرفت در همسویی و ایمنی همگام با پیشرفت خواهد ماند». این شرکت ادامه داد که سیستمهای توانمندتر میتوانند نظارت بر آنها را دشوارتر کنند، اما دنبال کردن RSI همچنان هدفی است که آن را ارزشمند میداند، زیرا یک «محقق هوش مصنوعی خودکار میتواند یک محقق ایمنی یا همسویی خودکار نیز باشد».