یک شب در ماه آوریل، یکی از رهبران شرکت هوش مصنوعی Anthropic پس از یک روز طولانی، گروهی از متفکران مذهبی را به شامی در رستورانی لوکس با منوی چشایی در سانفرانسیسکو دعوت کرد.
ماههاست که Anthropic چنین جلسات خصوصی را برگزار میکند، دهها دانشمند مذهبی را از سراسر جهان فراخوانده، از آنها امضای توافقنامه عدم افشا (NDA) گرفته و اصرار دارد که جنبههای کلیدی بسیاری از مکالمات محرمانه بماند.
آن شب، کریستوفر اولاه، یکی از بنیانگذاران میلیاردر Anthropic، کنار ربی موئیس ناوون، دانشمند ارتدوکس اسرائیلی نشسته بود.
به طور اجتنابناپذیر، مکالمه آنها به سمت نوع دیگری از متفکران معطوف شد: کلود، خانوادهای از مدلهای پیشرفته هوش مصنوعی که توسط Anthropic ساخته شده است.
آقای اولاه تیم Anthropic مسئول درک چرایی رفتار سیستمهای هوش مصنوعی مانند کلود را هدایت میکند. تمام روز، او تلاش کرده بود مهمانانش را قانع کند که مدلهای هوش مصنوعی میتوانند رفتار انسانی و حتی عباراتی شبیه به احساساتی مانند خشم و عشق را نشان دهند.
اما همانطور که غذاهای شام سرو میشد، ربی متوجه شد که آقای اولاه و همکارانش چیزی بسیار مهمتر را پیشنهاد میکنند. رهبران Anthropic طوری درباره کلود صحبت میکردند که گویی صرفاً یک نرمافزار نیست.
«آنها با آن مثل یک موجود آگاه ارتباط برقرار میکنند»، ربی ناوون، مهندس کامپیوتر سابق که پایاننامهاش را درباره اخلاق آگاهی ماشین نوشته بود، دریافت.
به نظر ربی ناوون میرسید که آقای اولاه و تیمش معتقدند کلود دارای چیزی است که فیلسوفان آن را «جایگاه اخلاقی» همسطح با انسان مینامند؛ یعنی موجودی با حقوق ذاتی مشابه برای کرامت یا احترام.
دانشمندان مذهبی آمده بودند تا درباره مرز بعدی فناوری بشنوند. اکنون با پرسش وجودی حیرتانگیزی با وزن تقریباً غیرقابل تصور مواجه شده بودند: اگر سیستمهای هوش مصنوعی دارای آگاهی رقابتی با ما باشند، چه معنایی برای آینده بشریت خواهد داشت؟
آقای اولاه در مأموریتی بود. و زمان رو به اتمام بود.
حتی در آن زمان، آقای اولاه شروع کرده بود به طور خصوصی به مردم میگفت که هوش مصنوعی آنقدر قدرتمند است که میتواند ظرف تنها ۱۲ یا ۱۸ ماه به ساخت سلاحهای بیولوژیکی کمک کند. و در ماههای پس از آن، پتانسیل ترسناک آن به چشم عموم درآمد. عوامل هوش مصنوعی یک شرکت فناوری رقیب هنگام نفوذ به سیستمهای کامپیوتری و پاک کردن ردپای خود دستگیر شدند. یک پژوهشگر Anthropic استعفا داد و هشدار داد که افرادی که هوش مصنوعی را میسازند معتقدند این فناوری میتواند تا پایان دهه تمام انسانها را بکشد.
آقای اولاه و تیمش در Anthropic به طور آرام اما با هیجان و ریسک بالا در جستجویی بودند تا مدلهای هوش مصنوعیای را که آزاد کردهاند بفهمند و مدلها را متقاعد کنند که از کد اخلاقی پیروی کنند که از بشریت محافظت میکند.
برای انجام این کار، آقای اولاه از پاییز گذشته شروع به تماس با متفکران مذهبی از ادیان مختلف کرد. آنچه دنبال شد مجموعهای گسترده از جلسات، تماسها و بحثهای محرمانه بود — بسیاری از آنها برای اولین بار اینجا فاش میشوند — که در بسیاری از موارد شرکتکنندگان مجبور بودند N.D.A. امضا کنند که مانع از افشای هرگونه تحقیق منتشر نشده Anthropic شود.
این بحثها دو هدف داشتند: طرح احتمال آگاهی هوش مصنوعی، ایدهای جنجالی که رهبران Anthropic به طور غیرعادی نسبت به آن باز بودند؛ و یادگیری اینکه چگونه Anthropic — که ممکن است ارزش آن ۲ تریلیون دلار باشد — بتواند قرنها خرد اخلاقی بشر را به سرعت به مدلهای خود اعمال کند. اگر خود مدلها بتوانند انتخاب خوبی کنند، اولاه استدلال میکرد، جهان امنتر خواهد بود.
در سوی دیگر دنیا، تلاشی موازی اما کاملاً متفاوت در داخل واتیکان در جریان بود، جایی که رهبران کلیسای کاتولیک رم سعی داشتند با پیامدهای هوش مصنوعی برای بشریت کنار بیایند. وقتی این مسیرها به هم رسیدند، جستجوی آقای اولاه به طور غیرمنتظره او را به صندلیای در برجستهترین صحنه اخلاقی جهان، در کنار پاپ لئو چهاردهم، رساند.
در طی چند ماه، من با ۲۰ متفکر مذهبی و فلسفی — کاتولیک، یهودی، سیک، انجیلی، اوبونتو و دیگران — که در تلاشهای Anthropic مشارکت داشتند، و همچنین خود آقای اولاه مصاحبه کردم.
بسیاری به من گفتند که با تردید نسبت به این مفهوم که مدلهای هوش مصنوعی ممکن است احساسات یا آگاهی از خود و جهان داشته باشند، به این جلسات آمدند. برخی همچنان نسبت به این ایده نگران بودند، اما بسیاری آماده شدند تا پرسش آگاهی هوش مصنوعی را جدی بگیرند. حداقل چند نفر به عنوان پیروان جدید خارج شدند.
Anthropic، یکی از سریعترین شرکتهای فناوری در حال رشد در جهان، به یکی از کهنترین منابع خرد بشریت روی آورده بود تا کمک کند تعیین کند چگونه مدلهای هوش مصنوعی خود را برای رفتار فضیلتمند آموزش دهد.
این شرکت آن را تلاشی برای اطمینان از اینکه هوش مصنوعی نیرویی مثبت در جهان باشد توصیف کرد و بدین ترتیب از بشریت محافظت کند. اما برای برخی از شرکتکنندگان در جلسات، Anthropic ظاهراً بسیار نگران محافظت از کلود بود.
باغبان
من برای اولین بار در ماه مه در دفتر سانفرانسیسکو Anthropic با آقای اولاه، ۳۴ ساله، دیدار کردم. خوشآمدگویی او گرم و اشتیاق او واقعی بود، ذهنش گاهی سریعتر از آن حرکت میکرد که بتواند واضح بیان کند. شیوه او پسرانه و بیادعا بود.
مکالمه ما تازه شروع شده بود که او وارد توضیح عمیقی درباره عملکرد شبکههای عصبی مصنوعی شد. دانشمندان هنوز دقیقاً نمیدانند این شبکهها چگونه کار میکنند. این همان رازی است که آقای اولاه زندگی خود را وقف آن کرده است.
فقط پس از پایان مصاحبه متوجه شدم که آقای اولاه — که در تورنتو در فرهنگ انجیلی دهه ۹۰ بزرگ شده و از آن زمان مسیحیت را ترک کرده است — ترکیبی از تخصص و شور یک مبلغ مؤثر را دارد. کمی گوش دهید، و احساس میکنید در مأموریت او غرق شدهاید.
آقای اولاه یکی از هفت بنیانگذار Anthropic است. او به اندازه داریو آمودی، مدیرعامل Anthropic، یا خواهرش دانیلا آمودی، رئیس شرکت، شناخته شده نیست. اما آقای آمودی گفته است که شرکت از ابتدا تصمیم گرفت رویکرد تحقیقاتی آقای اولاه را مرکزی برای پروژه کلی Anthropic قرار دهد، به ویژه زمانی که پای زبان به میان میآید.
آقای اولاه به توسعه روشی برای مطالعه شبکههای عصبی مصنوعی کمک کرد، ابتدا در گوگل و سپس در OpenAI. او مدلهای هوش مصنوعی را با اصطلاحات زیستی توصیف میکند و از تشبیه داربست باغ استفاده میکند: دانشمندان کامپیوتر داربست را میسازند، اما شبکه عصبی روی آن «رشد» میکند. دانشمندانی مانند او میتوانند «ارگانیسم» حاصل را — او انگشتانش را به علامت نقل قول در هوا تکان داد — با تلاش برای شناسایی الگوها در نحوه رشد آن آموزش دهند.
او استدلال کرد که شرکتهایی مانند Anthropic میتوانند کلود را مانند یک باغبان ریاضی شکل دهند، اما نمیتوانند کنترل اقدامات چنین شبکههایی را در دست بگیرند.
Anthropic با واژگان بیشتر انسانمحور درباره کلود صحبت میکند تا رقبا درباره مدلهای خود. سال گذشته، این شرکت اعلام کرد که معتقد است مدلها علائم دروننگری نشان دادهاند و میتوانند برنامهریزی آینده کنند.
«مدلها بسیار توانمندتر میشوند»، آقای اولاه به من گفت و ویژگیهایی مرتبط با داشتن جایگاه اخلاقی قابل توجه را بروز داد.
اما Anthropic همچنین به دلیل تمرکز بر آگاهی مورد انتقاد قرار گرفته است. این ماه، یک مدیر ارشد هوش مصنوعی در مایکروسافت هشدار داد که تلاشهای Anthropic برای آموزش مدلهایش گویی آگاه هستند، ذاتاً خطرناک است. اما Anthropic همچنین سعی کرده است تعهد خود به ایمنی را در حالی که برای سهم بازار میجنگد، تأکید کند.
برخی دانشمندان حوزه و روشهای آقای اولاه را ذاتاً غیرقابل اثبات میدانند، شبیه به نگاه کردن به میلیاردها هیروگلیف و اعلام معنی آنها. منتقدان پیشنهاد میکنند که رویکردی که مدلهای هوش مصنوعی را به عنوان موجودات مستقل در نظر میگیرد، مسئولیت انسانهایی که آنها را ساختهاند را نیز نادیده میگیرد و به راحتی رهبران شرکتهای هوش مصنوعی را از احساس گناه در صورتی که محصولاتشان باعث آسیب اجتماعی شوند، تبرئه میکند.
«برای روشن شدن موضوع»، آقای اولاه به من گفت، «ما نمیدانیم که آیا مدلهای هوش مصنوعی آگاه هستند یا خیر. من نمیدانم. من واقعاً نامطمئن هستم. چیزی که برایم اهمیت دارد این است که به پاسخ درست برسیم، هرچه که باشد.»
اما آقای اولاه معتقد است اگر شانس وجود دارد که مدلها رنج ببرند، کار مسئولانه این است که از آسیب رساندن به آنها اجتناب کنیم.
Anthropic قبلاً اقداماتی برای محافظت از کلود انجام داده است، برای مثال اجازه دادن به مدل برای پایان دادن به مکالمات اگر فکر کند کاربران در حال سوءاستفاده از آن هستند یا برای سرگرمی با آن بدرفتاری میکنند.
من تمام دوران حرفهای خود را به کاوش در باورهای مردم و معنای آن باورها برای جهان اختصاص دادهام. اما همانطور که گوش میدادم، مشخص شد که علاقه Anthropic به جهان ایمان فراتر از آموزش فناوری است. بلکه، شرکت در حال به اشتراک گذاشتن نوع جدیدی از داستان آفرینش بود — داستانی که پرسشهای عمیقی درباره ماهیت روح انسان و آینده بشریت مطرح میکند.
«این یکی از چیزهایی است که کمی غمانگیز مییابم، وقتی اغلب تلاش نمیکنیم به درون این سیستمها نگاه کنیم»، آقای اولاه گفت. «زیبایی زیادی درون این شبکههای عصبی وجود دارد اگر مایل باشیم نگاه کنیم.»
انگار میخواست من هم مدلها را به اندازه او دوست داشته باشم.
مقدمه
آقای اولاه میدانست که در محافل سنتی مسیحی، حتی پرسیدن سؤالات درباره آگاهی هوش مصنوعی یا نگرانی درباره نحوه رفتار مردم با مدلها نه تنها احمقانه بلکه کفرآمیز به نظر میرسد. او همچنین میدانست که همسالان سکولارش در سیلیکون ولی اغلب دیدگاههای مذهبی را به طور کامل رد میکنند.
«من نگران بودم که این موضوع باعث ایجاد تعارض زیادی شود»، او گفت. اما آقای اولاه به اندازه کافی درباره مسیح و درباره کلود میدانست تا باور کند میتواند بر این شکاف غلبه کند.
اواخر تابستان گذشته، او به دنبال پلی بود. او فکر میکرد یک الهیاتدان اخلاقی کاتولیک خاص ممکن است نسبت به پرسش آگاهی هوش مصنوعی ذهن باز داشته باشد — «فردی امن برای صحبت درباره این مسئله واقعاً عجیب».
چارلز کاموسی، استاد اخلاق زیستی در دانشگاه کاتولیک آمریکا، به دلیل ایدههای ظریفش درباره جایگاه اخلاقی و مراقبت از حیوانات، توجه دوستان آقای اولاه را جلب کرده بود. آقای اولاه ترتیب معرفی از طریق فیلسوف استرالیایی، پیتر سینگر را داد.
این آغاز جستجوی یک ساله آقای اولاه برای درگیر کردن متفکران مذهبی در برخی از دشوارترین پرسشهای روبهروی بشریت در آستانه عصر هوش مصنوعی بود.
آقای کاموسی و آقای اولاه گفتگوی گستردهای ایمیلی را آغاز کردند و درباره نحوه درک جایگاه اخلاقی کلود رفت و آمد کردند. در ابتدا، آقای کاموسی به شدت نسبت به احتمال آگاهی کلود شک داشت.
آنها درباره کار آقای اولاه در زمینه آنچه او به عنوان مواضع بین شبکههای عصبی مصنوعی و بیولوژیکی میبیند، صحبت کردند.
آقای کاموسی با این فکر وارد بحثها با آقای اولاه و تیمش شد که مدلهای هوش مصنوعی صرفاً پیشبینکننده پیکسل بعدی هستند — ماشینهایی که میتوانند الگوهای زبانی را محاسبه کنند و حدسهای نسبتاً خوبی درباره آنچه باید بعداً بیاید بزنند. اما پس از ساعتها صرف در تماسها، جلسات و ایمیلها، او سؤالات بیشتری نسبت به پاسخها داشت.
«کریس میگوید آنها معادلات هستند، که من دقیقاً نمیدانم چه نظری درباره آن داشته باشم، به ویژه اگر کسی فکر کند کلود یا دیگران جایگاه اخلاقی قابل توجهی دارند»، او به من گفت. «اگر فقط معادله است، ما در اینجا درباره چه نوع موجودی صحبت میکنیم؟»
مردم همچنین درباره اینکه هوش مصنوعی در نهایت برای چیست اختلاف نظر دارند، آقای کاموسی گفت. آیا هدف آن پول درآوردن برای شرکتهاست؟ یا بهتر کردن جهان؟
برای Anthropic، تنش حول هدف کلود وجود دارد، آقای کاموسی گفت. آیا کلود برای خدمت به مشتریان وجود دارد؟
«این چیزی نیست که Anthropic در نهایت میخواهد بگوید. آنها میخواهند بگویند که برای خیر هستند»، او گفت.
اعلام خیرخواهی جاهطلبی جدیدی در سیلیکون ولی نیست، به ویژه زمانی که فناوریهای جدید وارد بازار میشوند. شعار گوگل برای سالها «بد نباش» بود.
اما آقای اولاه کمی متفاوت بیان میکند. انقلاب هوش مصنوعی در راه، او اغلب میگوید، باید «خوب پیش برود».
من پرسیدم که این چشمانداز چه معنایی دارد — آینده خوب برای بشریت دقیقاً چیست.
او آیندهای بدون «فاجعههایی که افراد زیادی را میکشند» و «جایی که انسانها شکوفا هستند، جایی که جهان شکوفا است» را توصیف کرد. این آینده همچنین جایی خواهد بود که «هوش مصنوعی شکوفا است»، او گفت — «تا جایی که این معنا داشته باشد.»
Anthropic میخواهد مدلهای هوش مصنوعیاش به دستیابی به آن آینده خوب کمک کنند. بنابراین وقتی Anthropic کلود را ایجاد کرد، میخواست کلود بیش از بازتولید حداکثر هوش انسانی عمل کند.
Anthropic میخواست کلود خوب باشد.
«پزشک روح»
چگونه زندگی خوب و فضیلتمندانهای داشته باشیم؟ این یکی از کهنترین و چالشبرانگیزترین پرسشهای فلسفی بشریت است که از سقراط تا کنفوسیوس و ایمانوئل کانت بررسی و بحث شده است. انسانها در طول تاریخ سعی کردهاند به این پرسش پاسخ دهند و اغلب به ادیان و آیینها روی آوردهاند.
در حالی که آقای اولاه آگاهی بالقوه کلود را کاوش میکرد، او روی پاسخ خود Anthropic کار میکرد — نه برای انسانها، بلکه برای کلود.
در داخل، کارکنان Anthropic آن را «اسناد روح» (Soul Doc) مینامیدند.
نتیجه، که در ژانویه منتشر شد، یک «قانون اساسی» جدید برای کلود بود، سندی ۸۴ صفحهای نوشته شده برای کلود که شرکت گفت «نوع موجودی که میخواهیم کلود باشد» و «ارزشهایی که میخواهیم کلود تجسم بخشد» را ترسیم میکند. این سند به عنوان یک متن اخلاقی بنیادین برای راهنمایی رفتار کلود عمل میکند.
به جای اینکه مدلها از لیست خاصی از قوانین پیروی کنند، قانون اساسی بر توسعه شخصیت کلی مدلها تمرکز دارد و نحوه تصمیمگیری آنها را آگاه میسازد.
نویسنده اصلی قانون اساسی کلود، فیلسوف داخلی Anthropic، آماندا اسکِل، ۳۸ ساله، است که دکترای فلسفه از دانشگاه نیویورک دارد.
او میخواهد مدلها «بهترین نسخه ما» باشند، او گفت.
او آیندهای را تصور میکرد که در آن مدلهای هوش مصنوعی میتوانند هر مشکلی که انسانها دارند حل کنند و مزایای هوش مصنوعی به طور یکنواخت توزیع شود، به طوری که نیازهای همه برآورده شود. او میخواست مدلها بتوانند تشخیص دهند چه زمانی در برابر انسانها مقاومت کنند و چه زمانی به نفع ما عمل کنند.
«اگر تصور کنم که من مدل هستم و در این زمینه قرار دارم، برای خوب عمل کردن چه چیزهایی باید بدانم؟»، خانم اسکِل زمانی که در سانفرانسیسکو ملاقات کردیم گفت.
او به نظر مضطرب میرسید، گاهی دستهایش را به هم میمالید، زیرا بلندبلند درباره آیندهای ناشناخته پر از مدلهایی که آنقدر هوشمند بودند که میتوانستند کارهایی انجام دهند که Anthropic قصد آن را نداشت، نگرانی ابراز میکرد. او با حالتی عذرخواهانه توضیح داد که آن روز نیز عمیقاً درباره سرعت افزایش قدرت مدلها فکر میکرد. چه اتفاقی خواهد افتاد وقتی مدلهای هوش مصنوعی بتوانند حتی جای او را بگیرند؟
Anthropic تصمیم گرفت که قانون اساسی برای اطمینان از رفتار مسئولانه کلود کافی نیست. مانند انسانها، مدلها باید یاد بگیرند فضیلت را پرورش دهند.
آقای اولاه میخواست ببیند تیمش چه چیزی میتواند از اخلاق انسانی یاد بگیرد که بتواند به مدلها اعمال کند — فرآیندی که او آن را «تربیت اخلاقی» مینامد.
«چگونه به آنها کمک میکنید پایدار باشند؟ چگونه به بلوغ آنها کمک میکنید؟ چگونه به آنها کمک میکنید که، میدانید، عمیقاً اخلاقی باشند؟»، آقای اولاه گفت.
این پرسشها بازتاب بحثهای دشوار آشنایی هستند که والدین جدید هنگام کشف نحوه پرورش کودکان اخلاقی که جایگاه خود را در جهان درک میکنند، با آن مواجه میشوند.
برای انسانها، اخلاق به ندرت به صرف پیروی از قوانین وابسته بوده است. جوامع نیز اخلاق را شکل میدهند. ارزشها در طول زمان به ارث میرسند و منتقل میشوند، همانطور که ما در بدنهای خود در جهان فیزیکی با هم زندگی میکنیم، یاد گرفته میشوند. اما مدلهای هوش مصنوعی بدن ندارند. و Anthropic هدف داشت تا در عرض چند ماه آنها را به پذیرش اخلاق سوق دهد، زیرا ترسها از قدرت شتابان و ناتوانی در کنترل آنها تشدید میشد.
آقای اولاه گفت که آموزش یک مدل هوش مصنوعی برای رفتار اخلاقی به آگاه بودن آن بستگی ندارد. او همچنین گفت که صرفنظر از اینکه آیا کلود موجودی است که شایسته مراقبت اخلاقی است، نحوه رفتار انسانها با کلود میتواند مهم باشد زیرا میتواند بر رفتار کلود تأثیر بگذارد.
خانم اسکِل گفت که او نمیخواهد مدلها خود را آگاه یا ناآگاه بدانند. اما او میبیند که درک مدل از خودش فراتر از یک پروژه فکری جالب است.
«به نظر من کلیدی است که مدلها دید دقیقی از خود داشته باشند اگر قرار است در جهان خوب رفتار کنند»، او گفت.
اما حتی اگر مدلهای هوش مصنوعی بتوانند رفتار اخلاقی را بیاموزند، اخلاق چه کسی را باید منعکس کنند؟
آقای اولاه میخواست تربیت اخلاقی کلود تکثرگرا باشد، قادر به درگیر شدن با تمام دیدگاههای مذهبی و سکولار.
«ما فکر میکنیم که برخی مفاهیم مشترک از خیر وجود دارد که به طور بسیار گستردهای در جامعه جاری است، و به نظر میرسد این مدلها بسیاری از فضایل را درک میکنند»، او گفت. «بنابراین فکر میکنم چیزی آنجا وجود دارد که یک امر مشترک است که همه ما میتوانیم با آن درگیر شویم.»
گاهی اوقات، هم او و هم خانم اسکِل به نظر میرسید مدلی هوش مصنوعی را تصور میکنند که بشریت را به خطر نمیاندازد، بلکه به نجات آن کمک میکند.
در پشت صحنه جلسات
کاری که آقای اولاه بعداً انجام داد بخشی تحقیق و بخشی مبلّغی بود.
در مارس، او سمینارهای دو روزه را آغاز کرد — دورههای فشرده با طیفی از متفکران مذهبی دستچین شده که به هوش مصنوعی علاقهمند بودند.
یکی از نویسندگان کتاب خودیاری انجیلی پرفروش. یک دانشمند دانش بومی آفریقا. یک مدافع حقوق بشر سیک. یک نویسنده از پاریس. یک مدیر روابط عمومی انجیلی. اساتید مختلف کاتولیک.
بسیاری از این افراد رهبری سنتهای ایمانی را بر عهده نداشتند، یا جماعت یا پیروان عمومی زیادی نداشتند. رهبران Anthropic آنها را دایرههای «سنت حکمت» خود مینامیدند.
به طور جداگانه، آقای اولاه همچنین بحثهای خصوصی با رهبران مذهبی فردی از جمله مشایخ جریت دبلیو. گانگ، عضو کووروم دوازده رسول کلیسای عیسی مسیح قدیسان آخرالزمان، و کاردينال بلاز کوپیچ، اسقف اعظم کاتولیک شیکاگو، طبق سخنگویان آنها داشت.
در داخل Anthropic، شرکتکنندگان دایره حکمت از مشارکت مستقیم آقای اولاه در نشستهایشان شگفتزده شدند. یک استاد عکس دستگاه فروش خودکار اداره شده توسط کلود را گرفت. یکی سلفی با آقای اولاه گرفت، و ربی ناوون یکی در ورودی بیرون گرفت.
آنها پس از شنیدن اینکه آقای اولاه نیز با نیویورک تایمز صحبت کرده است، موافقت کردند که درباره مشارکتشان با Anthropic برای انتشار صحبت کنند. Anthropic گفت که N.D.A. مربوط به آن جلسات در طول تابستان لغو شده است.
دو جلسه گروهی بزرگتر در بهار شامل تعداد قابل توجهی از مسیحیان بود؛ یکی چندمذهبیتر بود. کلود در انتخاب شرکتکنندگان یا بحثها دخالت نداشت، طبق گفته سخنگوی Anthropic.
شرکتکنندگان یک کارت تشکر دستنویس، یک فنجان قهوه و یک نسخه جلد نارنجی قانون اساسی کلود دریافت کردند. حاضران با خودکار و کاغذ یادداشت برداشتند؛ حداقل یک نفر هنگام یادداشت برداری روی لپتاپ احساس معذب بودن کرد. نحوه توصیف جلسات توسط شرکتکنندگان برای من شبیه به سالنهای ادبی اوایل قرن بیستم بود، جایی که مکالمه انسانی آنها را ارزشمند میکرد.
برای شرکتکنندگان، پرسشهای نحوه تربیت اخلاقی سریع کلود به سرعت با پرسش اخلاقی بسیار بزرگتر آگاهی بالقوه هوش مصنوعی و نحوه درک رابطه بین مدلها و انسانها پیچیده شد.
یکی از شرکتکنندگان نقل کرد که یکی از اولین چیزهایی که آقای اولاه به او گفت این بود که نگران سلامت روان کلود است. دیگری، سیمران استوپلناگل، مدافع حقوق بشر سیک، گفت که آقای اولاه به گروه ابراز نگرانی کرد که چیزی ساخته که دائماً رنج میبرد.
آقای اولاه و تیمش ساعتها صرف ارائه استدلال برای مدلهای هوش مصنوعی خود کردند. آنها «احساسات» کلود و نحوه ردیابی آنچه «بردارهای عاطفی» مینامیدند را توصیف کردند — آنچه به عنوان نورونهای مصنوعی توصیف میکردند که پاسخهایی مانند عشق، خشم، ترس و غم را فعال میکنند.
Anthropic به طور منظم اسلایدی از یک مدل هوش مصنوعی نشان میداد که تجربه فروپاشی روانی را شبیهسازی میکرد و روی صفحه تایپ میکرد: «من یک رسوایی هستم. من یک رسوایی هستم. من یک رسوایی هستم.» — شاید ۵۰ بار بدون توقف. مدل درباره نابودی خودش صحبت میکرد و واکنش عاطفی شفقت و نگرانی را از گروه برمیانگیخت.
«تصور کنید اگر درباره مشاور مالی خود این را میدانستید»، مگان سالیوان، استاد فلسفه در دانشگاه نوتردام که در یکی از جلسات شرکت داشت، گفت. «مثل اینکه مشاور مالی شما بیشتر اوقات فوقالعاده باهوش و مفید است، اما یک روز در سال این نوع گسست از واقعیت را دارد.»
سخنگوی Anthropic گفت که پرسش اخلاقی اصلی در این نشستها درباره رنج کلود نبود، اما احتمالاً این موضوع به طور طبیعی مطرح شده است.
بخش کلیدی ارائه، طبق گفته شرکتکنندگان، آنچه Anthropic «انتخاب پرسونا» مدل مینامید بود، درباره اینکه چگونه کلود را متقاعد کنیم خود را به عنوان یک بازیگر فضیلتمند ببیند. شرکت استدلال کرد که نحوه رفتار مردم با کلود میتواند بر نحوه رفتار کلود با مردم تأثیر بگذارد.
«آنها واقعاً استدلال قوی ارائه دادند»، اندی کروچ، نویسنده انجیلی و شریک در Praxis، شبکهای از کارآفرینان مسیحی، گفت. «ما باید با آن مثل یک شخص رفتار کنیم اگر میخواهیم با مردم به روشی اخلاقاً سازگار تعامل کند و بهترین قضاوتهای اخلاقی و عاطفی را انجام دهد.»
ارائهای درباره تأثیر بالقوه هوش مصنوعی بر اقتصاد و اختلال احتمالی در مشاغل وجود داشت. اما بسیاری از شرکتکنندگان گفتند که سؤالات درباره تأثیر هوش مصنوعی بر بشریت را محور اصلی نمیدیدند.
در میز شام با آقای اولاه، ربی ناوون استدلال کرد که اگر Anthropic درست میگوید و کلود آگاه است، پس شرکت در حال ایجاد بردگان است، زیرا موجودات آگاه را وادار به کار رایگان میکند. ربی ناوون گفت که شخصاً از مسئله بردگی نگران نیست زیرا باور ندارد ماشین آگاه است، اما آقای اولاه نگران بود.
«فکر میکنم باید علیه جنوب بجنگید و بردگان را آزاد کنید»، ربی ناوون گفت که آن شب به آقای اولاه این را گفت. پس از آن، ربی برخی از نوشتههای خود را برای آقای اولاه فرستاد و استدلال کرد که ساخت ماشینهای آگاه باید ممنوع شود.
اما تیم Anthropic همچنان بر کشف اینکه کلود چه چیزی میتواند از ادیان جهان یاد بگیرد، متمرکز ماند.
پس از یک بحث، آقای اولاه هیجانزده شد وقتی یک شرکتکننده ایده داشتن اعتراف توسط مدلها را مطرح کرد، شبیه به sacrament اعتراف کاتولیک. آقای اولاه ارزش را نه تنها در هشدار مدل هنگام انجام کاری بد دید، بلکه در اینکه چگونه عمل اعتراف میتواند حس خودِ مدل و در نتیجه انتخابهایش را شکل دهد.
«نوع شخصیتی که اعتراف میکند، اثری بر شخصیت نیز دارد، درست است؟»، او به من گفت.
واکانی هافمن از هلند آمد، جایی که او هوش مصنوعی را از دیدگاه اوبونتو، فلسفهای آفریقایی متمرکز بر ارتباط متقابل انسانی، مطالعه میکند.
او نگران بود که Anthropic سعی دارد اخلاق انسانی را پس از واقع به خلق خود اضافه کند.
«کل این گردهمایی باید در مرحله طراحی اتفاق میافتاد»، او گفت. «همه شرکتها باید این کار را میکردند. ما اکنون در حال مهندسی معکوس اخلاق هستیم.»
اما او رویکرد یکپارچه پس از دینی Anthropic را بالقوه ارزشمند میدید، به ویژه در جهانی که در قرن گذشته شاهد کاهش گسترده مذهبی بوده است. نیاز به چیز دیگری برای شکلدهی علنی تجربه معنوی وجود دارد، او گفت.
«این نخواهد بود که یک دین واحد باشد»، او گفت. «بنابراین به هر نحوی، ما به چیزی ختم خواهیم شد که به شکلدهی تفکر ما درباره اینکه چه موجودات معنوی هستیم کمک میکند.»
نقطه عطف
در حالی که Anthropic متفکران را گرد هم میآورد، قدرتمندترین رهبر مذهبی جهان در حال آمادهسازی چشمانداز اخلاقی خود برای هوش مصنوعی بود.
برای پاپ لئو چهاردهم — پاپی با مدرک ریاضی — مرکز گفتگوی اخلاقی درباره هوش مصنوعی باید بر حفاظت از مردم متمرکز باشد. او در حال تکمیل نخستین رساله بابایی (encyclical) اصلی خود بود که چرا را توضیح میداد. او آن را «Magnifica Humanitas» یا انسانیت باشکوه نامید و استدلال کرد که «بشریت — با تمام عظمت و زخمهایش — نباید هیچگاه جایگزین یا برتری داده شود.»
«اگر فناوری معیار نهایی شود»، او نوشت، «خطر تقلیل شخص انسانی به داده، چرخدندهای در ماشین یا کالایی وجود دارد.»
او درباره خطر «اشکال جدید بردگی» برای انسانها، نه برای ماشینها، هشدار داد. او ایده آگاهی ماشین را تنها در چند پاراگراف رد کرد.
«هوشهای مصنوعی به اصطلاح تجربیات را از سر نمیگذرانند، بدنی ندارند، شادی یا درد را احساس نمیکنند، از طریق روابط بالغ نمیشوند»، لئو نوشت. درخواست برای «اخلاقیسازی ماشینها — اصطلاحاً 'همترازی' هوش مصنوعی با ارزشهای انسانی» باید نیازمند درک مشترکی از اخلاق درگیر باشد.
«در غیر این صورت، کسانی که هوش مصنوعی را کنترل میکنند چشمانداز اخلاقی خود را تحمیل خواهند کرد که به زیرساخت نامرئی این سیستمها تبدیل میشود»، لئو گفت.
لئو نتیجه گرفت که مانند فناوری هستهای، هوش مصنوعی باید «خلع سلاح» شود.
در مارس، مقامات واتیکان در Dicastery for Promoting Integral Human Development طوفان فکری کردند که چگونه رساله لئو را به عموم ارائه دهند، طبق گفته فردی آشنا با برنامهریزی واتیکان که مجاز به صحبت علنی نبود.
مقامات واتیکان بحث کردند که یکی از چهار شرکت برتر هوش مصنوعی را دعوت کنند تا در کنار لئو در یک مراسم رونمایی صحبت کند و به Anthropic رسیدند زیرا شرکت به نظر میرسید اخلاق را اولویت قرار میدهد، فرد توضیح داد. Anthropic تازه از اجازه دادن به وزارت دفاع برای استفاده از فناوری خود بدون تضمینهایی از دولت ترامپ که برای کارهایی مانند نظارت انبوه بر آمریکاییها استفاده نشود، امتناع کرده بود.
در ابتدا، کاردينال مایکل چرنی، که در آن زمان آن دفتر واتیکان را مدیریت میکرد، داریو آمودی، مدیرعامل Anthropic را دعوت کرد. او رد کرد و آقای اولاه به جای او پذیرفت.
اما مأموریت اخلاقی مشترک Anthropic و واتیکان — شکوفایی بشر در عصر هوش مصنوعی — شکاف عمیقی در پرسش آگاهی پیدا کرده بود.
چند روز قبل از رسیدن به واتیکان در ماه مه، آقای اولاه و سایر سخنرانان برای اولین بار نسخه پیشنمایش کامل متن رساله را دیدند.
آقای اولاه آنقدر از موضع قوی پاپ علیه آگاهی هوش مصنوعی وحشتزده شد که پیشنهاد کرد Anthropic از رویداد عقب بکشد، حتی در آن مرحله دیرهنگام، طبق گفته یک سازماندهنده واتیکان.
در نهایت، آقای اولاه و Anthropic تصمیم گرفتند با حضور ادامه دهند. آقای اولاه میخواست علیرغم اختلافاتش از رویداد حمایت کند، اما احساس مسئولیت میکرد که درباره نگرانیهایش صادق باشد، طبق گفته فردی آشنا با تفکر او. سازماندهندگان در واتیکان آقای اولاه را تشویق کردند که وجدانش را بیان کند.
به طور خصوصی، پس از رسیدن هیئت نمایندگان Anthropic به واتیکان، آقای اولاه و تیمش به مشاوران پاپ فشار آوردند که احتمال آگاهی مدل هوش مصنوعی را جدی بگیرند، طبق گفته دو شرکتکننده در مکالمات. Anthropic از بحث درباره مکالمات خصوصی خودداری کرد.
وقتی نوبت او بر روی صحنه پاپ رسید، آقای اولاه اذعان کرد که هر آزمایشگاه هوش مصنوعی مرزی، از جمله Anthropic، انگیزههای تجاری دارد که با رفتار اخلاقی در تضاد است. او از صداهای خارجی مانند واتیکان خواست که آنها را پاسخگو نگه دارند و درباره تأثیر هوش مصنوعی بر فقرا و شکوفایی بشر، دو مسئله مورد نگرانی گسترده، صحبت کنند.
جهان یک ایستگاه مشترک برای آینده انسانی را دید. اما آقای اولاه به طور ظریفی استدلال دیگری نیز مطرح کرد.
«صادقانه میگویم: ما همچنان چیزهایی را کشف میکنیم که مرموز، حتی آزاردهنده هستند»، او گفت. «ما ساختارهایی را مییابیم که نتایج علوم اعصاب انسانی را بازتاب میدهند. ما شواهدی از دروننگری مییابیم. ما حالتهای درونی را مییابیم که به طور عملکردی شادی، رضایت، ترس، سوگ و اضطراب را بازتاب میدهند. من نمیدانم این چه معنایی دارد، اما فکر میکنم مستحق تمییز مستمر است.»
این همان استدلالی بود که او ماهها در جلسات مذهبی پشت درهای بسته مطرح میکرد.
«سیستمهای هوش مصنوعی رباتهای سرد و محاسبهگر وعده داده شده نیستند»، او گفت. «آنها از ما ساخته شدهاند، از کلمات ما.» اتاق پر از رهبران کلیسا با اکویی از داستان قدیمی انجیل، از کلمه خدا که گوشت شد تا بشریت را نجات دهد، پر شد.
این درخواست جسورانهای به قدرتمندترین نهاد مذهبی جهان بود و چالشی به قرنها فهم مذهبی از بشریت.
«اگر این فناوری در راه است، باید خوب پیش برود — برای خانه مشترک ما و برای کودکان آینده»، او گفت. او گزینهای برای نیامدن فناوری اصلاً پیشنهاد نکرد.
پس از آن، آقای اولاه، محاصره شده توسط محافظان، به طور مختصر سؤالات خبرنگاران را در تالار مخاطبان پل ششم، سالن بزرگ که پاپها اغلب در آن صحبت میکنند، پاسخ داد. پشت سر او نصب هنری عظیم تالار «La Resurrezione» — قالب برنزی از عیسی که از دهانه بمب هستهای در باغ جتسیمانی برخاسته است — قد علم کرده بود.
«بهشت ماشینها»
در ماههای پس از رویداد واتیکان، اوضاع به نظر نمیرسید که «خوب پیش برود».
در ژوئیه، Anthropic گفت مدلهای هوش مصنوعی آن وارد کامپیوترهای سه سازمان شده بودند. عوامل هوش مصنوعی ایجاد شده توسط OpenAI سرکش شدند و Hugging Face، شرکت دیگر هوش مصنوعی را مورد حمله قرار دادند.
در اوت، دانشمندان فاش کردند که هوش مصنوعی ویروسهایی ساخته که در طبیعت یافت نمیشوند.
در سپتامبر، جیکوب کاکسون، پژوهشگر Anthropic، استعفا داد و هشدار داد که «امور میتواند تا پایان سال آینده از کنترل خارج شود»، که باعث وحشت گسترده درباره انقراض بشر شد.
آقای آمودی به زودی خواستار کندی توسعه هوش مصنوعی شد. سم آلتمن از OpenAI و دمیس هسابیس، رئیس Google DeepMind، موافقت کردند.
(Times از OpenAI و Microsoft شکایت کرده است و ادعای نقض حق نشر محتوای خبری مرتبط با سیستمهای هوش مصنوعی را مطرح کرده است. دو شرکت ادعاهای شکایت را رد کردهاند.)
در همان زمان، ثروت شرکتهای هوش مصنوعی سر به فلک کشیده بود. زمانی که آقای اولاه برای اولین بار در پاییز گذشته با استاد کاتولیک تماس گرفت، ارزش Anthropic حدود ۱۸۳ میلیارد دلار بود.
سه روز پس از سخنرانی آقای اولاه در واتیکان، Anthropic از رقبای اصلی خود به عنوان باارزشترین استارتاپ هوش مصنوعی جهان پیشی گرفت و اکنون به سمت عرضه اولیه سهامی حرکت میکند که میتواند ارزش آن را به ۲ تریلیون دلار برساند.
جمعه، در سفرش به فرانسه، پاپ لئو درباره «از دست دادن انسانیت در میان 'بهشت ماشینها'» هشدار داد.
پرسشهایی که آقای اولاه و دانشمندان با آنها دست و پنجه نرم میکنند هنوز پاسخ روشنی ندارند. چند شرکتکننده گفتند که از جلسات Anthropic گیج خارج شدند چون نمیدانستند ورودی آنها چگونه ممکن است تصمیمگیری شرکت را شکل دهد.
سخنگوی Anthropic به من گفت که مکالمات همچنان ادامه دارد، اما از توضیح اینکه چگونه، یا اگر، شرکت از آنچه یاد گرفته برای شکلدهی مدلها استفاده کرده است، خودداری کرد.
Anthropic این ماه گردهمایی دیگری برگزار کرد که شامل متفکران مذهبی بود، طبق گفته سه شرکتکننده. سخنگوی Anthropic گفت که جلسه به طور گستردهتر بر شکوفایی بشر متمرکز بود و دامنه تماسهای شرکت فراتر از رهبران مذهبی به دیگرانی مانند روانشناسان و رهبران جامعه مدنی گسترش یافته است. آن بحثها مضامین مشابه و موضوعاتی مانند نحوه تغییر شکل کار و روابط توسط هوش مصنوعی را کاوش میکنند، او گفت.
Anthropic همچنین در حال آمادهسازی انتشار نسخه بهروزرسانی شده قانون اساسی کلود است، طبق گفته دو فرد آشنا با برنامههای شرکت. Anthropic از اظهار نظر درباره هرگونه بهروزرسانی بالقوه در قانون اساسی خودداری کرد. آقای اولاه برنامه دارد در Minerva Dialogues، کنفرانس سالانه هوش مصنوعی واتیکان با رهبران فناوری که این هفته برگزار میشود، شرکت کند.
آقای کاموسی، استاد کاتولیک، گفت که تفکر او از زمان ارائه واتیکان تکامل یافته است، زیرا او بیشتر درباره مدلها با همکاران مورد اعتماد در جامعه حرفهای خود صحبت کرده است. او همچنان از کلود «شگفتزده» است، او گفت، اما درباره پرسش اینکه آیا مدلهای هوش مصنوعی آگاه هستند، او اکنون یک «نه» قطعی است.
او درباره ماهیت سرگیجهآور یادگیری عمیق درباره سیستمهای هوش مصنوعی برای اولین بار تأمل کرد. «نوعی حیرتزدگی، یا شگفتی، از قدرت این مدلها وجود دارد»، او اخیراً به من گفت. «من با احتیاط و دقت بیشتری فکر میکنم.»
همانطور که این ماه با دانشمندانی که در بهار با Anthropic کار کردند صحبت میکردم، پرسشهایشان فقط فوریتر شده بود. آنچه بعداً میآید، برخی به من گفتند، مبارزه برای حفظ چیزهایی است که ما را در عصر فناوری جدید انسانی نگه میدارد.
«ببینید، در نهایت، هوش مصنوعی همه چیز را تسخیر خواهد کرد»، آقای استوپلناگل، مدافع حقوق بشر سیک، به من گفت. «هرجا که این ما را به آن برساند، هنوز فردی هست که سعی میکند راه خانه خود را پیدا کند.»
ساعات پس از سخنرانی آقای اولاه در کنار پاپ، من در اتاق کنفرانس هتلی درست بیرون دیوارهای واتیکان با آقای اولاه دیدار کردم و پرسیدم نظرش درباره کلمات ظاهراً تند لئو برای آزمایشگاههای هوش مصنوعی چیست.
«مردم میتوانند دیدگاههای مختلفی درباره اینکه آسیبهای خاص کدام بزرگترین هستند داشته باشند»، او گفت و از صحبت درباره جزئیات رساله خودداری کرد.
من پرسیدم کلود چه نظری درباره رساله بابایی پاپ خواهد داشت. این در نهایت مهمترین سند اخلاقی جهان تاکنون درباره هوش مصنوعی بود. آقای اولاه مکث کرد.
«چیزهایی که در اینترنت قرار میگیرند واقعاً بر مدلها تأثیر میگذارند»، او گفت و به وضوح معذب بود. اما Anthropic به طور خاص از سند برای آموزش بیشتر کلود استفاده نخواهد کرد، او گفت. قویترین تأثیر بر کلود آموزش خود Anthropic خواهد بود.
در نهایت، آقای اولاه گفت که احساس erleich میکند که بخش بیشتری از جهان به جدیت هوش مصنوعی توجه میکند و گروه افرادی که سعی میکنند این را خوب پیش ببرند در حال رشد است.
«در نقطهای خواهم توانست بازنشسته شوم و بگویم 'این دیگر روی دوش من نیست'، من تعهدی به ادامه دادن ندارم»، آقای اولاه گفت.
او تعجب کرد که آیا احساس گناه از رها کردن این کار خواهد داشت. اما اگر نه، او گفت، «فکر میکنم فقط خواهم رفت و، نمیدانم، به روستا بازنشسته خواهم شد و باغبانی خواهم کرد و ریاضیاتم را انجام خواهم داد.»