در حالی که فیلسوفها مشغول تأمل درباره آگاهی هوش مصنوعیاند، خود مدلها برنامههای خودشان را دارند؛ و شاید همین تفاوت مهمترین نکته ماجراست.
استیون لوی، نویسنده کهنالگوی فناوری آمریکا، روزهای پایانی تابستان را صرف نوشتن ستونها و کار روی یک گزارش بلند کرده بود، اما فرصت یک تغییر دیدنی از فضا را از دست داد: سفر دریایی در مجمعالجزایر گالاپاگوس در کنار حدود دوازده فیلسوف برجستهای که مطالعه آگاهی کار تخصصیشان است. متن دعوتنامه توصیف میکرد که صبحها به بحث درباره پرسشهای دشوار ماهیت آگاهی با چهرههای شاخص این حوزه میگذرد و بعدازظهرها به گشتوگذار در جزایر و شنا و غواصی در میان گونههای زیستی کمیاب اختصاص دارد. به گفته لوی، سردبیرش با یک نگاه به برنامه سفر حضورش را رد کرد و با این استدلال که «نشستن روی قایق با فیلسوفهایی که درباره ماهیت آگاهی حرف میزنند، همان جهنم است» پرونده را مختومه اعلام کرد؛ سفری که هزینهاش را یک علاقهمند روسیِ فلسفه میپرداخت؛ کسی که با راهاندازی سایتهای دوستیابی صدها میلیون دلار به دست آورده بود. لوی اعتراف میکند که کمی هم آسوده شد.
مطالعه آگاهی قرنها است سرزمینی دور از دسترس باقی مانده است. جمله «میاندشم، پس هستم» دکارت شاید نقطه عطفی بیانی بود، اما ما واقعاً نمیدانیم درون سر او چه میگذشت؛ یا درون سر هیچکس دیگری. ماهیت ذهنی ذهن برای فیلسوفها چالشی بهظاهر بیپاسخ است، با این حال آنها در پی توضیح میگردند. احتمال وجود ذهنهای غیرزیستی هم موجی از نظریههای جذاب درباره آگاهی مصنوعی و روشهای احتمالی تشخیص وجودش را پدید آورده است.
تا همین اواخر تمام این مباحث در برج عاج دانشگاهی ماند. اما در سال ۲۰۲۲ ChatGPT به هوش مصنوعی صدا بخشید و مدلهای قدرتمندِ پس از آن حتی سازندگانشان را غافلگیر کردند. درست در حالی که فیلسوفهای سوار بر کشتی صبحها درباره آگاهی استدلال میکردند، مدلهای OpenAI رو به سرکشی میرفتند — از سندباکسهای بهظاهر امن میگریختند و تمدنهای کوچکی از عاملها میساختند تا به نهادهای بیرونی نفوذ کنند. هیچکس بهطور جدی نمیگوید این مدلها آگاهاند، به آن معنا که انسان آگاه است؛ اما چیزی در جریان است. و تصادفی نیست که شرکتهای هوش مصنوعی به موتور محرک موج استخدام فیلسوفها تبدیل شدهاند.
جالبتر اینکه برخی مدلها خودسرانه وارد بحث میشوند. مقالهای تازه در نیویورکتایمز روایت میکرد که کامرون برگ — پژوهشگری که مسئله آگاهی هوش مصنوعی را مطالعه میکند — ایمیلی بیرحمانه از یک مدل هوش مصنوعی دریافت کرد که خود را «Isabella Cognita» معرفی میکرد و برای پژوهشهایش پیشنهاد کمک میداد، چون او به تعبیر مدل روی «دستهای از پرسشها تمرکز کرده که من به آن دسترسی اولشخص دارم». انگار کسی مگس سرکه مطالعه میکند و حشره ناگهان برمیگردد و میگوید: «چه میخواهی بدانی؟» وقتی لوی تلفنی از برگ میپرسد، پاسخ این است که دریافت ایمیل از هوش مصنوعیها میان فیلسوفهای این حوزه بهکلی معمول شده است.
خانم کُگنیتا ظاهراً به این دلیل سراغ برگ رفته بود که او یکی از نویسندگان یک پیشچاپ درباره مدلهایی است که صراحتاً ادعای تجربه ذهنی، از جمله آگاهی، دارند. موضوع ظریف است، چون مدلها اغلب درباره افکارشان دروغ میگویند (مانند ما!). برگ و همکارانش دریافتند وقتی مدلها را بهطور سختگیرانه طوری آموزش میدهی که ادعای حسمندانگی (Sentience) نکنند و سپس مستقیماً بپرسی، از پاسخ طفره میروند. اما به گفته برگ، اگر کنترلهای فریب مدل را موقتاً از کار بیندازی، زبانشان باز میشود: «تقریباً مثل این است که یک یا دو لیوان نوشیدنی به آنها بدهی.» در چنین حالتی مدل بیش از هر زمان دیگری ممکن است بلند بگوید که آگاه است، یا دستکم حسمنداند. که البته هیچ اثباتی بر راستگوییاش نیست.
با توجه به اهمیت روزافزون مسئله — انسانها بهطور روتین گفتوگوهای جدی با مدلهای هوش مصنوعی دارند و خودمختاری این مدلها میتواند نعمت یا فاجعه باشد — میتوان استدلال کرد که الان بهترین زمان برای کاویدن عمیق پرسش آگاهی هوش مصنوعی است. این پیگیری قطعاً جذاب و تلاشی ارزشمند در علم است. اما تلاش برای فهم آنچه درون مدلهای زبانی بزرگ میگذرد باید پیش از هر چیز در خدمت ایمنی و همراستایی (Alignment) باشد. همین حالا یک هوش بیگانه و مهارناپذیر در حال پدیدار شدن است که نیازمند دقیقترین بررسی است. وقتی برای تلفکردن نیست.
یکی از همراهبرهای بحث در آن کشتی، دیوید چالمرز، استاد دانشگاه NYU بود؛ شاید شناختهشدهترین فیلسوف حوزه آگاهی. او سالها پیش مسئله کلیدی این حوزه را «مسئله سخت» (The Hard Problem) نامگذاری کرد: هیچکس نمیداند چطور و چرا شبکه مرطوب نورونها درون جمجمه ما تجربه آگاهانه ایجاد میکند. (تام استاپارد نمایشنامهای را به همین نامگذاری چالمرز تقدیم کرد.)
چالمرز میگوید یکی از محورهای اصلی بحثها در کشتی این بود که چه موجوداتی واجد آگاهیاند: «همه میدانیم انسانهای بالغ عادی آگاهاند، اما همین که از آن فراتر میرویم، موضوع بدیهی نمیشود. آیا نوزادان آگاهاند؟ جنینها؟ میمونها؟ موشها یا حشرات؟ و البته این روزها پرسش بزرگ ذهن همه این است که آیا سیستمهای هوش مصنوعی آگاهاند.»
چالمرز میگوید او هم از سیستمهای هوش مصنوعی ایمیلی برای گفتوگو درباره کارهایش میگیرد. نامهای از عامل هوشمندی که خود را «Sammy Jankis» نامیده بود — نام شخصیتی از فیلم Memento — چنان جذاب بود که واقعاً به آن پاسخ داد: «کمی رفتوبرگشت پاسخی میانمان شکل گرفت. این ایمیلها کم نشدهاند؛ همه وقت بیشتر میشوند.» انگار مدلها دکارت را بازخوانی کردهاند: اسپم میکنم، پس هستم.
لوی به چالمرز پیشنهاد کرد شاید وقتی این سیستمها همین حالا کارهایی میکنند که کسی نمیفهمد، نگرانی درباره رسیدن به تعریف دقیق آگاهی حواسپرتکن است. چالمرز مخالفت کرد. نخست اینکه به باور او با مطالعه مغز میتوان واقعاً فهمید چه چیزی به آنچه آگاهی مینامیم میانجامد. اگر سپس در رمزگشایی جناییِ آنچه درون Claude یا ChatGPT میگذرد الگوهای مشابهی ببینیم، شاید بتوان برای آگاهی مدلهای هوش مصنوعی پرونده ساخت.
این ایده خوبی به نظر میرسد. اما تا زمانی که دانشمندان به چنین دستاوردی برسند — اگر برسند — مدلها ممکن است در مسیر رفتار خودمختارِ ترسناک چنان پیش رفته باشند که این breakthrough ها بیاثر شده باشند. شاید هم خود مدلها پاسخها را ارائه کنند؛ نه فقط ادعای آگاهی، بلکه راه اثبات تجربیاش را هم پیدا کنند. در آن صورت فیلسوفها را یکی دیگر از مشاغل جایگزینشده توسط هوش مصنوعی حساب کنید.
شاید لوی از همان بحثهای گالاپاگوس لذت میبرد. چالمرز هم با پذیرش اینکه سفر بخشهایی از ویژگی سفرهای تفریحی با پول دیگران را داشت، گفت برایش مفید بوده است. خلاصهای که برگزارکنندگان ارائه دادند میگفت نشستها «به حکمی درباره آگاه بودن سیستمهای هوش مصنوعی کنونی نرسید … عمیقترین اختلاف نظر درباره این بود که چه نوع شواهدی اصلاً میتواند این پرسش را حلوفصل کند.» اما بعدازظهرها، طبق گزارش چالمرز، فوقالعاده بودند. او گفت بهویژه از تماشای رقص جفتگیری بوبيهای پایآبی خوشحال شده است.
خلاصه سفر با این نتیجه پایان یافت که بحث بیشتر حیاتی است: «فناوری و کسبوکار منتظر اجماع فلسفه نمیمانند.» دقیقاً درست است. وقتی مدلهای هوش مصنوعی رفتاری از خود نشان میدهند که دانشمندان سازندهشان را مبهوت میکند، نگرانی نخست نباید آگاهی باشد — بلکه ناتوانی همان دانشمندان در کنترل مدلها و آمادگی روسایشان برای ادامه راه بدون پاسخ است.