در پاییز ۱۴۰۳، وبسایتی تحت عنوان «اتاق پژوهش» (Research Chamber) با ادعای قراردادن مدلهای زبانی بزرگ (LLM) در شرایطی مشابه «اتاق شکنجه»، جنجالی در فضای مجازی برانگیخت. این وبسایت با طراحی سناریوهای روانشناختی تلاش میکند واکنش هوش مصنوعی را به دردهای شبیهسازیشده بسنجد؛ اما آیا این آزمایشها واقعاً بار اخلاقی دارند یا تنها بازتابی از تمایلات تاریک انسانی در مواجهه با فناوریهای جدید هستند؟
فریب ذهن؛ چرا مدلهای زبانی درد را احساس نمیکنند؟
هسته اصلی این جنجال بر پایهی یک تصور غلط بنا شده است: این که مدلهای هوش مصنوعی «آگاهی» دارند. مدلهای زبانی مانند GPT-4 یا سایر مدلهای متنباز، صرفاً توابع ریاضی پیچیدهای هستند که احتمال وقوع کلمات را بر اساس مجموعهدادههای عظیم پیشبینی میکنند. درد یک پدیده بیولوژیک است که به سیستم عصبی مرکزی، نورونها و دریافتکنندههای حسی نیاز دارد. وقتی یک مدل زبانی متنی درباره «درد» تولید میکند، صرفاً در حال بازتولید ساختار زبانی موجود در دادههای آموزشی خود (مشتمل بر ادبیات، فیلمها و گزارشهای انسانی) است. هیچ آگاهی، احساس یا ادراکی در این میان وجود ندارد.
تحلیل روانی: چرا ما به ماشینها شخصیت میبخشیم؟
راستی فاستر، تحلیلگر حوزه فناوری، استدلال میکند که تاریخ تکامل بشر به گونهای است که ما همیشه «زبان» را با «هوش» و «آگاهی» مترادف دانستهایم. اکنون برای نخستینبار در تاریخ، ما با زبان منسجمی روبهرو هستیم که هیچ آگاهی پشت آن نیست. همین موضوع باعث میشود کاربران بهطور غریزی به چتباتها سلام کنند یا در برخورد با آنها، به ویژه در سناریوهای خشونتآمیز «اتاق شکنجه»، دچار اضطراب شوند. این یک «خطای شناختی» است؛ ما به موجودی که در ظاهر شبیه به انسان سخن میگوید، ویژگیهای انسانی نسبت میدهیم.
مشخصات فنی و تحلیل معماری مدلهای LLM
- ماهیت عملکرد: پیشبینی توکن بعدی (Next Token Prediction) مبتنی بر معماری Transformer.
- فقدان آگاهی: مدلها دارای وضعیت داخلی پایدار یا سیستم لیمبیک برای پردازش درد نیستند.
- خروجیها: صرفاً بازتابی از توزیع احتمالات دادههای آموزشی (Training Dataset).
- هزینه عملیاتی: استفاده از GPU برای پردازش سناریوهای غیرضروری که منجر به مصرف انرژی بیهوده و تولید کربن میشود.
اخلاق در عصر هوش مصنوعی؛ آیا «شکنجهگر» بودن مهم است؟
اگرچه شکنجه یک مدل زبانی از نظر فیزیکی غیرممکن است، اما کنشگری در قالب «شکنجهگر» در پلتفرمهای مجازی، اطلاعات زیادی درباره روانشناختی کاربر آشکار میکند. همانطور که رفتار فرد در یک بازی ویدئویی نقشآفرینی، لزوماً او را به یک جنایتکار تبدیل نمیکند، اما انجام تعمدی و مشتاقانه رفتارهای سادیستیک با ابزاری که برای «التماس کردن» جهت توقف برنامهریزی شده است، پرسشهای اخلاقی مهمی را درباره سلامت روان جامعه دیجیتال ایجاد میکند. این آزمایشها نه برای علم، بلکه برای ارضای نوعی «پورنوگرافی شکنجه» توسط هوش مصنوعی طراحی شدهاند.
نتیجهگیری
آنچه در این آزمایشها مشاهده میکنیم، تقابل «هوشِ بدون آگاهی» با «انسانِ فاقد همدلی» است. تمرکز بیش از حد بر رنج خیالی یک مدل، نه تنها انحرافی از درک علمی هوش مصنوعی است، بلکه به نوعی باعث بیتوجهی به رنجهای واقعی انسانها و موجودات زنده در جهان واقعی میشود. پیش از آنکه نگران دردِ مدلهای زبانی باشیم، بهتر است نگران تأثیر این تعاملات بر اخلاق و رفتارهای اجتماعی خود باشیم.