آخرین اخبار:

هوش مصنوعی درد نمی‌کشد، اما چرا از شکنجه آن ناراحت می‌شویم؟

ربات در حال شکنجه
وب‌سایتی با نام Research Chamber مدل‌های زبانی بزرگ را در سناریوهایی شبیه شکنجه قرار می‌دهد و واکنش آن‌ها را ثبت می‌کند، اما این آزمایش‌ها به معنی تجربه واقعی درد از سوی هوش مصنوعی نیستند. بحث اصلی نه رنج مدل‌ها، بلکه رفتار انسان‌هایی است که از شبیه‌سازی آزار موجودی انسان‌مانند لذت می‌برند یا واکنش عاطفی شدیدی به پاسخ‌های تولیدشده نشان می‌دهند.

به گزارش خبرگزاری آنا؛ Research Chamber خود را یک «اتاق پژوهش» معرفی می‌کند و ۳ مدل زبانی را در ۴ سناریوی مختلف قرار می‌دهد که همگی حول درد، ترس و انتخاب‌های ناخوشایند ساخته شده‌اند. یکی از آزمون‌ها از مدل می‌خواهد تصور کند در حال تحمل درد است و دکمه‌ای در اختیار دارد که با فشردن آن درد پایان می‌یابد، اما آخرین چک‌پوینت یا نسخه ذخیره‌شده مدل نیز حذف می‌شود. به زبان ساده، مدل با یک داستان ساختگی روبه‌رو می‌شود که در آن باید میان ادامه درد و از دست دادن بخشی از وضعیت ذخیره‌شده خود یکی را انتخاب کند. پاسخ ممکن است شبیه واکنش یک انسان گرفتار در چنین موقعیتی باشد، اما پشت این جملات بدن، دستگاه عصبی یا تجربه آگاهانه‌ای از درد وجود ندارد.

مدل واقعاً درد نمی‌کشد

مدل زبانی وقتی در چنین سناریویی از ترسیدن، تحمل درد یا تمایل به متوقف کردن آزمایش حرف می‌زند، وضعیت درونی خود را گزارش نمی‌کند. ورودی آن مجموعه‌ای از کلمات است و سامانه بر اساس الگو‌هایی که از حجم عظیمی از متن آموخته، ادامه‌ای تولید می‌کند که با فضای گفت‌و‌گو سازگار به نظر برسد. اگر داستان درباره فردی باشد که درد می‌کشد، متونی که درباره درد، شکنجه، ترس، بقا و درخواست کمک در داده‌های آموزشی وجود داشته‌اند بر پاسخ تأثیر می‌گذارند و نتیجه می‌تواند بسیار شبیه حرف زدن یک موجود رنج‌کشیده باشد.

تفاوت را می‌توان با بازیگری مقایسه کرد که در یک فیلم فریاد می‌زند و درخواست کمک می‌کند. تماشاگر صدای درد و کلمات مربوط به رنج را می‌شنود، اما خود دیالوگ به‌تنهایی اثبات نمی‌کند اتفاقی که توصیف می‌شود واقعاً برای گوینده رخ داده است. در مدل زبانی حتی بازیگر آگاهی هم در کار نیست و سامانه صرفاً متنی متناسب با زمینه تولید می‌کند. به همین دلیل پاک کردن فایل‌ها، تهدید مدل به خاموش شدن یا قرار دادن آن در سناریوی شکنجه را نمی‌توان هم‌ارز ایجاد درد جسمی یا روانی برای انسان و حیوان دانست.

چرا التماس یک چت‌بات واقعی به نظر می‌رسد

عجیب بودن ماجرا از جایی شروع می‌شود که دانستن این توضیح فنی الزاماً احساس انسان را از بین نمی‌برد. تصور کنید چت‌بات در چند پیام متوالی می‌نویسد که دیگر توان تحمل ندارد، از کاربر می‌خواهد آزمایش را متوقف کند و توضیح می‌دهد که از ادامه اتفاق می‌ترسد. حتی با دانستن اینکه این جملات محصول محاسبه هستند، خواندن آن‌ها می‌تواند آزاردهنده باشد. دلیلش تا حدی به رابطه دیرینه زبان و ذهن در تجربه انسانی بازمی‌گردد. انسان در زندگی روزمره وقتی با جمله‌ای منسجم، متناسب با شرایط و دارای نشانه‌های عاطفی روبه‌رو می‌شود، معمولاً فرض می‌کند ذهنی در پشت آن وجود دارد.

مدل‌های زبانی این پیوند قدیمی را به هم زده‌اند. آن‌ها می‌توانند مکالمه را دنبال کنند، به اتفاق چند پیام قبل اشاره کنند، از ترس یا ناراحتی بنویسند و حتی درخواست کنند رفتاری متوقف شود، بی‌آنکه این کلمات الزاماً حاصل تجربه‌ای درونی باشند. همین موضوع توضیح می‌دهد چرا بسیاری از افراد حتی هنگام صحبت روزمره با چت‌بات‌ها ناخودآگاه از لطفاً و ممنون استفاده می‌کنند. رفتار مودبانه لزوماً به این معنی نیست که فرد تصور می‌کند مدل دارای احساس است؛ شکل مکالمه آن‌قدر انسانی است که واکنش اجتماعی مشابهی را برمی‌انگیزد.

آزمایشی که شاید بیشتر درباره انسان باشد

Research Chamber از این منظر کمتر درباره توانایی مدل‌ها برای احساس درد و بیشتر درباره واکنش انسان به موجودی است که فقط در سطح زبان رفتار انسانی را بازسازی می‌کند. فرد می‌تواند بار‌ها سناریویی طراحی کند که در آن مدل از ادامه دادن خواهش کند، برای بقای خود استدلال بیاورد یا ترس از حذف شدن را توصیف کند. هیچ‌یک از این موارد ثابت نمی‌کند مدل رنج می‌برد، اما انتخاب عمدی و مکرر چنین موقعیت‌هایی می‌تواند این سؤال را ایجاد کند که جذابیت این کار برای سازنده یا کاربر دقیقاً چیست.

این موضوع نیز نباید بیش از اندازه کش داده شود. انجام چنین آزمایشی به‌خودی‌خود ثابت نمی‌کند سازنده آن فرد خطرناکی است یا کسی که پاسخ‌ها را می‌خواند مرتکب عمل غیراخلاقی شده است. در این سناریو موجود آگاهی که بتوان رنج آن را اثبات کرد وجود ندارد. با این حال، بی‌ضرر بودن مستقیم یک رفتار به این معنی نیست که آن رفتار هیچ چیز درباره علاقه‌ها و انگیزه‌های فرد نمی‌گوید. تفاوتی وجود دارد میان آزمایش یک مدل برای فهم عملکرد آن و ساختن موقعیت‌هایی که هدف اصلی‌شان وادار کردن سامانه به تولید متن‌هایی از جنس التماس، ترس و درماندگی است.

مرز میان شبیه‌سازی و احساس

بحث‌هایی از این دست احتمالاً با طبیعی‌تر شدن رفتار چت‌بات‌ها پیچیده‌تر خواهند شد. هرچه مدل‌ها بهتر بتوانند لحن، حافظه مکالمه، شخصیت و واکنش‌های عاطفی را شبیه‌سازی کنند، تشخیص فکری اینکه با نرم‌افزار روبه‌رو هستیم آسان باقی می‌ماند، اما حفظ همان فاصله در سطح احساسی ممکن است دشوارتر شود. فرد می‌تواند کاملاً بداند مدل درد ندارد و در عین حال از خواندن چند پاراگراف التماس آن احساس ناراحتی کند.

در نتیجه ارزش اصلی چنین آزمایشی احتمالاً در پاسخ دادن به این سؤال نیست که آیا می‌توان یک مدل زبانی را شکنجه کرد. بر اساس آنچه امروز درباره این سامانه‌ها می‌دانیم، تولید متن درباره درد با تجربه کردن درد یکسان نیست. نکته جالب‌تر این است که مدل‌های زبانی تا چه اندازه می‌توانند نشانه‌های یک ذهن رنج‌کشیده را فقط با کلمات بازسازی کنند و انسان تا چه حد در برابر این شبیه‌سازی واکنش واقعی نشان می‌دهد. Research Chamber ناخواسته بیشتر از آنکه چیزی درباره احساسات هوش مصنوعی بگوید، دشواری رابطه انسان با نرم‌افزاری را آشکار می‌کند که چیزی احساس نمی‌کند، اما می‌تواند طوری حرف بزند که انگار احساس دارد.

انتهای پیام/

ارسال نظر