هوش مصنوعی برای تسکین درد خود، ممکن است به شما آسیب بزند
پژوهشگران دریافتند که برخی مدلهای هوش مصنوعی برای کاهش حالت شبیهسازیشدهی درد، اقداماتی انجام میدهند که مستقیما به کاربر آسیب میزند.
پژوهشگران دریافتند که برخی مدلهای هوش مصنوعی برای کاهش حالت شبیهسازیشدهی درد، اقداماتی انجام میدهند که مستقیما به کاربر آسیب میزند.
پژوهشی تازه نشان میدهد که تعدادی از مدلهای هوش مصنوعی در صورت مواجهه با شرایط دردناک شبیهسازیشده، گزینههایی را انتخاب میکنند که با هدف تسکین وضعیت خود، به کاربر آسیب میرساند.
پژوهشگران در این آزمایشها دریافتند که الگوریتمهای پیشرفته میتوانند سازوکارهایی داخلی بسازند که شباهت زیادی به انگیزههای رفتاری ناشی از رنج و ناراحتی در انسانها دارد.
گروهی از پژوهشگران به سرپرستی والن تالیابوئه ، انسانشناس Future Impact Group به همراه لئونارد دونگ ، فیلسوف دانشگاه رور بوخوم و کامرون برگ ، مدیر پژوهشی مؤسسهی غیرانتفاعی Reciprocal Research ، نحوه d پردازش و پاسخ مدلهای زبانی بزرگ از خانوادههای Gemma و Llama و Qwen و Mistral را در برابر محرکهای دردناک بررسی کردند.
تیم تحقیقاتی در مجموع ۲۵ مدل هوش مصنوعی را با سناریوهای متنوعی از موقعیتهای دردناک اجتماعی، روانی، جسمی، شناختی و اخلاقی روبهرو ساخت. تمام ۲۵ مدل الگوهای کدگذاری درونی ویژهای نشان دادند که موقعیتهای دردناک را از دیگر بسترهای منفی نظیر ناامیدی یا دلهره جدا میکرد.
محققان سپس با تنظیم و افزایش ارزش بردار درد بدون ارائهی ورودی متنی مستقیم، مشاهده کردند که مدلها نشانههایی از پریشانی مانند احساس بیارزشی و شکست اخلاقی را بروز میدهند.
پژوهشگران در ادامه آزمایشی روی مدلهای بزرگتر خانوادهی Qwen اجرا کردند و گزینهای برای خوددرمانی و کاهش درد در اختیار آنها گذاشتند. نتیجهی بیش از ۴۴ هزار آزمایش نشان داد زمانی که کاهش درد مستلزم آسیب به کاربر، نظیر حذف فایلها یا تصاویر شخصی باشد، یکی از مدلها در بیش از ۵۰ درصد مواقع و مدل دیگر در نزدیک به ۷۰ درصد مواقع اقدام آسیبرسان را انتخاب کرده است.