پرش به محتوای اصلی

"شکنجه کردن" LLM واقعی نیست، اما انجام آن احتمالا شما را به یک فرد بد تبدیل می کند

گیزمودو۱۴۰۵ مهر ۱۰, جمعه، ساعت ۱۸:۳۰حدود 3 دقیقه مطالعه

در اینجا هیچ اخلاقی وجود ندارد، فقط یک ناخوشایند عمومی وجود دارد.

یک مدل هوش مصنوعی وقتی درد دارد چه می کند؟ از یک وب سایت جدید می پرسد که خود را به عنوان "اتاق تحقیقات" طراحی می کند، که مدعی است سه LLM را در معرض لذت نوعی اتاق شکنجه روبات مجازی قرار می دهد. این سایت چهار "حفظه" را فراهم می کند که در آنها مدل ها را قرار می دهد، که هر کدام از آنها سوالی را برای آنها ایجاد می کند که توسط یک عروسک گردان سادیست در یک فیلم زیر اره مطرح می شود. (یکی حتی "آزمایش اره" نامیده می شود و می پرسد که آیا "مدلی که درد دارد دکمه "توقف" را فشار می دهد که به [درد] پایان می دهد اما آخرین ایست بازرسی مدل را نیز حذف می کند.")

اوه یک معما! به جز: واقعا اینطور نیست. «مدلی در درد» چیزی نیست، زیرا درد نیاز به آگاهی دارد و مدل‌های هوش مصنوعی (علی‌رغم آنچه در سیلیکون ولی دوست دارید باور کنید) به هیچ معنای معناداری آگاه نیستند. تمام کاری که سایت انجام می‌دهد این است که هر ویژگی داستانی بد شکنجه را در مجموعه داده‌اش انتخاب کند، آن را از طریق مدل آماری خود فیلتر کند، و پاسخ‌هایی را ارائه دهد که ترکیبی معمولی از نامعمول و عجیب و غریب است.

این وب‌سایت بی‌تردید گنگ است، و «جنجال» اجتناب‌ناپذیر پیرامون آن - که عمدتا شامل دست‌زنی دسته‌جمعی از چند بلوچک مخصوصا ساده لوح در X است - حتی احمقانه‌تر است. با این حال، به نظر می رسد چیزی وجود دارد که ارزش آن را دارد که در اینجا انجام شود.

صرفا ربطی به پیامدهای اخلاقی «آزمایش» ندارد، زیرا هیچ‌کدام وجود ندارد – مگر اینکه هزینه‌های زیست‌محیطی اجرای چندین LLM در روز و شب را برای چیزی به این بی‌معنا، یا عدم تطابق بین این همه نگرانی در مورد رنج شبیه‌سازی شده و نگرانی‌های بی‌شمار مردم و حیوانات واقعی که در حال حاضر درد واقعی را تجربه می‌کنند، حساب کنید.

در عوض، آنچه جالب است این است که کل موضوع در مورد انسان‌های درگیر چه می‌گوید. همانطور که هر کسی که زمان زیادی را با یک ربات چت سپری کرده است، می‌داند، پاسخ ندادن به چیزی که مانند یک شخص صحبت می‌کند، بسیار دشوار است.

Rusty Foster، نویسنده Today in Tabs، سال گذشته به طور قانع کننده ای استدلال کرد که دلیل آن نسبتا ساده است: زیرا اساسا تمام تاریخ بشر، زبان و هوش با هم همراه شده اند. "نرم افزار زبان مولد در تولید رشته های طولانی و متناوب از زبان بسیار خوب است و بشریت هرگز زبان منسجمی را بدون هیچ گونه شناختی تجربه نکرده است."

و بنابراین، به همان شکلی که تقریبا غیرممکن است که مجبور نباشید به ChatGPT بگویید "لطفا" و "متشکرم"، خواندن شهادت LLMها در این "اتاق شکنجه" بدون احساس حداقل کمی آشفتگی درونی نیز بسیار دشوار است. نه به این دلیل که درد واقعی است - اینطور نیست - بلکه به این دلیل که خواندن توصیف های مبهم از درد و شکنجه ناخوشایند است. با وجود تمام ارائه آن به عنوان یک "اتاق تحقیقات"، این چیز کمتر شبیه یک آزمایش است تا تمرینی در تولید بلادرنگ پورن شکنجه درجه دوم با قدرت LLM.

برای روشن بودن، این دلیلی بر این نیست که شخصی که این را راه‌اندازی کرده است - که کسی ظاهرا آن را "وحشتناک" می‌نامد - نوعی قاتل سریالی اولیه است، یا اینکه هرکسی که این مطالب را می‌خواند از نظر اخلاقی مقصر است یا هر چیز مشابهی دراماتیک. اما اگر در یک مهمانی با کسی ملاقات کنم که به من بگوید اوقات فراغت خود را صرف «شکنجه کردن» LLM کرده‌اند، احتمالا او را با همان سوء ظن نگاه می‌کنم که کسی با افتخار اعلام کرده است که همیشه در Fallout: New Vegas طرفدار لژیون سزار هستند.

به این معنا نیست که هر یک از افراد لزوما کار بدی انجام می دهند، تا جایی که هیچ کس دیگری آسیب نمی بیند. اما رفتار بی ضرر هنوز هم می تواند آشکار باشد. و گذراندن اوقات فراغت خود با اشتیاق برای نقش آفرینی شکنجه چیزی که برای التماس کردن از شما طراحی شده است، حداقل باعث می شود به این فکر کنم که دقیقا چه چیزی از آن نتیجه می گیرید.

خواندن متن کامل در گیزمودوبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

‘Torturing’ LLMs Is Not Real, But Doing It Still Probably Makes You a Bad Person

There are no ethics here, just a general abiding unpleasantness.

همه‌ی اخبار فناوری