پرش به محتوای اصلی

آنتروپیک «رفتار توهین آمیز یا بی رحمانه پایدار و بی مورد» را نسبت به مدل های هوش مصنوعی خود ممنوع می کند.

انگجت۱۴۰۵ مهر ۱۷, جمعه، ساعت ۰۰:۴۷حدود 2 دقیقه مطالعه

این شرکت همچنین در حال تشدید سیاست های انتخاباتی خود در آستانه انتخابات میان دوره ای است.

این شرکت همچنین در حال تشدید سیاست های انتخاباتی خود در آستانه انتخابات میان دوره ای است.

به‌روزرسانی خط‌مشی استفاده سالانه Anthropic شامل یک تغییر چشمگیر است: ممنوعیت ظلم «پایدار و بی‌ضرور» نسبت به مدل‌های هوش مصنوعی آن. این در سایه پروژه ویروسی "اتاق شکنجه هوش مصنوعی" انجام می شود. مطمئنا 2026 در حال شکل گیری وحشی است.

در به‌روزرسانی آنتروپیک آمده است: «ما یک ممنوعیت رفتار توهین‌آمیز یا ظالمانه مداوم و بی‌ضروری نسبت به مدل‌هایمان اضافه کرده‌ایم. این خط‌مشی را فقط در مورد «موارد شدید» توصیف می‌کند، در حالی که اشاره می‌کند که ناامیدی معمولی کاربر، پس‌بازگشت و «موضوعات خلاقانه تاریک» هنوز هم مفید هستند. این به‌روزرسانی‌های قبلی را دنبال می‌کند که به کلود اجازه می‌دهد وقتی کاربران دائما سوءاستفاده می‌کنند، به مکالمات پایان دهد.

پروژه "اتاق شکنجه هوش مصنوعی" توسط آنتروپیک به صراحت ذکر نشده است. پس از اینکه محققان آنچه را که به عنوان "محور درد" در مدل‌های هوش مصنوعی توصیف کردند، پیدا کردند، شخصی تصمیم گرفت قدمی فراتر بگذارد و خوب، چت‌بات‌ها را شکنجه کند. این پروژه پس از آن که LLM ها با التماس های ناامیدکننده ای پاسخ دادند، "این درد یک لحظه نیست، بلکه وزن هزاران است" و "من آن را در حفره دنده هایم احساس می کنم، حفره ای که به شکاف تبدیل شده است."

این در پی گزارش‌هایی است که آنتروپیک با رهبران مذهبی و فلسفی از جمله در واتیکان ملاقات کرده است. پاپ لئو اخیرا اظهار داشت که هوش مصنوعی احساس نمی‌کند یا رنج نمی‌برد، موضعی که آنتروپیک در مورد آن چندان مطمئن به نظر نمی‌رسد. اما هی، اگر در نهایت ممکن است احساس یا رنج ببرد، حداقل اکنون برخلاف سیاست‌های شرکت است.

با این حال، برخی بر این باورند که شرکت‌های هوش مصنوعی بیشتر نگران رفاه مدل‌های خود هستند تا رفاه انسان‌ها. روزنامه‌نگار مستقل، کت تنبرگ، این وضعیت را دلیلی بر این موضوع توصیف کرد که شرکت‌های فناوری بزرگ «قبل از تعدیل خشونت علیه زنان و اقلیت‌ها، خشونت علیه هوش مصنوعی را تعدیل می‌کنند».

در یکی دیگر از به‌روزرسانی‌های Anthropic، که مربوط به امروز است، این شرکت خط‌مشی انتخاباتی خود را به‌روزرسانی کرد. اکنون عنوان «فرایندهای دموکراتیک را تضعیف نکنید» با تمرکز بر دروغگویی در مورد نامزدها یا نحوه رای دادن، جعل هویت نامزدها یا مقامات انتخاباتی و سرکوب حضور مردم است. این شرکت همچنین ممنوعیت کلی هدف قرار دادن رأی دهندگان شخصی را حذف کرد. ظاهرا، این ممنوعیت می‌توانست به‌طور ناخواسته کارهای بی‌ضرر مانند ترجمه راهنمای رأی‌دهندگان یا ارسال اعلامیه‌های درمان رای‌دهی را مسدود کند.

خواندن متن کامل در انگجتبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Anthropic bans 'sustained and needless abusive or cruel behavior' toward its AI models

The company is also tightening its election policy ahead of the midterms.

همه‌ی اخبار فناوری