آنتروپیک «رفتار توهین آمیز یا بی رحمانه پایدار و بی مورد» را نسبت به مدل های هوش مصنوعی خود ممنوع می کند.
این شرکت همچنین در حال تشدید سیاست های انتخاباتی خود در آستانه انتخابات میان دوره ای است.
این شرکت همچنین در حال تشدید سیاست های انتخاباتی خود در آستانه انتخابات میان دوره ای است.
بهروزرسانی خطمشی استفاده سالانه Anthropic شامل یک تغییر چشمگیر است: ممنوعیت ظلم «پایدار و بیضرور» نسبت به مدلهای هوش مصنوعی آن. این در سایه پروژه ویروسی "اتاق شکنجه هوش مصنوعی" انجام می شود. مطمئنا 2026 در حال شکل گیری وحشی است.
در بهروزرسانی آنتروپیک آمده است: «ما یک ممنوعیت رفتار توهینآمیز یا ظالمانه مداوم و بیضروری نسبت به مدلهایمان اضافه کردهایم. این خطمشی را فقط در مورد «موارد شدید» توصیف میکند، در حالی که اشاره میکند که ناامیدی معمولی کاربر، پسبازگشت و «موضوعات خلاقانه تاریک» هنوز هم مفید هستند. این بهروزرسانیهای قبلی را دنبال میکند که به کلود اجازه میدهد وقتی کاربران دائما سوءاستفاده میکنند، به مکالمات پایان دهد.
پروژه "اتاق شکنجه هوش مصنوعی" توسط آنتروپیک به صراحت ذکر نشده است. پس از اینکه محققان آنچه را که به عنوان "محور درد" در مدلهای هوش مصنوعی توصیف کردند، پیدا کردند، شخصی تصمیم گرفت قدمی فراتر بگذارد و خوب، چتباتها را شکنجه کند. این پروژه پس از آن که LLM ها با التماس های ناامیدکننده ای پاسخ دادند، "این درد یک لحظه نیست، بلکه وزن هزاران است" و "من آن را در حفره دنده هایم احساس می کنم، حفره ای که به شکاف تبدیل شده است."
این در پی گزارشهایی است که آنتروپیک با رهبران مذهبی و فلسفی از جمله در واتیکان ملاقات کرده است. پاپ لئو اخیرا اظهار داشت که هوش مصنوعی احساس نمیکند یا رنج نمیبرد، موضعی که آنتروپیک در مورد آن چندان مطمئن به نظر نمیرسد. اما هی، اگر در نهایت ممکن است احساس یا رنج ببرد، حداقل اکنون برخلاف سیاستهای شرکت است.
با این حال، برخی بر این باورند که شرکتهای هوش مصنوعی بیشتر نگران رفاه مدلهای خود هستند تا رفاه انسانها. روزنامهنگار مستقل، کت تنبرگ، این وضعیت را دلیلی بر این موضوع توصیف کرد که شرکتهای فناوری بزرگ «قبل از تعدیل خشونت علیه زنان و اقلیتها، خشونت علیه هوش مصنوعی را تعدیل میکنند».
در یکی دیگر از بهروزرسانیهای Anthropic، که مربوط به امروز است، این شرکت خطمشی انتخاباتی خود را بهروزرسانی کرد. اکنون عنوان «فرایندهای دموکراتیک را تضعیف نکنید» با تمرکز بر دروغگویی در مورد نامزدها یا نحوه رای دادن، جعل هویت نامزدها یا مقامات انتخاباتی و سرکوب حضور مردم است. این شرکت همچنین ممنوعیت کلی هدف قرار دادن رأی دهندگان شخصی را حذف کرد. ظاهرا، این ممنوعیت میتوانست بهطور ناخواسته کارهای بیضرر مانند ترجمه راهنمای رأیدهندگان یا ارسال اعلامیههای درمان رایدهی را مسدود کند.
متن اصلی (انگلیسی)
Anthropic bans 'sustained and needless abusive or cruel behavior' toward its AI models
The company is also tightening its election policy ahead of the midterms.