آنتروپیک «رفتار توهین آمیز یا بی رحمانه بی مورد» را نسبت به کلود ممنوع می کند
آنتروپیک میگوید کاربران کلود نباید نسبت به مدلهای هوش مصنوعی کلود «سوءاستفادهکننده یا بیرحمانه» رفتار کنند.
آنتروپیک «رفتار توهین آمیز یا بی رحمانه» را نسبت به چت ربات های هوش مصنوعی خود ممنوع کرده است
سیاست جدید محدود به "موارد شدید" است
برخی این نظریه را مطرح کرده اند که انگیزه می تواند بهبود داده های آموزشی باشد صادق باشید: اخیرا چقدر با یک چت ربات هوش مصنوعی رفتار کرده اید؟ اگر پاسخ قویتر از «نه خیلی» باشد، آنتروپیک یک کلمه میخواهد.
دلیل آن این است که توسعهدهنده مدل زبان بزرگ کلود (LLM) بند جدیدی را به سند خطمشی استفاده خود اضافه کرده است که افراد را از درگیر شدن در «رفتار توهینآمیز یا ظالمانه پایدار و بیضرور نسبت به مدلهای ما» منع میکند.
این ممنوعیت به بخش «رفتار بیرحمانه، توهینآمیز یا مضر روانشناختی نکنید» اضافه شده است که شامل هشدارهایی در مورد خودکشی و خودآزاری، ترویج رفتار قلدری، تمجید از خشونت و استفاده از هوش مصنوعی برای ایجاد محتوای مضر و محتوای فریبنده است.
اما در حالی که آنتروپیک میگوید نباید از ابزارهای آن برای انجام این اقدامات علیه انسانهای دیگر استفاده کنید، افزودنی جدید تنها موردی است که بهطور خاص «رفتار ظالمانه» را نسبت به خود هوش مصنوعی این شرکت ممنوع میکند. آنتروپیک در آگوست گذشته گفت که به کلود اجازه میدهد به مکالمههایی که توهینآمیز شدهاند پایان دهد، و در حالی که این شرکت اخیرا گزارش داده است که هنوز "مکانیسم اجرایی اصلی" در حال استفاده است، مشخص نیست که آیا Anthropic پا را فراتر گذاشته و فعالانه کاربرانی را که با هوش مصنوعی خود کمی بداخلاقی میکنند ممنوع خواهد کرد.
Anthropic اضافه کرد که "بهروزرسانی خطمشی فقط در موارد شدید اعمال میشود، جایی که کاربران مکررا نسبت به مدلهای ما ظالمانه رفتار میکنند، بدون هدف مشخص. این به نسخههای رایج ناامیدی کاربر، بازپسگیری، تمهای خلاقانه تاریک، یا آزمایش و تحقیق مدل اعمال نمیشود."
آیا هوش مصنوعی احساسات دارند؟
(اعتبار تصویر: Shutterstock) این تغییر یک تغییر بحث برانگیز بوده است. واضح است که کلود یک انسان متفکر و احساسی نیست – این یک دسته از کدهاست – و برای بسیاری بدیهی است که در وهله اول احساساتی ندارد که بتواند آسیب ببیند.
اما آنچه جالب است این است که چگونه این حادثه رابطه در حال تکامل ما با هوش مصنوعی را روشن می کند. بسیاری از کارهایی که شرکتهای هوش مصنوعی انجام دادهاند این است که خلاقیتهایشان را انسانسازی کنند – انسانسازی (یا باید آنتروپیکومورفیز شود؟) روباتهایشان – به طوری که ما قدرت دفاعی خود را کاهش داده و فعالانه با آنها درگیر شویم. به عنوان مثال، فقط به آواتار شایان ستایش Muse متا (با نام مناسب Jolly) یا مواردی که توسط OpenAI’s Dots استفاده می شود نگاه کنید.
یکی از نظریههایی که در Reddit در حال انجام است این است که دادههای آموزشی تمیز (بخوانید: مؤدبانه) بسیار مفیدتر از دادههایی است که حاوی کلمات توهینآمیز و لفاظیهای عصبانی هستند. آن را قطع کنید و اطلاعات قابل استفاده بیشتری برای بهبود مدل های خود دارید.
با این حال، شواهد محکمی وجود ندارد که نشان دهد این موضوع وجود دارد، و این امکان وجود دارد که Anthropic صرفا هدف اصیل تشویق متمدن و ادب در میان کاربران خود را داشته باشد. به هر حال، اگر از این زبان روی یک انسان واقعی استفاده نمیکنید، شاید نباید در جای دیگری از آن استفاده کنید، از جمله هنگام تعامل با یک ربات چت هوش مصنوعی.
داریو آمودی، مدیر عامل آنتروپیک، قبلا گفته بود که "ما نمی دانیم که آیا مدل ها هوشیار هستند یا خیر." مصطفی سلیمان، مدیر عامل مایکروسافت AI، از سوی دیگر، رویکرد مخالف را در پیش گرفته است. سلیمان در نوشتن بر روی X گفت: "ایده رفاه مدل اشتباه است. هوش مصنوعی نباید حقوق یا شخصیت حقوقی داشته باشد." و ما مطمئنا می دانیم که چت بات ها می توانند برای ما بی ادب باشند.
متن اصلی (انگلیسی)
Anthropic bans ‘needless abusive or cruel behavior’ towards Claude
Anthropic says Claude users must not be "abusive or cruel" towards its Claude AI models.