پرش به محتوای اصلی

آنتروپیک «رفتار توهین آمیز یا بی رحمانه بی مورد» را نسبت به کلود ممنوع می کند

تک‌رادار۱۴۰۵ مهر ۱۷, جمعه، ساعت ۲۰:۵۲حدود 3 دقیقه مطالعه

آنتروپیک می‌گوید کاربران کلود نباید نسبت به مدل‌های هوش مصنوعی کلود «سوءاستفاده‌کننده یا بی‌رحمانه» رفتار کنند.

آنتروپیک «رفتار توهین آمیز یا بی رحمانه» را نسبت به چت ربات های هوش مصنوعی خود ممنوع کرده است

سیاست جدید محدود به "موارد شدید" است

برخی این نظریه را مطرح کرده اند که انگیزه می تواند بهبود داده های آموزشی باشد صادق باشید: اخیرا چقدر با یک چت ربات هوش مصنوعی رفتار کرده اید؟ اگر پاسخ قوی‌تر از «نه خیلی» باشد، آنتروپیک یک کلمه می‌خواهد.

دلیل آن این است که توسعه‌دهنده مدل زبان بزرگ کلود (LLM) بند جدیدی را به سند خط‌مشی استفاده خود اضافه کرده است که افراد را از درگیر شدن در «رفتار توهین‌آمیز یا ظالمانه پایدار و بی‌ضرور نسبت به مدل‌های ما» منع می‌کند.

این ممنوعیت به بخش «رفتار بی‌رحمانه، توهین‌آمیز یا مضر روان‌شناختی نکنید» اضافه شده است که شامل هشدارهایی در مورد خودکشی و خودآزاری، ترویج رفتار قلدری، تمجید از خشونت و استفاده از هوش مصنوعی برای ایجاد محتوای مضر و محتوای فریبنده است.

اما در حالی که آنتروپیک می‌گوید نباید از ابزارهای آن برای انجام این اقدامات علیه انسان‌های دیگر استفاده کنید، افزودنی جدید تنها موردی است که به‌طور خاص «رفتار ظالمانه» را نسبت به خود هوش مصنوعی این شرکت ممنوع می‌کند. آنتروپیک در آگوست گذشته گفت که به کلود اجازه می‌دهد به مکالمه‌هایی که توهین‌آمیز شده‌اند پایان دهد، و در حالی که این شرکت اخیرا گزارش داده است که هنوز "مکانیسم اجرایی اصلی" در حال استفاده است، مشخص نیست که آیا Anthropic پا را فراتر گذاشته و فعالانه کاربرانی را که با هوش مصنوعی خود کمی بداخلاقی می‌کنند ممنوع خواهد کرد.

Anthropic اضافه کرد که "به‌روزرسانی خط‌مشی فقط در موارد شدید اعمال می‌شود، جایی که کاربران مکررا نسبت به مدل‌های ما ظالمانه رفتار می‌کنند، بدون هدف مشخص. این به نسخه‌های رایج ناامیدی کاربر، بازپس‌گیری، تم‌های خلاقانه تاریک، یا آزمایش و تحقیق مدل اعمال نمی‌شود."

آیا هوش مصنوعی احساسات دارند؟

(اعتبار تصویر: Shutterstock) این تغییر یک تغییر بحث برانگیز بوده است. واضح است که کلود یک انسان متفکر و احساسی نیست – این یک دسته از کدهاست – و برای بسیاری بدیهی است که در وهله اول احساساتی ندارد که بتواند آسیب ببیند.

اما آنچه جالب است این است که چگونه این حادثه رابطه در حال تکامل ما با هوش مصنوعی را روشن می کند. بسیاری از کارهایی که شرکت‌های هوش مصنوعی انجام داده‌اند این است که خلاقیت‌هایشان را انسان‌سازی کنند – انسان‌سازی (یا باید آنتروپیکومورفیز شود؟) روبات‌هایشان – به طوری که ما قدرت دفاعی خود را کاهش داده و فعالانه با آنها درگیر شویم. به عنوان مثال، فقط به آواتار شایان ستایش Muse متا (با نام مناسب Jolly) یا مواردی که توسط OpenAI’s Dots استفاده می شود نگاه کنید.

یکی از نظریه‌هایی که در Reddit در حال انجام است این است که داده‌های آموزشی تمیز (بخوانید: مؤدبانه) بسیار مفیدتر از داده‌هایی است که حاوی کلمات توهین‌آمیز و لفاظی‌های عصبانی هستند. آن را قطع کنید و اطلاعات قابل استفاده بیشتری برای بهبود مدل های خود دارید.

با این حال، شواهد محکمی وجود ندارد که نشان دهد این موضوع وجود دارد، و این امکان وجود دارد که Anthropic صرفا هدف اصیل تشویق متمدن و ادب در میان کاربران خود را داشته باشد. به هر حال، اگر از این زبان روی یک انسان واقعی استفاده نمی‌کنید، شاید نباید در جای دیگری از آن استفاده کنید، از جمله هنگام تعامل با یک ربات چت هوش مصنوعی.

داریو آمودی، مدیر عامل آنتروپیک، قبلا گفته بود که "ما نمی دانیم که آیا مدل ها هوشیار هستند یا خیر." مصطفی سلیمان، مدیر عامل مایکروسافت AI، از سوی دیگر، رویکرد مخالف را در پیش گرفته است. سلیمان در نوشتن بر روی X گفت: "ایده رفاه مدل اشتباه است. هوش مصنوعی نباید حقوق یا شخصیت حقوقی داشته باشد." و ما مطمئنا می دانیم که چت بات ها می توانند برای ما بی ادب باشند.

خواندن متن کامل در تک‌راداربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Anthropic bans ‘needless abusive or cruel behavior’ towards Claude

Anthropic says Claude users must not be "abusive or cruel" towards its Claude AI models.

همه‌ی اخبار فناوری