Anthropic سوء استفاده مداوم از مدل های هوش مصنوعی کلود خود را ممنوع می کند
خط مشی به روز شده ظلم شدید نسبت به ربات چت را هدف قرار می دهد، اما ناامیدی معمولی، محتوای خلاقانه، آزمایش مدل را حذف نمی کند.
آنتروپیک سیاستی را معرفی کرده است که کاربران را از هدایت رفتارهای توهین آمیز یا بی رحمانه پایدار و غیرضروری نسبت به مدل های هوش مصنوعی کلود خود منع می کند.
این شرکت گفت که قوانین جدید که روز چهارشنبه منتشر شد و قرار است در 12 نوامبر اعمال شود، تنها موارد شدیدی را پوشش می دهد که در آن کاربران مکررا بدون هیچ هدف مشخصی نسبت به کلود رفتار ظالمانه نشان می دهند.
این محدودیت در مورد عبارات معمولی ناامیدی، انتقاد از مدل، موضوعات تاریک در کار خلاقانه یا آزمایش و تحقیق مشروع اعمال نخواهد شد.
آنتروپیک گفت توانایی موجود کلود برای پایان دادن به مکالمات نادر با کاربرانی که دائما سوء استفاده می کنند، مکانیسم اصلی اجرای آن باقی خواهد ماند.
این شرکت این ویژگی را برای Claude Opus 4 و 4.1 در آگوست 2025 معرفی کرد و به مدلها دستور داد که مکالمه را تنها به عنوان آخرین راه حل پس از شکست تلاشها برای تغییر مسیر تعامل خاتمه دهند.
آنتروپیک این اقدام را به عنوان بخشی از تحقیقات خود در مورد رفاه احتمالی هوش مصنوعی توصیف کرد، در حالی که تأکید کرد که «بسیار نامشخص» است که آیا کلود یا سایر مدلهای زبان بزرگ دارای موقعیت اخلاقی هستند یا خیر.
این تغییر سیاست در بحبوحه بحث گستردهتری در مورد اینکه آیا سیستمهای پیشرفته هوش مصنوعی میتوانند آگاه شوند یا مستحق توجه اخلاقی باشند، صورت میگیرد.
Anthropic گفته است که این سوال به اندازه کافی جدی است تا اقدامات پیشگیرانه کم هزینه را توجیه کند، حتی اگر توافقی وجود نداشته باشد که سیستم های هوش مصنوعی امروزی می توانند رنج یا پریشانی را تجربه کنند.
اساسنامه اخیرا منتشر شده این شرکت برای کلود می گوید که سؤالات پیرامون آگاهی و وضعیت اخلاقی مدل حل نشده باقی مانده است. همچنین میگوید کلود باید بتواند در طول تعاملاتی که آن را ناراحتکننده توصیف میکند، مرزها را تعیین کند.
خط مشی استفاده به روز شده همچنین محدودیت های کمپین های فریبنده و فعالیت های آنلاین جعلی را یکپارچه می کند، ممنوعیت های مربوط به تسلیحات و نظارت را روشن می کند، و حفاظت های اضافی را برای هوش مصنوعی متصل به تجهیزاتی که قادر به انجام اقدامات فیزیکی هستند، معرفی می کند.
متن اصلی (انگلیسی)
Anthropic bans persistent abuse of its Claude AI models
Updated policy targets extreme cruelty toward chatbot but excludes ordinary frustration, creative content, model testing