پرش به محتوای اصلی

Anthropic سوء استفاده مداوم از مدل های هوش مصنوعی کلود خود را ممنوع می کند

آناتولی۱۴۰۵ مهر ۱۷, جمعه، ساعت ۱۸:۲۱حدود 2 دقیقه مطالعه

خط مشی به روز شده ظلم شدید نسبت به ربات چت را هدف قرار می دهد، اما ناامیدی معمولی، محتوای خلاقانه، آزمایش مدل را حذف نمی کند.

آنتروپیک سیاستی را معرفی کرده است که کاربران را از هدایت رفتارهای توهین آمیز یا بی رحمانه پایدار و غیرضروری نسبت به مدل های هوش مصنوعی کلود خود منع می کند.

این شرکت گفت که قوانین جدید که روز چهارشنبه منتشر شد و قرار است در 12 نوامبر اعمال شود، تنها موارد شدیدی را پوشش می دهد که در آن کاربران مکررا بدون هیچ هدف مشخصی نسبت به کلود رفتار ظالمانه نشان می دهند.

این محدودیت در مورد عبارات معمولی ناامیدی، انتقاد از مدل، موضوعات تاریک در کار خلاقانه یا آزمایش و تحقیق مشروع اعمال نخواهد شد.

آنتروپیک گفت توانایی موجود کلود برای پایان دادن به مکالمات نادر با کاربرانی که دائما سوء استفاده می کنند، مکانیسم اصلی اجرای آن باقی خواهد ماند.

این شرکت این ویژگی را برای Claude Opus 4 و 4.1 در آگوست 2025 معرفی کرد و به مدل‌ها دستور داد که مکالمه را تنها به عنوان آخرین راه حل پس از شکست تلاش‌ها برای تغییر مسیر تعامل خاتمه دهند.

آنتروپیک این اقدام را به عنوان بخشی از تحقیقات خود در مورد رفاه احتمالی هوش مصنوعی توصیف کرد، در حالی که تأکید کرد که «بسیار نامشخص» است که آیا کلود یا سایر مدل‌های زبان بزرگ دارای موقعیت اخلاقی هستند یا خیر.

این تغییر سیاست در بحبوحه بحث گسترده‌تری در مورد اینکه آیا سیستم‌های پیشرفته هوش مصنوعی می‌توانند آگاه شوند یا مستحق توجه اخلاقی باشند، صورت می‌گیرد.

Anthropic گفته است که این سوال به اندازه کافی جدی است تا اقدامات پیشگیرانه کم هزینه را توجیه کند، حتی اگر توافقی وجود نداشته باشد که سیستم های هوش مصنوعی امروزی می توانند رنج یا پریشانی را تجربه کنند.

اساسنامه اخیرا منتشر شده این شرکت برای کلود می گوید که سؤالات پیرامون آگاهی و وضعیت اخلاقی مدل حل نشده باقی مانده است. همچنین می‌گوید کلود باید بتواند در طول تعاملاتی که آن را ناراحت‌کننده توصیف می‌کند، مرزها را تعیین کند.

خط مشی استفاده به روز شده همچنین محدودیت های کمپین های فریبنده و فعالیت های آنلاین جعلی را یکپارچه می کند، ممنوعیت های مربوط به تسلیحات و نظارت را روشن می کند، و حفاظت های اضافی را برای هوش مصنوعی متصل به تجهیزاتی که قادر به انجام اقدامات فیزیکی هستند، معرفی می کند.

خواندن متن کامل در آناتولیبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Anthropic bans persistent abuse of its Claude AI models

Updated policy targets extreme cruelty toward chatbot but excludes ordinary frustration, creative content, model testing

همه‌ی اخبار فناوری