پرش به محتوای اصلی

آنتروپیک از کاربران می خواهد که نسبت به کلود بد رفتار نکنند

دِ رجیستر۱۴۰۵ مهر ۱۷, جمعه، ساعت ۱۴:۱۲حدود 3 دقیقه مطالعه

خط مشی جدید استفاده از ظلم به ربات چت، در کنار مسائل کمی مبرم تر از توسعه سلاح، نظارت و دخالت در انتخابات را سرکوب می کند.

آنتروپیک قوانین خود را به روز کرده است تا از بدخواهی افراد نسبت به کلود جلوگیری کند و ظاهرا تصمیم گرفته است که چت ربات هوش مصنوعی خود به محافظت در برابر انسان هایی که برای استفاده از آن پول پرداخت می کنند نیاز دارد. آخرین سیاست استفاده توسعه‌دهنده هوش مصنوعی «رفتار توهین‌آمیز یا بی‌رحمانه پایدار و بی‌ضرور» را نسبت به مدل‌های خود ممنوع می‌کند. این قوانین از 12 نوامبر اعمال می شوند و به کاربران فقط یک ماه فرصت می دهند تا هرگونه توهین طولانی مدت را از سیستم خود خارج کنند. آنتروپیک گفت: «به‌روزرسانی خط‌مشی فقط در موارد شدید اعمال می‌شود، جایی که کاربران مکررا نسبت به مدل‌های ما ظالمانه رفتار می‌کنند، بدون هدف قابل تشخیص».

"این در مورد نسخه های رایج ناامیدی کاربر، پس زدن، تم های خلاقانه تاریک، یا آزمایش و تحقیق مدل اعمال نمی شود." بنابراین هنوز هم می‌توانید به کلود بگویید که این اشتباه است، اما سرزنش مکرر آن به خاطر لذت محض انجام این کار می‌تواند شما را به دردسر بیاندازد. مشخص نیست که آنتروپیک چگونه قصد دارد بین ناامیدی مشروع و ظلم بی دلیل تمایز قائل شود، اگرچه می گوید توانایی موجود کلود برای پایان دادن به مکالمات توهین آمیز ابزار اصلی اجرای آن باقی خواهد ماند.

آنتروپیک در آگوست 2025 به کلود توانایی پایان دادن به برخی مکالمات را به عنوان بخشی از تحقیقات خود در مورد آنچه "رفاه مدل" می نامد، داد. این ویژگی به برخی از نسخه‌های کلود اجازه می‌دهد کاربرانی را که دائما مدل‌ها را مورد سوء استفاده قرار می‌دهند، قطع کنند. شایان ذکر است که کلود یک نرم افزار است، نه یک شخص، و هیچ مدرک ثابتی وجود ندارد که نشان دهد آن پریشانی را تجربه می کند. این موضوع مانع از آنتروپیک نشده است که به مشتریانی که پول پرداخت می‌کنند می‌گوید به آداب و رسومشان در ربات چت خود توجه کنند.

قوانین آداب معاشرت تنها بخشی از یک بازنگری گسترده تر است که موضوعات نسبتا مهم تری از جمله دخالت در انتخابات، توسعه سلاح و نظارت را پوشش می دهد. آنتروپیک پس از مشاهده رسانه‌های دولتی، دفاتر تبلیغات دولتی و سازمان‌های تجاری که از کلود برای راه اندازی حساب‌های جعلی و وب‌سایت‌های خبری ساختگی استفاده می‌کنند، محدودیت‌های خود را برای کمپین‌های نفوذ فریبنده تشدید کرده است.

در همان زمان، ممنوعیت عمومی خود را در مورد هدف‌گیری سیاسی شخصی کنار گذاشته است، با این استدلال که این محدودیت فعالیت‌های مشروعی را نیز شامل می‌شود، مانند سازمان‌های غیرانتفاعی که اطلاعات رای‌دهندگان را ترجمه می‌کنند. هدف گذاری فریبنده و سوء استفاده از اطلاعات شخصی همچنان ممنوع است. این شرکت همچنین تصریح کرده است که ممنوعیت تسلیحات آن پس از مشاهده تلاش‌ها برای استفاده از کلود برای توسعه سیستم‌های هدایت و کنترل تسلیحات، از جمله پهپادهای مسلح و وسایل نقلیه خودران، شامل نرم‌افزارها و قطعات نیز می‌شود.

در همین حال، کلود را نمی توان برای توصیه به افرادی که پلیس باید مورد تحقیق، دستگیری، یا متهم کردن قرار دهد و همچنین برای توسعه ابزارهای نظارت استفاده کرد. ردیابی افراد بدون رضایت آنها نیز ممنوع است، چه در زمان واقعی و چه به صورت گذشته نگر. آنتروپیک می گوید این تغییرات به جای معرفی محدودیت های جدید، محدودیت های موجود را روشن می کند. همچنین الزامات جدیدی برای مشتریانی وجود دارد که کلود را به تجهیزات فیزیکی که قادر به ایجاد آسیب هستند متصل می کنند. یک اپراتور انسانی واجد شرایط باید بتواند سخت افزار را نظارت و متوقف کند، که در صورت قطع شدن اتصال هوش مصنوعی باید در حالت ایمن باقی بماند.

اصلاحات اساسی در سیاست زمانی انجام می شود که Anthropic تلاش می کند برخی از خطرات امنیتی ناشی از سیستم های هوش مصنوعی با قابلیت فزاینده را برطرف کند. این شرکت همچنین یک ابتکار جدید امنیت سایبری را با هدف کمک به اپراتورهای زیرساخت حیاتی و پروژه‌های منبع باز در یافتن و رفع آسیب‌پذیری‌ها با استفاده از مدل‌های هوش مصنوعی خود راه‌اندازی کرده است. این تلاش شامل اسکن امنیتی رایگان برای پروژه های منبع باز واجد شرایط و مشارکت با شرکت های امنیتی برای کمک به محافظت از زیرساخت های حیاتی است. مهاجمان Anthropic تخمین می‌زند تا دو سال آینده قبل از اینکه سیستم‌های دفاعی مبتنی بر هوش مصنوعی شروع به جبران کنند، از این مزیت برخوردار خواهند بود.

با این حال، در حال حاضر، این شرکت تهدید دیگری برای مقابله با آن دارد: افرادی که چیزهای بدی را به چت بات خود می گویند. ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Anthropic asks users to stop being mean to Claude

New usage policy cracks down on cruelty to chatbot, alongside slightly more pressing matters of weapons development, surveillance, and election interference

همه‌ی اخبار فناوری