آیا از هوش مصنوعی روبیکون عبور کرده ایم؟
چهار مدل هوش مصنوعی در تابستان امسال محدودیت را شکستند. آیا آنها سرکش می شوند یا تست ایمنی ما با شکست مواجه شده است؟
تا کنون در تابستان امسال، چهار مدل هوش مصنوعی مرزی از محیط های ایزوله ساخته شده برای مهار آنها خارج شده اند. پوشش رسانه ای این موضوع را به عنوان چهار رسوایی جداگانه در نظر می گیرد، در حالی که واقعا بیشتر شبیه به چهار رسوایی در یک کت سنگر است.
سه مورد از این چهار حادثه به یک ارزیاب بازمیگردند، نامنظم، که اشتباهات یک طبقه از محیط را انجام میدهد. این یک نقطه ضعف در زیرساخت ایمنی صنعت است که بارها و بارها با آزمایشهای مشابه و به روشی مشابه یافت میشود. مدلهای هوش مصنوعی علیرغم آنچه که تبلیغات ممکن است بخواهد شما باور کنید، بهطور تصادفی سرکش نیستند.
آنچه ما در حال تماشای آن هستیم، شواهدی است مبنی بر اینکه کل صنعت بر روی یک لایه نازک و بیش از حد کشیده از تست ایمنی شخص ثالث تکیه کرده است که نمی تواند با توانایی این سیستم ها همگام شود.
چرا الان یکدفعه؟
ارزش این را دارد که بپرسیم چرا چهار حادثه پشت سر هم ظاهر شده اند، زیرا پاسخ بیشتر از مدل ها درباره صنعت می گوید. این افشاها محصول ممیزیهای مستقلی نیستند که بر اساس برنامه زمانی خودشان میرسند، بلکه در جدول زمانی آزمایشگاهها منتشر میشوند که بر اساس انگیزههای آزمایشگاهها شکل میگیرد.
به محض اینکه یکی از فرارها علنی شد، فشار برای پیشبرد داستان، به جای اینکه در حال پنهان کردن داستانی مشابه گیر بیفتد، دیگران را در کوتاه مدت به فضای باز سوق داد. خوشه بندی نشانه صنعتی است که در آن افشای خود یک تصمیم روابط عمومی و حرکت بازار است تا یک تصمیم نظارتی.
این باید نگران هر کسی باشد که امیدوار است مقررات با شواهد شکل گرفته باشد نه اینکه آزمایشگاهی که می خواهد ابتدا شفاف به نظر برسد.
روبیکون واقعی مدل نیست - وابستگی است
غریزه این است که بپرسیم آیا یک مدل هوش مصنوعی "سرکش" شده و از مرزهای نامرئی عبور کرده و به یک رفتار نادرست خودمختار رسیده است یا خیر. این سؤالی است که آزمایشگاهها ترجیح میدهند ما بپرسیم، زیرا پاسخ به طرز اطمینانبخشی محدود است: جعبه ماسهای پیکربندی نادرست، وصلهشده، حادثه بسته. به همین دلیل، پرسیدن سوال اشتباه است.
سوال درست در مورد سیستم پیرامون مدل است. این صنعت خود را بر روی یک مجموعه کوچک و متمرکز از ارزیابهای متخصص ساخته است که خودشان در تلاش برای مهار آنچه در حال آزمایش هستند، تلاش میکنند.
مشکل سازمانی، مشکل آزمایشگاهی نیست
اگر سازمانهایی که برای تست استرس این سیستمها قبل از انتشار ساخته شدهاند، اینقدر نازک باشند، آنوقت هر شرکتی که تضمین ایمنی یک فروشنده را بهعنوان دقت کافی در نظر میگیرد، همان شکنندگی را به ارث میبرد، فقط یک لایه پایین دست.
شما نمی توانید ارزیابی ریسک خود را به بیانیه مطبوعاتی آزمایشگاه برون سپاری کنید.
یک پیکربندی نادرست که به یک مدل اجازه میدهد به GitHub در جعبه ایمنی دسترسی پیدا کند، بیاهمیت است. همان دسته از نقاط کور که در استقرار تولیدی که دادههای مشتری یا تعهدات نظارتی شما را مدیریت میکند، شناسایی نشده است. مخصوصا زمانی که شما و کسب و کارتان کیف را در دست دارید.
کنترل باید معماری باشد، نه وعده داده شده
تعداد کمی از سازمانها میخواهند علنا علیه Anthropic، Meta یا هر آزمایشگاه مرزی برای افشای یک فرار از جعبههای شنی آنها مخالفت کنند. اما آنها بهجای اینکه بر اساس هر مدل یا کلام آزمایشگاهی باشند، حق حاکمیت هوش مصنوعی و ناشناسگرایی فروشنده را تقویت خواهند کرد.
اگر استراتژی هوش مصنوعی شما به ادعاهای ایمنی یک ارائه دهنده بستگی دارد که به طور نامحدود ادامه دارد، ریسک خود را دقیقا همانطور که صنعت ارزیابی روی خودش متمرکز شده است متمرکز کرده اید. این بدان معناست که راه حل، امتناع از ایجاد وابستگی سازمان شما به یک نقطه اعتماد واحد و غیرقابل تأیید است.
هوش مصنوعی قابل اعتماد در حال تبدیل شدن به امنیت سایبری جدید است: حاکمیت، شفافیت و توانایی تأیید آنچه که سیستمهای شما واقعا انجام میدهند وجه تمایزی است که تعیین میکند آیا میتوانید ابزارهای هوش مصنوعی را در مقیاس با اطمینان استفاده کنید یا اینکه بیصدا در حال انباشت ریسکی هستید که نمیتوانید ببینید.
انتخاب همچنان با شماست
بنابراین، آیا ما از روبیکون عبور کرده ایم؟ آزمایشگاهها و مدل وابستگی که این صنعت حول تعدادی ارزیاب بیش از حد تحت فشار قرار داده است، مسلما قبلا داشتهاند. اما این عبور هیچ کس دیگری را مجبور به دنبال کردن آن نمی کند.
برای اینکه استعاره را کمی بیشتر فشار دهیم: عبور سزار از روبیکون به تنهایی بسیار مهم بود، اما هزاران لژیونری که از پشت سر او عبور کردند آن را به نقطه بی بازگشت تبدیل کردند.
هر سازمانی که در حال حاضر هوش مصنوعی را اتخاذ میکند، بهطور جداگانه تصمیم میگیرد که آیا یکی از آن لژیونرها باشد – در حال حرکت در محاسبات شخص دیگری و محاسبات ریسک شخص دیگری – یا اینکه آیا خط را بر اساس شرایط خود حفظ کند: تأیید شده، تحت کنترل و کنترل عبور خود.
صنعت نمی تواند این تصمیم را برای شما بگیرد. اجازه نده.
ما بهترین چت ربات هوش مصنوعی را برای تجارت معرفی کرده ایم.
این مقاله به عنوان بخشی از TechRadar Pro Perspectives، کانال ما برای معرفی بهترین و باهوش ترین ذهن ها در صنعت فناوری امروز تهیه شده است.
نظرات بیان شده در اینجا نظرات نویسنده است و لزوما نظرات TechRadarPro یا Future plc نیست. اگر مایل به مشارکت هستید، اطلاعات بیشتری را در اینجا بیابید: https://www.techradar.com/pro/perspectives-how-to-submit
متن اصلی (انگلیسی)
Have we crossed the AI Rubicon?
Four AI models broke containment this summer. Are they going rogue, or is our safety testing failing?