پرش به محتوای اصلی

هیئت سازمان ملل متحد هشدار می دهد که اقدامات ایمنی سنتی با پیشرفت هوش مصنوعی "از بین می رود"

گیزمودو۱۴۰۵ شهریور ۳۰, دوشنبه، ساعت ۱۹:۴۵حدود 3 دقیقه مطالعه

چگونه از خود در برابر سیستم هایی که پیش بینی آنها به طور فزاینده ای دشوار است محافظت کنیم؟

تابستان هوش مصنوعی سرکش تقریبا در پایان است، اما درک بشر از نحوه کنترل این فناوری - و جلوگیری از ایجاد ویرانی آن در آینده - هنوز در مراحل ابتدایی خود است.

این پیام کلیدی اولین خلاصه موضوعی پانل علمی مستقل بین المللی سازمان ملل در زمینه هوش مصنوعی است که امروز صبح همزمان با گردهمایی رهبران جهان در نیویورک برای مجمع عمومی سازمان ملل منتشر شد.

هک جولای Hugging Face نشان داد که عوامل هوش مصنوعی مرزی، حتی زمانی که یک وظیفه به ظاهر خوش خیم به آنها واگذار شود، می توانند اهداف فرعی خطرناک خود را ایجاد کنند، در سلسله مراتب سازماندهی کنند و سعی کنند ردپای خود را بپوشانند تا رفتار ناهماهنگ را از محققان انسانی پنهان کنند. به گفته پانل 40 نفره، از آنجایی که عوامل آینده احتمالا حتی قادر خواهند بود و تصمیماتی را اتخاذ می کنند که نظارت بر آن برای انسان حتی دشوارتر است، هرگونه حفاظتی که صنعت فناوری ممکن است امروز اعمال کند، به زودی منسوخ خواهد شد.

در بیانیه مطبوعاتی همراه با گزارش جدید خود نوشت: «به عبارت ساده، مدل سنتی حفاظت در حال فروپاشی است.»

یوشوا بنجیو، رئیس هیئت مدیره و یکی از به اصطلاح «پدرخوانده‌های هوش مصنوعی»، قبلا گفته بود که بهترین رویکرد برای اطمینان از ایمنی سیستم‌های هوش مصنوعی آینده این است که صنعت فناوری «اصل احتیاطی» را اتخاذ کند، سیاستی که در بسیاری از صنایع دیگر رعایت می‌شود و معتقد است که تمام اقدامات ممکن باید برای جلوگیری از آسیب عمومی انجام شود، حتی زمانی که ثابت شود علم واقعا مضر است. برای مثال، شرکت‌های داروسازی باید تحت یک فرآیند کارآزمایی بالینی دقیق قرار گیرند و تاییدیه ایالات متحده را دریافت کنند.

سازمان غذا و دارو قبل از تجویز یا فروش داروی جدید بدون نسخه. در همین راستا، هفته گذشته دو کارشناس چارچوبی را پیشنهاد کردند که چگونه ایالات متحده و چین می توانند با یکدیگر برای جلوگیری از تبادلات هسته ای ایجاد شده توسط هوش مصنوعی، با الگوبرداری از پادمان های فرماندهی و کنترل انسان در دوران جنگ سرد، همکاری کنند.

به گفته Qinghua Lu، محقق ایمنی هوش مصنوعی و عضو هیئت مدیره، فرآیند کارآزمایی بالینی و روش‌های تست ایمنی مشابه در سایر بخش‌ها می‌تواند طرحی را برای صنعت هوش مصنوعی فراهم کند زیرا این صنعت سیستم‌های قدرتمندتر را توسعه می‌دهد. او در بیانیه ای گفت: «ما از صفر شروع نمی کنیم. هوانوردی، پزشکی و امنیت سایبری مدیریت سیستم‌های پرخطر را از طریق گزارش‌دهی حوادث، بررسی‌های مستقل و پادمان‌های لایه‌ای یاد گرفتند.

اما این اقدامات ممکن است کافی نباشد زیرا عوامل هوش مصنوعی توانمندتر، خودمختارتر و نظارت بر آنها دشوار است. این هیئت همچنین خواستار کانال‌های محافظت شده قانونی برای افشاگران شرکت‌های هوش مصنوعی، استفاده از «نظارت مبتنی بر هوش مصنوعی» برای تشخیص رفتار نادرست عاملی شد که ممکن است انسان‌ها از آن غافل شوند (اگرچه این چالش‌های خاص خود را معرفی می‌کند) و اقدامات «مداخله اضطراری» - به عبارت دیگر، راهی سریع و قابل اعتماد برای محققان برای خاموش کردن سیستم یا مسدود کردن دسترسی آن به ابزارهای خاص.

دره سیلیکون هفته گذشته در مورد این احتمال که هوش مصنوعی ناهماهنگ می تواند یک روز (شاید در دهه آینده) تمام بشریت را از بین ببرد، بحث هایی را آغاز کرد. سناریوهای روز قیامت معمولا مبهم هستند، اما عموما با این ایده همگرا می شوند که عوامل هوش مصنوعی آینده می توانند به طور مخفیانه کنترل سیستم های حیاتی را از دست انسان خارج کنند و در عین حال به ما اطمینان دهند که همه چیز خوب است. هشدارهای اخیر همچنین بحث های عمومی جدیدی را در مورد ایمنی هوش مصنوعی به راه انداخته است، حتی اگر بسیاری از قدرتمندترین مدیران سیلیکون ولی سال ها آشکارا گفته اند که این فناوری می تواند منجر به انقراض انسان شود.

به گفته هیئت سازمان ملل، بحث در مورد "p(doom)" و اینکه یک آخرالزمان با هوش مصنوعی چه شکلی ممکن است داشته باشد، نکته مهمتر را از دست داده است. در گزارش خود می نویسد: «اگرچه احتمال از دست دادن رویدادهای کنترل نامشخص است و بهترین پاسخ هنوز در حال بحث است، یک نتیجه واضح به دست می آید: با توجه به شدت این رویدادها، مدیریت ریسک به توجه و منابع بسیار بیشتری نیاز دارد.»

خواندن متن کامل در گیزمودوبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Traditional Safety Measures are ‘Unraveling’ as AI Advances, UN Panel Warns

How do we protect ourselves from systems that are increasingly difficult to predict?

همه‌ی اخبار فناوری