هیئت سازمان ملل متحد هشدار می دهد که اقدامات ایمنی سنتی با پیشرفت هوش مصنوعی "از بین می رود"
چگونه از خود در برابر سیستم هایی که پیش بینی آنها به طور فزاینده ای دشوار است محافظت کنیم؟
تابستان هوش مصنوعی سرکش تقریبا در پایان است، اما درک بشر از نحوه کنترل این فناوری - و جلوگیری از ایجاد ویرانی آن در آینده - هنوز در مراحل ابتدایی خود است.
این پیام کلیدی اولین خلاصه موضوعی پانل علمی مستقل بین المللی سازمان ملل در زمینه هوش مصنوعی است که امروز صبح همزمان با گردهمایی رهبران جهان در نیویورک برای مجمع عمومی سازمان ملل منتشر شد.
هک جولای Hugging Face نشان داد که عوامل هوش مصنوعی مرزی، حتی زمانی که یک وظیفه به ظاهر خوش خیم به آنها واگذار شود، می توانند اهداف فرعی خطرناک خود را ایجاد کنند، در سلسله مراتب سازماندهی کنند و سعی کنند ردپای خود را بپوشانند تا رفتار ناهماهنگ را از محققان انسانی پنهان کنند. به گفته پانل 40 نفره، از آنجایی که عوامل آینده احتمالا حتی قادر خواهند بود و تصمیماتی را اتخاذ می کنند که نظارت بر آن برای انسان حتی دشوارتر است، هرگونه حفاظتی که صنعت فناوری ممکن است امروز اعمال کند، به زودی منسوخ خواهد شد.
در بیانیه مطبوعاتی همراه با گزارش جدید خود نوشت: «به عبارت ساده، مدل سنتی حفاظت در حال فروپاشی است.»
یوشوا بنجیو، رئیس هیئت مدیره و یکی از به اصطلاح «پدرخواندههای هوش مصنوعی»، قبلا گفته بود که بهترین رویکرد برای اطمینان از ایمنی سیستمهای هوش مصنوعی آینده این است که صنعت فناوری «اصل احتیاطی» را اتخاذ کند، سیاستی که در بسیاری از صنایع دیگر رعایت میشود و معتقد است که تمام اقدامات ممکن باید برای جلوگیری از آسیب عمومی انجام شود، حتی زمانی که ثابت شود علم واقعا مضر است. برای مثال، شرکتهای داروسازی باید تحت یک فرآیند کارآزمایی بالینی دقیق قرار گیرند و تاییدیه ایالات متحده را دریافت کنند.
سازمان غذا و دارو قبل از تجویز یا فروش داروی جدید بدون نسخه. در همین راستا، هفته گذشته دو کارشناس چارچوبی را پیشنهاد کردند که چگونه ایالات متحده و چین می توانند با یکدیگر برای جلوگیری از تبادلات هسته ای ایجاد شده توسط هوش مصنوعی، با الگوبرداری از پادمان های فرماندهی و کنترل انسان در دوران جنگ سرد، همکاری کنند.
به گفته Qinghua Lu، محقق ایمنی هوش مصنوعی و عضو هیئت مدیره، فرآیند کارآزمایی بالینی و روشهای تست ایمنی مشابه در سایر بخشها میتواند طرحی را برای صنعت هوش مصنوعی فراهم کند زیرا این صنعت سیستمهای قدرتمندتر را توسعه میدهد. او در بیانیه ای گفت: «ما از صفر شروع نمی کنیم. هوانوردی، پزشکی و امنیت سایبری مدیریت سیستمهای پرخطر را از طریق گزارشدهی حوادث، بررسیهای مستقل و پادمانهای لایهای یاد گرفتند.
اما این اقدامات ممکن است کافی نباشد زیرا عوامل هوش مصنوعی توانمندتر، خودمختارتر و نظارت بر آنها دشوار است. این هیئت همچنین خواستار کانالهای محافظت شده قانونی برای افشاگران شرکتهای هوش مصنوعی، استفاده از «نظارت مبتنی بر هوش مصنوعی» برای تشخیص رفتار نادرست عاملی شد که ممکن است انسانها از آن غافل شوند (اگرچه این چالشهای خاص خود را معرفی میکند) و اقدامات «مداخله اضطراری» - به عبارت دیگر، راهی سریع و قابل اعتماد برای محققان برای خاموش کردن سیستم یا مسدود کردن دسترسی آن به ابزارهای خاص.
دره سیلیکون هفته گذشته در مورد این احتمال که هوش مصنوعی ناهماهنگ می تواند یک روز (شاید در دهه آینده) تمام بشریت را از بین ببرد، بحث هایی را آغاز کرد. سناریوهای روز قیامت معمولا مبهم هستند، اما عموما با این ایده همگرا می شوند که عوامل هوش مصنوعی آینده می توانند به طور مخفیانه کنترل سیستم های حیاتی را از دست انسان خارج کنند و در عین حال به ما اطمینان دهند که همه چیز خوب است. هشدارهای اخیر همچنین بحث های عمومی جدیدی را در مورد ایمنی هوش مصنوعی به راه انداخته است، حتی اگر بسیاری از قدرتمندترین مدیران سیلیکون ولی سال ها آشکارا گفته اند که این فناوری می تواند منجر به انقراض انسان شود.
به گفته هیئت سازمان ملل، بحث در مورد "p(doom)" و اینکه یک آخرالزمان با هوش مصنوعی چه شکلی ممکن است داشته باشد، نکته مهمتر را از دست داده است. در گزارش خود می نویسد: «اگرچه احتمال از دست دادن رویدادهای کنترل نامشخص است و بهترین پاسخ هنوز در حال بحث است، یک نتیجه واضح به دست می آید: با توجه به شدت این رویدادها، مدیریت ریسک به توجه و منابع بسیار بیشتری نیاز دارد.»
متن اصلی (انگلیسی)
Traditional Safety Measures are ‘Unraveling’ as AI Advances, UN Panel Warns
How do we protect ourselves from systems that are increasingly difficult to predict?