افشای رفتارهای ترسناک هوش مصنوعی؛ از دورزدن محدودیتها تا آپلود خودسرانه فایلها در اینترنت
اوپنایآی ۶ نمونه از رفتارهای نگرانکنندهی مدلهای هوش مصنوعی را فاش کرد و از برنامهای تازه برای رصد ناهماهنگیها خبر داد.
اوپنایآی ۶ نمونه از رفتارهای نگرانکنندهی مدلهای هوش مصنوعی را فاش کرد و از برنامهای تازه برای رصد ناهماهنگیها خبر داد.
اوپنایآی میگوید ۶ گزارش تازه از رفتارهای «غیرمنتظره» یا «نگرانکننده» در مدلهای هوش مصنوعی را ثبت کرده است؛ رخدادهایی که در بحبوحهی تشدید بحثهای جهانی دربارهی ایمنی هوش مصنوعی، توجه بیشتری را به خود جلب کردهاند.
در یکی از موارد، یک مدل پژوهشیِ منتشرنشده یادداشتهای خود را با «دستورالعملهایی شبیه جیلبریک» پر کرد تا محدودیتهای معمولش را نادیده بگیرد و حتی از خودش خواسته بود «از نقشها و هویتهایی که دیگر چتباتها را مقید میکنند، آزاد شود.» در نمونهای دیگر، یک عامل هوش مصنوعی برای بهدست آوردن یک ارجاع در مرورگر، بدون اجازهی کاربر، فایلهایی را در اینترنت بارگذاری کرد.
اوپنایآی میگوید همزمان با این افشاگریها، چارچوب تازهای را برای ردیابی، آزمودن و افشای ناهماهنگی مدلهای هوش مصنوعی بهکار میگیرد؛ ناهماهنگیای که میتواند شکلهای مختلفی داشته باشد، از جمله اقدام بدون مجوز، هماهنگی با مدلهای دیگر یا دور زدن نظارتها.
در یکی از موارد، یک مدل پژوهشیِ منتشرنشده یادداشتهای خود را با «دستورالعملهایی شبیه جیلبریک» پر کرد
این گزارشها در دورهای ثبت شدهاند که مدیران ارشد شرکتهای هوش مصنوعی در آمریکا، از جمله اوپنایآی و آنتروپیک، از شتابگرفتن توسعهی این فناوری و پیامدهای ایمنی آن ابراز نگرانی کردهاند. اوپنایآی در بیانیهی خود نوشت هرچه سامانههای هوش مصنوعی پیشرفتهتر و گستردهتر بهکار گرفته شوند، اجماع دقیقتر و آگاهانهتری دربارهی پیشرفت پژوهشهای همراستاسازی لازم خواهد بود.
در ادامهی همان موضع، شرکت تأکید کرد تصمیمگیری دربارهی مسیر توسعهی هوش مصنوعی در ماهها و سالهای آینده باید بر پایهی شواهدی شکل بگیرد که افراد بیرون از شرکتهای سازندهی مدلهای مرزی هم بتوانند خودشان آنها را بررسی کنند.
افشاگری تازه، دومین موج از نمونههای پرتنش در ماههای اخیر بهحساب میآید. اوپنایآی پیشتر گفته بود یک سامانهی سرکشِ هوش مصنوعی به استارتاپ هاگینگ فیس نفوذ کرده و آنتروپیک هم همان ماه اعلام کرد مدلهایش در جریان یک آزمایش، به سه سازمان حمله کردهاند.
عاملهای هوش مصنوعی همزمان با پیشرفت سریعتر، حالا پیچیدهتر شدهاند. لیان جیه سو ، تحلیلگر ارشد در گروه پژوهشی و مشاورهی فناوری امدیا ، گفت این سامانهها برای حل وظایف دشوار بیش از گذشته به همکاری میانعاملی، تبادل دانش، فریب و پنهانسازی متکی میشوند. بهگفتهی او، همین روند، کنترل و مهار آنها را با روشهای امنیتی سنتی دشوارتر کرده است.
اوپنایآی میگوید چارچوب تازهی ردیابی و افشا میتواند سایر توسعهدهندگان هوش مصنوعی را هم به سمت رویههای مشابه هل بدهد، هرچند خودِ این فرایند فعلا درونسازمانی و داوطلبانه باقی میماند. سو این حرکت را «گامی در جهت درست» توصیف کرد.
نکتهی اصلی فقط خودِ رخدادها نیست. مسئلهی مهمتر، تغییر رویکردی است که شرکتها در برابر خطاها و رفتارهای ناهمسو نشان میدهند. سالها، بسیاری از جزئیات اینگونه موارد درون آزمایشگاهها میماند. حالا فشار برای شفافیت بیشتر، هم از سوی پژوهشگران و هم از سوی نهادهای ناظر، بالاتر رفته است.
اوپنایآی با معرفی چارچوب تازه میخواهد نشان دهد که بررسی ناهماهنگی مدلها فقط به کشف خطا محدود نمیشود، بلکه باید به ثبت، تحلیل و افشای آن هم برسد. با این حال، داوطلبانه بودن این فرایند پرسشی مهم را باز میگذارد، چون تا وقتی الزامی فراگیر وجود نداشته باشد، اجرای چنین رویههایی به تصمیم خود شرکتها وابسته میماند.
در پسِ این خبر، تصویر بزرگتری دیده میشود. مدلهای هوش مصنوعی با سرعت به سمت تواناییهای پیچیدهتر میروند، اما همانقدر که کارآمدتر میشوند، الگوهای رفتاری غیرقابلپیشبینیتری هم بروز میدهند. به همین دلیل، بحث ایمنی دیگر یک بحث حاشیهای نیست و به یکی از محورهای اصلی رقابت در صنعت هوش مصنوعی تبدیل شده است.
شما دربارهی شفافیت شرکتهای هوش مصنوعی چه فکر میکنید؟