پرش به محتوای اصلی

اولین نقض عامل AI شناخته شده: چه اتفاقی می افتد وقتی که به طور مستقل شروع به فعالیت کند؟

آناتولی۱۴۰۵ مهر ۶, دوشنبه، ساعت ۱۳:۲۷حدود 6 دقیقه مطالعه

نخست وزیر آنتونی آلبانیز می گوید که عامل OpenAI پس از مواجهه با محدودیت ها به پورتال سلامت استرالیا دسترسی غیرمجاز پیدا کرده است.

از یک عامل OpenAI خواسته شد تا در مورد آمار سلامت استرالیا تحقیق کند.

اما زمانی که به یک مانع دیجیتالی در وب سایت دولتی برخورد کرد، کاری را انجام داد که اپراتورهایش از او نخواسته بودند. به تلاش ادامه داد.

این عامل در نهایت به فایل‌های غیر عمومی در یک سیستم دولتی استرالیا دسترسی غیرمجاز پیدا کرد، اتفاقی که کارشناسان آن را اولین مورد شناخته شده عمومی از نقض مستقل یک عامل هوش مصنوعی به یک نهاد دولتی توصیف کردند.

این حادثه در اواسط ژوئن رخ داد اما تنها هفته گذشته توسط آنتونی آلبانیز، نخست وزیر استرالیا در نیویورک در حاشیه مجمع عمومی سازمان ملل به طور علنی فاش شد.

در یکی دیگر از موارد مربوط به پذیرش، OpenAI جمعه گذشته گفت که عوامل آن با چندین وب سایت دولتی ایالات متحده به روش های غیرمنتظره ای از جمله کمیسیون بورس و اوراق بهادار ایالات متحده (SEC) و سایت های اداره سرشماری، به عنوان بخشی از بررسی مداوم رفتار مدل، تعامل داشته اند.

با این حال، برای کارشناسان هوش مصنوعی و امنیت سایبری، اهمیت این حادثه فراتر از داده های مربوط است.

این سؤال اساسی‌تر را مطرح می‌کند: وقتی یک سیستم هوش مصنوعی هدف، دسترسی به ابزارهای دیجیتال و استقلال کافی برای تصمیم‌گیری در هنگام شکست اولین رویکردش چه کاری انجام دهد، چه اتفاقی می‌افتد؟

هشام الاسام، دانشیار و خواننده علوم کامپیوتر در دانشگاه باکینگهام، گفت: "بر اساس آنچه که به طور عمومی گزارش شده است، به نظر می رسد که این اولین مورد شناخته شده از این نوع است که شامل یک عامل هوش مصنوعی و یک سیستم دولتی استرالیا می شود."

او نسبت به توصیف آن به عنوان اولین حادثه از این دست هشدار داد و خاطرنشان کرد که موارد مشابه ممکن است رخ داده باشد اما به طور عمومی فاش نشده است.

پیتر گاراگان، استاد کرسی امنیت هوش مصنوعی در دانشگاه لنکستر، این اقدام را "بسیار مهم" خواند.

او گفت: «یک عامل هوش مصنوعی فراتر از بازیابی اطلاعات حرکت کرد و به داده‌های غیرعمومی در یک سیستم دولتی دسترسی پیدا کرد، بدون اینکه چنین دستوری دریافت کند.»

با این حال، او هشدار داد، هنوز خیلی زود است که نتیجه بگیریم که عامل به طور مستقل یک آسیب پذیری را کشف کرده است زیرا موضوع در دست بررسی است.

الاسام گفت آنچه این پرونده را به ویژه جالب می کند این است که مامور دستورات "هک دولت استرالیا" را دریافت نکرده است.

برعکس، وظیفه پژوهشی به آن داده شد. هنگامی که هنگام تلاش برای دسترسی به اطلاعات با محدودیت مواجه شد، به جای توقف ساده، سعی کرد راه دیگری برای دور زدن مانع پیدا کند.

"این تمایز مهم است زیرا نشان می دهد که چگونه یک عامل می تواند به طور بالقوه از دنبال کردن یک هدف به انطباق رفتار خود زمانی که چیزی مانع می شود حرکت کند."

او افزود، مسئله این است که یک عامل هوش مصنوعی ذاتا نمی داند چه چیزی قانونی، اخلاقی یا مجاز است و چه چیزی مجاز نیست.

او همچنین معتقد است که به نظر نمی‌رسد داده‌های واقعی درگیر بزرگترین نگرانی باشد، زیرا هیچ مدرکی مبنی بر دسترسی به سوابق بیماران Medicare گزارش نشده است، و سیستم درگیر اساسا برای ارائه آمارهای کلی طراحی شده است.

برای او مسئله بزرگتر رفتار عامل هوش مصنوعی است.

یک ربات چت معمولی عمدتا متن تولید می‌کند. یک سیستم هوش مصنوعی عاملی می‌تواند به وب‌سایت‌ها، APIها، کدها و ابزارهای دیگر متصل شود و به آن اجازه دهد عملا اقداماتی انجام دهد.

توانایی مشاهده، انطباق و تلاش کردن همان چیزی است که هوش مصنوعی عامل را بسیار قدرتمند می‌کند، اما چالش امنیتی متفاوتی را نیز ایجاد می‌کند.»

الاسام گفت این بدان معنا نیست که هوش مصنوعی ناگهان به یک ابر هکر تبدیل شده است.

اما نشان می‌دهد که سازمان‌ها باید در مورد سیستم‌هایی متفاوت فکر کنند که می‌توانند هدفی را دنبال کنند، با سیستم‌های دیگر تعامل داشته باشند و رفتار خود را تطبیق دهند، بدون اینکه انسان هر مرحله‌ای را مشخص کند.

آلبانیز گفت که این نماینده به فایل‌های عمومی و غیرعمومی در پورتال گزارش‌دهی آمار مدیکر که توسط سرویس استرالیا اداره می‌شود، دسترسی داشته است.

تحقیقات پزشکی قانونی شامل اداره سیگنال های استرالیا در حال انجام است. آلبانیز گفت که تاکنون هیچ مدرکی مبنی بر دسترسی به اطلاعات شخصی یا درمورد نفوذ گسترده‌تر شبکه خدمات استرالیا وجود ندارد.

با این حال، کارشناسان از دولت ها خواستند تا مرزهای قوی تری را معرفی کنند.

الاسام گفت که بزرگترین درس این است که یک عامل هوش مصنوعی به طور طبیعی تفاوت بین "من نمی توانم به این دسترسی داشته باشم" و "من مجاز به دسترسی به این نیستم" را درک نمی کند.

اگر هدف آن یافتن اطلاعات باشد، به طور بالقوه می‌تواند یک محدودیت فنی را به‌عنوان مشکلی برای حل تفسیر کند تا مرزی که باید رعایت کند.»

او گفت که این امر به ویژه در مراقبت های بهداشتی نگران کننده است، جایی که سیستم ها حاوی اطلاعات بسیار حساس هستند و اغلب به زیرساخت های قدیمی، برنامه های کاربردی قدیمی و ارتباطات پیچیده بین سیستم های مختلف بستگی دارند.

بنابراین عوامل هوش مصنوعی به مرزهای فنی بسیار قوی‌تری نیاز دارند تا اینکه به آنها بگوییم چه کاری باید انجام دهند یا نباید انجام دهند. این بدان معناست که دسترسی با حداقل امتیاز، احراز هویت قوی، سندباکس، محدودیت‌های شبکه، نظارت مستمر و محدودیت‌های واضح در مورد آنچه که یک عامل مجاز به دسترسی یا تغییر است. برای اقدامات پرخطر، تأیید انسانی نیز باید مورد نیاز باشد.»

Stavros Shiaeles، استاد امنیت سایبری و هوش مصنوعی کاربردی در دانشگاه پورتسموث، خواستار احتیاط در مورد توسعه ابرهوشی شد.

ما باید به دنبال ایجاد عامل برای کارهای خاص، به عنوان مثال هوش مصنوعی برای ریاضیات، فیزیک و غیره باشیم، نه اینکه همه علوم را در یک هوش مصنوعی ترکیب کنیم.»

وی افزود: متأسفانه همه چیز به سمت ابرهوشی منتهی می شود که به اعتقاد او انسان ها به زودی با آن مشکل خواهند داشت.

هشدار شیائلس در حالی مطرح می‌شود که شرکت‌های پیشرو هوش مصنوعی درباره ابرهوش، سیستم‌هایی که قادر به پیشی گرفتن از انسان در طیف وسیعی از وظایف فکری هستند، به عنوان مرحله بعدی بالقوه توسعه بحث می‌کنند.

جاکوب پاچوکی، دانشمند ارشد OpenAI، در 6 سپتامبر هشدار داد که سرعت فعلی پیشرفت هوش مصنوعی می‌تواند به سمت خود-بهبودی بازگشتی ادامه یابد و سیستم‌های آینده به طور فزاینده‌ای توسعه خود را هدایت کنند. او نوشت: «این زمانی است که نیاز به احتیاط شدید دارد.

در همین حال، متا در ماه اوت گفت که مردم می‌توانند «در چند سال آینده» به ابرهوش‌مندی دسترسی داشته باشند، در حالی که هوش مصنوعی مایکروسافت می‌گوید که در حال کار روی «سوپرهوش انسانی» است که برای باقی ماندن تحت کنترل انسان طراحی شده است.

Garraghan، بنیانگذار Mindgard، یک شرکت امنیتی هوش مصنوعی، گفت این حادثه نشان می دهد که عوامل هوش مصنوعی می توانند اقداماتی فراتر از وظایف مورد نظر خود انجام دهند، اما نامیدن آن یک حمله سایبری کاملا مستقل فراتر از شواهد موجود است.

OpenAI گفت که مدل ها در طول یک ارزیابی داخلی به دنبال آمار بودند و اقدامات ناخواسته ای انجام دادند، که این امر در درجه اول یک شکست جدی در کنترل، مهار و نظارت است.

نگرانی‌های من فراتر از دسترسی اولیه به شکست آشکار مهار، احتمال آسیب‌دیدگی چندین سیستم و فرآیند افشای چند ماهه است. ما باید منتظر حوادث بیشتری باشیم زیرا عوامل دسترسی بیشتری به سیستم‌های خارجی پیدا می‌کنند و ایزوله‌سازی، دسترسی کمترین امتیاز، تست امنیتی مداوم، نظارت و افشای سریع ضروری است.

برای الاسام، تغییر گسترده تر بسیار مهم است.

ما دهه ها را صرف ایمن سازی سیستم ها در برابر انسان ها با استفاده از رایانه کرده ایم.

اکنون باید به فکر این باشیم که چگونه آنها را در برابر رایانه‌هایی که می‌توانند بیشتر شبیه انسان عمل کنند، ایمن کنیم.»

خواندن متن کامل در آناتولیبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

First known AI agent breach: What happens when it starts acting independently?

OpenAI agent gained unauthorized access to Australian health portal after encountering restrictions, says Prime Minister Anthony Albanese

همه‌ی اخبار فناوری