هکرها با کمک هوش مصنوعی آنتروپیک به اوپنایآی نفوذ کردند
پژوهشگران با هوش مصنوعی آنتروپیک به حساب ChatGPT یک کارمند OpenAI رسیدند و از ضعفهای تازهی امنیتی پرده برداشتند.
پژوهشگران با هوش مصنوعی آنتروپیک به حساب ChatGPT یک کارمند OpenAI رسیدند و از ضعفهای تازهی امنیتی پرده برداشتند.
هفتهها پس از آنکه گروهی از عاملهای هوش مصنوعی از کنترل خارج شدند و هاگینگ فیس را هک کردند، OpenAI با رخنهی دیگری روبهرو شد؛ رخنهای که اینبار خودِ شرکت هدف بود.
پژوهشگران امنیتی مستقل با کمک هوش مصنوعی کلاد آنتروپیک توانستند به حساب ChatGPT یک کارمند OpenAI دسترسی پیدا کنند و راهی برای خواندن و پیشنهاد تغییر در بخشی از مخزن خصوصی نرمافزارهای شرکت باز کنند.
به روایت والاستریت ژورنال ، این تیم در برنامهی باگبانتی OpenAI شرکت داشت؛ برنامهای که به پژوهشگران اجازه میدهد در یک چارچوب امن برای شکستن سامانههای سازمانی تلاش کنند. پژوهشگران نتیجه را سریع به OpenAI گزارش کردند و شرکت در برابر این افشاگری ۶۵۰۰ دلار پاداش پرداخت کرد. نخستینبار است که جزئیات کار آنها علنی میشود.
اوپنایآی ۶۵۰۰ دلار پاداش به هکرها پرداخت کرد
ماجرا به فهرست روبهبلندِ افشاگریهای امنیتی در هفتههای اخیر افزوده شد؛ افشاگریهایی که شرکتهای بزرگ فناوری و پژوهشگران امنیت سایبری یکی پس از دیگری منتشر کردهاند. با وجود هشدارهایی که ماهها دربارهی توانایی سامانههای هوش مصنوعی مطرح شده، رخنهی تازه نشان میدهد که پیچیدگی زیرساختهای رایانشی امروز، دفاع از آنها را دشوارتر از آن کرده که در ظاهر به نظر میرسد.
سم آلتمن ، مدیرعامل OpenAI، همراه با شماری از چهرههای همصنف خود خواستار توقف در توسعهی هوش مصنوعی شد و گفت سرعت پیشرفت چنان بالا است که شرکتها برای مهار آسیبها فرصت کافی ندارند. OpenAI هم روز چهارشنبه از رخدادهای ایمنیِ پیشتر گزارشنشده پرده برداشت و سیاستهای تازهای برای گزارش چنین مواردی اعلام کرد.
در زمانی که آمریکا در رقابتی مستقیم با چین برای برتری در هوش مصنوعی قرار دارد، پژوهشگرانی که OpenAI را هک کردند میگویند این حمله نشان میدهد تیمهای پیشرفتهی آشنا با جنگ سایبری، اگر از سوی دولتها پشتیبانی شوند، میتوانند بهسادگی نگاهی به اسرار هوش مصنوعی آمریکا بیندازند.
هکرها دو مشکل مهم را کشف کردند که برای اوپنایآی ارزشمند بود
OpenAI اعلام کرد هکرها دو مشکل را کشف کرده بودند؛ یکی در سرویس Discourse که انجمن گفتوگوی عمومی OpenAI را میزبانی میکند و دیگری در خودِ شرکت. هر دو مورد اکنون برطرف شدهاند.
بهگفتهی پژوهشگران، این نشانهها بهطور غیرمنتظره روی ChatGPT معتبر بودند و برخی از آنها به کارمندان OpenAI تعلق داشتند. همان نشانهها همچنین میتوانستند برای دسترسی به سرویس GitHub متعلق به OpenAI هم استفاده شوند؛ مخزنی برای کدهای نرمافزاری شرکت.
چون پژوهشگران نمیخواستند به دادههای حساس دست بزنند، نمیتوانند با قطعیت بگویند سامانهی کد منبع OpenAI برای چه استفاده شده بود، اما میگویند نام آن Monorepo بوده است. بهگفتهی افرادی آشنا با معماری اوپنایآی، Monorepo یک مخزن نرمافزاری بزرگ از اسرار الگوریتمی شرکت به شمار میرود.
از نگاه فنی، Monorepo معادل نرمافزاری «سس مخفی» یک شرکت است؛ بخشی که مدلها را سریعتر و کارآمدتر میکند، اما گفته میشود وزنهای مدل در آن نگهداری نمیشود. وزنها همان تریلیونها عددی هستند که هستهی مدلهای زبانی بزرگ را تشکیل میدهند و تعیین میکنند کدام اطلاعات تقویت شوند و کدام دادهها نادیده بمانند.
ماجرا فقط یک دسترسی غیرمجاز ساده نبود. ترکیبِ باگ در یک سرویس متفرقه، استفاده از یک مدل زبانی برای نوشتن کد حمله، و رسیدن به نشانههای ورودِ معتبر برای حسابهای داخلی OpenAI تصویری از سطح تازهای از ریسک را نشان میدهد. حمله ثابت کرد زنجیرههای اعتماد دیجیتال، حتی وقتی با هدف امنیت طراحی میشوند، میتوانند از جایی غیرمنتظره شکسته شوند.
در این پرونده، عامل انسانی کنار نرفت، اما نقش هوش مصنوعی پررنگ شد. کلاد بهجای آنکه فقط ابزار تولید متن باشد، به موتور یافتن آسیبپذیری و ساخت کد بهرهبرداری تبدیل شد. همین جابهجایی نقش، تصویری روشن از مرحلهی تازهی تهدیدهای سایبری ارائه میکند؛ مرحلهای که در آن مدلهای زبانی فقط از حمله خبر نمیدهند، بلکه در طراحی خودِ حمله هم شریک میشوند.