پرش به محتوای اصلی

هکرهای کلاه سفید به تازگی با استفاده از Anthropic's Claude در کمتر از 72 ساعت OpenAI را نقض کردند - و این یک مطالعه موردی در مورد سرعت پیشرفت هوش مصنوعی است.

تک‌رادار۱۴۰۵ شهریور ۲۷, جمعه، ساعت ۱۴:۱۹حدود 5 دقیقه مطالعه

محققان تلاش کردند تا با یک عامل هوش مصنوعی در Opus 4.8 از این اکسپلویت سوء استفاده کنند، اما انتشار Opus 5 همه چیز را تغییر داد.

محققان امنیتی از Claude Opus 5 برای ربودن حساب ChatGPT یک کارمند OpenAI استفاده کردند

اکسپلویت از یک نقص پردازش تصویر در انجمن های OpenAI برای دسترسی کامل به مخزن سوء استفاده کرد

کل جدول زمانی از کشف آسیب‌پذیری تا دسترسی به مخزن کمتر از ۷۲ ساعت طول کشید گروهی از محققان امنیتی Hacktron در حین شرکت در یک برنامه پاداش باگ OpenAI، موفق شدند یک حساب OpenAI ChatGPT داخلی را به خطر بیاندازند و به کد داخلی شرکت در Github دسترسی پیدا کنند.

بر اساس گزارش وال استریت ژورنال، که اولین بار این حادثه را گزارش کرد، محققان از "نسخه ویژه" کلود آنتروپیک استفاده کردند که در اختیار "متخصصان واجد شرایط امنیت سایبری" قرار گرفت تا این حمله را انجام دهند.

محققان در ابتدا سعی کردند از Claude Opus 4.8 برای ایجاد یک رخنه استفاده کنند، اما با مشکلات متعددی روبرو شدند زیرا این مدل «در چندین جلسه برای تولید یک اکسپلویت کار تلاش کرد». اما انتشار Opus 5 همه چیز را تغییر داد.

نقض OpenAI بخشی از سوء استفاده گسترده تر libheif

این نقض با یک سوء استفاده از libheif شروع شد که از نقصی در رمزگشا و رمزگذار فرمت فایل تصویر .heic/.heif/.avif سوء استفاده می کند. در حالی که این اکسپلویت به Hacktron اجازه داد تا OpenAI را نقض کند، libheif همچنین در سایر پلتفرم‌ها و نرم‌افزارها از جمله Slack، Meta، GitHub Enterprise، Ruby on Rails و غیره استفاده می‌شود.

برای شروع، محققان ابتدا خاطرنشان کردند که انجمن OpenAI به پلتفرم Discourse متکی است که به نوبه خود برای بررسی تصویر به FastImage متکی است. اما FastImage از فایل‌های تصویر .heif پشتیبانی نمی‌کند و در عوض برای تبدیل به ImageMagick منتقل می‌شود.

محققان گفتند که توسعه یک اکسپلویت اجرای کد که از این رابطه بین ImageMagick و libheif با Opus 4.8 سوء استفاده می‌کرد «مثمربخش نبود»، اما در همان روز Anthropic Claude Opus 5 را منتشر کرد.

با Opus 5، محققان با تنظیم یک عامل هوش مصنوعی در یک حلقه برای سوء استفاده از نمونه محلی Discourse Cloud، موفق شدند یک اجرای کد از راه دور محلی (RCE) را با استفاده از همان فرض ایجاد کنند.

سپس از اکسپلویت موفق Discourse علیه انجمن‌های OpenAI استفاده شد، جایی که محققان حساب ChatGPT یک کارمند OpenAI را ربودند. کارمند ChatGPT Codex خود را با Github شرکت متصل کرده بود و به محققان امکان دسترسی کامل به مخزن را می داد.

اکسپلویت فقط به چند ساعت تعامل انسانی نیاز داشت

جایی که محققان ساعت ها برای ایجاد یک اکسپلویت کاری با Opus 4.8 تلاش کردند، انتشار Opus 5 نشان داد که "هر مدل جدید به طور فزاینده ای توانمند می شود." تنها چند ساعت طول کشید تا عاملی که روی Opus 5 اجرا شود، یک اکسپلویت کار را توسعه دهد.

محققان خاطرنشان کردند که جدول زمانی کامل از کشف اولیه این اکسپلویت تا دسترسی به مخزن OpenAI تنها 72 ساعت طول کشید.

محققان همچنین گفتند که کل هک OpenAI و Discourse "چند روز برای یک عامل و فقط چند ساعت وقت انسانی" طول کشید تا موفقیت آمیز باشد. علاوه بر این، تحقیقات آنها در مورد سوء استفاده از libheif علیه سازمان‌هایی مانند Slack، Zoom، Meta "دو ماه طول کشید، در مجموع کمتر از 3000 دلار در توکن هزینه داشت و توسط سه محقق انجام شد."

محققان گفتند: «هوش مصنوعی تقریبا کور شروع به کار کرد و در عرض یک یا دو روز اکسپلویت را برای هر شرکت تطبیق داد. ما حتی پس از ارسال هزاران تصویر و از کار افتادن مکرر پردازشگرهای تصویر آن‌ها، هیچ شرکتی به جز Shopify این فعالیت را شناسایی نکرده است.

در ازای افشای این آسیب‌پذیری‌ها، Hacktron جایزه ۶۵۰۰ دلاری از OpenAI دریافت کرد و آسیب‌پذیری libheif اصلاح شد.

عوامل هوش مصنوعی، چه خوب و چه بد، آینده هستند

گفتگویی وجود دارد که به اندازه کافی با صدای بلند انجام نمی دهیم: آیا واقعا می خواهید پلتفرم امنیتی شما توسط هوش مصنوعی ساخته شده باشد و هیچ سابقه انسانی پشت آن نباشد؟

اسپنسر استارکی، SonicWall

نمایش بهره‌برداری Hacktron نشان می‌دهد که چگونه عوامل هوش مصنوعی در امنیت سایبری رایج شده‌اند. جایی که شرکت‌های هوش مصنوعی از آنها برای ارائه پاداش‌های بهره‌وری و افزایش بهره‌وری به کارگران تحسین شده‌اند، همین امر را می‌توان در مورد مهاجمان نیز گفت.

این واقعیت که از کشف اکسپلویت تا دسترسی کامل به مخزن فقط 72 ساعت طول کشید، خطرات را برجسته می کند. با تنظیم یک عامل هوش مصنوعی برای اجرا در یک حلقه پیوسته تا زمانی که یک اکسپلویت قابل اجرا ایجاد کند، به طور چشمگیری جدول زمانی بهره برداری را از هفته ها یا ماه ها در مورد حملات غیر AI به ساعات صرف برای مهاجمان با کمک عوامل تغییر می دهد.

این شرایط مشابه نقض تصادفی خود OpenAI از Hugging Face در طول آزمایش عوامل هوش مصنوعی است. به عوامل اساسا گفته شد که یک سناریوی آزمایشی را به هر وسیله ای که لازم است تکمیل کنند، که نمایندگان آن را به عنوان اجازه فراتر از همسویی خود و هک کردن به یک محیط شخص ثالثی که فکر می کردند کلید حل کارشان است، تعبیر کردند.

اسپنسر استارکی، معاون اجرایی EMEA در SonicWall گفت: «هوش مصنوعی مدتی است که چشم‌انداز تهدید و چشم‌انداز دفاعی را با آن تغییر داده است. اما گفتگویی وجود دارد که به اندازه کافی با صدای بلند انجام نمی دهیم: آیا واقعا می خواهید پلتفرم امنیتی شما توسط هوش مصنوعی ساخته شده باشد و هیچ سابقه انسانی در پشت آن وجود نداشته باشد؟

قانع‌کننده به نظر می‌رسد. شما دارای هزینه کم، حاشیه‌های بالا، رابط نرم‌افزاری هستید. اما چه اتفاقی می‌افتد زمانی که مشکلی در ساعت 02:00 بامداد پیش می‌آید و به کسی نیاز دارید که محصول را بشناسد، محیط شما را بشناسد و قبلا آن مشکل را دیده باشد؟ یک پلتفرم ساخته‌شده با هوش مصنوعی با کارمندان صفر نمی‌تواند به شما این امکان را بدهد.

"چرا وقتی یک گزینه جدیدتر 90٪ کارهای مشابه را با نصف قیمت انجام می دهد، با یک فروشنده معتبر بروید؟ این یک سوال منصفانه است. اما 10 درصدی که شما با آن معامله می کنید معمولا مسئولیت پذیری، انعطاف پذیری و دانش سازمانی است. زمانی که مورد حمله قرار می گیرید دقیقا چه چیزی مهم است.

استارکی در پایان گفت: "به نظر می رسد که دقت در حال فرسایش است، و این من را نگران می کند. براق و مقرون به صرفه ترکیبی قدرتمند است... برای سرخابی ها. اما در امنیت سایبری، هزینه تصمیم نادرست تامین کننده تا زمانی که حداقل توان پرداخت آن را نداشته باشید، نشان داده نمی شود، پس زاغی نباشید."

خواندن متن کامل در تک‌راداربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

White hat hackers just breached OpenAI using Anthropic's Claude in less than 72 hours — and it is a case study in just how fast AI is advancing

The researchers struggled to abuse the exploit with an AI agent on Opus 4.8, but the release of Opus 5 changed everything.

همه‌ی اخبار فناوری