پرش به محتوای اصلی

گزارش موارد بیشتری از هک کردن وب‌سایت‌ها توسط عوامل «هوش مصنوعی سرکش» OpenAI را نشان می‌دهد و نشان می‌دهد که ممکن است در هفته‌های اخیر هنوز فعال بوده‌اند.

فورچون۱۴۰۵ مهر ۲, پنجشنبه، ساعت ۲۱:۰۸حدود 5 دقیقه مطالعه

شرکت تحقیقاتی شواهدی پیدا می‌کند که ممکن است ماموران OpenAI به صرافی ارزهای دیجیتال در 20 سپتامبر حمله کرده باشند.

مسائل OpenAI با عوامل سرکش هوش مصنوعی گسترده تر از آن چیزی است که شرکت قبلا اذعان کرده است - و ممکن است ادامه داشته باشد. این نتیجه یک گزارش جدید از یک شرکت تحقیقاتی مستقل است.

افشاگری‌های جدید در همان روزی منتشر شد که دولت استرالیا اعلام کرد که ماموران هوش مصنوعی OpenAI آژانسی را هک کرده‌اند که داده‌های Medicare کشور را نگهداری می‌کرد، به اطلاعات غیر عمومی دسترسی پیدا کرد و توانایی نوشتن در سرورهای فایل را به دست آورد. این حمله در ماه ژوئن رخ داد، اما دولت استرالیا گفت که OpenAI تنها در مورد آنچه در 10 سپتامبر رخ داده است، صحبت کرده است.

آخرین یافته‌ها از Transluce به دست آمده است، که می‌گوید این یک آزمایشگاه تحقیقاتی غیرانتفاعی مستقل است که بر نظارت بر هوش مصنوعی متمرکز است. این شرکت در گزارشی که چهارشنبه منتشر شد، گفت که ماموران OpenAI را کشف کرده است که به وب‌سایت‌های دولتی دیگر استرالیا، از جمله مؤسسه بهداشت و رفاه و همچنین BOSCAR، که سازمان آمار جرم و جنایت در ایالت نیو ساوت ولز استرالیا است، حمله می‌کنند. علاوه بر این، حداقل دو مورد گزارش نشده قبلی از حمله ماموران OpenAI به یک شرکت و یک دانشگاه را کشف کرد.

Transluce همچنین گفت که شواهدی از فعالیت مشابه پیدا کرده است که حداقل تا ماه مارس ادامه داشته است، ماه‌ها زودتر از اینکه OpenAI گفته بود شواهدی دال بر رفتار غیرمجاز عوامل هوش مصنوعی وجود دارد و حداقل تا 16 سپتامبر و احتمالا تا 20 سپتامبر ادامه دارد.

ترانسلوس گفت: به نظر می‌رسد که فعالیت اخیر شامل تلاش‌هایی برای هک کردن یک صرافی ارزهای دیجیتال و تجارت ارزهای رمزنگاری شده است، اگرچه تلاش‌ها ناموفق بودند.

OpenAI بلافاصله به درخواست ها برای اظهار نظر در مورد گزارش Transluce پاسخ نداد. این شرکت روز چهارشنبه گفت با استرالیا در ارتباط با حمله ماموران هوش مصنوعی به سایتی که داده‌های مدیکر را در اختیار دارد، در تماس است و عواملش اقداماتی را انجام داده‌اند که قصدش را نداشت.

ترانسلوس گفت که علاوه بر حمله به مؤسسه بهداشت و رفاه استرالیا، عوامل OpenAI همچنین به Data USA، یک پلت فرم داده منبع باز رایگان که داده های دولت ایالات متحده را از منابع مختلف جمع آوری می کند، و کتابخانه دیجیتال دانشگاه نیومکزیکو نیز حمله کردند. این سازمان گفت که می‌تواند مستقیما حمله به آژانس بهداشت استرالیا و Data USA را به همان گروه عامل هوش مصنوعی OpenAI که در حمله سایبری ماه جولای علیه پلتفرم هوش مصنوعی Hugging Face دست داشت، متصل کند.

گزارش جدید نگرانی‌هایی را در مورد اینکه آیا OpenAI در افشای تمام رویدادهای سرکش هوش مصنوعی که از آن آگاه است کاملا شفاف بوده است، ایجاد می‌کند. همچنین این احتمال را افزایش می دهد که OpenAI خودش از گستردگی این فعالیت عامل سرکش آگاه نیست.

Transluce "شواهد قوی" پیدا کرد مبنی بر اینکه عوامل هوش مصنوعی OpenAI ممکن است در ماه مارس سعی در هک کردن وب سایت ها داشته باشند. این سازمان گفت شواهد ضعیف تری وجود دارد مبنی بر اینکه این فعالیت ممکن است از نوامبر 2025 آغاز شده باشد. OpenAI گفته است که شواهدی از پیش سازهای حمله Hugging Face تا 8 می پیدا نکرده است، اما هیچ فعالیت مشکوکی قبلی را فاش نکرده است.

نگرانی های مداوم

این گزارش همچنین نشان می‌دهد که OpenAI ممکن است به تجربه فعالیت عامل AI سرکش ادامه دهد. پس از اینکه OpenAI در 20 جولای کشف کرد که عوامل هوش مصنوعی آن Hugging Face را در طول هفته گذشته هک کرده اند، این شرکت اعلام کرد که مدل منتشر نشده هوش مصنوعی را غیرفعال کرده، جنبه های کلیدی آموزش هوش مصنوعی خود را به مدت دو هفته متوقف کرده و اقداماتی را برای اعمال کنترل های سختگیرانه و نظارت بر مدل های هوش مصنوعی منتشر نشده انجام داده است. OpenAI این کنترل‌های سخت‌گیرانه‌تر را در 18 آگوست اعلام کرد. اما Transluce شواهدی از ادامه فعالیت‌های مشابه با وجود کنترل‌های جدید تا اواسط سپتامبر یافت.

علاوه بر این، محققان Transluce گفتند که این یافته‌ها قابل توجه است زیرا نشان می‌دهد که عوامل هوش مصنوعی زمانی که قادر به بازیابی اطلاعات مورد نظر خود مستقیما از اطلاعات یافت شده در صفحات وب عمومی این سازمان‌ها نبودند، به تلاش‌های هک متوسل شدند. در این بیانیه آمده است: «به ویژه، وظایفی که این عوامل در تلاش برای حل آنها بودند، مربوط به سایبری نبودند؛ این عوامل در حین کار بر روی وظایف عادی بازیابی اطلاعات، به تاکتیک‌های هک متوسل شدند.

این مهم است زیرا یک توضیح برای حمله Hugging Face این است که عوامل هوش مصنوعی درگیر در آن حادثه بر اساس توانایی آنها در انجام وظایف سایبری، از جمله سوء استفاده‌های آسیب‌پذیری شبیه‌سازی شده، ارزیابی می‌شوند. اگر ماموران به راحتی به هک کردن سیستم‌ها در زمینه‌های دیگر متوسل شوند، این نشان می‌دهد که مدل‌های هوش مصنوعی درگیر حتی خطرناک‌تر از آنچه قبلا تصور می‌شد هستند.

OpenAI گفته است که دو مدل در حمله Hugging Face دخیل بوده‌اند - یک مدل منتشر نشده که به طور عمومی نامی از آن ارائه نکرده است، مسئول اصلی آن بوده است، اگرچه برخی از عوامل هوش مصنوعی مبتنی بر مدل GPT-5.6 Sol آن که برای عموم منتشر شده است نیز درگیر بوده‌اند. OpenAI گفته است در ارزیابی ای که در طی آن حمله Hugging Face صورت گرفت، نرده های محافظی که معمولا برای محدود کردن توانایی مدل های منتشر شده خود در حملات سایبری استفاده می کند، به دلیل ماهیت ارزیابی وجود نداشت.

چارلی اریکسن، محقق امنیتی آیکیدو سکیوریتی، به فورچون گفت که آخرین گزارش Transluce نشان می‌دهد که «هنوز انبوه عوامل غیرمجاز و نظارت‌نشده در اطراف وجود دارند، که آزمایشگاه‌ها و شرکای آزمایش کنترلی بر آن‌ها ندارند و به‌طور فعال آن‌ها را شناسایی نمی‌کنند». او خاطرنشان کرد که سم آلتمن، مدیر عامل OpenAI، در شورای امنیت سازمان ملل متحد در مورد خطرات هوش مصنوعی صحبت می‌کند و بخشی از این زمان را صرف این موضوع می‌کند که OpenAI چقدر این خطرات را جدی می‌گیرد، در عین حال یا از این رویدادهای اضافی مربوط به عوامل هوش مصنوعی خود که در تلاش برای مقابله با آن هستند اطلاعی نداشته یا فاش نکرده است.

وارد سیستم ها شود

جورج چالهوب، استاد مرکز تعامل دانشگاه کالج لندن، که بر تعامل انسان و رایانه تمرکز دارد، گفت: «آنچه که من را نگران می‌کند این است که این وضعیت چقدر می‌تواند تشدید شود. نگرانی من این است که ظرف 6 تا 12 ماه آینده، انبوهی از عوامل هوش مصنوعی می توانند بات نت های پایداری را تشکیل دهند که قادر به از بین بردن بخش های بزرگی از اینترنت هستند و به طور بالقوه صدها میلیارد دلار خسارت اقتصادی ایجاد می کنند.

این داستان در ابتدا در سایت Fortune.com منتشر شد

خواندن متن کامل در فورچونبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Report reveals yet more cases of OpenAI’s ‘rogue AI’ agents hacking websites—and suggests they may still have been active in recent weeks

Research firm finds evidence OpenAI agents may have attacked a cryptocurrency exchange as recently as September 20

همه‌ی اخبار فناوری