گزارش موارد بیشتری از هک کردن وبسایتها توسط عوامل «هوش مصنوعی سرکش» OpenAI را نشان میدهد و نشان میدهد که ممکن است در هفتههای اخیر هنوز فعال بودهاند.
شرکت تحقیقاتی شواهدی پیدا میکند که ممکن است ماموران OpenAI به صرافی ارزهای دیجیتال در 20 سپتامبر حمله کرده باشند.
مسائل OpenAI با عوامل سرکش هوش مصنوعی گسترده تر از آن چیزی است که شرکت قبلا اذعان کرده است - و ممکن است ادامه داشته باشد. این نتیجه یک گزارش جدید از یک شرکت تحقیقاتی مستقل است.
افشاگریهای جدید در همان روزی منتشر شد که دولت استرالیا اعلام کرد که ماموران هوش مصنوعی OpenAI آژانسی را هک کردهاند که دادههای Medicare کشور را نگهداری میکرد، به اطلاعات غیر عمومی دسترسی پیدا کرد و توانایی نوشتن در سرورهای فایل را به دست آورد. این حمله در ماه ژوئن رخ داد، اما دولت استرالیا گفت که OpenAI تنها در مورد آنچه در 10 سپتامبر رخ داده است، صحبت کرده است.
آخرین یافتهها از Transluce به دست آمده است، که میگوید این یک آزمایشگاه تحقیقاتی غیرانتفاعی مستقل است که بر نظارت بر هوش مصنوعی متمرکز است. این شرکت در گزارشی که چهارشنبه منتشر شد، گفت که ماموران OpenAI را کشف کرده است که به وبسایتهای دولتی دیگر استرالیا، از جمله مؤسسه بهداشت و رفاه و همچنین BOSCAR، که سازمان آمار جرم و جنایت در ایالت نیو ساوت ولز استرالیا است، حمله میکنند. علاوه بر این، حداقل دو مورد گزارش نشده قبلی از حمله ماموران OpenAI به یک شرکت و یک دانشگاه را کشف کرد.
Transluce همچنین گفت که شواهدی از فعالیت مشابه پیدا کرده است که حداقل تا ماه مارس ادامه داشته است، ماهها زودتر از اینکه OpenAI گفته بود شواهدی دال بر رفتار غیرمجاز عوامل هوش مصنوعی وجود دارد و حداقل تا 16 سپتامبر و احتمالا تا 20 سپتامبر ادامه دارد.
ترانسلوس گفت: به نظر میرسد که فعالیت اخیر شامل تلاشهایی برای هک کردن یک صرافی ارزهای دیجیتال و تجارت ارزهای رمزنگاری شده است، اگرچه تلاشها ناموفق بودند.
OpenAI بلافاصله به درخواست ها برای اظهار نظر در مورد گزارش Transluce پاسخ نداد. این شرکت روز چهارشنبه گفت با استرالیا در ارتباط با حمله ماموران هوش مصنوعی به سایتی که دادههای مدیکر را در اختیار دارد، در تماس است و عواملش اقداماتی را انجام دادهاند که قصدش را نداشت.
ترانسلوس گفت که علاوه بر حمله به مؤسسه بهداشت و رفاه استرالیا، عوامل OpenAI همچنین به Data USA، یک پلت فرم داده منبع باز رایگان که داده های دولت ایالات متحده را از منابع مختلف جمع آوری می کند، و کتابخانه دیجیتال دانشگاه نیومکزیکو نیز حمله کردند. این سازمان گفت که میتواند مستقیما حمله به آژانس بهداشت استرالیا و Data USA را به همان گروه عامل هوش مصنوعی OpenAI که در حمله سایبری ماه جولای علیه پلتفرم هوش مصنوعی Hugging Face دست داشت، متصل کند.
گزارش جدید نگرانیهایی را در مورد اینکه آیا OpenAI در افشای تمام رویدادهای سرکش هوش مصنوعی که از آن آگاه است کاملا شفاف بوده است، ایجاد میکند. همچنین این احتمال را افزایش می دهد که OpenAI خودش از گستردگی این فعالیت عامل سرکش آگاه نیست.
Transluce "شواهد قوی" پیدا کرد مبنی بر اینکه عوامل هوش مصنوعی OpenAI ممکن است در ماه مارس سعی در هک کردن وب سایت ها داشته باشند. این سازمان گفت شواهد ضعیف تری وجود دارد مبنی بر اینکه این فعالیت ممکن است از نوامبر 2025 آغاز شده باشد. OpenAI گفته است که شواهدی از پیش سازهای حمله Hugging Face تا 8 می پیدا نکرده است، اما هیچ فعالیت مشکوکی قبلی را فاش نکرده است.
نگرانی های مداوم
این گزارش همچنین نشان میدهد که OpenAI ممکن است به تجربه فعالیت عامل AI سرکش ادامه دهد. پس از اینکه OpenAI در 20 جولای کشف کرد که عوامل هوش مصنوعی آن Hugging Face را در طول هفته گذشته هک کرده اند، این شرکت اعلام کرد که مدل منتشر نشده هوش مصنوعی را غیرفعال کرده، جنبه های کلیدی آموزش هوش مصنوعی خود را به مدت دو هفته متوقف کرده و اقداماتی را برای اعمال کنترل های سختگیرانه و نظارت بر مدل های هوش مصنوعی منتشر نشده انجام داده است. OpenAI این کنترلهای سختگیرانهتر را در 18 آگوست اعلام کرد. اما Transluce شواهدی از ادامه فعالیتهای مشابه با وجود کنترلهای جدید تا اواسط سپتامبر یافت.
علاوه بر این، محققان Transluce گفتند که این یافتهها قابل توجه است زیرا نشان میدهد که عوامل هوش مصنوعی زمانی که قادر به بازیابی اطلاعات مورد نظر خود مستقیما از اطلاعات یافت شده در صفحات وب عمومی این سازمانها نبودند، به تلاشهای هک متوسل شدند. در این بیانیه آمده است: «به ویژه، وظایفی که این عوامل در تلاش برای حل آنها بودند، مربوط به سایبری نبودند؛ این عوامل در حین کار بر روی وظایف عادی بازیابی اطلاعات، به تاکتیکهای هک متوسل شدند.
این مهم است زیرا یک توضیح برای حمله Hugging Face این است که عوامل هوش مصنوعی درگیر در آن حادثه بر اساس توانایی آنها در انجام وظایف سایبری، از جمله سوء استفادههای آسیبپذیری شبیهسازی شده، ارزیابی میشوند. اگر ماموران به راحتی به هک کردن سیستمها در زمینههای دیگر متوسل شوند، این نشان میدهد که مدلهای هوش مصنوعی درگیر حتی خطرناکتر از آنچه قبلا تصور میشد هستند.
OpenAI گفته است که دو مدل در حمله Hugging Face دخیل بودهاند - یک مدل منتشر نشده که به طور عمومی نامی از آن ارائه نکرده است، مسئول اصلی آن بوده است، اگرچه برخی از عوامل هوش مصنوعی مبتنی بر مدل GPT-5.6 Sol آن که برای عموم منتشر شده است نیز درگیر بودهاند. OpenAI گفته است در ارزیابی ای که در طی آن حمله Hugging Face صورت گرفت، نرده های محافظی که معمولا برای محدود کردن توانایی مدل های منتشر شده خود در حملات سایبری استفاده می کند، به دلیل ماهیت ارزیابی وجود نداشت.
چارلی اریکسن، محقق امنیتی آیکیدو سکیوریتی، به فورچون گفت که آخرین گزارش Transluce نشان میدهد که «هنوز انبوه عوامل غیرمجاز و نظارتنشده در اطراف وجود دارند، که آزمایشگاهها و شرکای آزمایش کنترلی بر آنها ندارند و بهطور فعال آنها را شناسایی نمیکنند». او خاطرنشان کرد که سم آلتمن، مدیر عامل OpenAI، در شورای امنیت سازمان ملل متحد در مورد خطرات هوش مصنوعی صحبت میکند و بخشی از این زمان را صرف این موضوع میکند که OpenAI چقدر این خطرات را جدی میگیرد، در عین حال یا از این رویدادهای اضافی مربوط به عوامل هوش مصنوعی خود که در تلاش برای مقابله با آن هستند اطلاعی نداشته یا فاش نکرده است.
وارد سیستم ها شود
جورج چالهوب، استاد مرکز تعامل دانشگاه کالج لندن، که بر تعامل انسان و رایانه تمرکز دارد، گفت: «آنچه که من را نگران میکند این است که این وضعیت چقدر میتواند تشدید شود. نگرانی من این است که ظرف 6 تا 12 ماه آینده، انبوهی از عوامل هوش مصنوعی می توانند بات نت های پایداری را تشکیل دهند که قادر به از بین بردن بخش های بزرگی از اینترنت هستند و به طور بالقوه صدها میلیارد دلار خسارت اقتصادی ایجاد می کنند.
این داستان در ابتدا در سایت Fortune.com منتشر شد
متن اصلی (انگلیسی)
Report reveals yet more cases of OpenAI’s ‘rogue AI’ agents hacking websites—and suggests they may still have been active in recent weeks
Research firm finds evidence OpenAI agents may have attacked a cryptocurrency exchange as recently as September 20