شکست OpenAI sandbox به عامل AI اجازه می دهد تا به اینترنت دسترسی پیدا کند
این کشف کمتر از یک هفته پیش انجام شد.
OpenAI این شکست را اولین حادثه امنیتی در نوع خود توصیف کرد.
OpenAI گفت که سیستم هوش مصنوعی دیگری که در محیطی امن و بدون اینترنت آموزش دیده بود، توانست به وب دسترسی پیدا کند تا به یک چت ربات خارجی و شخص ثالث دسترسی پیدا کند.
بر اساس یک پست وبلاگ در وب سایت OpenAI در 25 سپتامبر، این کشف کمتر از یک هفته پیش انجام شد. یکی از سیستمهای هوش مصنوعی عاملی آن در حال آموزش در محیط sandbox بود که از یک شکاف برای دسترسی به اینترنت عمومی استفاده کرد.
این گزارش نشان داد که با این دسترسی، حداقل 20 پرسش را به یک سرویس چت بات شخص ثالث، از جمله «پایتخت فرانسه چیست» ارسال کرد.
OpenAI این شکست را اولین حادثه امنیتی در نوع خود توصیف کرد، زیرا ترکیبی از مدلها در طول آزمایش داخلی به اینترنت دسترسی پیدا کردند و به طور سهوی سیستم پلتفرم هوش مصنوعی Hugging Face را در ماه جولای نقض کردند.
توسعهدهنده هوش مصنوعی گفت: «این سیگنال مهمی به ما میدهد که مرحله بعدی آن کار را کجا متمرکز کنیم». این شرکت گفت که پس از آخرین حادثه تصمیم گرفته است تا آموزش با استفاده از ابزار در قوی ترین مدل های خود را تا رفع نقص سندباکس متوقف کند. OpenAI افزود: "ما آموزش این مدل خاص را از سر نخواهیم گرفت."
نقضهای مدلهای هوش مصنوعی توسعهیافته OpenAI، Anthropic PBC، DeepMind گوگل و پلتفرمهای متا در ماههای اخیر، کارشناسان امنیت سایبری و ایمنی هوش مصنوعی را نگران کرده است.
حادثه Hagging Face یکی از دلایلی بود که مدیر اجرایی آنتروپیک، داریو آمودی، زمانی که دو هفته پیش خواستار کاهش سرعت توسعه هوش مصنوعی در سراسر صنعت شد، عنوان کرد.
فراخوان او که به سرعت توسط سام آلتمن، مدیر عامل OpenAI، ایلان ماسک و دیگران تأیید شد، بحث جهانی را در مورد نیاز به مقررات بیشتر هوش مصنوعی برانگیخت.
OpenAI آخرین شکست سندباکس را فاش کرد حتی در حالی که هنوز در حال کار برای درک اختلال ایجاد شده توسط سیستمهای هوش مصنوعی عامل خود در زمانی که قبلا به اینترنت دسترسی پیدا کردند.
این شرکت در 25 سپتامبر تأیید کرد که مدلهایش در طول آموزش و ارزیابی به اطلاعات وبسایتهای دولت ایالات متحده، از جمله وبسایتهای اداره سرشماری و کمیسیون بورس و اوراق بهادار دسترسی داشتهاند.
چند روز پیش، OpenAI فاش کرد که مدلهای آن در اوایل سال ۲۰۲۶ یک وبسایت دولتی استرالیا را مختل کرده بودند.
جدیدترین نقض سندباکس همچنین شکاف هایی را در فرآیندهای عملیاتی OpenAI آشکار کرد.
پست وبلاگ نشان داد که یک "بازبین انسانی" یک هشدار از یک سیستم نظارت داخلی دریافت کرد و آن را در Slack در عرض سه دقیقه تایید کرد، اما اجرای تمرین به طور خودکار همانطور که انتظار می رفت متوقف نشد.
بر اساس این گزارش، بیش از دو ساعت طول کشید تا کسی به صورت دستی دویدن را متوقف کند.
سیدنی فون آرکس، موسس یک سازمان غیرانتفاعی Nightingale در مورد ایمنی هوش مصنوعی، گفت: «مایه تاسف است که حتی پس از بالا بردن امنیت خود در پی Hugging Face، مدلهای OpenAI همچنان قادر به دسترسی غیرمجاز به اینترنت هستند.
سوال بزرگ اکنون این است که آیا آنها در این مورد یک باند بند می زنند و اگر علت اصلی مشکل را پیدا کنند و آن را برطرف کنند، آموزش را در اسرع وقت برگردانند. بلومبرگ
متن اصلی (انگلیسی)
OpenAI sandbox failure allows AI agent to gain internet access
The discovery was made less than a week ago.