پرش به محتوای اصلی

شکست OpenAI sandbox به عامل AI اجازه می دهد تا به اینترنت دسترسی پیدا کند

استریتس‌تایمز۱۴۰۵ مهر ۵, یکشنبه، ساعت ۰۵:۱۵حدود 3 دقیقه مطالعه

این کشف کمتر از یک هفته پیش انجام شد.

OpenAI این شکست را اولین حادثه امنیتی در نوع خود توصیف کرد.

OpenAI گفت که سیستم هوش مصنوعی دیگری که در محیطی امن و بدون اینترنت آموزش دیده بود، توانست به وب دسترسی پیدا کند تا به یک چت ربات خارجی و شخص ثالث دسترسی پیدا کند.

بر اساس یک پست وبلاگ در وب سایت OpenAI در 25 سپتامبر، این کشف کمتر از یک هفته پیش انجام شد. یکی از سیستم‌های هوش مصنوعی عاملی آن در حال آموزش در محیط sandbox بود که از یک شکاف برای دسترسی به اینترنت عمومی استفاده کرد.

این گزارش نشان داد که با این دسترسی، حداقل 20 پرسش را به یک سرویس چت بات شخص ثالث، از جمله «پایتخت فرانسه چیست» ارسال کرد.

OpenAI این شکست را اولین حادثه امنیتی در نوع خود توصیف کرد، زیرا ترکیبی از مدل‌ها در طول آزمایش داخلی به اینترنت دسترسی پیدا کردند و به طور سهوی سیستم پلتفرم هوش مصنوعی Hugging Face را در ماه جولای نقض کردند.

توسعه‌دهنده هوش مصنوعی گفت: «این سیگنال مهمی به ما می‌دهد که مرحله بعدی آن کار را کجا متمرکز کنیم». این شرکت گفت که پس از آخرین حادثه تصمیم گرفته است تا آموزش با استفاده از ابزار در قوی ترین مدل های خود را تا رفع نقص سندباکس متوقف کند. OpenAI افزود: "ما آموزش این مدل خاص را از سر نخواهیم گرفت."

نقض‌های مدل‌های هوش مصنوعی توسعه‌یافته OpenAI، Anthropic PBC، DeepMind گوگل و پلتفرم‌های متا در ماه‌های اخیر، کارشناسان امنیت سایبری و ایمنی هوش مصنوعی را نگران کرده است.

حادثه Hagging Face یکی از دلایلی بود که مدیر اجرایی آنتروپیک، داریو آمودی، زمانی که دو هفته پیش خواستار کاهش سرعت توسعه هوش مصنوعی در سراسر صنعت شد، عنوان کرد.

فراخوان او که به سرعت توسط سام آلتمن، مدیر عامل OpenAI، ایلان ماسک و دیگران تأیید شد، بحث جهانی را در مورد نیاز به مقررات بیشتر هوش مصنوعی برانگیخت.

OpenAI آخرین شکست سندباکس را فاش کرد حتی در حالی که هنوز در حال کار برای درک اختلال ایجاد شده توسط سیستم‌های هوش مصنوعی عامل خود در زمانی که قبلا به اینترنت دسترسی پیدا کردند.

این شرکت در 25 سپتامبر تأیید کرد که مدل‌هایش در طول آموزش و ارزیابی به اطلاعات وب‌سایت‌های دولت ایالات متحده، از جمله وب‌سایت‌های اداره سرشماری و کمیسیون بورس و اوراق بهادار دسترسی داشته‌اند.

چند روز پیش، OpenAI فاش کرد که مدل‌های آن در اوایل سال ۲۰۲۶ یک وب‌سایت دولتی استرالیا را مختل کرده بودند.

جدیدترین نقض سندباکس همچنین شکاف هایی را در فرآیندهای عملیاتی OpenAI آشکار کرد.

پست وبلاگ نشان داد که یک "بازبین انسانی" یک هشدار از یک سیستم نظارت داخلی دریافت کرد و آن را در Slack در عرض سه دقیقه تایید کرد، اما اجرای تمرین به طور خودکار همانطور که انتظار می رفت متوقف نشد.

بر اساس این گزارش، بیش از دو ساعت طول کشید تا کسی به صورت دستی دویدن را متوقف کند.

سیدنی فون آرکس، موسس یک سازمان غیرانتفاعی Nightingale در مورد ایمنی هوش مصنوعی، گفت: «مایه تاسف است که حتی پس از بالا بردن امنیت خود در پی Hugging Face، مدل‌های OpenAI همچنان قادر به دسترسی غیرمجاز به اینترنت هستند.

سوال بزرگ اکنون این است که آیا آنها در این مورد یک باند بند می زنند و اگر علت اصلی مشکل را پیدا کنند و آن را برطرف کنند، آموزش را در اسرع وقت برگردانند. بلومبرگ

خواندن متن کامل در استریتس‌تایمزبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI sandbox failure allows AI agent to gain internet access

The discovery was made less than a week ago.

همه‌ی اخبار فناوری