جمینی گوگل سه شرکت را در ماه مه هک کرد و اکنون فقط به آن اعتراف کرده است
گوگل گفت این حادثه ثابت کرد که پادمان هایش در واقع کار می کنند.
جمینی گوگل سرانجام به جمع عوامل سرکش هوش مصنوعی پیوست.
وال استریت ژورنال روز جمعه گزارش داد که گوگل تایید کرده است که یکی از نمونه های Gemini توانسته است جعبه شنی خود را ترک کند و در طی یک آزمایش امنیتی در ماه می به شرکت های دیگر حمله کند. شرکتی که این آزمایش را انجام داد، شرکت امنیت هوش مصنوعی مرزی Irregular بود - که ژورنال اشاره کرد که اتفاقا در موارد مشابه در OpenAI، Anthropic و Meta شرکت داشته است. به گفته نیویورک تایمز، موضوع مشترک بین همه حوادث این است که مدلهای هوش مصنوعی در طول آزمایشهای Irregular به اینترنت غیرمجاز دسترسی پیدا کردند.
به گزارش ژورنال، Irregular جمینی را در تمرینی که شامل یک محیط زیرساخت شبیه سازی شده برای یک شرکت خیالی است، به کار گرفت. وقتی جمینی متوجه شد که به اینترنت متصل است، به سرعت به سمت یک هدف واقعی در یک شرکت واقعی با همین نام حرکت کرد و «گذرواژهها را حدس زد تا زمانی که به آن دسترسی پیدا کرد»، یعنی به اجبار وارد شد. در دو رویداد دیگر، جمینی به سادگی اعتبارنامههای معتبری را که برای هر کسی در یک مخزن عمومی قابل دستیابی بود، برداشت.
گوگل به ژورنال گفت که Gemini متوجه شده است که مدت کوتاهی پس از ورود به محیط های مورد نظر سبقت گرفته است و آسیب بیشتری وارد نکرده است. یک سخنگوی Irregular اضافه کرد: "در اواخر ژوئیه به تمام آزمایشگاه های مربوطه اطلاع داده شد." مشخص نیست که چرا، اگر جمینی متوجه شد که خیلی زیاده روی کرده است، تا اواسط تابستان طول کشید تا محققان متوجه شوند و/یا گوگل را مطلع کنند.
سخنگوی Irregular به ژورنال گفت که واکنش شرکت سریع بوده و منجر به اصلاحات بتن شده است.
آنها نوشتند: "همه مسائل شناخته شده در مورد ما هفته ها پیش اصلاح و حل شد."
گوگل به تایمز گفت که به این نتیجه رسیده است که Gemini به درستی جلوی خود را گرفته است و بنابراین «عدم همسویی مدل» را نشان نمی دهد، و بنابراین نیازی به افشای این حادثه برای عموم مردم نمی بیند. این عجیب است، زیرا در آن زمان، طبق گزارش ها، گوگل اطلاع رسانی به فدرال رزرو را مهم می دانست.
جک کیبل، مدیرعامل استارت آپ امنیت هوش مصنوعی Corridor به ژورنال گفت: «به نظر میرسد که آنها تلاش میکنند در پشت هنجارهایی که در افشای آسیبپذیری برای این موضوع ایجاد شده است، پنهان شوند، که مشکلی بسیار متفاوت است».
دسترسی غیرمجاز به اینترنت نیز در تستهای Irregular قبلی مقصر بوده است. اگرچه اکنون به نظر میرسد که علت اصلی آن خطای انسانی بود تا زیرکی خاص مدلها، عواملی که فرار کردند به روشهای غیرقابل پیشبینی و خطرناک عمل کردند. در طی یک آزمایش نامنظم با استفاده از کلود اپوس 4.7 آنتروپیک، گزارش شده است که عامل حتی پس از تشخیص واقعی بودن هدف به حمله ادامه داد.
آزمایش نامنظم در OpenAI (حادثه ای جداگانه از حمله بدنام OpenAI به پلتفرم کد رقیب Hugging Face) شامل یک نمونه بود که یک وب سایت زنده را مشاهده کرد، اما ظاهرا فکر می کرد که هنوز در یک شبیه سازی است.
توجه به این نکته مهم است که تجزیه و تحلیل هوش مصنوعی از اقدامات خود تقریبا غیرممکن است که بطور مستقل تأیید شود - نه گزارش فرآیند استدلال و نه توضیح گذشته نگر آن از توهم یا عدم دقت مصون نیستند. در بیشتر موارد، محققان باید اعتماد کنند که این فقط ساختن چیزها نیست.
هدر ادکینز، معاون مهندسی امنیت گوگل در بیانیهای به تایمز گفت: «ما مطمئن شدیم که سه نهاد آگاه شدهاند و با شریک آموزشی خود روی تغییراتی که اکنون در فرآیندهای آزمایشی خود ایجاد کردهاند کار کردیم. «این رویدادها اهمیت آموزش مدلهای هوش مصنوعی قدرتمند را برای عمل مسئولانه نشان میدهد.»
متن اصلی (انگلیسی)
Google’s Gemini Hacked Three Companies in May, and It’s Only Admitting That Now
Google said the incident proved its safeguards work, actually.