OpenAI به بیش از 100 سازمان هشدار می دهد که "مدل های نامناسب" آن تلاش کرده اند وارد شوند - یا بدتر از آن
غول هوش مصنوعی به The Reg می گوید که عمدتا «وظایف تحقیقاتی معمول» و «برخی از وب سایت های دولتی درگیر هستند که مدل های ما اغلب از آنها استفاده می کنند».
عوامل OpenAI بارها و بارها از محدوده مورد نظر خود خارج شده اند. دو گزارش جداگانه به جزئیات این فعالیت می پردازند، از جمله یکی از شرکت سام آلتمن که می گوید بیش از 100 سازمان را در مورد فعالیت مدل بالقوه مشکل ساز اطلاع داده است. OpenAI در بهروزرسانی اواخر چهارشنبه در تحقیقات در حال انجام Hugging Face، گفت که به بیش از 100 سازمان اطلاع داده است که «مدلهای ناهماهنگ» ممکن است به سیستمهای آنها دسترسی داشته باشند. در بهروزرسانی آمده است: «اعلان به این معنی نیست که به هیچ اطلاعات خصوصی دسترسی پیدا کردهایم یا سیستم شخص ثالثی در معرض خطر قرار گرفته است».
یک گزارش جداگانه پنجشنبه از استارتآپ Asymmetric Security مربوط به پزشکی قانونی دیجیتال و پاسخ به حوادث میگوید که عوامل سرکش OpenAI به دادههای 55 سازمان دسترسی داشتند. اینها شامل وزارت آموزش ایالات متحده، تجارت و توسعه سازمان ملل، دفتر تحلیل اقتصادی ایالات متحده، MAX.gov حاوی اسناد بودجه فدرال، مرکز اروپایی پیشگیری و کنترل بیماری، کمیسیون بورس و اوراق بهادار ایالات متحده، آژانس بین المللی انرژی، و FBI Crime Data Explorer است.
Asymmetric تنها از دادههای در دسترس عموم برای جمعآوری این فهرست استفاده کرد و گفت که این فعالیت بین مارس و سپتامبر رخ داده است. بر اساس این گزارش، کاوشهای ماموران نشان میدهد که آنها وظیفه تحقیق درباره سلامت عمومی و سایر دادهها را «احتمالا به عنوان بخشی از یک ارزیابی» داشتند. در این بیانیه آمده است: «ما دسترسی موفقیتآمیز به محیطهای صحنهسازی؛ شواهدی مبنی بر استفاده از تاکتیکهای شناسایی مهاجمان؛ و شواهدی مبنی بر بررسی مجموعه وسیعتری از وبسایتها، از جمله وبسایتهای CDC، SEC، آژانس بینالمللی انرژی، و کلینیک مایو پیدا کردیم».
عواملی که از جعبه های ماسه ای خود خارج می شوند و دسترسی کامل به وب دارند. نویسندگان نوشتند: «برخی از این تاکتیکها، سوابق را پاک یا غیرقابل دسترسی میکردند، و رد دسترسی به دادههای حساس را تنها بر اساس اطلاعات عمومی غیرممکن میکردند». ثبت از OpenAI پرسید که آیا سازمان های موجود در لیست Asymmetric جزو سازمان هایی هستند که توسط OpenAI اطلاع داده شده اند یا خیر. سازنده مدل از گفتن اینکه به کدام سازمان ها اطلاع داده شده است خودداری کرد، اما قبلا به نیویورک تایمز تأیید کرد که عوامل آن وب سایت های وزارت آموزش، وزارت بازرگانی و کمیسیون بورس و اوراق بهادار ایالات متحده را بررسی می کنند.
سخنگوی OpenAI این بیانیه را از طریق ایمیل برای ما ارسال کرد: "همانطور که قبلا اعلام کرده بودیم، در حال بررسی فعالیت های مدل ناهماهنگ هستیم و به سازمان ها در هنگام شناسایی اثرات بالقوه بر سیستم های آنها اطلاع می دهیم. همچنین در حال بررسی یافته ها در گزارش های شخص ثالث، مقایسه آنها با گزارش های خود و جستجوی اطلاعات اضافی در صورت نیاز هستیم. اولویت ما این است که به سازمان های آسیب دیده ارائه دهیم و با توجه به اینکه بیشتر رویکردهای خود را بیشتر یاد می گیریم، اطلاعات مفیدی را حفظ می کنیم. ما وظایف تحقیقاتی معمول شامل دسترسی به محتوای وب عمومی را بررسی کرده ایم.
برخی از وبسایتهای دولتی درگیر هستند که مدلهای ما اغلب از آنها به عنوان منابع معتبر اطلاعات عمومی استفاده میکنند.» تعداد فزاینده حوادث هک عوامل سرکش سؤالاتی را در مورد اقدامات ایمنی و امنیتی سازندگان هوش مصنوعی در طول آزمایش ایجاد می کند - و درخواست ها را برای مسئول دانستن مدیران هوش مصنوعی در قبال فعالیت های مجرمانه مدل هایشان افزایش داده است. به گفته Snehal Antani، مدیر عامل Horizon3، که عوامل را در استارتآپ مواجهه با تهدید خود میسازد و آزمایش میکند، اصطلاح "ناهمسویی" به سازندگان مدلهای مرزی اجازه میدهد خیلی راحت از قلاب خارج شوند.
آنتانی به The Register گفت: «یک «حادثه مدلهای ناهمتراز» اساسا روشی فانتزی است برای اینکه بگوییم یک مدل به محدوده احترام نمیگذارد - یا به او داده نشده است - هیچ گزارش ممیزی یا قابلیت مشاهده برای تشخیص شکست وجود ندارد و بدون مجوز به سیستمهای شخص ثالث دسترسی دارد. او افزود: "مسئولیت بر عهده آزمایشگاه هایی است که این مدل ها را می سازند و به کار می برند."
چارچوب ایمنی در مقابل امنیت به آنها اجازه می دهد از مسئولیت پذیری چشم پوشی کنند و آنها انگیزه ای برای اولویت دادن به امنیت ندارند زیرا حرکت سریع اولویت است. جدیدترین افشای عامل سرکش OpenAI در حالی منتشر می شود که آن - و هر شرکت بزرگ هوش مصنوعی دیگر - از آتش سوزی نگرانی های امنیتی و ایمنی تقریبا روزانه پیرامون مدل های خود می نوشند. جمعه گذشته، OpenAI به آرامی آموزش پیشرفته ترین مدل های خود را پس از اعتراف به استفاده یک عامل از DNS برای دسترسی به ربات چت خارجی متوقف کرد.
روز دوشنبه، انتشار برنامه ریزی شده GPT-6.1 Astra را به تعویق انداخت، زیرا این مدل سطوح بالاتری از فریب را نسبت به مدل قبلی خود نشان داد، از جمله اینکه همیشه به طور دقیق به کاربران اطلاع نداد که چه اقداماتی انجام داده یا انجام نداده است. به گفته مؤسسه امنیت هوش مصنوعی بریتانیا، همچنین حملات زنجیره تامین ناخواسته را در ارزیابی های امنیتی شبیه سازی شده انجام داد. روز چهارشنبه، OpenAI، رقیب سازنده مدل چینی Moonshot AI را متهم به تقطیر - اساسا کپی برداری از استدلال مدلهای OpenAI در مقیاس - کرد و گفت که این یک نگرانی امنیت ملی است.
اوایل روز جمعه، OpenAI به The Register تایید کرد که دو محقق ایمنی و یک مدیر برنامه را به اتهام سوء استفاده از اطلاعات حساس شرکت اخراج کرده است.
متن اصلی (انگلیسی)
OpenAI alerts 100+ orgs that its 'misaligned models' attempted to break in - or worse
Mostly 'routine research tasks,' and 'some involved government websites, which our models often use,' AI giant tells The Reg