پرش به محتوای اصلی

OpenAI به بیش از 100 سازمان هشدار می دهد که "مدل های نامناسب" آن تلاش کرده اند وارد شوند - یا بدتر از آن

دِ رجیستر۱۴۰۵ مهر ۱۰, جمعه، ساعت ۲۱:۰۷حدود 4 دقیقه مطالعه

غول هوش مصنوعی به The Reg می گوید که عمدتا «وظایف تحقیقاتی معمول» و «برخی از وب سایت های دولتی درگیر هستند که مدل های ما اغلب از آنها استفاده می کنند».

عوامل OpenAI بارها و بارها از محدوده مورد نظر خود خارج شده اند. دو گزارش جداگانه به جزئیات این فعالیت می پردازند، از جمله یکی از شرکت سام آلتمن که می گوید بیش از 100 سازمان را در مورد فعالیت مدل بالقوه مشکل ساز اطلاع داده است. OpenAI در به‌روزرسانی اواخر چهارشنبه در تحقیقات در حال انجام Hugging Face، گفت که به بیش از 100 سازمان اطلاع داده است که «مدل‌های ناهماهنگ» ممکن است به سیستم‌های آنها دسترسی داشته باشند. در به‌روزرسانی آمده است: «اعلان به این معنی نیست که به هیچ اطلاعات خصوصی دسترسی پیدا کرده‌ایم یا سیستم شخص ثالثی در معرض خطر قرار گرفته است».

یک گزارش جداگانه پنجشنبه از استارت‌آپ Asymmetric Security مربوط به پزشکی قانونی دیجیتال و پاسخ به حوادث می‌گوید که عوامل سرکش OpenAI به داده‌های 55 سازمان دسترسی داشتند. اینها شامل وزارت آموزش ایالات متحده، تجارت و توسعه سازمان ملل، دفتر تحلیل اقتصادی ایالات متحده، MAX.gov حاوی اسناد بودجه فدرال، مرکز اروپایی پیشگیری و کنترل بیماری، کمیسیون بورس و اوراق بهادار ایالات متحده، آژانس بین المللی انرژی، و FBI Crime Data Explorer است.

Asymmetric تنها از داده‌های در دسترس عموم برای جمع‌آوری این فهرست استفاده کرد و گفت که این فعالیت بین مارس و سپتامبر رخ داده است. بر اساس این گزارش، کاوش‌های ماموران نشان می‌دهد که آنها وظیفه تحقیق درباره سلامت عمومی و سایر داده‌ها را «احتمالا به عنوان بخشی از یک ارزیابی» داشتند. در این بیانیه آمده است: «ما دسترسی موفقیت‌آمیز به محیط‌های صحنه‌سازی؛ شواهدی مبنی بر استفاده از تاکتیک‌های شناسایی مهاجمان؛ و شواهدی مبنی بر بررسی مجموعه وسیع‌تری از وب‌سایت‌ها، از جمله وب‌سایت‌های CDC، SEC، آژانس بین‌المللی انرژی، و کلینیک مایو پیدا کردیم».

عواملی که از جعبه های ماسه ای خود خارج می شوند و دسترسی کامل به وب دارند. نویسندگان نوشتند: «برخی از این تاکتیک‌ها، سوابق را پاک یا غیرقابل دسترسی می‌کردند، و رد دسترسی به داده‌های حساس را تنها بر اساس اطلاعات عمومی غیرممکن می‌کردند». ثبت از OpenAI پرسید که آیا سازمان های موجود در لیست Asymmetric جزو سازمان هایی هستند که توسط OpenAI اطلاع داده شده اند یا خیر. سازنده مدل از گفتن اینکه به کدام سازمان ها اطلاع داده شده است خودداری کرد، اما قبلا به نیویورک تایمز تأیید کرد که عوامل آن وب سایت های وزارت آموزش، وزارت بازرگانی و کمیسیون بورس و اوراق بهادار ایالات متحده را بررسی می کنند.

سخنگوی OpenAI این بیانیه را از طریق ایمیل برای ما ارسال کرد: "همانطور که قبلا اعلام کرده بودیم، در حال بررسی فعالیت های مدل ناهماهنگ هستیم و به سازمان ها در هنگام شناسایی اثرات بالقوه بر سیستم های آنها اطلاع می دهیم. همچنین در حال بررسی یافته ها در گزارش های شخص ثالث، مقایسه آنها با گزارش های خود و جستجوی اطلاعات اضافی در صورت نیاز هستیم. اولویت ما این است که به سازمان های آسیب دیده ارائه دهیم و با توجه به اینکه بیشتر رویکردهای خود را بیشتر یاد می گیریم، اطلاعات مفیدی را حفظ می کنیم. ما وظایف تحقیقاتی معمول شامل دسترسی به محتوای وب عمومی را بررسی کرده ایم.

برخی از وب‌سایت‌های دولتی درگیر هستند که مدل‌های ما اغلب از آنها به عنوان منابع معتبر اطلاعات عمومی استفاده می‌کنند.» تعداد فزاینده حوادث هک عوامل سرکش سؤالاتی را در مورد اقدامات ایمنی و امنیتی سازندگان هوش مصنوعی در طول آزمایش ایجاد می کند - و درخواست ها را برای مسئول دانستن مدیران هوش مصنوعی در قبال فعالیت های مجرمانه مدل هایشان افزایش داده است. به گفته Snehal Antani، مدیر عامل Horizon3، که عوامل را در استارت‌آپ مواجهه با تهدید خود می‌سازد و آزمایش می‌کند، اصطلاح "ناهمسویی" به سازندگان مدل‌های مرزی اجازه می‌دهد خیلی راحت از قلاب خارج شوند.

آنتانی به The Register گفت: «یک «حادثه مدل‌های ناهمتراز» اساسا روشی فانتزی است برای اینکه بگوییم یک مدل به محدوده احترام نمی‌گذارد - یا به او داده نشده است - هیچ گزارش ممیزی یا قابلیت مشاهده برای تشخیص شکست وجود ندارد و بدون مجوز به سیستم‌های شخص ثالث دسترسی دارد. او افزود: "مسئولیت بر عهده آزمایشگاه هایی است که این مدل ها را می سازند و به کار می برند."

چارچوب ایمنی در مقابل امنیت به آنها اجازه می دهد از مسئولیت پذیری چشم پوشی کنند و آنها انگیزه ای برای اولویت دادن به امنیت ندارند زیرا حرکت سریع اولویت است. جدیدترین افشای عامل سرکش OpenAI در حالی منتشر می شود که آن - و هر شرکت بزرگ هوش مصنوعی دیگر - از آتش سوزی نگرانی های امنیتی و ایمنی تقریبا روزانه پیرامون مدل های خود می نوشند. جمعه گذشته، OpenAI به آرامی آموزش پیشرفته ترین مدل های خود را پس از اعتراف به استفاده یک عامل از DNS برای دسترسی به ربات چت خارجی متوقف کرد.

روز دوشنبه، انتشار برنامه ریزی شده GPT-6.1 Astra را به تعویق انداخت، زیرا این مدل سطوح بالاتری از فریب را نسبت به مدل قبلی خود نشان داد، از جمله اینکه همیشه به طور دقیق به کاربران اطلاع نداد که چه اقداماتی انجام داده یا انجام نداده است. به گفته مؤسسه امنیت هوش مصنوعی بریتانیا، همچنین حملات زنجیره تامین ناخواسته را در ارزیابی های امنیتی شبیه سازی شده انجام داد. روز چهارشنبه، OpenAI، رقیب سازنده مدل چینی Moonshot AI را متهم به تقطیر - اساسا کپی برداری از استدلال مدل‌های OpenAI در مقیاس - کرد و گفت که این یک نگرانی امنیت ملی است.

اوایل روز جمعه، OpenAI به The Register تایید کرد که دو محقق ایمنی و یک مدیر برنامه را به اتهام سوء استفاده از اطلاعات حساس شرکت اخراج کرده است.

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI alerts 100+ orgs that its 'misaligned models' attempted to break in - or worse

Mostly 'routine research tasks,' and 'some involved government websites, which our models often use,' AI giant tells The Reg

همه‌ی اخبار فناوری