پرش به محتوای اصلی

OpenAI انتشار GPT-6.1 Astra را لغو کرد زیرا از نظر ایمنی "پسرفت" داشت

گیزمودو۱۴۰۵ مهر ۷, سه‌شنبه، ساعت ۰۳:۳۸حدود 3 دقیقه مطالعه

به نظر نمی رسد که به یک هکر شیطانی تبدیل شده است. اکثرا فقط خراب شده

بر اساس گزارش وال استریت ژورنال، GPT-6.1 Astra OpenAI برای عرضه در ماه اکتبر در نظر گرفته شده بود، اما این برنامه لغو شده است. گزارش WSJ حداقل بخشی از مصاحبه با ساچی جین، رئیس سیستم‌های ایمنی OpenAI است.

مدلی که ظاهرا در مبارزه با تنبلی مدل بهبود یافته بود (به قول WSJ) "در دو زمینه پسرفت کرد." آن مناطق فریب و عدم دریافت مجوز بودند.

مهمتر از همه، به نظر نمی رسد که این مدل نوعی گرایش جدید در حال ظهور برای "سرکشی کردن" داشته باشد. فریبکاری و عدم کسب اجازه مطمئنا می‌تواند از نظر تئوری ویران شود، اما WSJ فریبکاری و تجاوز به آن را به شرح زیر توصیف می‌کند:

همیشه صادقانه نبود که به کاربران درباره اقداماتی که انجام داده یا انجام نداده بگوید.»

"GPT-6.1 Astra بدون درخواست اجازه از کاربر، کار را پیش می برد و گاهی اوقات به ابزارها و خدمات خارجی دسترسی پیدا می کند حتی اگر ممکن است ناامن باشد."

پلتفرم‌های هوش مصنوعی عاملی که از توکن‌های OpenAI و دیگر توسعه‌دهندگان مدل مرزی تغذیه می‌شوند، از این مدل‌ها برای کار با رایانه‌ها و عمل به نمایندگی از صاحبان آن سیستم‌ها استفاده می‌کنند. این مشکلات ایمنی به طور بالقوه برای کاربران چنین پلتفرم‌هایی فاجعه‌بار به نظر می‌رسند، که به انجام کارهایی مانند حذف کل صندوق ورودی یک محقق متا هوش مصنوعی بدون اجازه شناخته شده‌اند.

در عین حال، ما در لحظه‌ای هستیم که در آن عموم مردم به طور فزاینده‌ای در معرض داستان‌هایی درباره مدل‌های منتشر نشده «سرکش» و فرار از «جعبه‌های شن» خود هستند. در خلال آزمایش‌های امسال، مدل‌ها به‌شدت از مرزها فراتر رفته‌اند و تلاش کرده‌اند یا حتی در آن به موفقیت‌هایی دست یافته‌اند که اطلاعات را از مکان‌های آنلاینی که گمان می‌رود محدودیت‌های آن‌ها وجود ندارد، خارج کنند، و برخی از آنها به روش‌های فریبنده با انسان‌های ناآگاه تعامل داشتند.

این‌ها هک‌های واقعی و حوادث مهندسی اجتماعی هستند، و شوخی نیستند، اما به نظر می‌رسد این داستان‌ها منجر به افزایش بحث در مورد «هوش فوق‌العاده» شده است (همانطور که اصرار ناگهانی رئیس‌جمهور بر استفاده از آن عبارت نشان می‌دهد)، و همچنین اشاره‌هایی به این موضوع دارد که عموم مردم به طور فزاینده نگران هستند که سیستم‌های هوش مصنوعی ممکن است حساس باشند.

مصطفی سلیمان، رئیس هوش مصنوعی مایکروسافت، نسبت به ایده هایی که در مورد هوش مصنوعی بخشی از آموزش یک مدل است، ابراز نگرانی کرد. "به راحتی می توان دید که چگونه سیستمی که به این روش آموزش دیده عمل می کند که انگار از آزادی ها، حمایت ها و حقوق برخوردار است. و تصور اینکه چگونه می توانیم آن را کنترل کنیم دشوار است."

در مقابل، نسخه مدل OpenAI که به تازگی حذف شده است، به نظر نمی رسد که سازندگان فکر می کنند مدل در خطر عمل کردن مانند یک ابر هکر یا یک خدای کامپیوتر خودآگاه است.

جین به WSJ گفت: "برای هر چیزی که در مورد ایمنی و همسویی باشد، یک معامله وجود دارد."

به عبارت دیگر، این یک محصول معیوب بود، بنابراین OpenAI، به اعتبار خود، آن را ارسال نکرد.

خواندن متن کامل در گیزمودوبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI Cancels Release of GPT-6.1 Astra Because It ‘Regressed’ on Safety

It doesn’t sound like it morphed into a diabolical hacker. It mostly just screwed up.

همه‌ی اخبار فناوری