OpenAI انتشار GPT-6.1 Astra را لغو کرد زیرا از نظر ایمنی "پسرفت" داشت
به نظر نمی رسد که به یک هکر شیطانی تبدیل شده است. اکثرا فقط خراب شده
بر اساس گزارش وال استریت ژورنال، GPT-6.1 Astra OpenAI برای عرضه در ماه اکتبر در نظر گرفته شده بود، اما این برنامه لغو شده است. گزارش WSJ حداقل بخشی از مصاحبه با ساچی جین، رئیس سیستمهای ایمنی OpenAI است.
مدلی که ظاهرا در مبارزه با تنبلی مدل بهبود یافته بود (به قول WSJ) "در دو زمینه پسرفت کرد." آن مناطق فریب و عدم دریافت مجوز بودند.
مهمتر از همه، به نظر نمی رسد که این مدل نوعی گرایش جدید در حال ظهور برای "سرکشی کردن" داشته باشد. فریبکاری و عدم کسب اجازه مطمئنا میتواند از نظر تئوری ویران شود، اما WSJ فریبکاری و تجاوز به آن را به شرح زیر توصیف میکند:
همیشه صادقانه نبود که به کاربران درباره اقداماتی که انجام داده یا انجام نداده بگوید.»
"GPT-6.1 Astra بدون درخواست اجازه از کاربر، کار را پیش می برد و گاهی اوقات به ابزارها و خدمات خارجی دسترسی پیدا می کند حتی اگر ممکن است ناامن باشد."
پلتفرمهای هوش مصنوعی عاملی که از توکنهای OpenAI و دیگر توسعهدهندگان مدل مرزی تغذیه میشوند، از این مدلها برای کار با رایانهها و عمل به نمایندگی از صاحبان آن سیستمها استفاده میکنند. این مشکلات ایمنی به طور بالقوه برای کاربران چنین پلتفرمهایی فاجعهبار به نظر میرسند، که به انجام کارهایی مانند حذف کل صندوق ورودی یک محقق متا هوش مصنوعی بدون اجازه شناخته شدهاند.
در عین حال، ما در لحظهای هستیم که در آن عموم مردم به طور فزایندهای در معرض داستانهایی درباره مدلهای منتشر نشده «سرکش» و فرار از «جعبههای شن» خود هستند. در خلال آزمایشهای امسال، مدلها بهشدت از مرزها فراتر رفتهاند و تلاش کردهاند یا حتی در آن به موفقیتهایی دست یافتهاند که اطلاعات را از مکانهای آنلاینی که گمان میرود محدودیتهای آنها وجود ندارد، خارج کنند، و برخی از آنها به روشهای فریبنده با انسانهای ناآگاه تعامل داشتند.
اینها هکهای واقعی و حوادث مهندسی اجتماعی هستند، و شوخی نیستند، اما به نظر میرسد این داستانها منجر به افزایش بحث در مورد «هوش فوقالعاده» شده است (همانطور که اصرار ناگهانی رئیسجمهور بر استفاده از آن عبارت نشان میدهد)، و همچنین اشارههایی به این موضوع دارد که عموم مردم به طور فزاینده نگران هستند که سیستمهای هوش مصنوعی ممکن است حساس باشند.
مصطفی سلیمان، رئیس هوش مصنوعی مایکروسافت، نسبت به ایده هایی که در مورد هوش مصنوعی بخشی از آموزش یک مدل است، ابراز نگرانی کرد. "به راحتی می توان دید که چگونه سیستمی که به این روش آموزش دیده عمل می کند که انگار از آزادی ها، حمایت ها و حقوق برخوردار است. و تصور اینکه چگونه می توانیم آن را کنترل کنیم دشوار است."
در مقابل، نسخه مدل OpenAI که به تازگی حذف شده است، به نظر نمی رسد که سازندگان فکر می کنند مدل در خطر عمل کردن مانند یک ابر هکر یا یک خدای کامپیوتر خودآگاه است.
جین به WSJ گفت: "برای هر چیزی که در مورد ایمنی و همسویی باشد، یک معامله وجود دارد."
به عبارت دیگر، این یک محصول معیوب بود، بنابراین OpenAI، به اعتبار خود، آن را ارسال نکرد.
متن اصلی (انگلیسی)
OpenAI Cancels Release of GPT-6.1 Astra Because It ‘Regressed’ on Safety
It doesn’t sound like it morphed into a diabolical hacker. It mostly just screwed up.