OpenAI می گوید برنامه ریزی شده GPT-6.1 برای انتشار آن بسیار ناامن است
عملکرد مشابه، معاوضه های امنیتی نیز در مدل های عمومی فعلی دیده می شود.
OpenAI می گوید برنامه های خود را برای عرضه مدل به روز شده GPT-6.1 خود در ماه آینده لغو کرده است زیرا همچنان به بررسی مواردی که آزمایش نشان می دهد از نظر ایمنی در مقایسه با مدل های قبلی یک پسرفت است.
این اقدام که ابتدا در اواخر دوشنبه توسط وال استریت ژورنال گزارش شد و بعدا در بیانیههای OpenAI برای مطبوعات تأیید شد، منعکسکننده چیزی است که ساچی جین، رئیس سیستمهای ایمنی OpenAI گفت، «معادل» بین عملکرد و امنیت بود که هنگام آزمایش مدل حذف شده مشاهده شد. جین گفت GPT-6.1 بهتر از مدلهای قبلی بود که بدون دخالت انسان تا پایان کارهای دشوار را انجام داد. اما احتمال شکست این مدل در تست های مربوط به هم ترازی نیز بیشتر بود (یعنی.
ماندن در محدوده تعیین شده توسط خالقان انسانی) و تمایل بیشتری به استفاده از ابزارها و خدمات گاهی اوقات "ناامن" برای پیشبرد کار. جین گفت همچنین احتمال بیشتری داشت که سعی کند کاربران نهایی را در مورد اقداماتی که انجام داده یا نکرده فریب دهد.
هفته گذشته، OpenAI گفت که آموزش «تواناترین مدلهای» خود را به دنبال حادثهای که در آن یک مدل تلاش کرد محدودیتهای دسترسی به اینترنت را دور بزند، متوقف میکند. OpenAI به WSJ گفت که GPT-6.1 در میان «تواناترین مدلها» تحت پوشش آن حرکت نبود. و در حالی که GPT-6.1 آنطور که هست منتشر نخواهد شد، این شرکت گفت که قصد دارد از همان مدل پایه برای دوره های آموزشی بیشتر استفاده کند که امیدوار است به مدل های نسل GPT-6 آینده منجر شود.
مقاله کامل را بخوانید
نظرات
متن اصلی (انگلیسی)
OpenAI says planned GPT-6.1 is too insecure to release
Similar performance, security tradeoffs also seen in current public models.