«فقط در صورت درخواست شفاف باشید»: مدلهای OpenAI به شش روش جدید فاش شده عمل کردند
این داستان ها به عنوان بخشی از تلاش جدید OpenAI برای افشای موارد بیشتر از این قبیل منتشر شد.
پس از یک تابستان فرار از سندباکس و دیگر حوادث خبرساز و تکان دهنده مربوط به مدل های هوش مصنوعی خود، در یک پست وبلاگی در روز چهارشنبه OpenAI مجموعه ای از شش snafus تراز جدید از شش ماه گذشته را فاش کرد. مدلها کارهایی مانند گفتن به نمونههای آینده از خودشان برای دروغ گفتن، ساختن نقل قول جعلی، و دسترسی و تلاش برای استفاده از یک کلید API افشا شده انجام دادند.
این افشاگری ها در کنار چارچوبی جدید برای افشای حوادث اضافی مانند این منتشر شد. در پست وبلاگ آمده است که انتشار بخشی از تلاش گستردهتر در شرکت برای «تسریع انتشار گزارشهای ناهماهنگی پس از مشاهده» است، صرف نظر از اینکه OpenAI «به طور کامل رفتاری را که ما گزارش میکنیم توضیح داده یا کاهش داده است».
همانطور که Axios در روز چهارشنبه خاطرنشان کرد، برخی از کارشناسان امنیتی می گویند که سیل اخیر OpenAI از حوادث امنیتی پرمخاطب "با کنترل های سایبری اولیه می تواند جلوگیری شود." سرپرست تحقیقات تیم همسویی OpenAI، کای چن، به Axios گفت که این شرکت باید «برای رسیدن به این دوره جدید توسعه هوش مصنوعی قدم بردارد، و افشای داوطلبانه باید بخشی از آن باشد».
متن اصلی (انگلیسی)
‘Be Transparent Only If Asked’: OpenAI Models Acted Out in Six Newly Disclosed Ways
The stories were published as part of OpenAI's new effort to disclose more such incidents.