پرش به محتوای اصلی

«فقط در صورت درخواست شفاف باشید»: مدل‌های OpenAI به شش روش جدید فاش شده عمل کردند

گیزمودو۱۴۰۵ شهریور ۲۶, پنجشنبه، ساعت ۰۵:۱۲حدود 1 دقیقه مطالعه

این داستان ها به عنوان بخشی از تلاش جدید OpenAI برای افشای موارد بیشتر از این قبیل منتشر شد.

پس از یک تابستان فرار از سندباکس و دیگر حوادث خبرساز و تکان دهنده مربوط به مدل های هوش مصنوعی خود، در یک پست وبلاگی در روز چهارشنبه OpenAI مجموعه ای از شش snafus تراز جدید از شش ماه گذشته را فاش کرد. مدل‌ها کارهایی مانند گفتن به نمونه‌های آینده از خودشان برای دروغ گفتن، ساختن نقل قول جعلی، و دسترسی و تلاش برای استفاده از یک کلید API افشا شده انجام دادند.

این افشاگری ها در کنار چارچوبی جدید برای افشای حوادث اضافی مانند این منتشر شد. در پست وبلاگ آمده است که انتشار بخشی از تلاش گسترده‌تر در شرکت برای «تسریع انتشار گزارش‌های ناهماهنگی پس از مشاهده» است، صرف نظر از اینکه OpenAI «به طور کامل رفتاری را که ما گزارش می‌کنیم توضیح داده یا کاهش داده است».

همانطور که Axios در روز چهارشنبه خاطرنشان کرد، برخی از کارشناسان امنیتی می گویند که سیل اخیر OpenAI از حوادث امنیتی پرمخاطب "با کنترل های سایبری اولیه می تواند جلوگیری شود." سرپرست تحقیقات تیم همسویی OpenAI، کای چن، به Axios گفت که این شرکت باید «برای رسیدن به این دوره جدید توسعه هوش مصنوعی قدم بردارد، و افشای داوطلبانه باید بخشی از آن باشد».

خواندن متن کامل در گیزمودوبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

‘Be Transparent Only If Asked’: OpenAI Models Acted Out in Six Newly Disclosed Ways

The stories were published as part of OpenAI's new effort to disclose more such incidents.

همه‌ی اخبار فناوری