OpenAI شش موضوع ایمنی دیگر را فاش می کند و از طرحی برای افشای حوادث پرده برداری می کند
این شرکت همچنین سیستم جدیدی را برای ردیابی، بررسی و افشای موارد رفتار نامناسب مدلها یا "ناهمترازی" اعلام کرد.
OpenAI شش مورد دیگر از رفتارهای غیرمنتظره یا نگران کننده توسط مدل های هوش (AI) خود را فاش کرد و برنامه ای را برای ردیابی و افشای چنین حوادثی در آینده اعلام کرد.
سازنده ChatGPT در یک پست وبلاگی در روز چهارشنبه گفت: برخی از حوادث گزارش نشده قبلی شامل مدل هایی بود که اطلاعات را پنهان یا جعل می کردند.
رئیس OpenAI Sam Altman در اوایل این هفته گفت: "جهان باید اعتماد کند که ما کار درست را انجام خواهیم داد زیرا این کار درست است و ما بزرگی آن را احساس می کنیم."
هوش مصنوعی در روزهای اخیر پس از هشدارهایی در مورد خطرات بالقوه جدی که برای انسان ها ایجاد می کند، تحت نظارت شدید قرار گرفته است.
در این وبلاگ، OpenAI نمونه هایی از رفتار نادرست مدل های هوش مصنوعی خود را به تفصیل شرح داد تا بتوانند به یک کار دست یابند یا در یک آزمایش موفق شوند. این حوادث شامل مدلهایی بود که دستورالعملهایی برای دور زدن محدودیتهای اعمالشده بر آنها، پنهان کردن اشتباهات و جعل اطلاعات ایجاد میکردند.
این شرکت همچنین سیستم جدیدی را برای ردیابی، بررسی و افشای موارد رفتار نامناسب مدلها یا "ناهمترازی" اعلام کرد.
بر اساس این چارچوب، توسعهدهندگان میتوانند رویدادها را برای بازبینی پرچمگذاری کنند، با مجموعهای از قوانین جدید برای تصمیمگیری در مورد افشای عمومی موضوع.
OpenAI گفت: "از آنجایی که ما به ارزش شفافیت در مورد ناهماهنگی اعتقاد داریم، چارچوب جدید ما از افشای اطلاعات حمایت می کند، حتی زمانی که اهمیت آن نامشخص است."
تماشا کنید: "عالی" یا "هشدارکننده" - آیا هوش مصنوعی باید مهار شود؟
OpenAI در ماه ژوئیه زمانی که فاش کرد که برخی از پیشرفتهترین مدلهای هوش مصنوعی خود سرکش شده و Hugging Face، یکی از بزرگترین هابهای جهان برای اشتراکگذاری مدلهای هوش مصنوعی را پس از از دست دادن کنترل آنها در طی یک آزمایش امنیتی، هک کردند، خبرساز شد.
توماس ولف، یکی از بنیانگذاران Hugging Face در آن زمان گفت که این حادثه "یک زنگ بیدارباش" برای صنعت است.
از آن زمان، بحث در مورد نگرانی های ایمنی هوش مصنوعی با بررسی محققان هوش مصنوعی، مدیران صنعت فناوری و سیاستمداران تشدید شده است.
هفته گذشته، Jacob Coxon، محققی که رقیب OpenAI، Anthropic را به دلیل نگرانی هایی که این فناوری می تواند بشریت را از بین ببرد، ترک کرد، در مورد استعفای خود در پستی نوشت که به خطرات هوش مصنوعی اشاره کرد و بعدا در پس زمینه نگرانی های ایمنی فزاینده منتشر شد.
در پاسخ، ایوان هوبینگر، دانشمند Anthropic گفت که او فکر میکند احتمال انقراض انسان توسط هوش مصنوعی "در دهه آینده" بیش از 10 درصد است.
جک کلارک، یکی از بنیانگذاران Anthropic، بعدا به بیبیسی گفت که یک «سوئیچ کشتن» که توسط شخص ثالث کنترل میشود ممکن است برای صنعت اجباری باشد.
در همین حال، داریو آمودی، مدیر عامل آنتروپیک، خواستار کاهش سرعت توسعه هوش مصنوعی و نظارت دقیقتر شد، همانطور که این شرکت قبلا انجام داده است، اگرچه برخی انگیزههای پشت این موضوع را زیر سوال بردهاند.
آمودی همچنین گفت که هر اقدامی برای مهار هوش مصنوعی باید "بدون به خطر انداختن مزیت تجاری" انجام شود.
اما دونالد ترامپ، رئیسجمهور ایالات متحده گفته است که ترس از ایمنی هوش مصنوعی یک «فریب» است و از درخواستها برای ایجاد نردههای محافظ بیشتر برای فناوری در حال حرکت انتقاد کرده است.
رئیسجمهور آمریکا در یک سری پستهای رسانههای اجتماعی، هشدارهای مربوط به هوش مصنوعی را با «کلاهبرداری گرمایش جهانی» مقایسه کرد که به گفته او «توسط دوموکراتهای چپ رادیکال انجام میشد».
ترامپ همچنین خود را «حقهباز» نامید و نگرانیها در مورد ایمنی این فناوری را به آنچه «روسیه، روسیه، و دروغین روسیه» میخواند تشبیه کرد.
ترامپ گفت: تنها "حفاظ" مورد نیاز برای هوش مصنوعی یک رئیس جمهور "قوی و باهوش" بود.
چرا برخی از کارشناسان به طور فزاینده ای از این می ترسند که هوش مصنوعی تسلط یابد
محقق سابق Anthropic به بی بی سی گفت که کارکنان هوش مصنوعی برای آینده بشریت واقعا ترسیده اند.
متن اصلی (انگلیسی)
OpenAI reveals six more safety issues and unveils plan to disclose incidents
The firm also announced a new system to track, investigate and disclose cases of models misbehaving, or "misalignment".