پرش به محتوای اصلی

OpenAI شش موضوع ایمنی دیگر را فاش می کند و از طرحی برای افشای حوادث پرده برداری می کند

بی‌بی‌سی اقتصاد۱۴۰۵ شهریور ۲۶, پنجشنبه، ساعت ۰۶:۳۹حدود 3 دقیقه مطالعه

این شرکت همچنین سیستم جدیدی را برای ردیابی، بررسی و افشای موارد رفتار نامناسب مدل‌ها یا "ناهمترازی" اعلام کرد.

OpenAI شش مورد دیگر از رفتارهای غیرمنتظره یا نگران کننده توسط مدل های هوش (AI) خود را فاش کرد و برنامه ای را برای ردیابی و افشای چنین حوادثی در آینده اعلام کرد.

سازنده ChatGPT در یک پست وبلاگی در روز چهارشنبه گفت: برخی از حوادث گزارش نشده قبلی شامل مدل هایی بود که اطلاعات را پنهان یا جعل می کردند.

رئیس OpenAI Sam Altman در اوایل این هفته گفت: "جهان باید اعتماد کند که ما کار درست را انجام خواهیم داد زیرا این کار درست است و ما بزرگی آن را احساس می کنیم."

هوش مصنوعی در روزهای اخیر پس از هشدارهایی در مورد خطرات بالقوه جدی که برای انسان ها ایجاد می کند، تحت نظارت شدید قرار گرفته است.

در این وبلاگ، OpenAI نمونه هایی از رفتار نادرست مدل های هوش مصنوعی خود را به تفصیل شرح داد تا بتوانند به یک کار دست یابند یا در یک آزمایش موفق شوند. این حوادث شامل مدل‌هایی بود که دستورالعمل‌هایی برای دور زدن محدودیت‌های اعمال‌شده بر آن‌ها، پنهان کردن اشتباهات و جعل اطلاعات ایجاد می‌کردند.

این شرکت همچنین سیستم جدیدی را برای ردیابی، بررسی و افشای موارد رفتار نامناسب مدل‌ها یا "ناهمترازی" اعلام کرد.

بر اساس این چارچوب، توسعه‌دهندگان می‌توانند رویدادها را برای بازبینی پرچم‌گذاری کنند، با مجموعه‌ای از قوانین جدید برای تصمیم‌گیری در مورد افشای عمومی موضوع.

OpenAI گفت: "از آنجایی که ما به ارزش شفافیت در مورد ناهماهنگی اعتقاد داریم، چارچوب جدید ما از افشای اطلاعات حمایت می کند، حتی زمانی که اهمیت آن نامشخص است."

تماشا کنید: "عالی" یا "هشدارکننده" - آیا هوش مصنوعی باید مهار شود؟

OpenAI در ماه ژوئیه زمانی که فاش کرد که برخی از پیشرفته‌ترین مدل‌های هوش مصنوعی خود سرکش شده و Hugging Face، یکی از بزرگ‌ترین هاب‌های جهان برای اشتراک‌گذاری مدل‌های هوش مصنوعی را پس از از دست دادن کنترل آن‌ها در طی یک آزمایش امنیتی، هک کردند، خبرساز شد.

توماس ولف، یکی از بنیانگذاران Hugging Face در آن زمان گفت که این حادثه "یک زنگ بیدارباش" برای صنعت است.

از آن زمان، بحث در مورد نگرانی های ایمنی هوش مصنوعی با بررسی محققان هوش مصنوعی، مدیران صنعت فناوری و سیاستمداران تشدید شده است.

هفته گذشته، Jacob Coxon، محققی که رقیب OpenAI، Anthropic را به دلیل نگرانی هایی که این فناوری می تواند بشریت را از بین ببرد، ترک کرد، در مورد استعفای خود در پستی نوشت که به خطرات هوش مصنوعی اشاره کرد و بعدا در پس زمینه نگرانی های ایمنی فزاینده منتشر شد.

در پاسخ، ایوان هوبینگر، دانشمند Anthropic گفت که او فکر می‌کند احتمال انقراض انسان توسط هوش مصنوعی "در دهه آینده" بیش از 10 درصد است.

جک کلارک، یکی از بنیانگذاران Anthropic، بعدا به بی‌بی‌سی گفت که یک «سوئیچ کشتن» که توسط شخص ثالث کنترل می‌شود ممکن است برای صنعت اجباری باشد.

در همین حال، داریو آمودی، مدیر عامل آنتروپیک، خواستار کاهش سرعت توسعه هوش مصنوعی و نظارت دقیق‌تر شد، همانطور که این شرکت قبلا انجام داده است، اگرچه برخی انگیزه‌های پشت این موضوع را زیر سوال برده‌اند.

آمودی همچنین گفت که هر اقدامی برای مهار هوش مصنوعی باید "بدون به خطر انداختن مزیت تجاری" انجام شود.

اما دونالد ترامپ، رئیس‌جمهور ایالات متحده گفته است که ترس از ایمنی هوش مصنوعی یک «فریب» است و از درخواست‌ها برای ایجاد نرده‌های محافظ بیشتر برای فناوری در حال حرکت انتقاد کرده است.

رئیس‌جمهور آمریکا در یک سری پست‌های رسانه‌های اجتماعی، هشدارهای مربوط به هوش مصنوعی را با «کلاهبرداری گرمایش جهانی» مقایسه کرد که به گفته او «توسط دوموکرات‌های چپ رادیکال انجام می‌شد».

ترامپ همچنین خود را «حقه‌باز» نامید و نگرانی‌ها در مورد ایمنی این فناوری را به آنچه «روسیه، روسیه، و دروغین روسیه» می‌خواند تشبیه کرد.

ترامپ گفت: تنها "حفاظ" مورد نیاز برای هوش مصنوعی یک رئیس جمهور "قوی و باهوش" بود.

چرا برخی از کارشناسان به طور فزاینده ای از این می ترسند که هوش مصنوعی تسلط یابد

محقق سابق Anthropic به بی بی سی گفت که کارکنان هوش مصنوعی برای آینده بشریت واقعا ترسیده اند.

خواندن متن کامل در بی‌بی‌سی اقتصادبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI reveals six more safety issues and unveils plan to disclose incidents

The firm also announced a new system to track, investigate and disclose cases of models misbehaving, or "misalignment".

همه‌ی اخبار فناوری