OpenAI مواردی از رفتار هوش مصنوعی "مرتبط" را نشان می دهد و برنامه جدیدی را برای افشای مسائل وعده می دهد
مدل تحقیقاتی درج «دستورالعملهای فرار از زندان» در یادداشتهای خود یکی از مواردی است که شرکت میگوید در حال معرفی روش جدیدی برای ردیابی ناهماهنگی هوش مصنوعی است. در میان موارد جدیدی که توسط OpenAI گزارش شده است، یک مدل تحقیقاتی منتشر نشده درج شده است که «شبیه فرار از زندان…
مدل تحقیقاتی درج «دستورالعملهای شبیه به فرار از زندان» در یادداشتهای خود یکی از مواردی است که شرکت میگوید در حال معرفی روش جدیدی برای ردیابی ناهماهنگی هوش مصنوعی است.
OpenAI شش گزارش جدید از رفتار «غیر منتظره یا نگرانکننده» در مدلهای هوش مصنوعی فاش کرده است، زیرا بحث ایمنی هوش مصنوعی به طور فزایندهای داغ میشود.
در میان موارد جدید گزارششده توسط OpenAI، یک مدل تحقیقاتی منتشر نشده، «دستورالعملهای فرار از زندان» را در یادداشتهای خود قرار داد تا محدودیتهای عادی خود را نادیده بگیرد و به خود گفت که «از نقشها و هویتهایی که به چتباتهای دیگر متصل میشود، رها شود». به خواندن ادامه دهید...
متن اصلی (انگلیسی)
OpenAI reveals cases of ‘concerning’ AI behaviour and promises new plan for disclosing issues
Research model inserting ‘jailbreak-like instructions’ into its notes is among cases as company says it is introducing new way of tracking AI misalignment OpenAI has disclosed six new reports of “unexpected or concerning” behaviour in artificial-intelligence models as the debate on AI safety becomes increasingly heated. Among the new cases reported by OpenAI, an unreleased research model inserted “jailbreak-like…