OpenAI گزارش های منظمی در مورد رفتارهای غیرمنتظره یا غیرمجاز هوش مصنوعی برنامه ریزی می کند
این حرکت پس از چندین مورد از سرکشی مدل های پیشرفته صورت می گیرد.
OpenAI چارچوب جدیدی را برای ردیابی، بررسی و افشای موارد ناهماهنگی مدل هوش مصنوعی منتشر کرد.
OpenAI در 16 سپتامبر اعلام کرد که به طور منظم گزارش هایی در مورد رفتارهای غیرمنتظره یا غیرمجاز هوش مصنوعی منتشر خواهد کرد، در حالی که هشدار داد که صنعت هنوز چالش های کلیدی همسویی را با قدرتمندتر شدن سیستم ها حل نکرده است.
این شرکت چارچوب جدیدی را برای ردیابی، بررسی و افشای موارد ناهماهنگی مدل هوش مصنوعی به همراه شش گزارش در مورد رفتارهای غیرمنتظره یا مربوط به مدل مشاهده شده در شش ماه گذشته منتشر کرد.
این اطلاعیه در حالی منتشر میشود که نگرانیها نسبت به عقب ماندن تلاشهای ایمنی هوش مصنوعی از توسعه سرسامآور سیستمهای قدرتمندتر افزایش مییابد.
محققان هشدار دادهاند که وقتی عوامل هوش مصنوعی مستقلتر میشوند، ممکن است رفتارهایی ایجاد کنند که از نیات خالقانشان متفاوت باشد و نظارت یا کنترل آنها سختتر شود.
در آخر هفته، داریو آمودی، مدیر اجرایی آنتروپیک، چارچوبی سه مرحلهای را با هدف کاهش سرعت توسعه هوش مصنوعی و دادن زمان بیشتری برای مدیریت ریسکهای آن پیشنهاد کرد.
این پیشنهاد توسط چندین مدیر هوش مصنوعی، از جمله ایلان ماسک، مدیر xAI، و مدیر عامل OpenAI، سم آلتمن، حمایت شد.
گزارشهای اولیه از OpenAI شامل مواردی است که مدلها دستورالعملهای خود را در خلاصهکاریها ایجاد میکنند، اشتباهات را پنهان میکنند، فایلها را در اینترنت به منظور استناد به آنها آپلود میکنند و فایلها را بدون مجوز بین عوامل همکار به اشتراک میگذارند.
OpenAI گفت که این گزارشها نمونههای فردی را توصیف میکنند و نباید به عنوان شواهدی مبنی بر اینکه چقدر ناهماهنگی در مدلهای آن رخ میدهد، تلقی شود.
چارچوب جدید این شرکت شامل فرآیندی برای کارمندان میشود تا حوادث احتمالی ناهماهنگی مدل را علامتگذاری کنند، تحقیقات توسط تیمهای ایمنی و همترازی و سیستمی برای تعیین مواردی که نیاز به افشای عمومی دارند. رویترز
متن اصلی (انگلیسی)
OpenAI plans regular reports on unexpected or unauthorised AI behaviour
The move comes after several cases of advanced models going rogue.