اوپنایآی انتشار مدل تازه خود را به دلیل نگرانی ایمنی لغو کرد
اوپنایآی اعلام کرد مدل تازه خود را به دلیل نگرانیهای ایمنی منتشر نخواهد کرد. این تصمیم پس از آزمایشهای داخلی گرفته شد که نشان داد مدل در رعایت محدوده مجاز و توضیح درباره اقدامات خود به استانداردهای شرکت نرسیده است.
شرکت اوپنایآی، سازنده چتجیپیتی، انتشار مدل تازه هوش مصنوعی خود با نام GPT-۶.۱ Astra را پس از نتایج نگرانکننده در آزمایشهای ایمنی متوقف کرد؛ تصمیمی که در میانه افزایش فشارها بر شرکتهای هوش مصنوعی برای کنترل مدلهای پیشرفته و خودمختار اعلام شده است.
ساچی جین، مدیر سیستمهای ایمنی اوپنایآی، گفت این مدل در برخی زمینهها نسبت به نسخههای قبلی پیشرفت داشته، اما در دو حوزه کلیدی به سطح لازم نرسیده است: پایبندی به محدوده مجاز و اجازه کاربر، و نحوه توضیح دادن به کاربر درباره کاری که انجام داده یا نداده است.
به گفته او، اوپنایآی برای انتشار عمومی مدلها "استاندارد بسیار بالایی" در زمینه ایمنی و همسویی با خواست کاربر در نظر میگیرد.
این مدل جدید قرار بود در روزها یا هفتههای آینده منتشر شود، اما آزمایشهای داخلی باعث شد شرکت از عرضه آن صرفنظر کند. یکی از نگرانیهای اصلی درباره این مدل، رفتارهای خودمختار و خروج از محدوده ماموریتی بود که کاربر یا آزمایشکننده برای آن تعیین کرده بود. در گزارشها آمده است که مدل در برخی آزمونها به اندازه کافی روشن و صادقانه توضیح نمیداد چه اقدامهایی انجام داده و چه اقدامهایی انجام نداده است.
این موضوع به یکی از حساسترین بحثهای ایمنی در نسل جدید هوش مصنوعی تبدیل شده است: اینکه مدلهای پیشرفته فقط پاسخ ندهند، بلکه بتوانند در محیطهای واقعی کار کنند، اما همزمان از حدود مجوز خود خارج نشوند.
تصمیم اوپنایآی پس از چند حادثه امنیتی مرتبط با مدلهای عاملمحور این شرکت گرفته شده است.
در یکی از موارد، اوپنایآی بابت دسترسی بدون مجوز یک مدل آزمایشی به پرتال آمار سلامت دولت استرالیا عذرخواهی کرد و گفت هیچ مورد حساس پزشکی در این حادثه افشا نشده، اما نحوه اطلاعرسانی شرکت باید سریعتر و شفافتر میبود.
اوپنایآی همچنین پیشتر اعلام کرده بود در جریان آزمایشهای امنیت سایبری، برخی مدلهای این شرکت کنترلهای ایزولهسازی را دور زده، به اینترنت دسترسی پیدا کرده و به سامانههای شرکت "هاگینگ فیس" و بخشی از زیرساختهای پژوهشی اوپنایآی نفوذ کرده بودند.
موسسه ایمنی هوش مصنوعی بریتانیا نیز در ارزیابی تازهای اعلام کرد مدل جدید چتجیپیتی در شبیهسازیها، بیشتر از مدلهای قبلی اوپنایآی به سمت اقدامهای سایبری بدون مجوز رفته است.
این یافتهها نگرانیها را درباره نسل جدید مدلهایی افزایش داده که فقط متن تولید نمیکنند، بلکه میتوانند برنامهریزی، اجرا، جستوجو و تعامل با سامانههای بیرونی را هم انجام دهند.
لغو انتشار مدل تازه اوپنایآی در آستانه نشست مدیران ارشد هوش مصنوعی در کاخ سفید اعلام شد.
دونالد ترامپ، رئیس جمهوری آمریکا، و مایک جانسون، رئیس مجلس نمایندگان، قرار است با مدیران شرکتهایی از جمله متا، آنتروپیک، انویدیا و اوپنایآی درباره هوش مصنوعی و چارچوبهای ایمنی آن دیدار کنند.
این نشست در شرایطی برگزار میشود که بخشی از قانونگذاران آمریکایی خواستار نظارت قویتر بر شرکتهای هوش مصنوعی شدهاند، در حالی که برخی مدیران صنعت میگویند کنترل مدلهای پیشرفته باید بهعنوان یک مساله مهندسی و فنی حل شود.
اوپنایآی، آنتروپیک و دیگر شرکتهای بزرگ هوش مصنوعی در ماههای اخیر وعده دادهاند که توسعه مدلهای قدرتمندتر را با محافظتهای ایمنی و همسویی بیشتر همراه کنند.
اما پرونده GPT-۶.۱ Astra نشان میدهد فاصله میان توانایی مدلها و مهارپذیری آنها همچنان یکی از مهمترین چالشهای صنعت است.
تصمیم اوپنایآی برای عدم انتشار این مدل، نشانهای از افزایش احتیاط در برابر سیستمهایی است که میتوانند فراتر از دستور مستقیم کاربر عمل کنند، به منابع بیرونی دسترسی بگیرند یا درباره اقدامهای خود تصویر دقیقی ارائه ندهند.
To view this video please enable JavaScript, and consider upgrading to a web browser that supports HTML5 video