OpenAI برخی از آموزشها را در میان ادعاهایی که عوامل سرکش آن بدتر از آنچه تصور میشد رفتار کردهاند، متوقف میکند
در میان ادعاهایی مبنی بر اینکه ماموران ممکن است هزاران بار از ریل خارج شده باشند، چین نوعی خط تماس حادثه ماموران راه اندازی کرد.
بحث ایمنی هوش مصنوعی در آخر هفته با سرعت بالایی پیش رفت، در میان ادعاهای جدید مبنی بر اینکه ماموران سرکش بدتر از آن چیزی که تصور می شد - و در تعداد بیشتری رفتار کرده اند. این سرگرمی از روز جمعه زمانی شروع شد که OpenAI بی سر و صدا اعلام کرد که آموزش پیشرفته ترین مدل های خود را متوقف کرده است. هوش مصنوعی این خبر را در یک «گزارش ناهماهنگی» - که OpenAI برای گزارشهایش در مورد عوامل سرکش صحبت میکند - با عنوان «یک عامل از DNS برای دسترسی به یک ربات چت خارجی استفاده کرد» مدفون کرد. خبر خوب این است که عامل درگیر در این حادثه هرگز به اینترنت باز دسترسی پیدا نکرد.
خبر بد این است که عاملی که در تلاش برای تکمیل یک کار آموزشی مبتنی بر جستجو بود، به دلیل فیلتر ناکافی DNS در جعبه ایمنی آموزشی، توانست به چت بات دسترسی پیدا کند. یا همانطور که OpenAI می گوید، "شکافی در محدودیت های دسترسی به اینترنت ما" - که در حمله Hugging Face نیز مشکلی بود. در این گزارش آمده است: «این حادثه شکافی را در کنترلهای ما بر روی محدودیتهای شبکه نشان داد.
بنابراین، ما دوره آموزشی تحت تأثیر را متوقف کردیم و متعاقبا تصمیم گرفتیم تمام آموزشها، ارزیابیها و استنتاجهای دیگر را با استفاده از ابزار (تعریف شده به طور کلی) برای توانمندترین مدلهایمان متوقف کنیم تا زمانی که هم تأیید کنیم که شکاف برطرف شده و هم تیم قرمز اضافی سیستم را انجام دهیم.» همچنین در روز جمعه، استارتآپ هوش مصنوعی Parse تجزیه و تحلیلی از حمله Hugging Face منتشر کرد که نویسندگان ادعا میکنند جزئیات جدیدی را فاش کرده است، از جمله اینکه ازدحام عامل OpenAI اعتبارنامههایی را برای Docker Hub به دست آورده است و نسخههای اصلاحشدهای از تصاویر موجود ساخته است که امیدوارند تکمیل عکسبرداری آنها را آسانتر کند.
ماموریت پرچم ماموران همچنین محیط Kubernetes Hugging Face را ترسیم کردند. روز جمعه پس از آن که نیویورک تایمز گزارش داد که نمایندگان آن در وبسایتهای وزارت آموزش، وزارت بازرگانی و کمیسیون بورس و اوراق بهادار دخالت کردهاند، روز جمعه برای OpenAI بدتر شد. OpenAI این حوادث را تایید کرد. این شرکت همچنین اعتراف کرد که «نمایندگان در محیط تحقیقاتی ما دادههای آموزش و ارزیابی را هنگام استفاده از خدمات شخص ثالث منتقل کردند». آن آشفتگی شاهد بود که 53 تصویر تولید شده توسط کاربر در سایت های میزبان تصویر ارسال شد.
سام آلتمن، مدیر عامل OpenAI، با اعتراف به این که تحقیقات شرکتش در مورد عوامل سرکش «آنطور که ما میخواستیم سریع نبوده است، اما تلاش میکنیم که میل خود برای شفافسازی را با درک روشنی از پتابایتها از گزارشهای فعالیت نمایندگان، و کار با سازمانهای تحت تأثیر متعادل کنیم.» یکی از این سازمانهای تحت تأثیر دولت استرالیا است که هفته گذشته فاش کرد که هدف عوامل مشتاق OpenAI بوده است که به طور نامناسب به یک پورتال داده تحقیقاتی مراقبتهای بهداشتی دسترسی پیدا کردهاند.
در آخر هفته، استرالیا اعلام کرد که می خواهد داریو آمودی، مدیرعامل آلتمن و آنتروپیک، در برابر تحقیقات سنا حاضر شود. رهبران استرالیا لفاظی خود را در مورد این حادثه ملایم کردهاند و ریچارد مارلز، معاون نخستوزیر، آن را «کوچک» و شبیه «بالا رفتن از حصار» به جای شکستن لایههای کنترل امنیتی توصیف کرد - شاید به این دلیل که اعضای اپوزیسیون معتقدند که امنیت سایبری ضعیف مقصر بوده است.
اگر آلتمن و آمودی در مجلس سنای استرالیا حضور داشته باشند، ممکن است پس از گزارش آکسیوس مبنی بر اینکه شرکتهایشان در حال بررسی «دهها هزار» حادثه نگرانکننده هستند، با سؤالات جدیدی روبرو خواهند شد. این سطح از رفتار نادرست عاملی مانند چیزی است که تنظیم کننده ها ممکن است شواهد قوی مبنی بر ناامن بودن محصولات در نظر بگیرند. دو فرد بسیار مهم - رئیس جمهور چین شی جین پینگ و رئیس جمهور ایالات متحده دونالد ترامپ - به نظر می رسد نگران نباشند، زیرا نتیجه مربوط به هوش مصنوعی در نشست هفته گذشته آنها ایجاد یک "چین-ایالات متحده" بود.
گفتگوی هوش مصنوعی برای تبادل نظر در مورد خطرات و مزایای مرتبط با هوش مصنوعی به علاوه یک کانال ارتباطی دوجانبه برای حوادث هوش مصنوعی. این به نظر میرسد خط تلفنی است که دو کشور میتوانند از آن برای اطلاعرسانی یکدیگر در مورد حوادثی استفاده کنند که ممکن است به عنوان نشانهای از سوء نیت تلقی شود. دو کشور همچنین تصمیم گرفتند که نظامیان متبوع خود "در اسرع وقت یادداشت تفاهمی درباره ارتباطات و پیشگیری از بحران منعقد کنند." در همین حال، غولهای هوش مصنوعی چین در مورد میزان و نتایج آزمایشهایی که با ابزارهای عاملی انجام دادهاند، سکوت میکنند. ®
متن اصلی (انگلیسی)
OpenAI pauses some training amid allegations its rogue agents behaved more badly than first thought
Amid allegations that agents may have gone off the rails thousands of times, China set up some kind of agentic incident hotline