جنجال بر سر اخراج ناگهانی اعضای تیم ایمنی OpenAI درگیر در تحقیقات هک Hugging Face بالا گرفته است.
سه کارمند سابق نامه ای را در پاسخ به اتهامات مربوط به اخراج خود منتشر می کنند که OpenAI با یک یادداشت داخلی و بیانیه ای در معرض دید عموم به آن پاسخ می دهد.
بحثی در رسانه های اجتماعی و در داخل دیوار OpenAI در جریان است که چرا این شرکت هفته گذشته سه نفر را از تیم ایمنی خود اخراج کرد. اکنون، کارمندان سابق، و همچنین OpenAI، بیانیههای دیگری را برای روشن کردن جنبههای خود از ماجرا صادر کردهاند.
دو تن از محققین اخراج شده - تامک کورباک و میکیتا بالسنی - روی تحقیق OpenAI درباره حادثه صورت در آغوش کشیدن کار کردند. Korbak نقطه تماس فنی METR بود، شرکت تحقیقاتی شخص ثالثی که OpenAI از آن درخواست کرد تا یک ممیزی مستقل از این حادثه انجام دهد. سومین کارمند اخراج شده، یاسمین وانگ، مدیر برنامه در تیم ایمنی OpenAI بود.
وال استریت ژورنال اولین بار این اخراج ها را در 1 اکتبر گزارش کرد. در آن زمان، OpenAI گفت: "افراد اطلاعات حساس خارج از رویه های شرکت را به درستی مدیریت کردند، خط مشی های ما را نقض کردند و اعتماد ضروری برای کار ما را شکستند."
کارکنان اخراجی نامه ای در پاسخ به این اتهامات منتشر می کنند
از آن زمان به بعد، به نظر میرسد که گفتگوها و بحثهایی در میان ردههای OpenAI ادامه داشته است، و این سه کارمند سابق را بر آن داشت تا نامهای چهار صفحهای را که در 8 اکتبر منتشر شد، بنویسند.
این نامه به «نسخههای مختلفی از رویدادهایی که در میان کارکنان OpenAI در جریان است» پاسخ میدهد و به «ارتباطات داخلی و خارجی» مداوم در مورد اخراج اشاره میکند که به گفته کارمندان سابق باعث میشود کارمندان فعلی «از صحبت کردن» ترس داشته باشند.
در نامه میگوید: «فسخهایی مانند ما که بهطور ناگهانی اجرا و ارتباط برقرار میکنند، فرهنگ باز را که OpenAI در گذشته ارزشمند کرده بود، سرد میکند». این فرهنگ است که ما برای دفاع از آن می نویسیم.»
دو موضوع بزرگ در نامه در مورد توانایی OpenAI برای نظارت بر مدل های پیشرفته خود و در مورد تعامل آن با شرکت های ایمنی شخص ثالث مانند METR است. کارمندان سابق نگرانیهایشان در مورد توانایی نظارت بر آخرین مدل Astra OpenAI را به The Information که مقالهای در 1 سپتامبر در مورد آن منتشر کرد را تکذیب کردند. دوم، آنها هرگونه بازی نادرست را در ارتباط خود با METR انکار می کنند.
کارکنان از OpenAI میخواهند توانایی نظارت دقیق بر مدلهای پیشرفتهاش را حفظ کند، به تعهد خود برای تعبیه ممیزان ایمنی شخص ثالث در سازمان پایبند باشد و فرهنگ باز و شفاف را تقویت کند.
در این نامه آمده است: «ما نگران این هستیم که اخراجهای ما ممکن است برای توجیه پایان دادن به کار OpenAI با METR یا در غیر این صورت ارائه دسترسی و دامنه محدودتر به حسابرسان خارجی مورد استفاده قرار گیرد.
دلایل مختلف شلیک، اما چیزی مشخص نیست
OpenAI دلایل مشخصی برای اخراج را فاش نکرده است، اما به Fortune گفته است که یک الگوی رفتار نادرست از سه کارمند، از جمله تعدادی تخلف، که آشکارا خطمشیهای آن را برای مدیریت اطلاعات نقض میکند، پیدا کرده است. این شلیکها را به ارتباط خود با مترو یا حادثه «صورت در آغوش گرفته» مرتبط نکرد.
هر یک از کارمندان سابق این هفته در پستهای رسانههای اجتماعی که به نامه مشترک پیوند دارند، توضیح مختصری ارائه کردند.
کورباک گفت که OpenAI به صورت شفاهی و نه کتبی به او گفته است که "به دلیل نحوه ارتباط من با METR اخراج شده است." یک نگهبان نشان من را گرفت و مرا از ساختمان بیرون کرد.» کوربک گفت: «صحبت با METR کار من بود.»
وانگ گفت دلیلی که OpenAI به او داده این بود که به ایمیل یک مدیر اجرایی ناشناس دسترسی پیدا کرد. او گفت که شرکت این دسترسی را برای استخدام به او داده است و وقتی دیگر به آن نیازی نداشت، از IT خواست آن را حذف کند، اما آنها درخواست او را تکمیل نکردند.
وانگ گفت: «ما اولین کسی نبودیم که تحت شرایط مشکوک از OpenAI بیرون رانده شدیم. "مگر این که کارمندان اکنون علیه این نوع مانورها موضع نگیرند، من نگرانم که آخرین نفر نباشیم. پیام برای همه هنوز در OpenAI واضح است: نگرانیهای خود را مطرح کنید یا از نزدیک با گروههای ایمنی بیرونی کار کنید، و شما میتوانید نفر بعدی باشید، بدون اینکه دلیل آن گفته شود."
بالسنی گفت که آنها "به دلیل اولویت دادن به ایمنی بر منافع کوتاه مدت OpenAI به عنوان یک شرکت اخراج شدند."
آیا OpenAI فرهنگ ایمنی ناسالم دارد؟
در پاسخ به این نامه، OpenAI یک یادداشت داخلی برای کارمندان ارسال کرد و همچنین یک بیانیه عمومی منتشر کرد. این شرکت گفت: «تحقیقات داخلی ما نقض قابلتوجهی را آشکار کرد، فراتر از آنچه در نامهای که آنها منتشر کردند، و ما بر تصمیم خود مبنی بر عدم ادامه کار آنها میایستیم.»
اما عدم شفافیت در مورد آنچه که کارکنان دقیقا انجام داده اند یا ممکن است با METR به اشتراک گذاشته باشند، به گمانه زنی ها در مورد آنچه اتفاق افتاده است دامن زده است. (METR به درخواست ما برای اظهار نظر پاسخ نداد.)
نیل ناندا، کارمند گوگل دیپ مایند که قبلا در آنتروپیک بود، میگوید: «من واقعا نمیتوانم دنیایی را ببینم که در آن اعمال OpenAI در اینجا توجیه شوند. اخراج مردم به دلیل تلاش برای استفاده از بهترین قضاوت خود در یک موقعیت بدیع و نامطمئن، نشانه یک فرهنگ بسیار ناسالم است.
دیوید رابینسون، رهبر سابق شفافیت ایمنی OpenAI نیز در این ماه در مورد فرهنگ ایمنی "شکسته" شرکت در مقاله ای در آتلانتیک صحبت کرد و گفت که شرکت "تقریبا به اندازه کافی ایمن" نیست و بر "آزمایش و خطا" تکیه دارد. او حادثه Hugging Face را به عنوان شاهدی بر این موضوع برجسته میکند، و اینکه تدابیری که شرکت در پاسخ به آن اعمال کرده است، هنوز از حوادث سرکش بیشتر جلوگیری نکرده است.
OpenAI بخشی از یادداشت داخلی خود را که توسط رهبران تحقیقاتی خود با Fortune ارسال شده بود - که احتمالا توسط مارک چن، مدیر ارشد تحقیقاتی نوشته شده بود، برای کارمندان به اشتراک گذاشت، اگرچه شرکت مشخص نکرد. این یادداشت تعهد شرکت به همکاری با ارزیابهای ایمنی شخص ثالث را تأیید کرد و گفت: «نظارت برای ما از اهمیت بالایی برخوردار است».
در این یادداشت آمده است: «من فرهنگ باز بحث ما را گرامی میدارم، بهویژه در مورد ایمنی، و این صراحت را برای تصمیمگیری صحیح بسیار مهم میدانم. من میخواهم خیلی واضح بگویم که این تصمیمها برای مطرح کردن نگرانیهای ایمنی یا صحبت کردن نبودند. ما همیشه آن را تشویق کردهایم و همیشه خواهیم کرد.»
OpenAI گفت هنوز متعهد به کار با ارزیابهای ایمنی شخص ثالث است و اکنون در حال نهایی کردن قراردادها است که «در هفتههای آینده» اعلام خواهد کرد.
این داستان در ابتدا در سایت Fortune.com منتشر شد
متن اصلی (انگلیسی)
Controversy swirls over ‘abrupt’ firing of OpenAI safety team members involved in the Hugging Face hack investigation
Three former employees publish a letter in response to allegations about their firings, to which OpenAI responds with an internal memo and public-facing statement.