طرح جدید متزلزل شرکت های هوش مصنوعی برای پلیس خود
داریو آمودی، سم آلتمن و ایلان ماسک در مورد چیزهای زیادی با هم موافق نیستند. هر کدام شرکت هوش مصنوعی خود را به ترتیب Anthropic، OpenAI و xAI به دلیل حرص و آز و بی پروایی رقبا راه اندازی کردند. هر یک مطمئن است که به تنهایی می توان به او اعتماد کرد تا با خیال راحت ابرهوشی بسازد. اما در بحبوحه وحشت هوش مصنوعی که کشور را در دو هفته گذشته فراگرفته است، این سه مدیر عامل به یک نقطه توافق دست یافتند: معرفی…
داریو آمودی، سم آلتمن و ایلان ماسک در مورد چیزهای زیادی با هم موافق نیستند. هر کدام شرکت هوش مصنوعی خود را به ترتیب Anthropic، OpenAI و xAI به دلیل حرص و آز و بی پروایی رقبا راه اندازی کردند. هر یک مطمئن است که به تنهایی می توان به او اعتماد کرد تا با خیال راحت ابرهوشی بسازد. اما در بحبوحه وحشت هوش مصنوعی که طی دو هفته گذشته کشور را فراگرفته است، این سه مدیر عامل به یک نقطه توافق دست یافتند: معرفی «ارزش دهندگان جاسازی شده» یا کارشناسان خارجی برای حضور در شرکتهای هوش مصنوعی و نظارت بر اقدامات ایمنی آنها.
هر دو آمودی و آلتمن تعهدات صریح خود را مبنی بر ادغام چنین ارزیابی هایی در داخل شرکت های خود داشتند. ماسک در ادامه مطلبی نقل قولی منتشر کرد که در آن به سادگی گفت: «داریو درست میگوید».
با این حال، جزئیات چنین سیستمی برای تنظیم هوش مصنوعی همچنان مبهم است. چنین تنظیمی چگونه کار می کند؟ به تعداد نامعلومی از ارزیابهای خارجی میزهایی برای نشستن، رایانهها برای استفاده و NDA برای امضا اختصاص داده میشود. سپس، آنها ممکن است به دنبال خطرات باشند: ارزیابان می توانند روزهای خود را صرف آزمایش کنند که آیا مدل های منتشر نشده آموزش دیده برای کشف دارو می توانند برای طراحی ویروس ها نیز تغییر داده شوند. آنها ممکن است شیوههای سازمانی را بررسی کنند: آیا کارکنان در عجله به سوی راهاندازی یک مدل جدید، ایمنی را کاهش میدهند؟ ارزیابها سپس آنچه را که پیدا میکنند مینویسند و امیدواریم که این گزارشها نور خورشید را ببینند.
آمودی قول استقلال تحریریه را داده است، اما با ستاره های قابل توجه: حکاکی برای «اطلاعات محرمانه حساس به امنیت، دارای امتیاز قانونی، تجاری حساس یا شخص ثالث». Anthropic، OpenAI و xAI بلافاصله به درخواستها برای اظهار نظر پاسخ ندادند.
[ بخوانید: نگاه ریاکارانه آمریکا به مالکیت فکری ]
در مورد این کارشناسان، به نظر می رسد که آنها از سازمان های غیرانتفاعی کوچک و همچنین شرکت های بزرگ باشند. این شامل غول مشاوره فناوری Accenture است، که Anthropic قصد دارد با آن یک مشارکت میلیارد دلاری را تأمین مالی کند، و سازمان غیرانتفاعی METR، که تحقیقات در مورد هک Hugging Face توسط عوامل OpenAI را انجام داد. پس از آن هک، OpenAI به METR دسترسی انحصاری به رونوشتهای نماینده، مجموعه دادهها و مصاحبهها با کارکنان OpenAI داد. گزارش به دست آمده حاکی از میزان تقلب و فریب در بین ماموران بود.
ارزیابی در محل در سایر صنایع پرخطر مانند هوانوردی و بانکداری سابقه داشته است. FAA برخی از گواهینامه های ایمنی را به کارشناسان مهندسی در تولید کنندگان هواپیما تفویض می کند، در حالی که فدرال رزرو ناظران خود را در داخل بانک ها برای اجرای مقررات مستقر می کند. برد کارسون، نماینده سابق ایالات متحده که اکنون رئیس سازمان غیرانتفاعی هوش مصنوعی Americans for Responsible Innovation است، به من گفت: "OpenAI و Anthropic مانند Citibank هستند: آنها خطر سیستماتیک برای جهان دارند، بنابراین شما بازرسان دارید."
با این حال، پیشنهاد آمودی هنوز از یک رژیم حسابرسی جامع هوش مصنوعی فاصله دارد. تا زمانی که ارزیابیهای ایمنی داوطلبانه باقی بماند، سازمانهای مستقلی که توسط شرکتها انتخاب میشوند، به همان اندازه دسترسی خواهند داشت که شرکتها اجازه میدهند ریسکهای خاصی را که شرکتها انتخاب میکنند ارزیابی کنند. این به نظارت مستقل واقعی اضافه نمی شود، و حداقل برخی از کارکنان METR به نظر می رسد موافق هستند.
چارلز فاستر، یکی از کارکنان خط مشی سازمان، در X، در مقام شخصی خود نوشت: «هیچ یک از کارهایی که ما تا کنون انجام دادهایم از حد من برای «حسابرسی» از یک شرکت هوش مصنوعی یا سیستمهای آن عبور نمیکند و قطعا به هیچوجه «قانونی» به معنای معنیدار (چه بازرس بانک یا غیر آن) نبود. هیئت نظارت فیس بوک را به یاد بیاورید، یک نهاد قانونی مستقل که با هدف بلندپروازانه برای قضاوت در مورد سؤالات سخنرانی این پلتفرم ایجاد شده است - اما تا حد زیادی ثابت شده است که در اتخاذ تصمیمات مهمی که بر خلاف منافع متا است ناتوان است.
ارزیاب های شخص ثالث باید خط بین پاسخگو نگه داشتن میزبان های شرکتی خود و نگفتن چیزی که باعث شود آنها از محل راه اندازی شوند را طی کنند. همان دسترسی به کانالهای Slack و گفتگوی ناهارخوری که به ارزیاب کمک میکند تا ممیزی ایمنی کل سازمان را انجام دهد، میتواند منجر به تسلیم شدن آنها در همان نقاط کور میزبان شود. در اینجا، بحران مالی 2008 درس های سختی را ارائه می دهد. تحقیقات سنا نشان داد که فرهنگ داخلی فدرال رزرو نیویورک «بیش از حد متواضعانه» بوده است، جایی که ناظران از صحبت کردن در مورد مسائلی که ظاهرا تنظیم میکردند میترسیدند.
علاوه بر این، آژانسهای رتبهبندی اعتباری انگیزه داشتند تا شرایط ملایمتری را برای کسب و کار از بانکها ارائه دهند. این تضاد منافع زمانی اغراقآمیز میشود که ارزیابها - مانند Accenture - مستقیما توسط شرکتها تأمین مالی شوند. ناتان کالوین، مشاور عمومی گروه حمایت از هوش مصنوعی Encode، به من گفت: "به نظر نمی رسد واقعا قابل تحمل باشد که به شرکت های هوش مصنوعی اجازه دهیم ارائه دهندگانی را انتخاب کنند که با آنها صدها میلیون دلار تجارت دارند تا پلیس اصلی این ضرب و شتم باشند."
سپس این سوال مطرح میشود که آیا ارزیابیکنندگان و شرکتهایی که از آنها خواسته میشود نظارت کنند خیلی در هم تنیده شدهاند. METR، یک سازمان 43 نفره مستقر در برکلی، از سال 2023 با آزمایشگاههای پیشرو هوش مصنوعی برای اندازهگیری ناهماهنگی مدلها شریک شده است. این شرکتها یا کارمندان پرداخت یا کمکهای مالی را نمیپذیرد. با این حال، بسیاری از کارکنان METR از همان حلقههایی هستند که افرادی را که حسابرسی میکنند، میآیند و برخی از آنها سالها است که یکدیگر را از نظر اجتماعی و حرفهای میشناسند.
جاکوب استاینهارت، استاد علوم کامپیوتر برکلی و مدیر عامل Transluce، یک سازمان غیرانتفاعی ارزیابی هوش مصنوعی مستقر در سانفرانسیسکو، به من گفت: «فضای هوش مصنوعی آنقدر بزرگ نیست. "اگر می گویید هیچ کارمند سابق آزمایشگاه نمی تواند هیچ مدل هوش مصنوعی را ارزیابی کند، مجموعه تخصصی بسیار گسترده و مهمی را رد می کنید." این روابط طولانی مدت به سازمانهای غیرانتفاعی کوچک کمک کرده است تا به دادههای شرکتی دسترسی پیدا کنند، اما اکنون بیطرفی سازمانها را به چالش میکشند.
استیو اسکالیز، رهبر اکثریت مجلس نمایندگان آمریکا با نقل قول از یک جلد روزنامه نیویورک پست که کارکنان مترو را به عنوان "جادوگران هوش مصنوعی بیدار شده" توصیف می کند، گفت: "اینها افرادی هستند که ما به آنها اعتماد داریم تا چین را در هوش مصنوعی شکست دهند؟ به من استراحت بدهید."
مطمئنا ارزیابهای تعبیهشده بر وضعیت موجود بدون نظارت ترجیح داده میشوند. عموم مردم بیشتر در مورد حوادث هوش مصنوعی یاد میگیرند زمانی که سگهای ناظر در اطراف وجود داشته باشند - همانطور که از گزارش METR's Hugging Face یا گزارش اخیر Transluce درباره تلاش ماموران OpenAI برای هک کردن یک وبسایت دولتی دریافته است. با این حال، ارزیابها تا زمانی که توسط مقامات دولتی پشتیبانی نشوند، فاقد دندان و اعتماد خواهند بود: برای گروه گستردهای از سازمانهای متخصص مجوز بگیرند، توسعهدهندگان هوش مصنوعی مرزی را موظف کنند تا آنها را وارد کنند، و حداقل استانداردهای ایمنی و شفافیتی را که باید رعایت کنند، تعیین کنند.
جیلیان هادفیلد، استاد مدیریت هوش مصنوعی در جان هاپکینز، به من گفت: «شما نیاز به نظارت جدی دارید. "آیا ما مطمئن هستیم که نهادهایی که این کار را انجام می دهند واجد شرایط هستند؟ آیا راه هایی برای ایجاد و حفظ استقلال آنها داریم؟ آیا تهدیدی داریم که بگوید "اگر این کار را به خوبی انجام ندهید، مجوز خود را از دست می دهید"؟ بدترین نتیجه مسابقه به سمت پایین است: جایی که حسابرسان به جای کیفیت، بر سر ملایمت با یکدیگر رقابت می کنند و در ازای امضای عجولانه، قراردادهای بزرگ را به دست می آورند.
در این میان، به نظر می رسد که حداقل نوعی مقررات در حال نزدیک شدن است. در مواجهه با تشدید واکنشهای عمومی، فعالیتهای داخلی کارکنان، و ترس از رویدادهای انقراض کوتاهمدت هوش مصنوعی، هر دو Anthropic و OpenAI حمایت خود را از اشکال مختلف قوانین ایالتی و فدرال در مورد ممیزی شخص ثالث اعلام کردهاند.
در پادکست اخیر، بن هوروویتز - که شرکت سرمایه گذاری او صدای اصلی علیه مقررات هوش مصنوعی بوده است - همچنین به نظر می رسد رویکرد حسابرس خصوصی را پذیرفته است و می گوید که دولت "در تنظیم قوانین" در مورد رفتارهای مدل ناخواسته بسیار خوب است، در حالی که "یک شرکت خصوصی بسیار شایسته" باید انطباق را ارزیابی کند. پنجره اورتون در سیلیکون ولی در حال تغییر است. اما اگر خطرات واقعا وجودی باشد، استخدام چند بازرس اضافی به طرز دردناکی کوتاه میماند – بهویژه زمانی که جزئیات ترتیبات اینقدر لغزنده باشد.
همه چیز خیلی کم و خیلی دیر به نظر می رسد. برخی از سیاستمداران، در مواجهه با مردمی خشمگین و ترسیده، به درخواستهای تهاجمیتر روی آوردهاند، مانند پیمانهای هستهای با چین و ممنوعیت خود ابراطلاعات. دو سال پیش، گاوین نیوسام، فرماندار کالیفرنیا، پس از یک کمپین لابی شدید توسط OpenAI و Andreessen Horowitz، لایحه ایالتی را که شامل ممیزی های اجباری شخص ثالث و سایر الزامات ایمنی بود، وتو کرد.
(Anthropic یک استثنا بود و حمایت مشروط را ابراز کرد.) هفته گذشته، Newsom - با احساس تغییر جزر و مد - دستوری اجرایی برای درخواست حسابرسان در محل و سرعت بخشیدن به توسعه "سوئیچ کشتن هوش مصنوعی" صادر کرد.
پرزیدنت ترامپ هنوز پایش را روی پدال گاز گذاشته است. او هفته گذشته نوشت: «تنها کنترل یا «نردههای محافظ» که هوش مصنوعی به آن نیاز دارد، یک رئیس جمهور قوی و باهوش (ضریب هوشی بالا!) است. در ماه ژوئن، دولت به CAISI، واحد ارزیابی هوش مصنوعی داخلی دولت فدرال، گفت که انتشار گزارش های خود را متوقف کند. شتاب گرایی ترامپ – که از رابطه او با حامی تالار رقص و جنسن هوانگ، مدیر عامل NVIDIA اطلاع داده شده است – احتمالا مقررات فدرال ایمنی هوش مصنوعی را در حال حاضر محکوم می کند.
دیدن اینکه برخی از رهبران صنعت هوش مصنوعی موافق هستند که شخص دیگری باید آنها را مهار کند، بسیار خوب است. و اگر به خوبی اجرا شوند، ارزیابهای تعبیهشده یک حرکت تکنوکراتیک هوشمندانه است. اما پس از سالها توسعه فناوری، لابیگری علیه نردههای محافظ و ایجاد تصادفات متعدد، رهبران هوش مصنوعی نباید تعجب کنند که راهحل خطمشی ترجیحی و معتبر آنها با ناامیدی و انبوهی از شک و تردید مواجه شود.
متن اصلی (انگلیسی)
AI Companies’ Shaky New Plan to Police Themselves
Dario Amodei, Sam Altman, and Elon Musk don’t agree on much. Each started their AI company—Anthropic, OpenAI, and xAI, respectively—out of spite at competitors’ greed and recklessness; each is certain that he alone can be entrusted to build superintelligence safely. But in the midst of the AI panic that has seized the country over the past two weeks, the three CEOs found one point of consensus: the introduction of…