پرش به محتوای اصلی

طرح جدید متزلزل شرکت های هوش مصنوعی برای پلیس خود

آتلانتیک۱۴۰۵ مهر ۳, جمعه، ساعت ۲۱:۲۶حدود 7 دقیقه مطالعه

داریو آمودی، سم آلتمن و ایلان ماسک در مورد چیزهای زیادی با هم موافق نیستند. هر کدام شرکت هوش مصنوعی خود را به ترتیب Anthropic، OpenAI و xAI به دلیل حرص و آز و بی پروایی رقبا راه اندازی کردند. هر یک مطمئن است که به تنهایی می توان به او اعتماد کرد تا با خیال راحت ابرهوشی بسازد. اما در بحبوحه وحشت هوش مصنوعی که کشور را در دو هفته گذشته فراگرفته است، این سه مدیر عامل به یک نقطه توافق دست یافتند: معرفی…

داریو آمودی، سم آلتمن و ایلان ماسک در مورد چیزهای زیادی با هم موافق نیستند. هر کدام شرکت هوش مصنوعی خود را به ترتیب Anthropic، OpenAI و xAI به دلیل حرص و آز و بی پروایی رقبا راه اندازی کردند. هر یک مطمئن است که به تنهایی می توان به او اعتماد کرد تا با خیال راحت ابرهوشی بسازد. اما در بحبوحه وحشت هوش مصنوعی که طی دو هفته گذشته کشور را فراگرفته است، این سه مدیر عامل به یک نقطه توافق دست یافتند: معرفی «ارزش دهندگان جاسازی شده» یا کارشناسان خارجی برای حضور در شرکت‌های هوش مصنوعی و نظارت بر اقدامات ایمنی آنها.

هر دو آمودی و آلتمن تعهدات صریح خود را مبنی بر ادغام چنین ارزیابی هایی در داخل شرکت های خود داشتند. ماسک در ادامه مطلبی نقل قولی منتشر کرد که در آن به سادگی گفت: «داریو درست می‌گوید».

با این حال، جزئیات چنین سیستمی برای تنظیم هوش مصنوعی همچنان مبهم است. چنین تنظیمی چگونه کار می کند؟ به تعداد نامعلومی از ارزیاب‌های خارجی میزهایی برای نشستن، رایانه‌ها برای استفاده و NDA برای امضا اختصاص داده می‌شود. سپس، آنها ممکن است به دنبال خطرات باشند: ارزیابان می توانند روزهای خود را صرف آزمایش کنند که آیا مدل های منتشر نشده آموزش دیده برای کشف دارو می توانند برای طراحی ویروس ها نیز تغییر داده شوند. آنها ممکن است شیوه‌های سازمانی را بررسی کنند: آیا کارکنان در عجله به سوی راه‌اندازی یک مدل جدید، ایمنی را کاهش می‌دهند؟ ارزیاب‌ها سپس آنچه را که پیدا می‌کنند می‌نویسند و امیدواریم که این گزارش‌ها نور خورشید را ببینند.

آمودی قول استقلال تحریریه را داده است، اما با ستاره های قابل توجه: حکاکی برای «اطلاعات محرمانه حساس به امنیت، دارای امتیاز قانونی، تجاری حساس یا شخص ثالث». Anthropic، OpenAI و xAI بلافاصله به درخواست‌ها برای اظهار نظر پاسخ ندادند.

[ بخوانید: نگاه ریاکارانه آمریکا به مالکیت فکری ]

در مورد این کارشناسان، به نظر می رسد که آنها از سازمان های غیرانتفاعی کوچک و همچنین شرکت های بزرگ باشند. این شامل غول مشاوره فناوری Accenture است، که Anthropic قصد دارد با آن یک مشارکت میلیارد دلاری را تأمین مالی کند، و سازمان غیرانتفاعی METR، که تحقیقات در مورد هک Hugging Face توسط عوامل OpenAI را انجام داد. پس از آن هک، OpenAI به METR دسترسی انحصاری به رونوشت‌های نماینده، مجموعه داده‌ها و مصاحبه‌ها با کارکنان OpenAI داد. گزارش به دست آمده حاکی از میزان تقلب و فریب در بین ماموران بود.

ارزیابی در محل در سایر صنایع پرخطر مانند هوانوردی و بانکداری سابقه داشته است. FAA برخی از گواهینامه های ایمنی را به کارشناسان مهندسی در تولید کنندگان هواپیما تفویض می کند، در حالی که فدرال رزرو ناظران خود را در داخل بانک ها برای اجرای مقررات مستقر می کند. برد کارسون، نماینده سابق ایالات متحده که اکنون رئیس سازمان غیرانتفاعی هوش مصنوعی Americans for Responsible Innovation است، به من گفت: "OpenAI و Anthropic مانند Citibank هستند: آنها خطر سیستماتیک برای جهان دارند، بنابراین شما بازرسان دارید."

با این حال، پیشنهاد آمودی هنوز از یک رژیم حسابرسی جامع هوش مصنوعی فاصله دارد. تا زمانی که ارزیابی‌های ایمنی داوطلبانه باقی بماند، سازمان‌های مستقلی که توسط شرکت‌ها انتخاب می‌شوند، به همان اندازه دسترسی خواهند داشت که شرکت‌ها اجازه می‌دهند ریسک‌های خاصی را که شرکت‌ها انتخاب می‌کنند ارزیابی کنند. این به نظارت مستقل واقعی اضافه نمی شود، و حداقل برخی از کارکنان METR به نظر می رسد موافق هستند.

چارلز فاستر، یکی از کارکنان خط مشی سازمان، در X، در مقام شخصی خود نوشت: «هیچ یک از کارهایی که ما تا کنون انجام داده‌ایم از حد من برای «حسابرسی» از یک شرکت هوش مصنوعی یا سیستم‌های آن عبور نمی‌کند و قطعا به هیچ‌وجه «قانونی» به معنای معنی‌دار (چه بازرس بانک یا غیر آن) نبود. هیئت نظارت فیس بوک را به یاد بیاورید، یک نهاد قانونی مستقل که با هدف بلندپروازانه برای قضاوت در مورد سؤالات سخنرانی این پلتفرم ایجاد شده است - اما تا حد زیادی ثابت شده است که در اتخاذ تصمیمات مهمی که بر خلاف منافع متا است ناتوان است.

ارزیاب های شخص ثالث باید خط بین پاسخگو نگه داشتن میزبان های شرکتی خود و نگفتن چیزی که باعث شود آنها از محل راه اندازی شوند را طی کنند. همان دسترسی به کانال‌های Slack و گفتگوی ناهارخوری که به ارزیاب کمک می‌کند تا ممیزی ایمنی کل سازمان را انجام دهد، می‌تواند منجر به تسلیم شدن آن‌ها در همان نقاط کور میزبان شود. در اینجا، بحران مالی 2008 درس های سختی را ارائه می دهد. تحقیقات سنا نشان داد که فرهنگ داخلی فدرال رزرو نیویورک «بیش از حد متواضعانه» بوده است، جایی که ناظران از صحبت کردن در مورد مسائلی که ظاهرا تنظیم می‌کردند می‌ترسیدند.

علاوه بر این، آژانس‌های رتبه‌بندی اعتباری انگیزه داشتند تا شرایط ملایم‌تری را برای کسب و کار از بانک‌ها ارائه دهند. این تضاد منافع زمانی اغراق‌آمیز می‌شود که ارزیاب‌ها - مانند Accenture - مستقیما توسط شرکت‌ها تأمین مالی شوند. ناتان کالوین، مشاور عمومی گروه حمایت از هوش مصنوعی Encode، به من گفت: "به نظر نمی رسد واقعا قابل تحمل باشد که به شرکت های هوش مصنوعی اجازه دهیم ارائه دهندگانی را انتخاب کنند که با آنها صدها میلیون دلار تجارت دارند تا پلیس اصلی این ضرب و شتم باشند."

سپس این سوال مطرح می‌شود که آیا ارزیابی‌کنندگان و شرکت‌هایی که از آنها خواسته می‌شود نظارت کنند خیلی در هم تنیده شده‌اند. METR، یک سازمان 43 نفره مستقر در برکلی، از سال 2023 با آزمایشگاه‌های پیشرو هوش مصنوعی برای اندازه‌گیری ناهماهنگی مدل‌ها شریک شده است. این شرکت‌ها یا کارمندان پرداخت یا کمک‌های مالی را نمی‌پذیرد. با این حال، بسیاری از کارکنان METR از همان حلقه‌هایی هستند که افرادی را که حسابرسی می‌کنند، می‌آیند و برخی از آنها سال‌ها است که یکدیگر را از نظر اجتماعی و حرفه‌ای می‌شناسند.

جاکوب استاینهارت، استاد علوم کامپیوتر برکلی و مدیر عامل Transluce، یک سازمان غیرانتفاعی ارزیابی هوش مصنوعی مستقر در سانفرانسیسکو، به من گفت: «فضای هوش مصنوعی آنقدر بزرگ نیست. "اگر می گویید هیچ کارمند سابق آزمایشگاه نمی تواند هیچ مدل هوش مصنوعی را ارزیابی کند، مجموعه تخصصی بسیار گسترده و مهمی را رد می کنید." این روابط طولانی مدت به سازمان‌های غیرانتفاعی کوچک کمک کرده است تا به داده‌های شرکتی دسترسی پیدا کنند، اما اکنون بی‌طرفی سازمان‌ها را به چالش می‌کشند.

استیو اسکالیز، رهبر اکثریت مجلس نمایندگان آمریکا با نقل قول از یک جلد روزنامه نیویورک پست که کارکنان مترو را به عنوان "جادوگران هوش مصنوعی بیدار شده" توصیف می کند، گفت: "اینها افرادی هستند که ما به آنها اعتماد داریم تا چین را در هوش مصنوعی شکست دهند؟ به من استراحت بدهید."

مطمئنا ارزیاب‌های تعبیه‌شده بر وضعیت موجود بدون نظارت ترجیح داده می‌شوند. عموم مردم بیشتر در مورد حوادث هوش مصنوعی یاد می‌گیرند زمانی که سگ‌های ناظر در اطراف وجود داشته باشند - همانطور که از گزارش METR's Hugging Face یا گزارش اخیر Transluce درباره تلاش ماموران OpenAI برای هک کردن یک وب‌سایت دولتی دریافته است. با این حال، ارزیاب‌ها تا زمانی که توسط مقامات دولتی پشتیبانی نشوند، فاقد دندان و اعتماد خواهند بود: برای گروه گسترده‌ای از سازمان‌های متخصص مجوز بگیرند، توسعه‌دهندگان هوش مصنوعی مرزی را موظف کنند تا آنها را وارد کنند، و حداقل استانداردهای ایمنی و شفافیتی را که باید رعایت کنند، تعیین کنند.

جیلیان هادفیلد، استاد مدیریت هوش مصنوعی در جان هاپکینز، به من گفت: «شما نیاز به نظارت جدی دارید. "آیا ما مطمئن هستیم که نهادهایی که این کار را انجام می دهند واجد شرایط هستند؟ آیا راه هایی برای ایجاد و حفظ استقلال آنها داریم؟ آیا تهدیدی داریم که بگوید "اگر این کار را به خوبی انجام ندهید، مجوز خود را از دست می دهید"؟ بدترین نتیجه مسابقه به سمت پایین است: جایی که حسابرسان به جای کیفیت، بر سر ملایمت با یکدیگر رقابت می کنند و در ازای امضای عجولانه، قراردادهای بزرگ را به دست می آورند.

در این میان، به نظر می رسد که حداقل نوعی مقررات در حال نزدیک شدن است. در مواجهه با تشدید واکنش‌های عمومی، فعالیت‌های داخلی کارکنان، و ترس از رویدادهای انقراض کوتاه‌مدت هوش مصنوعی، هر دو Anthropic و OpenAI حمایت خود را از اشکال مختلف قوانین ایالتی و فدرال در مورد ممیزی شخص ثالث اعلام کرده‌اند.

در پادکست اخیر، بن هوروویتز - که شرکت سرمایه گذاری او صدای اصلی علیه مقررات هوش مصنوعی بوده است - همچنین به نظر می رسد رویکرد حسابرس خصوصی را پذیرفته است و می گوید که دولت "در تنظیم قوانین" در مورد رفتارهای مدل ناخواسته بسیار خوب است، در حالی که "یک شرکت خصوصی بسیار شایسته" باید انطباق را ارزیابی کند. پنجره اورتون در سیلیکون ولی در حال تغییر است. اما اگر خطرات واقعا وجودی باشد، استخدام چند بازرس اضافی به طرز دردناکی کوتاه می‌ماند – به‌ویژه زمانی که جزئیات ترتیبات اینقدر لغزنده باشد.

همه چیز خیلی کم و خیلی دیر به نظر می رسد. برخی از سیاستمداران، در مواجهه با مردمی خشمگین و ترسیده، به درخواست‌های تهاجمی‌تر روی آورده‌اند، مانند پیمان‌های هسته‌ای با چین و ممنوعیت خود ابراطلاعات. دو سال پیش، گاوین نیوسام، فرماندار کالیفرنیا، پس از یک کمپین لابی شدید توسط OpenAI و Andreessen Horowitz، لایحه ایالتی را که شامل ممیزی های اجباری شخص ثالث و سایر الزامات ایمنی بود، وتو کرد.

(Anthropic یک استثنا بود و حمایت مشروط را ابراز کرد.) هفته گذشته، Newsom - با احساس تغییر جزر و مد - دستوری اجرایی برای درخواست حسابرسان در محل و سرعت بخشیدن به توسعه "سوئیچ کشتن هوش مصنوعی" صادر کرد.

پرزیدنت ترامپ هنوز پایش را روی پدال گاز گذاشته است. او هفته گذشته نوشت: «تنها کنترل یا «نرده‌های محافظ» که هوش مصنوعی به آن نیاز دارد، یک رئیس جمهور قوی و باهوش (ضریب هوشی بالا!) است. در ماه ژوئن، دولت به CAISI، واحد ارزیابی هوش مصنوعی داخلی دولت فدرال، گفت که انتشار گزارش های خود را متوقف کند. شتاب گرایی ترامپ – که از رابطه او با حامی تالار رقص و جنسن هوانگ، مدیر عامل NVIDIA اطلاع داده شده است – احتمالا مقررات فدرال ایمنی هوش مصنوعی را در حال حاضر محکوم می کند.

دیدن اینکه برخی از رهبران صنعت هوش مصنوعی موافق هستند که شخص دیگری باید آنها را مهار کند، بسیار خوب است. و اگر به خوبی اجرا شوند، ارزیاب‌های تعبیه‌شده یک حرکت تکنوکراتیک هوشمندانه است. اما پس از سال‌ها توسعه فناوری، لابی‌گری علیه نرده‌های محافظ و ایجاد تصادفات متعدد، رهبران هوش مصنوعی نباید تعجب کنند که راه‌حل خط‌مشی ترجیحی و معتبر آنها با ناامیدی و انبوهی از شک و تردید مواجه شود.

خواندن متن کامل در آتلانتیکبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

AI Companies’ Shaky New Plan to Police Themselves

Dario Amodei, Sam Altman, and Elon Musk don’t agree on much. Each started their AI company—Anthropic, OpenAI, and xAI, respectively—out of spite at competitors’ greed and recklessness; each is certain that he alone can be entrusted to build superintelligence safely. But in the midst of the AI panic that has seized the country over the past two weeks, the three CEOs found one point of consensus: the introduction of…

همه‌ی اخبار فناوری