شرکتهای هوش مصنوعی میخواهند ارزیابهای ایمنی را تعبیه کنند، اما کشورها به ارزیابهای خودشان نیاز دارند
در رویداد Rest of World هفته گذشته در نیویورک، سخنرانان به بررسی این موضوع پرداختند که چگونه کشورهایی که توسط رقابت ایالات متحده و چین کنار گذاشته شدهاند، میتوانند برخی از کنترلهای خود را بر استانداردهای ایمنی حفظ کنند، زیرا مدلهایی از OpenAI، Anthropic و دیگران را اتخاذ میکنند.
کارشناسان هفته گذشته در رویداد Rest of World در نیویورک گفتند، تعداد فزاینده مواردی که عوامل هوش مصنوعی وب سایت های دولت ها و سایر موسسات را هک می کنند، هشداری برای کشورهایی است که از مدل های آمریکایی برای انجام ارزیابی های ایمنی خود استفاده می کنند.
نخست وزیر آنتونی آلبانیز هفته گذشته گفت که یک عامل OpenAI به پایگاه داده ملی مراقبت های بهداشتی استرالیا هک کرد و به "فایل های عمومی و غیر عمومی" دسترسی پیدا کرد. این اولین مورد گزارش شده بود. چند روز بعد، OpenAI گفت به دهها مؤسسه جهانی هشدار داده است که عوامل هوش مصنوعی آن برای دریافت اطلاعات از وبسایتهایشان نادرست عمل کرده و گاهی اقدامات امنیتی را دور زدهاند.
تمرکز قدرت خود یک خطر ایمنی است.» آمبا کاک، مدیر اجرایی، موسسه هوش مصنوعی در حال حاضر
این افشاگریها پس از سایر حوادث گزارششده توسط OpenAI، Anthropic و Meta در ماههای اخیر منتشر شد و داریو آمودی، مدیر عامل آنتروپیک، خواستار کاهش سرعت توسعه هوش مصنوعی در سراسر صنعت شد. سام آلتمن، مدیر عامل OpenAI و ایلان ماسک، مدیر عامل xAI، از درخواست او حمایت کردند، حتی اگر رئیس جمهور دونالد ترامپ آن را رد کرد.
آمبا کاک، مدیر اجرایی مؤسسه AI Now، یک سازمان تحقیقاتی مستقل، در رویداد Rest of World گفت: واگذاری ایمنی هوش مصنوعی به دست چند شرکت، تهدیدی برای حاکمیت کشورها، به ویژه کشورهای کوچکتر است که منابع لازم برای ارزیابی مدلها یا درخواست پاسخگویی بیشتر را ندارند.
او گفت که هک استرالیا «نمونه دیگری از ضعیفترین و غیرمسئولانهترین بهداشت سایبری از سوی برخی از قدرتمندترین و ثروتمندترین شرکتهای منبع در جهان است». "تمرکز قدرت به خودی خود یک خطر ایمنی است."
OpenAI گفت که حادثه استرالیا در ماه ژوئن رخ داد و این شرکت در ماه آگوست از آن مطلع شد و دولت استرالیا را در سپتامبر از طریق ایمیلی به صندوق ورودی عمومی اطلاع داد. آلبانیز به خبرنگاران گفت که OpenAI "خیلی طول کشید تا به دولت اطلاع دهد که چه اتفاقی افتاده است، و ماهیت نحوه انجام آن اطلاع رسانی نیز غیرقابل قبول بود."
آلتمن در X نوشت: OpenAI «به آن سرعتی که ما میخواستیم» نبود، اما ما سعی میکنیم میل خود برای شفافیت را با دستیابی به درک روشنی از پتابایتها از گزارشهای فعالیت عامل و کار با سازمانهای تحت تأثیر متعادل کنیم.
ساعاتی پس از افشای این حوادث، OpenAI گفت که تصمیم گرفته است آموزش قویترین مدلهای خود را متوقف کند و «فقط زمانی که مطمئن باشیم که تدابیر امنیتی بیشتری داریم، آموزش را از سر میگیرد». این هفته، این شرکت اعلام کرد که جدیدترین مدل هوش مصنوعی خود را به دلیل نگرانی های امنیتی منتشر نخواهد کرد.
رامن چاودری، مدیر اجرایی شرکت Humane Intelligence Public Benefit Corp.، یک شرکت مستقل تست و ارزیابی، در رویداد بقیه جهان گفت: همانطور که پذیرش هوش مصنوعی در سراسر جهان رشد می کند، هر کشوری باید بدون اتکا به ایالات متحده یا شرکت های هوش مصنوعی برای اقدام، ایمنی را در دست بگیرد.
چاودوری گفت: «فکر نمیکنم هیچ یک از ما فکر کنیم در دنیایی زندگی میکنیم که در آن مدلهای هوش مصنوعی به اندازه کافی امن هستند. هر وزیر و سفیری میگویند، ما هوش مصنوعی را در آموزش قرار میدهیم، ما از هوش مصنوعی برای مراقبتهای بهداشتی استفاده میکنیم. چیزی که من دوست دارم این است که تک تک آن وزرا به طور یکسان به این فکر کنند که چگونه دسترسی عادلانه و نتایج عادلانه از اجرای هوش مصنوعی را تضمین میکنند، نه اینکه این از دست دادن کنترل را بهعنوان «این برای کشورهای بزرگ و قدرتمند» ببینند.
انجام یک ارزیابی کاری غیرقابل حل به نظر می رسد، زیرا به این شکل طراحی شده است.» رامن چاودری، مدیر عامل، Humane Intelligence PBC
OpenAI گفته است که با Anthropic و Google برای ایجاد یک سازمان استاندارد کار می کند، ایده ای که در ابتدا توسط Demis Hassabis از Google DeepMind به عنوان یک آژانس خودتنظیمی پیشنهاد شد که قدرتمندترین سیستم های هوش مصنوعی را قبل از انتشار برای عموم آزمایش می کند. رئیس جمهور ترامپ روز سه شنبه گفت که مدیران ارشد هوش مصنوعی با استانداردهای داوطلبانه با هدف بازنگری سیستم های هوش مصنوعی و افزایش نظارت بر صنعت موافقت کرده اند.
به گفته کاک، این اقدامات برای محیطهایی که هوش مصنوعی در کشورهای با درآمد پایین و متوسط که بسیار متفاوت از جعبههای شنی در ایالات متحده هستند، مستقر شده است.
او گفت: «حتی اگر این شرکتها میلیاردها دلار برای ایمنسازی مدلهای خود هزینه کردند، ما با طرف دیگر مشکل مواجه نیستیم، یعنی محیطهایی که این سیستمها در آن ادغام میشوند چقدر انعطافپذیر هستند». این هزینهها هرگز بر عهده این شرکتهای تریلیون دلاری نخواهد بود. آنها توسط بیمارستانها، مدارس، بانکها در کشورهایی که به شدت ناآماده هستند، متقبل خواهند شد.»
وفا بن حسین، رئیس بخش فناوری دیجیتال و حقوق بشر در دفتر کمیساریای عالی حقوق بشر سازمان ملل، در رویداد بقیه جهان گفت که بسیاری از کشورها همچنین فاقد منابع و تخصص برای انجام ارزیابی های خود هستند.
بن هاسین گفت: «فقدان شدید تخصص فنی، هم در اقتصادهای پیشرفته و هم در هر جای دیگر وجود دارد. کشورهای فقیرتر می توانند از ارزیابی تاثیرات حقوق بشر سازمان ملل برای اطمینان از استقرار ایمن و ایمن هوش مصنوعی استفاده کنند.
او گفت: "بررسی حقوق بشر، ارزیابی تاثیرات حقوق بشر... روش های قابل سنجش و اثبات شده ای هستند تا بتوانیم محصولات بهتری داشته باشیم که به گونه ای به دست مردم برسند که به آنها و کرامت انسانی آنها احترام بگذارد."
روسای Anthropic و OpenAI هفته گذشته به شورای امنیت سازمان ملل گفتند که کشورها باید برای توسعه استانداردهای بین المللی برای مدیریت خطرات هوش مصنوعی همکاری کنند.
کمبود شدید تخصص فنی، هم در اقتصادهای پیشرفته و هم در هر جای دیگر وجود دارد.» وفا بن حسین، دفتر کمیساریای عالی حقوق بشر سازمان ملل
به طور جداگانه، بیش از 25 کشور اخیرا فراخوانی را برای شرکتهای هوش مصنوعی مرزی برای توسعه «آزمایش اجباری قبل از استقرار و ارزیابی مستقل، با ارزیابهای واجد شرایط دسترسی کافی برای ارزیابی خطرات» تأیید کردند.
با این حال، ارزیابیهای ایمنی هوش مصنوعی عمدتا توسط شرکتهای مورد ارزیابی طراحی میشوند و زیرساختها از نظر زبانی و جغرافیایی در غرب متمرکز است. پانل علمی بین المللی مستقل سازمان ملل در زمینه هوش مصنوعی در گزارش خود در اوایل سال جاری خاطرنشان کرد، بدون "ارزیابی شخص ثالث مستقل، دقیق و مستقل، مشابه آنچه برای صنایع داروسازی و هوانوردی وجود دارد، تضمین ایمنی تا حد زیادی به حسن نیت توسعه دهنده بستگی دارد."
Chowdhury با اشاره به اینکه Anthropic تنها حدود یک دهم بودجه آموزشی خود را برای ایمن سازی مدل های خود اختصاص می دهد، گفت: حتی در ایالات متحده نیز "سرمایه گذاری ناکافی در ایمنی و امنیت" صورت گرفته است. او گفت، با این حال، شرکتهای هوش مصنوعی عوامل خود را «سرکش» توصیف میکنند که گویی آن نتیجه غیرمنتظره بود.
Chowdhury هفته گذشته بنیاد ارزیابی هوش مصنوعی مستقل را راه اندازی کرد تا چک های مستقل و شخص ثالث سیستم های هوش مصنوعی را ایجاد کند. او گفت: برای کشورهای کوچکتر و کسب و کارهای کوچک و متوسط، "انجام یک ارزیابی کاری غیرقابل حل به نظر می رسد، زیرا به این صورت تنظیم شده است، که آنها نمی دانند چه سوالاتی باید بپرسند، ابزار لازم برای انجام آزمایش را ندارند، آنها افرادی را برای انجام کار ندارند."
چاودری گفت که هدف IAEF ایجاد زیرساخت و ابزاری برای کاهش هزینه ها و سپس ارتقاء مهارت افراد مناسب برای ارزیابی کننده در کشورهای خود است.
کاک گفت، در نهایت، برای کشورهایی که توسط رقابت هوش مصنوعی ایالات متحده و چین کنار گذاشته شده اند، تعیین چگونگی تعریف ایمنی مهم است.
او گفت: «بیایید درباره همه راههایی صحبت کنیم که ایمنی برای افراد عادی چه معنایی دارد یا میتواند به آن معنا داشته باشد، و این منافع کجاست. "به طور مشابه در مورد حاکمیت. ما باید در برابر تصرف صنعت در اشکال مختلف مقاومت کنیم."
متن اصلی (انگلیسی)
AI companies want to embed safety evaluators, but countries need their own
At a Rest of World event in New York last week, speakers explored how countries sidelined by the U.S.-China race can retain some control over safety standards as they adopt models from OpenAI, Anthropic, and others.