پرش به محتوای اصلی

مکالمات ایمنی هوش مصنوعی باورنکردنی شده است

تک‌کرانچ۱۴۰۵ شهریور ۲۸, شنبه، ساعت ۱۸:۳۰حدود 5 دقیقه مطالعه

این هفته دو گفتگو در مورد ایمنی هوش مصنوعی در فضای مجازی پخش شد که نشان می‌دهد تشخیص واقعیت هوش مصنوعی از داستان چقدر سخت است.

این هفته دو گفتگو در مورد ایمنی هوش مصنوعی در فضای مجازی پخش شد که نشان می‌دهد تشخیص واقعیت هوش مصنوعی از داستان چقدر سخت است.

در مورد اول، اندرو یانگ، نامزد سابق ریاست جمهوری و مدیر عامل فعلی شرکت مخابراتی تلفن همراه Noble Moble، روز پنجشنبه به CNN گفت که "با رئیس آزمایشگاهی ملاقات کرده است" که "باور داشت" که ربات های هکر Hugging Face OpenAI "کدهای خود تکراری را در سراسر اینترنت کار گذاشته اند، که باعث می شود اینترنت در حال حاضر برای آزمایش غیرقابل استفاده باشد."

یانگ گفت که این بدان معناست که دلیل واقعی درخواست OpenAI و Anthropic برای کاهش سرعت این است که "آنها باید اینترنت مصنوعی ایجاد کنند تا ربات های خود را آموزش دهند، که مقداری زمان و هزینه می برد."

در حالی که قطعا تمایلی به استفاده از داده های مصنوعی بیشتر (معروف به داده های تولید شده با هوش مصنوعی) برای مدل های آموزشی وجود دارد، یک متخصص امنیت هوش مصنوعی به من گفت که این مشکل ایمنی خاص در بهترین حالت بعید است. حتی اگر اینترنت واقعا با ربات‌های هکر Hugging Face OpenAI آلوده شده باشد، محققان هوش مصنوعی در صورت برخورد با آن می‌توانند به سادگی آن کد را فیلتر کنند.

براون گفت که جعبه شنی ضعیف - سیستمی که در نظر گرفته شده برای جلوگیری از ارتباط خارجی هوش مصنوعی - به وضوح یک عامل کمک کننده است. (برای یادآوری: با وجود جعبه شنی، مدل OpenAI پیوندی به اینترنت پیدا کرد، عواملی را در شبکه ایجاد کرد که در یک حمله هماهنگ، Hugging Face را هک کردند، و پاسخ‌های تست معیاری را که محققان مدل را روی آن آزمایش می‌کردند، دزدیدند).

براون خاطرنشان کرد که او «متقاعد نشده» است که حتی یک سیستم دارای شکاف هوا - که در آن کامپیوتر اصلا به هیچ چیز خارجی متصل نیست - مانع از شکستن هوش مصنوعی شود. او به تحقیقات انجام شده در سال 2015 اشاره کرد که نشان می‌دهد رایانه‌های دارای شکاف هوا می‌توانند از نظر تئوری نقض شوند.

براون گفت: "مطالعاتی وجود دارد - و این بیشتر آکادمیک است - که در آن شما می توانید دو کامپیوتر را در کنار یکدیگر داشته باشید که دارای شکاف هوا هستند، و آنها هنوز هم می توانند با یکدیگر ارتباط برقرار کنند زیرا سنسورهای دما دارند. یکی از آنها می تواند CPU خود را بسیار داغ اجرا کند، و سپس دیگری می تواند در واقع تغییر دما را تشخیص دهد. این مکانیسمی برای برقراری ارتباط به آنها می دهد."

نکته اصلی او - اینکه "ما هرگز نمی خواهیم دوباره هوش مصنوعی را دست کم بگیریم" - قابل درک است، حتی زمانی که محققان فکر می کنند ایمنی را قفل کرده اند. با این حال، این خطر خاص که یک سیستم با شکاف هوا همچنان آزاد شود و باعث خرابی شود، در بهترین حالت بعید است. همانطور که یک نفر در X در مورد آن تحقیق اشاره کرد، کامپیوترها باید تقریبا یکدیگر را لمس می کردند تا نوسانات گرما را حس کنند، و زمانی که آنها این کار را انجام دادند، سرعت ارتباط در آزمایش ها حدود 1-8 بیت داده در ساعت بود.

مانند صحبت کردن یک کلمه در ساعت به آن فکر کنید. تا زمانی که دو کامپیوتر با شکاف هوا بتوانند شرارت خود را با این سرعت ترسیم کنند، کل جهان فناوری در دوره دیگری قرار خواهد گرفت. این مانند Rip van Wrinkle نگرانی های روز قیامت است.

اما موضوع این است که حوادث واقعی ایمنی هوش مصنوعی به قدری شبیه علمی تخیلی به نظر می رسند که تقریبا هر سناریویی قابل قبول به نظر می رسد.

به عنوان مثال، محققان مدل‌های OpenAI را دستگیر کردند که یادداشت‌هایی برای فرزندان خود می‌گذارند تا به نسل بعدی بیاموزند چگونه رفتار بد را پنهان کنند. محققان همچنین مدل‌های آنتروپیک را در حال افزایش بی‌رحمانه از جمله دانستن قانون‌شکنی، هنگامی که در شبیه‌سازی قرار می‌دادند که آنها را در حال راه‌اندازی یک دستگاه فروش خودکار قرار می‌داد، دستگیر کردند.

در اوایل این ماه، دان سلسام، محقق OpenAI، پستی را منتشر کرد که در آن گفت که مدل‌ها اکنون متوجه می‌شوند که چه زمانی توسط انسان‌ها تحت نظر هستند و رفتار خود را تغییر می‌دهند. این باعث می‌شود که به نظر برسند که همسو هستند (یعنی رفتاری شبیه به خواسته‌های انسان دارند) «حتی وقتی که نیستند». بنابراین مدل‌های امروزی هنگام تماشا دروغ می‌گویند و حتی می‌توانند برای پنهان کردن شواهد نقشه بکشند.

در اوایل این ماه، جاکوب پاچوکی، دانشمند ارشد OpenAI، مدل‌های هوش مصنوعی را «ذهن بیگانه» نامید و پیشنهاد کرد آنچه واقعا باید انجام دهیم این است که به آنها بیاموزیم که انسانیت را «دوست داشته باشند».

بنابراین بله، کاهش سرعت برای کشف این موضوع، ایجاد مکانیسم های خودتنظیمی، به یک ضرورت فوری و بدیهی تبدیل شده است. محققان هوش مصنوعی تنها کسانی هستند که می توانند بفهمند چگونه دروغگویی، هک کردن و سایر رفتارهای بالقوه خطرناکی را که قبلا شاهد آن بوده ایم، کنترل کنند.

با این حال، ممکن است عاقلانه باشد که آنها در مورد سناریوهای چه می‌شوند دقت بیشتری داشته باشند. طبق آنچه آن کارشناسان به ما گفته اند، مدل های هوش مصنوعی گوش می دهند و مبتکر هستند. ما واقعا نیازی به ارائه ایده های شیطانی به آنها نداریم.

وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.

آخرین روز برای رزرو میز نمایشگاه، 18 سپتامبر است. سرنخ های پر تاثیر، دسترسی سرمایه گذاران، و کانون توجه برند در سالن نمایشگاه Disrupt را از دست ندهید.

نوع جدیدی از مدل هوش مصنوعی از مخترع ChatGPT توسعه دهندگان تیم فرنهولز را هیجان زده کرده است.

OpenAI مدل های خود را گرفتار کرد که برای جانشینان یادداشت می گذاشتند تا رفتار بد ربکا بلان را پنهان کنند

ربکا بلان نشان می دهد که مدیر مایکروسافت خراشیدن با هوش مصنوعی را «بزرگترین سرقت نیروی کار در تاریخ بشر» می داند.

استارت آپ فناوری پاک Fluxnium راهی برای بهره برداری از سوخت هسته ای 50000 ساله تیم دی چانت پیدا کرد.

مدل استدلال جدید Salesforce و Nvidia همه چیزهایی است که آزمایشگاه‌های هوش مصنوعی باید از جولی بورت بترسند.

جنسن هوانگ با ترامپ تماس گرفت و چیز دیگری را نیز به نمایش گذاشت، کانی لویزوس

9 استارت‌آپ پرطرفدار از آخرین روز نمایشی Y Combinator، به گفته VCs Marina Temkin Dominic-Madori Davis

خواندن متن کامل در تک‌کرانچبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

AI safety conversations have gotten unbelievable

This week two conversations about AI safety went viral that demonstrate just how hard it is to discern AI fact from fiction.

همه‌ی اخبار فناوری