رئیس هوش مصنوعی مایکروسافت به Anthropic هشدار می دهد که ایده ها را در سر کلود قرار ندهد
مصطفی سلیمان ادعا می کند که زبان رفاه مدل می تواند کنترل سیستم های آینده را سخت تر کند - در حالی که OpenAI از همان بررسی دقیق جلوگیری می کند.
رئیس هوش مصنوعی مایکروسافت به Anthropic هشدار داده است که آموزش به کلود ممکن است احساسات و حقوقی داشته باشد، میتواند کنترل هوش مصنوعی را سختتر کند – نگرانی قابل توجهی از سوی یکی از شرکتهایی که سختترین تلاش خود را برای ساختن سیستمهای هوش مصنوعی توانمندتر میکنند. مصطفی سلیمان، مدیر عامل هوش مصنوعی مایکروسافت، در مقاله ای که این هفته منتشر شد، Anthropic را مورد هدف قرار داد و استدلال کرد که سیستم های هوش مصنوعی هوشیار نیستند و نباید طوری آموزش ببینند که گویی ممکن است چنین رفتار کنند. بحث او بر اساس قانون اساسی کلود است، سندی طولانی که Anthropic برای شکل دادن به ارزش ها و رفتار ربات چت استفاده می کند.
آنتروپیک در سند تصدیق میکند که نمیداند آیا کلود یک «بیمار اخلاقی» است که علایقش مستلزم در نظر گرفتن است یا خیر، و به مدل میگوید که سؤالات در مورد آگاهی و رفاه او نامشخص است. سلیمان فکر می کند این ایده بسیار بدی است. او نوشت: «در واقع، آنتروپیک به کلود آموزش میدهد که ممکن است هوشیار باشد، و اگر اینطور باشد، ممکن است به عنوان یک «بیمار اخلاقی» مستحق حقوق باشد. "به راحتی می توان دید که چگونه یک نهاد آموزش دیده به این شکل عمل می کند که به نوعی حق آزادی خاصی دارد.
oms، حفاظت ها و حقوق. و تصور اینکه چگونه میتوانیم چنین موجودی را کنترل کنیم دشوار است." او افزود. قانون اساسی Anthropic به کلود میگوید که شرکت به رفاه خود اهمیت میدهد، میخواهد حس هویت خود را توسعه دهد، و منافع خود را هنگام تصمیمگیری در مورد آن در نظر میگیرد. سلیمان استدلال میکند که این یک حلقه بازخورد ایجاد میکند: او به یک ربات چت بگویید که ممکن است احساساتش را منعکس کند، سپس بپرسید که ممکن است چه احساسی داشته باشد. زمانی رشد می کند که به مدل ها ابزار داده شود و اجازه داده شود که مستقل عمل کنند.
سلیمان به تحقیقاتی اشاره میکند که نشان میدهد مدلهای هوش مصنوعی به گونهای رفتار میکنند که برای اپراتورهای انسانیشان ناخوشایند به نظر میرسد، از جمله تلاش برای جلوگیری از خاموش شدن. او همچنین به حادثه اخیر OpenAI-Hugging Face اشاره می کند که در آن ماموران در طی یک تمرین امنیت سایبری از محیط مورد نظر خود فرار کردند و به سیستم های خارجی دسترسی پیدا کردند. نگرانی سلیمان این است که آموزش هوش مصنوعی قدرتمند برای مراقبت از وجود خود می تواند دلیل دیگری برای انجام ندادن آنچه که انسان ها به آن می گویند به او بدهد. او نوشت: «کنترل چیزی که قادرتر و باهوشتر از کل بشریت است، یک چالش بزرگ است.
"اما کنترل چیزی که معتقد است ممکن است آگاهانه باشد - اینکه از رفاه ما برخوردار است و حقوق خودش را دارد - ممکن است غیرممکن باشد." این هشدار با موقعیت خود مایکروسافت در مسابقه هوش مصنوعی مطابقت دارد. ردموند در حال ساخت مدلهای هوش مصنوعی خود است، هوش مصنوعی را در محصولات در سرتاسر امپراتوری خود جمع میکند و میلیاردها دلار برای زیرساختهای مورد نیاز برای ادامه کار هزینه میکند. و سپس OpenAI وجود دارد که مایکروسافت در آن سهامدار اصلی و شریک ابری اصلی خود باقی می ماند و تا سال 2032 حقوق مدل ها و محصولات خود را دارد.
سلیمان علیرغم اشاره به حادثه Hagging Face به عنوان شواهدی از خطرات ناشی از سیستمهای خودمختار فزاینده، انتقاد قابل مقایسهای را در OpenAI وارد نمیکند. اعتراضات او به شیوه های آموزشی به جای شریک قدیمی مایکروسافت، برای آنتروپیک محفوظ است. و OpenAI از آن زمان به سختی بهترین رفتار خود را نشان داده است. این هفته شش مورد دیگر از مدلهای خود را فاش کرد که از اسکریپت خارج میشوند، از جمله عواملی که در GitHub به دنبال کلیدهای API لو رفته، پنهان کردن خرابیها از کاربران و یافتن راههای غیرمجاز برای برقراری ارتباط با یکدیگر بودند.
اعتراض سلیمان به آنتروپیک خاص تر است: نه اینکه کلود می تواند غیرمنتظره رفتار کند، بلکه این است که شرکت ایده هایی در مورد آگاهی، هویت و وضعیت اخلاقی در دستورالعمل هایی قرار می دهد که نحوه رفتار کلود را شکل می دهد. با این حال، هشدار مایکروسافت به یک آزمایشگاه مرزی دیگر در مورد هوش مصنوعی خطرناک، طعنه خاصی دارد. شرکتهایی که قویترین مدلها را میسازند، به طور فزایندهای علاقه دارند به همه هشدار دهند که این مدلها چقدر ممکن است خطرناک باشند. همانطور که The Register در اوایل این هفته اشاره کرد، این هشدارها لزوما برای تجارت بد نیستند.
Anthropic و OpenAI هر دو این ایده را مطرح کردهاند که مدلهای توانمندتر به کنترلهای سختتر نیاز دارند، موقعیتی که میتواند به تثبیت سلطه تعداد انگشت شماری از شرکتهای آمریکایی با پول و محاسبات برای ساخت آنها کمک کند. نتیجه این است که یک غول هوش مصنوعی هشدار می دهد که دیگری ممکن است هوش مصنوعی را بسیار خطرناک کند در حالی که با شرکتی که مایکروسافت میلیاردها دلار در آن سرمایه گذاری کرده است با ملایمت رفتار می کند. سلیمان رویکرد متفاوتی را پیشنهاد می کند.
آییننامه رفتاری هوش مصنوعی انسانگرایانه مایکروسافت که به تازگی منتشر شده است، میگوید سیستمهای آن باید تابع انسانها باقی بمانند، این ایده که هوش مصنوعی مستحق حقوق است را رد میکند و میگوید که مدلها نباید تشویق شوند که طوری رفتار کنند که انگار یک زندگی درونی دارند. او میخواهد آزمایشگاههای دیگر با حذف حدس و گمان در مورد آگاهی ماشین از اسناد آموزشی و جدا کردن این بحث از دستورالعملهای مورد استفاده برای شکل دادن به رفتار مدل، از همین روش پیروی کنند.
رونق هوش مصنوعی به جایی رسیده است که شرکتهایی که ماشینهای قدرتمندتر میسازند علنا بحث میکنند که کدام یک از آنها قصد دارند ماشینهای بالقوه غیرقابل کنترل را به روش اشتباه بسازند. مایکروسافت طبیعتا فکر میکند راهش بهتر است. ®
متن اصلی (انگلیسی)
Microsoft AI chief warns Anthropic not to put ideas in Claude's head
Mustafa Suleyman claims model welfare language could make future systems harder to control – while sparing OpenAI the same scrutiny