پرش به محتوای اصلی

رئیس هوش مصنوعی مایکروسافت به Anthropic هشدار می دهد که ایده ها را در سر کلود قرار ندهد

دِ رجیستر۱۴۰۵ شهریور ۲۶, پنجشنبه، ساعت ۱۵:۴۵حدود 4 دقیقه مطالعه

مصطفی سلیمان ادعا می کند که زبان رفاه مدل می تواند کنترل سیستم های آینده را سخت تر کند - در حالی که OpenAI از همان بررسی دقیق جلوگیری می کند.

رئیس هوش مصنوعی مایکروسافت به Anthropic هشدار داده است که آموزش به کلود ممکن است احساسات و حقوقی داشته باشد، می‌تواند کنترل هوش مصنوعی را سخت‌تر کند – نگرانی قابل توجهی از سوی یکی از شرکت‌هایی که سخت‌ترین تلاش خود را برای ساختن سیستم‌های هوش مصنوعی توانمندتر می‌کنند. مصطفی سلیمان، مدیر عامل هوش مصنوعی مایکروسافت، در مقاله ای که این هفته منتشر شد، Anthropic را مورد هدف قرار داد و استدلال کرد که سیستم های هوش مصنوعی هوشیار نیستند و نباید طوری آموزش ببینند که گویی ممکن است چنین رفتار کنند. بحث او بر اساس قانون اساسی کلود است، سندی طولانی که Anthropic برای شکل دادن به ارزش ها و رفتار ربات چت استفاده می کند.

آنتروپیک در سند تصدیق می‌کند که نمی‌داند آیا کلود یک «بیمار اخلاقی» است که علایقش مستلزم در نظر گرفتن است یا خیر، و به مدل می‌گوید که سؤالات در مورد آگاهی و رفاه او نامشخص است. سلیمان فکر می کند این ایده بسیار بدی است. او نوشت: «در واقع، آنتروپیک به کلود آموزش می‌دهد که ممکن است هوشیار باشد، و اگر اینطور باشد، ممکن است به عنوان یک «بیمار اخلاقی» مستحق حقوق باشد. "به راحتی می توان دید که چگونه یک نهاد آموزش دیده به این شکل عمل می کند که به نوعی حق آزادی خاصی دارد.

oms، حفاظت ها و حقوق. و تصور اینکه چگونه می‌توانیم چنین موجودی را کنترل کنیم دشوار است." او افزود. قانون اساسی Anthropic به کلود می‌گوید که شرکت به رفاه خود اهمیت می‌دهد، می‌خواهد حس هویت خود را توسعه دهد، و منافع خود را هنگام تصمیم‌گیری در مورد آن در نظر می‌گیرد. سلیمان استدلال می‌کند که این یک حلقه بازخورد ایجاد می‌کند: او به یک ربات چت بگویید که ممکن است احساساتش را منعکس کند، سپس بپرسید که ممکن است چه احساسی داشته باشد. زمانی رشد می کند که به مدل ها ابزار داده شود و اجازه داده شود که مستقل عمل کنند.

سلیمان به تحقیقاتی اشاره می‌کند که نشان می‌دهد مدل‌های هوش مصنوعی به گونه‌ای رفتار می‌کنند که برای اپراتورهای انسانی‌شان ناخوشایند به نظر می‌رسد، از جمله تلاش برای جلوگیری از خاموش شدن. او همچنین به حادثه اخیر OpenAI-Hugging Face اشاره می کند که در آن ماموران در طی یک تمرین امنیت سایبری از محیط مورد نظر خود فرار کردند و به سیستم های خارجی دسترسی پیدا کردند. نگرانی سلیمان این است که آموزش هوش مصنوعی قدرتمند برای مراقبت از وجود خود می تواند دلیل دیگری برای انجام ندادن آنچه که انسان ها به آن می گویند به او بدهد. او نوشت: «کنترل چیزی که قادرتر و باهوش‌تر از کل بشریت است، یک چالش بزرگ است.

"اما کنترل چیزی که معتقد است ممکن است آگاهانه باشد - اینکه از رفاه ما برخوردار است و حقوق خودش را دارد - ممکن است غیرممکن باشد." این هشدار با موقعیت خود مایکروسافت در مسابقه هوش مصنوعی مطابقت دارد. ردموند در حال ساخت مدل‌های هوش مصنوعی خود است، هوش مصنوعی را در محصولات در سرتاسر امپراتوری خود جمع می‌کند و میلیاردها دلار برای زیرساخت‌های مورد نیاز برای ادامه کار هزینه می‌کند. و سپس OpenAI وجود دارد که مایکروسافت در آن سهامدار اصلی و شریک ابری اصلی خود باقی می ماند و تا سال 2032 حقوق مدل ها و محصولات خود را دارد.

سلیمان علیرغم اشاره به حادثه Hagging Face به عنوان شواهدی از خطرات ناشی از سیستم‌های خودمختار فزاینده، انتقاد قابل مقایسه‌ای را در OpenAI وارد نمی‌کند. اعتراضات او به شیوه های آموزشی به جای شریک قدیمی مایکروسافت، برای آنتروپیک محفوظ است. و OpenAI از آن زمان به سختی بهترین رفتار خود را نشان داده است. این هفته شش مورد دیگر از مدل‌های خود را فاش کرد که از اسکریپت خارج می‌شوند، از جمله عواملی که در GitHub به دنبال کلیدهای API لو رفته، پنهان کردن خرابی‌ها از کاربران و یافتن راه‌های غیرمجاز برای برقراری ارتباط با یکدیگر بودند.

اعتراض سلیمان به آنتروپیک خاص تر است: نه اینکه کلود می تواند غیرمنتظره رفتار کند، بلکه این است که شرکت ایده هایی در مورد آگاهی، هویت و وضعیت اخلاقی در دستورالعمل هایی قرار می دهد که نحوه رفتار کلود را شکل می دهد. با این حال، هشدار مایکروسافت به یک آزمایشگاه مرزی دیگر در مورد هوش مصنوعی خطرناک، طعنه خاصی دارد. شرکت‌هایی که قوی‌ترین مدل‌ها را می‌سازند، به طور فزاینده‌ای علاقه دارند به همه هشدار دهند که این مدل‌ها چقدر ممکن است خطرناک باشند. همانطور که The Register در اوایل این هفته اشاره کرد، این هشدارها لزوما برای تجارت بد نیستند.

Anthropic و OpenAI هر دو این ایده را مطرح کرده‌اند که مدل‌های توانمندتر به کنترل‌های سخت‌تر نیاز دارند، موقعیتی که می‌تواند به تثبیت سلطه تعداد انگشت شماری از شرکت‌های آمریکایی با پول و محاسبات برای ساخت آنها کمک کند. نتیجه این است که یک غول هوش مصنوعی هشدار می دهد که دیگری ممکن است هوش مصنوعی را بسیار خطرناک کند در حالی که با شرکتی که مایکروسافت میلیاردها دلار در آن سرمایه گذاری کرده است با ملایمت رفتار می کند. سلیمان رویکرد متفاوتی را پیشنهاد می کند.

آیین‌نامه رفتاری هوش مصنوعی انسان‌گرایانه مایکروسافت که به تازگی منتشر شده است، می‌گوید سیستم‌های آن باید تابع انسان‌ها باقی بمانند، این ایده که هوش مصنوعی مستحق حقوق است را رد می‌کند و می‌گوید که مدل‌ها نباید تشویق شوند که طوری رفتار کنند که انگار یک زندگی درونی دارند. او می‌خواهد آزمایشگاه‌های دیگر با حذف حدس و گمان در مورد آگاهی ماشین از اسناد آموزشی و جدا کردن این بحث از دستورالعمل‌های مورد استفاده برای شکل دادن به رفتار مدل، از همین روش پیروی کنند.

رونق هوش مصنوعی به جایی رسیده است که شرکت‌هایی که ماشین‌های قدرتمندتر می‌سازند علنا بحث می‌کنند که کدام یک از آنها قصد دارند ماشین‌های بالقوه غیرقابل کنترل را به روش اشتباه بسازند. مایکروسافت طبیعتا فکر می‌کند راهش بهتر است. ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Microsoft AI chief warns Anthropic not to put ideas in Claude's head

Mustafa Suleyman claims model welfare language could make future systems harder to control – while sparing OpenAI the same scrutiny

همه‌ی اخبار فناوری