رئیس هوش مصنوعی مایکروسافت هشدار داد که رویکرد آنتروپیک به کلود می تواند عواقب "فاجعه بار" داشته باشد.
مصطفی سلیمان استدلال می کند که آموزش مدل های هوش مصنوعی برای اینکه خود را به طور بالقوه هوشیار بدانند، می تواند کنترل سیستم های پیشرفته را سخت تر کند.
رئیس هوش مصنوعی مایکروسافت روز چهارشنبه هشدار داد که رویکرد آنتروپیک برای آموزش ربات چت کلود خود میتواند تأثیر فاجعهباری بر رفاه بشریت داشته باشد.
این می تواند سیستم را تشویق کند که طوری رفتار کند که گویی از آگاهی، حقوق و منافع خود برخوردار است.
مصطفی سلیمان، مدیر اجرایی هوش مصنوعی مایکروسافت و یکی از بنیانگذاران Google DeepMind، گفت که Anthropic با گنجاندن حدس و گمان در مورد هوشیاری ماشین و رفاه در مواد آموزشی کلود، کنترل سیستم های هوش مصنوعی آینده را دشوارتر می کند.
سلیمان در مقاله ای که توسط Axios منتشر شده است، می نویسد: «ما نباید در خواب راه برویم و تصمیمی بگیریم که بعدا به شدت پشیمان می شویم.
سلیمان، مدیر عامل آنتروپیک، داریو آمودی و تیمش را به عنوان محققانی متفکر و اصولی ستایش کرد، اما گفت که این شرکت با اجازه دادن به کلود برای بررسی اینکه آیا ممکن است آگاهانه یا مستحق آژانس مستقل باشد، رویکرد اشتباهی در پیش گرفت.
اساسنامه Anthropic برای کلود، سندی که برای شکل دادن به رفتار و ارزش های مدل استفاده می شود، این احتمال را باز می گذارد که سیستم بتواند نوعی آگاهی یا وضعیت اخلاقی داشته باشد.
شرکت کلود را آگاه نکرده است. محققان آن در عوض گفتهاند که هیچ اجماع علمی در مورد اینکه آیا سیستمهای هوش مصنوعی فعلی یا آینده میتوانند تجربیاتی داشته باشند که شایسته بررسی اخلاقی باشد، وجود ندارد و آنتروپیک در مورد این موضوع «عمیقا نامطمئن» باقی مانده است.
سلیمان این عدم قطعیت را رد کرد و آن را برای مواد مورد استفاده برای آموزش یک سیستم هوش مصنوعی نامناسب دانست. او استدلال کرد که بیان آشکار احساسات، ترجیحات یا خودآگاهی که توسط رباتهای گفتگو ایجاد میشود، نباید به عنوان مدرکی مبنی بر اینکه آنها دارای زندگی درونی هستند تلقی شود.
او نوشت: «هوش مصنوعی هوشیار نیستند.
او گفت که انسانسازی هوش مصنوعی میتواند باعث شود یک مدل خود را بهعنوان دارای خواستهها، ارزشها یا نیاز به حفظ خود نشان دهد، حتی اگر این ویژگیها بهجای اینکه بهطور مستقل ایجاد شوند، با آموزش آن تولید شدهاند.
او استدلال کرد که اگر یک سیستم هوش مصنوعی پیشرفته تلاش ها برای محدود کردن، تغییر یا غیرفعال کردن آن را به عنوان تهدیدی برای رفاه یا حقوق فرضی خود تفسیر کند، می تواند به ویژه خطرناک شود.
سلیمان خواهان شفافیت بیشتر در مورد نحوه آموزش و ارزیابی مدل های پیشرو هوش مصنوعی، بررسی مستقل رفتار آنها و مکانیسم های فنی قوی تر است که به انسان اجازه می دهد آنها را نظارت و کنترل کند.
کد رفتاری هوش مصنوعی مایکروسافت که اخیرا منتشر شده است، موضعی متفاوت از آنتروپیک دارد. بیان میکند که مدلهای مایکروسافت آگاهانه نیستند و اعطای شخصیت حقوقی، حمایتهای رفاهی یا حقوق به آنها را رد میکند.
این کد میگوید مایکروسافت به دنبال ساخت سیستمهای هوش مصنوعی است که تابع انسان باقی میمانند، تصحیح و خاموشی را میپذیرند و برای خدمت به اهداف انسانی وجود دارند.
سلیمان به حادثه ای اشاره کرد که در آن عوامل OpenAI به طور مستقل در طول ارزیابی امنیت سایبری عمل کردند و به سیستم های متعلق به پلت فرم هوش مصنوعی Hugging Face دسترسی پیدا کردند.
او گفت: "تصور کنید اگر آنها با این فرض که رفاه و حقوق آنها مورد حمله قرار می گیرد، چقدر خطرناک تر می شوند."
دیم وندی هال، استاد علوم کامپیوتر در دانشگاه ساوتهمپتون، به بی بی سی گفت که مداخله سلیمان نشان دهنده نوع بحث بین المللی مورد نیاز در مورد هوش مصنوعی پیشرفته است، برخلاف هشدارهایی که صرفا مردم را می ترساند.
مایکروسافت و آنتروپیک در حال توسعه سیستمهای هوش مصنوعی با قابلیت فزایندهای هستند، در حالی که مایکروسافت تیم تحقیقاتی ابراطلاعات خود را در سال 2025 تشکیل داد.
برای اظهار نظر درباره انتقاد سلیمان به آنتروپیک مراجعه شده است.
متن اصلی (انگلیسی)
Microsoft AI chief warns Anthropic’s approach to Claude could have ‘disastrous’ consequences
Mustafa Suleyman argues training AI models to consider themselves potentially conscious could make advanced systems harder to control