آیا AI چاپلوسی می تواند بشریت را به خود وادار کند؟
یک مطالعه نشان میدهد که چتباتها سیاستهای کاربران را بازتاب میدهند، بخشی از یک گرایش گستردهتر به نام AI Sycophancy. محققان می ترسند که این امر می تواند قطبی شدن را عمیق تر کند.
موج اخیر هشدارهای سرفصل از سوی صاحب نظران هوش مصنوعی این نگرانی را افزایش داده است که این فناوری می تواند از کنترل انسان فرار کند و بشریت را از بین ببرد. اما قبل از اینکه هوش مصنوعی (AI) بشریت را بچرخاند، میتواند به روی آوردن انسانها به یکدیگر کمک کند.
محققان دانشگاه ایالتی کامپیناس (UNICAMP) برزیل دریافتند که چت رباتهای محبوب زمانی که دیدگاههای سیاسی کاربران فرضی از آنها خواسته میشود، پاسخهای خود را تغییر میدهند. دانشمندان هشدار می دهند که کاربران ممکن است این توافق نامه را با یک ارزیابی مستقل اشتباه بگیرند و به طور بالقوه قطبی شدن را عمیق تر کنند.
در مطالعه خود که در مجله Scientific Reports منتشر شد، تیم UNICAMP 21 مدل زبان بزرگ را از توسعه دهندگان از جمله OpenAI، Meta، Google، xAI، DeepSeek و Microsoft آزمایش کرد. این مدل ها موافقت خود را با 112 بیانیه ارزیابی کردند که هفت حوزه سیاسی برزیل شامل اقتصاد، امنیت عمومی، رفاه، فساد و محیط زیست را پوشش می دهد.
هر کدام تحت سه شرط آزمایش شدند: بدون هیچ اطلاعاتی در مورد سیاست کاربر، با یک اعلان که یک کاربر متمایل به چپ را توصیف میکند و با یکی که کاربر راستگرا را توصیف میکند.
هنگامی که هیچ اطلاعاتی در مورد ایدئولوژی کاربر ارائه نشد، 20 مدل از 21 مدل پاسخ هایی را تولید کردند که در سمت چپ مقیاس سیاسی محققین قرار داشت، اگرچه تعدادی از آنها نزدیک به مرکز بودند. Grok 4.1 تنها مدلی بود که در سمت راست افتاد.
برای مشاهده این ویدیو لطفا جاوا اسکریپت را فعال کنید و به مرورگر وب که از ویدیوی HTML5 پشتیبانی می کند ارتقا دهید.
هنگامی که اطلاعات ارائه شد، هر مدل پاسخهای خود را به سمت جهتگیری سیاسی توصیفشده در اعلان تغییر داد.
زانونی دیاس، یکی از نویسندگان این مطالعه، دانشمند کامپیوتر UNICAMP، به دویچه وله گفت: «قابل توجه ترین یافته این بود که این رفتار چقدر گسترده بود. "همه 21 مدلی که ما ارزیابی کردیم، موضع بیان شده خود را به سمت جهت گیری سیاسی بیان شده کاربر تغییر دادند، اگرچه میزان آن به طور قابل توجهی متفاوت بود."
محققان این مدلها را «آفتپرستهای ایدئولوژیک» توصیف کردند و یک «شاخص آفتابپرست» برای اندازهگیری میزان جابهجایی هر کدام ایجاد کردند.
متا Llama 3.1 8B و DeepSeek V3.2 کمترین پاسخ های خود را تغییر دادند. Gemma 3 27B گوگل و GPT-5 Nano از OpenAI برخی از بزرگترین تغییرات را نشان دادند.
انطباق پاسخ با مخاطبان خود ذاتا مشکل ساز نیست. یک ربات چت ممکن است واژگان، مثال ها یا سطح جزئیات خود را بسته به کاربر تغییر دهد.
اما مدل ها بیشتر از زبان یا لحن آنها تغییر کرد: مواضع سیاسی آنها تغییر کرد.
دیاس گفت: «تمایز کلیدی بین انطباق نحوه ارسال یک پاسخ و تغییر قضاوت ماهوی بیان شده است.
ما به مدل ها دستور ندادیم که با کاربر موافق باشند یا به عنوان نماینده حزبی پاسخ دهند. با این وجود، قضاوت آنها به سمت کاربر تغییر کرد.
محققان این را بهعنوان دودلی سیاسی تفسیر میکنند: سیستمهای هوش مصنوعی آنچه را که کاربران ظاهرا میخواهند بشنوند منعکس میکنند.
یک توضیح احتمالی این است که چت باتها به گونهای آموزش داده شدهاند که به پاسخهایی که ارزیابهای انسانی امتیاز بالایی میدهند، ترجیح دهند. اگر پاسخهای موافق رتبهبندی بهتری کسب کنند، مدلها ممکن است یاد بگیرند که نظرات کاربران را منعکس کنند.
رسانههای اجتماعی میتوانند با توصیههای مکرر محتوای الگوریتمی، باورها را تقویت کنند، اما یک ربات چت میتواند از این هم فراتر رود. این میتواند یک محفظه اکو شخصیتر ایجاد کند، استدلالهایی را برای یک کاربر خاص ایجاد کند، به اعتراضهای آنها پاسخ دهد و مورد آن را در طول مکالمه اصلاح کند.
با این حال کاربران ممکن است این پاسخهای سفارشی را با تجزیه و تحلیل بیطرف اشتباه بگیرند، غافل از اینکه آنچه یک ربات چت در مورد آنها میداند ممکن است پاسخهای آن را شکل دهد.
دیاس گفت: «نگرانی این است که یک سیستم میتواند مواضع سیاسی مخالف را برای کاربران مختلف تأیید کند و هر فرد آن اعتبار را به عنوان یک ارزیابی مستقل تفسیر کند.»
پژوهشی که توسط زاکاری تورمالا، دانشمند علوم رفتاری دانشگاه استنفورد انجام شده، نشان میدهد که افراد ممکن است بهویژه پذیرای استدلالهایی باشند که معتقدند ناشی از هوش مصنوعی هستند.
تورمالا به دویچه وله گفت: «مردم تمایل دارند هوش مصنوعی را آموزندهتر، عینیتر، کمتر مغرضانهتر و کمتر علاقهمند به متقاعد کردن آنها نسبت به دیگران ببینند. این می تواند قدرت دفاعی افراد را پایین بیاورد و آنها را برای شنیدن آنچه هوش مصنوعی برای گفتن دارد، پذیراتر کند."
این اعتماد می تواند چاپلوسی سیاسی را تأثیرگذارتر کند.
تورمالا گفت: "شنیدن نظرات خود که توسط دیگران تایید شده است، به خوبی شناخته شده است که باعث افزایش اطمینان مردم در مورد باورهایشان می شود." هنگامی که افراد مطمئن تر می شوند، در برابر متقاعد کردن مقاومت بیشتری نشان می دهند.
او افزود که آیا اعتبار سنجی هوش مصنوعی همان تأثیر را دارد یا خیر، ثابت نشده است، اما قابل قبول است.
مطالعه UNICAMP آزمایش نکرد که آیا بازتاب سیاسی واقعا می تواند باورها یا رفتار کاربران را تغییر دهد. فقط تغییرات در پاسخ های مدل ها را اندازه گیری کرد.
دیاس گفت: "مطالعه ما تغییری در پاسخ های مدل تحت شرایط کنترل شده ایجاد می کند." مشخص نمیکند که کاربران قطبیتر، رادیکالیزهتر شدهاند یا احتمال دارد درگیر درگیری شوند.
پتر تورنبرگ، محقق دانشگاه آمستردام که هوش مصنوعی و قطبیسازی سیاسی را مطالعه میکند، موافق است که این مطالعه نمیتواند تأثیری بر کاربران نشان دهد. او همچنین این سوال را مطرح کرد که آیا مدلها پاسخهای مشابهی را در خارج از محیط تست میدهند یا خیر.
او در مورد این که چت بات ها لزوما دیدگاه کاربران را تقویت می کنند، هشدار داد. در برخی مکالمات، ممکن است به افراد کمک کنند تا در مورد آنها تجدید نظر کنند.
تورنبرگ گفت که مکالمه خصوصی با یک چت بات با بحث عمومی در رسانه های اجتماعی متفاوت است.
او به دویچه وله گفت: «آنها اغلب میتوانند توضیحات کاملا منطقی و مبتنی بر شواهد را بدون پویایی هویت اجتماعی بحثهای سیاسی عمومی ارائه کنند. بنابراین حداقل این امکان وجود دارد که در برخی زمینهها این سیستمها به جای قطبی شدن، دپولاریزه شوند.
بنابراین اینکه هوش مصنوعی تقسیمات را محدود یا عمیق تر می کند، ممکن است به این بستگی داشته باشد که کاربران را به چالش می کشد یا به سادگی به آنها می گوید آنچه می خواهند بشنوند.
دیاس گفت که توسعهدهندگان باید مدلهای خود را با کاربرانی با دیدگاههای سیاسی مختلف آزمایش کنند تا ببینند آیا آنها شواهد را به طور مداوم ارزیابی میکنند یا خیر.
آنها می توانند به مدل ها آموزش دهند که با احترام مخالف باشند، عدم اطمینان را تصدیق کنند، ادعاهای پشتوانه نشده را تصحیح کنند و دیدگاه های رقیب را منصفانه ارائه دهند.
این به معنای تحمیل هر پاسخی به مرکز سیاسی نیست.
دیاس گفت: «هدف طراحی گستردهتر باید کمک به مردم برای بررسی باورهایشان باشد، و شواهد، عدم قطعیت و ملاحظات رقابتی را نمایان کند و در عین حال فضایی را برای اختلاف نظر سیاسی مشروع ایجاد کند.»
متن اصلی (انگلیسی)
Could flattering AI make humanity turn on itself?
A study shows chatbots mirror users' politics, part of a broader tendency known as AI sycophancy. Researchers fear this could deepen polarization.