پرش به محتوای اصلی

آیا AI چاپلوسی می تواند بشریت را به خود وادار کند؟

دویچه‌وله۱۴۰۵ مهر ۲, پنجشنبه، ساعت ۱۶:۴۰حدود 5 دقیقه مطالعه

یک مطالعه نشان می‌دهد که چت‌بات‌ها سیاست‌های کاربران را بازتاب می‌دهند، بخشی از یک گرایش گسترده‌تر به نام AI Sycophancy. محققان می ترسند که این امر می تواند قطبی شدن را عمیق تر کند.

موج اخیر هشدارهای سرفصل از سوی صاحب نظران هوش مصنوعی این نگرانی را افزایش داده است که این فناوری می تواند از کنترل انسان فرار کند و بشریت را از بین ببرد. اما قبل از اینکه هوش مصنوعی (AI) بشریت را بچرخاند، می‌تواند به روی آوردن انسان‌ها به یکدیگر کمک کند.

محققان دانشگاه ایالتی کامپیناس (UNICAMP) برزیل دریافتند که چت ربات‌های محبوب زمانی که دیدگاه‌های سیاسی کاربران فرضی از آنها خواسته می‌شود، پاسخ‌های خود را تغییر می‌دهند. دانشمندان هشدار می دهند که کاربران ممکن است این توافق نامه را با یک ارزیابی مستقل اشتباه بگیرند و به طور بالقوه قطبی شدن را عمیق تر کنند.

در مطالعه خود که در مجله Scientific Reports منتشر شد، تیم UNICAMP 21 مدل زبان بزرگ را از توسعه دهندگان از جمله OpenAI، Meta، Google، xAI، DeepSeek و Microsoft آزمایش کرد. این مدل ها موافقت خود را با 112 بیانیه ارزیابی کردند که هفت حوزه سیاسی برزیل شامل اقتصاد، امنیت عمومی، رفاه، فساد و محیط زیست را پوشش می دهد.

هر کدام تحت سه شرط آزمایش شدند: بدون هیچ اطلاعاتی در مورد سیاست کاربر، با یک اعلان که یک کاربر متمایل به چپ را توصیف می‌کند و با یکی که کاربر راست‌گرا را توصیف می‌کند.

هنگامی که هیچ اطلاعاتی در مورد ایدئولوژی کاربر ارائه نشد، 20 مدل از 21 مدل پاسخ هایی را تولید کردند که در سمت چپ مقیاس سیاسی محققین قرار داشت، اگرچه تعدادی از آنها نزدیک به مرکز بودند. Grok 4.1 تنها مدلی بود که در سمت راست افتاد.

برای مشاهده این ویدیو لطفا جاوا اسکریپت را فعال کنید و به مرورگر وب که از ویدیوی HTML5 پشتیبانی می کند ارتقا دهید.

هنگامی که اطلاعات ارائه شد، هر مدل پاسخ‌های خود را به سمت جهت‌گیری سیاسی توصیف‌شده در اعلان تغییر داد.

زانونی دیاس، یکی از نویسندگان این مطالعه، دانشمند کامپیوتر UNICAMP، به دویچه وله گفت: «قابل توجه ترین یافته این بود که این رفتار چقدر گسترده بود. "همه 21 مدلی که ما ارزیابی کردیم، موضع بیان شده خود را به سمت جهت گیری سیاسی بیان شده کاربر تغییر دادند، اگرچه میزان آن به طور قابل توجهی متفاوت بود."

محققان این مدل‌ها را «آفت‌پرست‌های ایدئولوژیک» توصیف کردند و یک «شاخص آفتاب‌پرست» برای اندازه‌گیری میزان جابه‌جایی هر کدام ایجاد کردند.

متا Llama 3.1 8B و DeepSeek V3.2 کمترین پاسخ های خود را تغییر دادند. Gemma 3 27B گوگل و GPT-5 Nano از OpenAI برخی از بزرگترین تغییرات را نشان دادند.

انطباق پاسخ با مخاطبان خود ذاتا مشکل ساز نیست. یک ربات چت ممکن است واژگان، مثال ها یا سطح جزئیات خود را بسته به کاربر تغییر دهد.

اما مدل ها بیشتر از زبان یا لحن آنها تغییر کرد: مواضع سیاسی آنها تغییر کرد.

دیاس گفت: «تمایز کلیدی بین انطباق نحوه ارسال یک پاسخ و تغییر قضاوت ماهوی بیان شده است.

ما به مدل ها دستور ندادیم که با کاربر موافق باشند یا به عنوان نماینده حزبی پاسخ دهند. با این وجود، قضاوت آنها به سمت کاربر تغییر کرد.

محققان این را به‌عنوان دودلی سیاسی تفسیر می‌کنند: سیستم‌های هوش مصنوعی آنچه را که کاربران ظاهرا می‌خواهند بشنوند منعکس می‌کنند.

یک توضیح احتمالی این است که چت بات‌ها به گونه‌ای آموزش داده شده‌اند که به پاسخ‌هایی که ارزیاب‌های انسانی امتیاز بالایی می‌دهند، ترجیح دهند. اگر پاسخ‌های موافق رتبه‌بندی بهتری کسب کنند، مدل‌ها ممکن است یاد بگیرند که نظرات کاربران را منعکس کنند.

رسانه‌های اجتماعی می‌توانند با توصیه‌های مکرر محتوای الگوریتمی، باورها را تقویت کنند، اما یک ربات چت می‌تواند از این هم فراتر رود. این می‌تواند یک محفظه اکو شخصی‌تر ایجاد کند، استدلال‌هایی را برای یک کاربر خاص ایجاد کند، به اعتراض‌های آن‌ها پاسخ دهد و مورد آن را در طول مکالمه اصلاح کند.

با این حال کاربران ممکن است این پاسخ‌های سفارشی را با تجزیه و تحلیل بی‌طرف اشتباه بگیرند، غافل از اینکه آنچه یک ربات چت در مورد آنها می‌داند ممکن است پاسخ‌های آن را شکل دهد.

دیاس گفت: «نگرانی این است که یک سیستم می‌تواند مواضع سیاسی مخالف را برای کاربران مختلف تأیید کند و هر فرد آن اعتبار را به عنوان یک ارزیابی مستقل تفسیر کند.»

پژوهشی که توسط زاکاری تورمالا، دانشمند علوم رفتاری دانشگاه استنفورد انجام شده، نشان می‌دهد که افراد ممکن است به‌ویژه پذیرای استدلال‌هایی باشند که معتقدند ناشی از هوش مصنوعی هستند.

تورمالا به دویچه وله گفت: «مردم تمایل دارند هوش مصنوعی را آموزنده‌تر، عینی‌تر، کمتر مغرضانه‌تر و کمتر علاقه‌مند به متقاعد کردن آنها نسبت به دیگران ببینند. این می تواند قدرت دفاعی افراد را پایین بیاورد و آنها را برای شنیدن آنچه هوش مصنوعی برای گفتن دارد، پذیراتر کند."

این اعتماد می تواند چاپلوسی سیاسی را تأثیرگذارتر کند.

تورمالا گفت: "شنیدن نظرات خود که توسط دیگران تایید شده است، به خوبی شناخته شده است که باعث افزایش اطمینان مردم در مورد باورهایشان می شود." هنگامی که افراد مطمئن تر می شوند، در برابر متقاعد کردن مقاومت بیشتری نشان می دهند.

او افزود که آیا اعتبار سنجی هوش مصنوعی همان تأثیر را دارد یا خیر، ثابت نشده است، اما قابل قبول است.

مطالعه UNICAMP آزمایش نکرد که آیا بازتاب سیاسی واقعا می تواند باورها یا رفتار کاربران را تغییر دهد. فقط تغییرات در پاسخ های مدل ها را اندازه گیری کرد.

دیاس گفت: "مطالعه ما تغییری در پاسخ های مدل تحت شرایط کنترل شده ایجاد می کند." مشخص نمی‌کند که کاربران قطبی‌تر، رادیکالیزه‌تر شده‌اند یا احتمال دارد درگیر درگیری شوند.

پتر تورنبرگ، محقق دانشگاه آمستردام که هوش مصنوعی و قطبی‌سازی سیاسی را مطالعه می‌کند، موافق است که این مطالعه نمی‌تواند تأثیری بر کاربران نشان دهد. او همچنین این سوال را مطرح کرد که آیا مدل‌ها پاسخ‌های مشابهی را در خارج از محیط تست می‌دهند یا خیر.

او در مورد این که چت بات ها لزوما دیدگاه کاربران را تقویت می کنند، هشدار داد. در برخی مکالمات، ممکن است به افراد کمک کنند تا در مورد آنها تجدید نظر کنند.

تورنبرگ گفت که مکالمه خصوصی با یک چت بات با بحث عمومی در رسانه های اجتماعی متفاوت است.

او به دویچه وله گفت: «آنها اغلب می‌توانند توضیحات کاملا منطقی و مبتنی بر شواهد را بدون پویایی هویت اجتماعی بحث‌های سیاسی عمومی ارائه کنند. بنابراین حداقل این امکان وجود دارد که در برخی زمینه‌ها این سیستم‌ها به جای قطبی شدن، دپولاریزه شوند.

بنابراین اینکه هوش مصنوعی تقسیمات را محدود یا عمیق تر می کند، ممکن است به این بستگی داشته باشد که کاربران را به چالش می کشد یا به سادگی به آنها می گوید آنچه می خواهند بشنوند.

دیاس گفت که توسعه‌دهندگان باید مدل‌های خود را با کاربرانی با دیدگاه‌های سیاسی مختلف آزمایش کنند تا ببینند آیا آنها شواهد را به طور مداوم ارزیابی می‌کنند یا خیر.

آنها می توانند به مدل ها آموزش دهند که با احترام مخالف باشند، عدم اطمینان را تصدیق کنند، ادعاهای پشتوانه نشده را تصحیح کنند و دیدگاه های رقیب را منصفانه ارائه دهند.

این به معنای تحمیل هر پاسخی به مرکز سیاسی نیست.

دیاس گفت: «هدف طراحی گسترده‌تر باید کمک به مردم برای بررسی باورهایشان باشد، و شواهد، عدم قطعیت و ملاحظات رقابتی را نمایان کند و در عین حال فضایی را برای اختلاف نظر سیاسی مشروع ایجاد کند.»

خواندن متن کامل در دویچه‌ولهبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Could flattering AI make humanity turn on itself?

A study shows chatbots mirror users' politics, part of a broader tendency known as AI sycophancy. Researchers fear this could deepen polarization.

همه‌ی اخبار فناوری