پرش به محتوای اصلی

ممیزی گسترده شکاف های بین پاسخ های هوش مصنوعی گوگل و منابع ذکر شده را نشان می دهد

فیزیک‌ارگ۱۴۰۵ مهر ۷, سه‌شنبه، ساعت ۲۰:۵۰حدود 5 دقیقه مطالعه

از زمان راه اندازی در سال 1998، گوگل، موتور جستجوی پیشرو در جهان، نحوه یافتن اطلاعات آنلاین توسط مردم را تغییر داده است. برای سال‌ها، نتایج جستجو به‌عنوان فهرست‌های رتبه‌بندی شده از منابع ظاهر می‌شد: Google تصمیم می‌گرفت چه چیزی را نشان دهد، اما کاربران تصمیم می‌گرفتند چه چیزی را بخوانند و به چه کسی اعتماد کنند.

توسط سارا ساوات، دانشگاه واشنگتن در سنت لوئیس

ویرایش شده توسط گابی کلارک، بررسی توسط رابرت ایگان

این مقاله با توجه به روند و سیاست‌های ویرایشی Science X بررسی شده است. ویراستاران ضمن اطمینان از اعتبار محتوا، ویژگی های زیر را برجسته کرده اند:

از زمان راه اندازی در سال 1998، گوگل، موتور جستجوی پیشرو در جهان، نحوه یافتن اطلاعات آنلاین توسط مردم را تغییر داده است. برای سال‌ها، نتایج جستجو به‌عنوان فهرست‌های رتبه‌بندی شده از منابع ظاهر می‌شد: Google تصمیم می‌گرفت چه چیزی را نشان دهد، اما کاربران تصمیم می‌گرفتند چه چیزی را بخوانند و به چه کسی اعتماد کنند.

با این حال، ظهور Google AI Overviews اساسا این پارادایم را تغییر داده است. امروزه، وقتی کاربر چیزی را از «چقدر تخم مرغ را بجوشانم؟» جستجو می کند. به "چگونه کلسترول خود را کاهش دهم؟" این احتمال وجود دارد که پاسخ با یک خلاصه تولید شده از هوش مصنوعی (AI) منتهی شود. به گفته ژاکوب مونتگومری، استاد علوم سیاسی در هنر و علوم در دانشگاه واشنگتن در سنت لوئیس، این تغییر به گوگل کنترل بی‌سابقه‌ای بر سرمقاله‌های خواندن و دانستن کاربران می‌دهد.

مونتگومری گفت: «گوگل اکنون پاسخ‌ها را می‌نویسد، نه فقط آنها را رتبه‌بندی می‌کند، و این کار را برای میلیاردها جستجو انجام می‌دهد. "با این حال، ما اطلاعات کمی در مورد نحوه عملکرد سیستم داریم. چه زمانی یک نمای کلی ظاهر می شود؟ از کدام منابع استفاده می کند؟ آیا خلاصه ها دقیق هستند؟ و چه اتفاقی برای بقیه وب می افتد وقتی مردم دیگر روی آن کلیک نمی کنند؟ هدف ما پاسخ به این سوالات اساسی بود."

مقاله آتی، که در کنفرانس اندازه‌گیری اینترنتی ACM اکتبر 2026 ارائه می‌شود، گسترده‌ترین ممیزی مستقل از Google AI Overviews تا به امروز را ارائه می‌کند - الگوهای فعال‌سازی نمای کلی هوش مصنوعی، انتخاب منبع، مطابقت ادعاها با منابع آنها و تأثیر بالقوه بر درآمد تبلیغاتی ناشران را بررسی می‌کند.

نویسندگان مشترک، عمر اقبال، استادیار مهندسی در مهندسی WashU McKelvey، و Haofei Xu، دانشجوی کارشناسی ارشد در بخش علوم محاسباتی و داده WashU هستند. این کار در سرور preprint arXiv نیز موجود است.

در مجموع، محققان 55393 جستجوی گوگل را در مورد موضوعات پرطرفدار طی 40 روز، از 13 مارس تا 21 آوریل 2026 انجام دادند. آنها هر مروری بر هوش مصنوعی، استنادات آن، نتایج جستجوی صفحه اول نمایش داده شده با آن و محتوای صفحات وب ذکر شده را جمع آوری کردند.

این تحقیق نشان داد که AI Overviews برای 13.7 درصد از تمام پرس‌و‌جوها ظاهر می‌شود، اما این میزان بر اساس نحوه بیان کاربران جستجوهای خود به شدت متفاوت است. تقریبا 65 درصد از پرس و جوهای فرم سؤال در مقایسه با 9.5 درصد جستجوهای دیگر، یک نمای کلی ایجاد کردند. جستجوهای طولانی‌تر نیز احتمالا پاسخ‌های تولید شده توسط هوش مصنوعی را ایجاد می‌کنند. در میان جستجوهای غیر سوالی، نرخ فعال سازی از 9.9% برای جستارهای یک کلمه ای به 38.7% برای پرس و جوهای شش کلمه ای یا بیشتر افزایش یافت.

مونتگومری توضیح داد: این الگو نشان می دهد افرادی که به جای استفاده از جستجوی کلمات کلیدی به دنبال توضیحات به زبان طبیعی هستند، احتمال بیشتری دارد که با مواد تولید شده توسط هوش مصنوعی مواجه شوند. موضوع هم مهم بود مرورهای کلی برای 46.1٪ از جستجوهای سرگرمی و اوقات فراغت و 39.9٪ از جستارهای علمی، اما فقط برای 7.5٪ از جستجوهای سیاسی و 9.6٪ از سؤالات حقوقی و دولتی ظاهر شد، که نشان می دهد منطق راه اندازی Google به اختیارات سردبیری فاش نشده متکی است.

در میان 61212 استناد، دامنه‌های ذکر شده توسط AI Overviews میانگین امتیازات اعتبار بالاتری نسبت به نتایج سنتی صفحه اول نشان داده شده برای همان جستجوها دریافت کردند. مرورهای کلی نیز کمتر به محتوای تولید شده توسط کاربر متکی بود.

با این حال، 29.8٪ از دامنه های ذکر شده در نتایج صفحه اول ظاهر نشدند. محققان گفتند که این تفاوت نشان می‌دهد که گوگل از یک فرآیند انتخاب منبع برای خلاصه‌های هوش مصنوعی خود استفاده می‌کند که از سیستم رتبه‌بندی جستجوی معمولی متمایز است. یک مرور کلی متوسط ​​حدود هشت منبع را ذکر کرده است.

با این حال، منابع معتبر تضمین نکردند که خلاصه تولید شده آنها را به طور دقیق نشان دهد. این تیم مرورهای کلی را به 98020 ادعای قابل تأیید تقسیم کرد و هر یک را در برابر صفحات وب ذکر شده بررسی کرد. حدود 89 درصد به وضوح یا به طور گسترده توسط منابع مورد حمایت قرار گرفتند. 11٪ باقیمانده شامل ادعاهایی بود که در متن ذکر شده یافت نشد (7٪) یا ادعاهایی که با منبع ذکر شده (4٪) مغایرت داشتند.

نویسندگان هشدار دادند که نرخ خطای 11% باید به عنوان حد بالایی در نظر گرفته شود. خط لوله آنها نمی تواند به طور کامل محتوای ارسال شده توسط کاربران عادی، مانند موضوعات Reddit، پست های انجمن و ویدیوهای YouTube را ضبط کند. اطلاعاتی که به سرعت در حال تغییر هستند، مانند پیش‌بینی آب‌وهوا و تعطیلی مدارس، ممکن است بین نمای کلی Google و زمانی که محققان صفحه را ضبط کردند، به‌روزرسانی شده باشند.

تنها 41.9 درصد از مرورها کاملا مستدل بودند، به این معنی که هر ادعای قابل تأییدی توسط متن استناد شده موجود پشتیبانی می‌شد. از آنجایی که برخی از صفحات ذکر شده را نمی توان به طور کامل جمع آوری کرد، این رقم احتمالا محافظه کارانه است.

مونتگومری گفت: «خلاصه‌های گوگل معمولا از وب‌سایت‌های معتبر استفاده می‌کنند، که خبر خوبی است. اما منابع باکیفیت کافی نیستند». "در بخش قابل توجهی از موارد، ما نتوانستیم برای ادعایی در صفحاتی که گوگل به آنها استناد کرده است، پشتیبانی پیدا کنیم. خوانندگان هنوز باید آنچه را که به آنها گفته می شود بررسی کنند، حتی زمانی که نقل قول ها قابل اعتماد به نظر می رسند."

در نهایت، این مطالعه خطرات مالی ناشران را نیز بررسی کرد. هنگامی که یک نمای کلی مستقیما به سؤالی پاسخ می دهد، ناشران ممکن است بازدیدی را که باعث ایجاد درآمد تبلیغاتی، اشتراک یا فروش می شود، از دست بدهند. در این مطالعه، بیش از نیمی از صفحات وب مورد استناد، تبلیغات را به نمایش گذاشتند.

محققان به طور مستقیم میزان کاهش ترافیک یا درآمد را اندازه گیری نکردند. با این حال، آن‌ها دریافتند که 2.2 درصد از صفحات جستجوی حاوی نمای کلی هوش مصنوعی نیز آگهی‌های حمایت‌شده توسط Google را نمایش می‌دهند، از جمله 39 صفحه که یک آگهی در بالای نمای کلی ظاهر می‌شود. آنها نوشتند که این ترتیب ممکن است درآمد تبلیغات گوگل را حفظ کند در حالی که به کاربران دلیل کمتری برای بازدید از ناشرانی که محتوای آنها پاسخ داده است را می دهد.

مونتگومری گفت: «نمایش‌های هوش مصنوعی گوگل بر روی محتوایی ساخته شده است که ناشران برای تولید آن پول پرداخت می‌کنند و بسیاری از این سایت‌ها به درآمد تبلیغاتی وابسته هستند». "اگر مردم پاسخ خود را از نمای کلی دریافت کنند و هرگز روی آن کلیک نکنند، آن ناشران بازدید و درآمد خود را از دست می دهند. ما این ضرر را مستقیما اندازه گیری نکردیم، اما مشوق ها نگران کننده است. با گذشت زمان، Google و ناشران باید ترتیبات مجوز یا اشتراک درآمد را انجام دهند، یا سایت هایی که AI Overviews به آنها متکی است ممکن است زنده نمانند."

Haofei Xu و همکاران، اندازه‌گیری مرورهای اجمالی هوش مصنوعی گوگل: فعال‌سازی، کیفیت منبع، وفاداری ادعا، و تأثیر ناشر، arXiv (2026). DOI: 10.48550/arxiv.2605.14021

ارائه شده توسط دانشگاه واشنگتن در سنت لوئیس

کارشناسی ارشد زبان انگلیسی، ویرایشگر کپی از سال 2021 با تجربه در آموزش عالی و محتوای بهداشتی. تقدیم به اخبار معتبر علمی. نمایه کامل →

لیسانس زیست شناسی ریاضی، کارشناسی ارشد در نوشتن خلاق. خوش سفر با دیدگاه های منحصر به فرد در علم و زبان. نمایه کامل →

خواندن متن کامل در فیزیک‌ارگبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Extensive audit reveals gaps between Google AI answers and cited sources

Since its launch in 1998, Google, the world's leading search engine, has transformed how people find information online. For years, search results appeared as ranked lists of sources: Google decided what to show, but users decided what to read and whom to trust.

همه‌ی اخبار فناوری