ممیزی گسترده شکاف های بین پاسخ های هوش مصنوعی گوگل و منابع ذکر شده را نشان می دهد
از زمان راه اندازی در سال 1998، گوگل، موتور جستجوی پیشرو در جهان، نحوه یافتن اطلاعات آنلاین توسط مردم را تغییر داده است. برای سالها، نتایج جستجو بهعنوان فهرستهای رتبهبندی شده از منابع ظاهر میشد: Google تصمیم میگرفت چه چیزی را نشان دهد، اما کاربران تصمیم میگرفتند چه چیزی را بخوانند و به چه کسی اعتماد کنند.
توسط سارا ساوات، دانشگاه واشنگتن در سنت لوئیس
ویرایش شده توسط گابی کلارک، بررسی توسط رابرت ایگان
این مقاله با توجه به روند و سیاستهای ویرایشی Science X بررسی شده است. ویراستاران ضمن اطمینان از اعتبار محتوا، ویژگی های زیر را برجسته کرده اند:
از زمان راه اندازی در سال 1998، گوگل، موتور جستجوی پیشرو در جهان، نحوه یافتن اطلاعات آنلاین توسط مردم را تغییر داده است. برای سالها، نتایج جستجو بهعنوان فهرستهای رتبهبندی شده از منابع ظاهر میشد: Google تصمیم میگرفت چه چیزی را نشان دهد، اما کاربران تصمیم میگرفتند چه چیزی را بخوانند و به چه کسی اعتماد کنند.
با این حال، ظهور Google AI Overviews اساسا این پارادایم را تغییر داده است. امروزه، وقتی کاربر چیزی را از «چقدر تخم مرغ را بجوشانم؟» جستجو می کند. به "چگونه کلسترول خود را کاهش دهم؟" این احتمال وجود دارد که پاسخ با یک خلاصه تولید شده از هوش مصنوعی (AI) منتهی شود. به گفته ژاکوب مونتگومری، استاد علوم سیاسی در هنر و علوم در دانشگاه واشنگتن در سنت لوئیس، این تغییر به گوگل کنترل بیسابقهای بر سرمقالههای خواندن و دانستن کاربران میدهد.
مونتگومری گفت: «گوگل اکنون پاسخها را مینویسد، نه فقط آنها را رتبهبندی میکند، و این کار را برای میلیاردها جستجو انجام میدهد. "با این حال، ما اطلاعات کمی در مورد نحوه عملکرد سیستم داریم. چه زمانی یک نمای کلی ظاهر می شود؟ از کدام منابع استفاده می کند؟ آیا خلاصه ها دقیق هستند؟ و چه اتفاقی برای بقیه وب می افتد وقتی مردم دیگر روی آن کلیک نمی کنند؟ هدف ما پاسخ به این سوالات اساسی بود."
مقاله آتی، که در کنفرانس اندازهگیری اینترنتی ACM اکتبر 2026 ارائه میشود، گستردهترین ممیزی مستقل از Google AI Overviews تا به امروز را ارائه میکند - الگوهای فعالسازی نمای کلی هوش مصنوعی، انتخاب منبع، مطابقت ادعاها با منابع آنها و تأثیر بالقوه بر درآمد تبلیغاتی ناشران را بررسی میکند.
نویسندگان مشترک، عمر اقبال، استادیار مهندسی در مهندسی WashU McKelvey، و Haofei Xu، دانشجوی کارشناسی ارشد در بخش علوم محاسباتی و داده WashU هستند. این کار در سرور preprint arXiv نیز موجود است.
در مجموع، محققان 55393 جستجوی گوگل را در مورد موضوعات پرطرفدار طی 40 روز، از 13 مارس تا 21 آوریل 2026 انجام دادند. آنها هر مروری بر هوش مصنوعی، استنادات آن، نتایج جستجوی صفحه اول نمایش داده شده با آن و محتوای صفحات وب ذکر شده را جمع آوری کردند.
این تحقیق نشان داد که AI Overviews برای 13.7 درصد از تمام پرسوجوها ظاهر میشود، اما این میزان بر اساس نحوه بیان کاربران جستجوهای خود به شدت متفاوت است. تقریبا 65 درصد از پرس و جوهای فرم سؤال در مقایسه با 9.5 درصد جستجوهای دیگر، یک نمای کلی ایجاد کردند. جستجوهای طولانیتر نیز احتمالا پاسخهای تولید شده توسط هوش مصنوعی را ایجاد میکنند. در میان جستجوهای غیر سوالی، نرخ فعال سازی از 9.9% برای جستارهای یک کلمه ای به 38.7% برای پرس و جوهای شش کلمه ای یا بیشتر افزایش یافت.
مونتگومری توضیح داد: این الگو نشان می دهد افرادی که به جای استفاده از جستجوی کلمات کلیدی به دنبال توضیحات به زبان طبیعی هستند، احتمال بیشتری دارد که با مواد تولید شده توسط هوش مصنوعی مواجه شوند. موضوع هم مهم بود مرورهای کلی برای 46.1٪ از جستجوهای سرگرمی و اوقات فراغت و 39.9٪ از جستارهای علمی، اما فقط برای 7.5٪ از جستجوهای سیاسی و 9.6٪ از سؤالات حقوقی و دولتی ظاهر شد، که نشان می دهد منطق راه اندازی Google به اختیارات سردبیری فاش نشده متکی است.
در میان 61212 استناد، دامنههای ذکر شده توسط AI Overviews میانگین امتیازات اعتبار بالاتری نسبت به نتایج سنتی صفحه اول نشان داده شده برای همان جستجوها دریافت کردند. مرورهای کلی نیز کمتر به محتوای تولید شده توسط کاربر متکی بود.
با این حال، 29.8٪ از دامنه های ذکر شده در نتایج صفحه اول ظاهر نشدند. محققان گفتند که این تفاوت نشان میدهد که گوگل از یک فرآیند انتخاب منبع برای خلاصههای هوش مصنوعی خود استفاده میکند که از سیستم رتبهبندی جستجوی معمولی متمایز است. یک مرور کلی متوسط حدود هشت منبع را ذکر کرده است.
با این حال، منابع معتبر تضمین نکردند که خلاصه تولید شده آنها را به طور دقیق نشان دهد. این تیم مرورهای کلی را به 98020 ادعای قابل تأیید تقسیم کرد و هر یک را در برابر صفحات وب ذکر شده بررسی کرد. حدود 89 درصد به وضوح یا به طور گسترده توسط منابع مورد حمایت قرار گرفتند. 11٪ باقیمانده شامل ادعاهایی بود که در متن ذکر شده یافت نشد (7٪) یا ادعاهایی که با منبع ذکر شده (4٪) مغایرت داشتند.
نویسندگان هشدار دادند که نرخ خطای 11% باید به عنوان حد بالایی در نظر گرفته شود. خط لوله آنها نمی تواند به طور کامل محتوای ارسال شده توسط کاربران عادی، مانند موضوعات Reddit، پست های انجمن و ویدیوهای YouTube را ضبط کند. اطلاعاتی که به سرعت در حال تغییر هستند، مانند پیشبینی آبوهوا و تعطیلی مدارس، ممکن است بین نمای کلی Google و زمانی که محققان صفحه را ضبط کردند، بهروزرسانی شده باشند.
تنها 41.9 درصد از مرورها کاملا مستدل بودند، به این معنی که هر ادعای قابل تأییدی توسط متن استناد شده موجود پشتیبانی میشد. از آنجایی که برخی از صفحات ذکر شده را نمی توان به طور کامل جمع آوری کرد، این رقم احتمالا محافظه کارانه است.
مونتگومری گفت: «خلاصههای گوگل معمولا از وبسایتهای معتبر استفاده میکنند، که خبر خوبی است. اما منابع باکیفیت کافی نیستند». "در بخش قابل توجهی از موارد، ما نتوانستیم برای ادعایی در صفحاتی که گوگل به آنها استناد کرده است، پشتیبانی پیدا کنیم. خوانندگان هنوز باید آنچه را که به آنها گفته می شود بررسی کنند، حتی زمانی که نقل قول ها قابل اعتماد به نظر می رسند."
در نهایت، این مطالعه خطرات مالی ناشران را نیز بررسی کرد. هنگامی که یک نمای کلی مستقیما به سؤالی پاسخ می دهد، ناشران ممکن است بازدیدی را که باعث ایجاد درآمد تبلیغاتی، اشتراک یا فروش می شود، از دست بدهند. در این مطالعه، بیش از نیمی از صفحات وب مورد استناد، تبلیغات را به نمایش گذاشتند.
محققان به طور مستقیم میزان کاهش ترافیک یا درآمد را اندازه گیری نکردند. با این حال، آنها دریافتند که 2.2 درصد از صفحات جستجوی حاوی نمای کلی هوش مصنوعی نیز آگهیهای حمایتشده توسط Google را نمایش میدهند، از جمله 39 صفحه که یک آگهی در بالای نمای کلی ظاهر میشود. آنها نوشتند که این ترتیب ممکن است درآمد تبلیغات گوگل را حفظ کند در حالی که به کاربران دلیل کمتری برای بازدید از ناشرانی که محتوای آنها پاسخ داده است را می دهد.
مونتگومری گفت: «نمایشهای هوش مصنوعی گوگل بر روی محتوایی ساخته شده است که ناشران برای تولید آن پول پرداخت میکنند و بسیاری از این سایتها به درآمد تبلیغاتی وابسته هستند». "اگر مردم پاسخ خود را از نمای کلی دریافت کنند و هرگز روی آن کلیک نکنند، آن ناشران بازدید و درآمد خود را از دست می دهند. ما این ضرر را مستقیما اندازه گیری نکردیم، اما مشوق ها نگران کننده است. با گذشت زمان، Google و ناشران باید ترتیبات مجوز یا اشتراک درآمد را انجام دهند، یا سایت هایی که AI Overviews به آنها متکی است ممکن است زنده نمانند."
Haofei Xu و همکاران، اندازهگیری مرورهای اجمالی هوش مصنوعی گوگل: فعالسازی، کیفیت منبع، وفاداری ادعا، و تأثیر ناشر، arXiv (2026). DOI: 10.48550/arxiv.2605.14021
ارائه شده توسط دانشگاه واشنگتن در سنت لوئیس
کارشناسی ارشد زبان انگلیسی، ویرایشگر کپی از سال 2021 با تجربه در آموزش عالی و محتوای بهداشتی. تقدیم به اخبار معتبر علمی. نمایه کامل →
لیسانس زیست شناسی ریاضی، کارشناسی ارشد در نوشتن خلاق. خوش سفر با دیدگاه های منحصر به فرد در علم و زبان. نمایه کامل →
متن اصلی (انگلیسی)
Extensive audit reveals gaps between Google AI answers and cited sources
Since its launch in 1998, Google, the world's leading search engine, has transformed how people find information online. For years, search results appeared as ranked lists of sources: Google decided what to show, but users decided what to read and whom to trust.