پرش به محتوای اصلی

افشاگری علیه مایکروسافت و اوپن‌ای‌آی؛ هر دو شرکت می‌دانستند که در حال نابودی وب هستند

زومیت۱۴۰۵ شهریور ۲۸, شنبه، ساعت ۰۹:۳۲حدود 5 دقیقه مطالعه

اسناد تازه نشان می‌دهد اوپن‌ای‌آی و مایکروسافت از آسیب به وب، ناشران و ترافیک سایت‌ها آگاه بودند.

اسناد تازه نشان می‌دهد اوپن‌ای‌آی و مایکروسافت از آسیب به وب، ناشران و ترافیک سایت‌ها آگاه بودند.

اسناد تازه‌ای که در پرونده‌ی نیویورک تایمز علیه اوپن‌ای‌آی و مایکروسافت منتشر شده ، تصویری تند و صریح از پشت‌صحنه‌ی توسعه‌ی هوش مصنوعی ترسیم می‌کند. در این مدارک، از «دور باطل» برای توصیف اثر این محصولات بر وب گفته شده، از «بزرگ‌ترین سرقت کار در تاریخ بشر» یاد شده و استدلال شرکت‌ها برای گردآوری داده‌ها، «تمسخر کامل» ایده‌ی استفاده‌ی منصفانه توصیف شده است.

متن‌های فاش‌شده نشان می‌دهند که بحث فقط بر سر یک اختلاف حقوقی ساده نبوده، بلکه مدیران و کارکنان دو شرکت از پیامدهای گسترده‌ی روندی خبر داشته‌اند که بعدتر با عنوان Google Zero توصیف شد؛ وضعیتی که در آن کاربر پاسخ را مستقیم از چت‌بات می‌گیرد و دیگر نیازی به کلیک‌کردن روی منبع نمی‌بیند.

در میان نام‌هایی که در این اسناد تکرار می‌شوند، برنت هکت ، مدیر علم کاربردی مایکروسافت، بیش از بقیه جلب توجه می‌کند. مایکروسافت کوشیده اظهارات او را به دیدگاه شخصی محدود کند؛ اما خودِ نقل‌قول‌ها مسیر پرونده را روشن‌تر می‌کنند.

برای بخشی از صنعت نشر، هوش مصنوعی فقط ابزار جست‌وجوی تازه نیست، بلکه رقیبی ساختاری است

در پرونده‌ای جداگانه نیز جوردن اوسدان ، مدیرکل راهبرد و عملیات داده در Microsoft AI، نقش هکت را «متعارض» توصیف کرده و نوشته بود که او دیدگاه‌هایی «متمایز، دانشگاهی و آینده‌نگر» درباره‌ی اکوسیستم اطلاعات برای هوش مصنوعی دارد؛ اما حتی با این فاصله‌گذاری‌ها هم مضمون کلی تغییر نمی‌کند؛ اسناد می‌گویند شرکت‌ها می‌دانستند چه مسیری را باز کرده‌اند.

یکی از تندترین بخش‌ها به نقل از هکت می‌گوید گردآوری اطلاعات برای ChatGPT و کوپایلت، «بزرگ‌ترین سرقت کار در تاریخ بشر» بوده و دفاع مایکروسافت در برابر این انتقاد، «تمسخر کامل» مفهوم fair use را رقم زده است. در همان بخش آغازین، اسناد از تهدیدی وجودی برای ناشرانی مانند نیویورک تایمز سخن می‌گویند. لحن سند سرد است؛ اما نتیجه‌گیری‌اش روشن: برای بخشی از صنعت نشر، مدل‌های زبانی فقط ابزار جست‌وجوی تازه نیستند، بلکه رقیبی ساختاری‌اند.

ساتیا نادلا، مدیرعامل مایکروسافت، در این پرونده پذیرفته که چت‌بات‌ها تا حد زیادی جای جست‌وجوی سنتی را گرفته‌اند و نیاز به رفتن مستقیم سراغ منبع را کم کرده‌اند.

تندتر از او، یک سند داخلی مایکروسافت می‌گوید راهبرد محتوایی هوش مصنوعی شرکت وارد «دور باطل» شده؛ چرخه‌ای که هم عملکرد مدل‌ها را آسیب می‌زند و هم کل وب را تحت فشار می‌گذارد. متن سند پا را فراتر می‌گذارد و می‌نویسد که یک محصول نهایی، پایه‌های اقتصادی تامین‌کنندگان ضروری خودش را تهدید می‌کند؛ وضعیتی غیرمعمول که مایکروسافت آن را برای زنجیره‌ی تامین محتوای کسب‌وکار مدل‌های زبانی خود ساخته است.

بخش دیگری از اسناد، انگیزه‌ی اقتصادی را هم پررنگ می‌کند. گِرگ براکمن ، هم‌بنیان‌گذار اوپن‌ای‌آی، به‌جای زبان آرمان‌گرایانه، بیشتر به امکان کسب درآمد از هوش مصنوعی تجاری توجه نشان داده است. عددِ دقیق و رسمی وجود ندارد؛ اما پیام روشن است؛ سود بالقوه در مرکز تصمیم‌ها قرار داشته، نه صرفا بهبود تجربه‌ی کاربر.

در همین مسیر، موضوع محتوای پولی هم مطرح شده است. یک نماینده‌ی اوپن‌ای‌آی اذعان کرده بود که از هیچ تلاشی برای شناسایی یا حذف محتوای پولی از داده‌های آموزشی آگاه نیست. فاصله‌ی میان حرف و عمل، در متن پرونده آشکار است.

فهرست نمونه‌ها به همین‌جا ختم نمی‌شود. اسناد نشان می‌دهند که اوپن‌ای‌آی از تمایل ChatGPT به بازتولید لفظ‌به‌لفظ محتوای دارای حق نشر آگاه بوده است. در داخل شرکت، «جلوگیری از حفظ‌کردن» برای «کاهش نقض حق نشر» مهم شمرده می‌شد، اما هم‌زمان کارکنان پذیرفته بودند که GPT-4 «حجم زیادی از داده را حفظ کرده و بنابراین در بازگویی، به‌طرز وحشتناکی خوب خواهد بود.»

سپس چند نمونه از خروجی‌های ChatGPT آمده که بخش‌های طولانی‌ای را از مطالب نیویورک تایمز و مرکوری نیوز وThe Denver Post و LifeHacker و Eurogamer تقریبا بدون تغییر بازتولید کرده‌اند.

ChatGPT به‌عنوان جایگزینِ کار انسان‌ها مطرح شده است

مایکروسافت هم از سوی خود به درک پیامدهای این الگو متهم شده است. یکی از نقل‌قول‌ها می‌گوید شرکت می‌دانسته که «تقریبا هیچ‌کس» قصد نداشته محتوایی که ساخته برای چنین استفاده‌ای به کار برود. در نقل‌قولی دیگر، ChatGPT به‌عنوان «جایگزینی برای کار انسان‌ها» توصیف شده؛ دیدگاهی که جک کلارک ، مدیر سیاست‌گذاری اوپن‌ای‌آی، مطرح کرده و گفته شرکت در حال ساخت سیستم‌هایی است که جای نیروی کارِ سازنده‌ی «فرهنگ» جامعه را می‌گیرند.

خودِ اوپن‌ای‌آی در اسناد داخلی، ChatGPT را «دکه‌ی روزنامه‌فروشی مدرن» نامیده است. نیک ترلی ، رئیس ChatGPT، بعدها گفته بود وقتی کاربر از چت‌بات پاسخ می‌گیرد، دلیلی برای کلیک‌کردن روی لینک منبع باقی نمی‌ماند. نتیجه‌ی چنین رفتاری، مستقیم به ترافیک سایت ضربه می‌زند.

در همین چارچوب، اوپن‌ای‌آی و کارشناسان رسانه کاهش ترافیک سایت‌هایی مثل تایمز را مستقیما به خلاصه‌های هوش مصنوعی، از جمله AI Overviews گوگل نسبت داده‌اند و حتی احتمال داده‌اند افت جست‌وجوهای ارجاعی تا ۶۰ درصد برسد. مایکروسافت هم در یک نقل‌قول دیگر پذیرفته که مدل‌های هوش مصنوعی محصولی هستند که زنجیره‌ی تامین خودشان را از بین می‌برند، چون در بسیاری از موارد جایگزین همان داده‌هایی می‌شوند که برای آموزش به آن نیاز دارند.

در پایان، متن پرونده تصویری می‌سازد از صنعتی که هم‌زمان در حال بازتعریف جست‌وجو، تضعیف جریان ترافیک وب، و فشار بر ناشران است. واژه‌ی «دور باطل» فقط یک استعاره نیست؛ در این اسناد، توصیفی از سازوکاری است که به گفته‌ی خود شرکت‌ها، می‌تواند هم به مدل‌ها آسیب بزند و هم به اکوسیستم تولید محتوا. پرونده‌ی نیویورک تایمز علیه اوپن‌ای‌آی و مایکروسافت هنوز ادامه دارد، اما اسناد تازه دست‌کم یک چیز را روشن کرده‌اند؛ آگاهی از هزینه‌ها، پیش از گسترش کامل این فناوری، وجود داشته است.

خواندن متن کامل در زومیتبه زبان اصلی، در سایت ناشر باز می‌شودهمه‌ی اخبار فناوری