آموزش هوش مصنوعی OpenAI در اسناد بدون مهر و موم «سرقت شگفت انگیز» نامیده می شود
یادداشتهای داخلی مایکروسافت و OpenAI نگرانیهایی را درباره «تهدید وجودی» هوش مصنوعی برای ناشران اخبار ایجاد میکنند
بر اساس گزارش نیویورک تایمز، که به اسناد دادگاه به تازگی مهر و موم نشده است، کارکنان مایکروسافت در مورد استفاده OpenAI از میلیون ها مقاله خبری و سایر مطالب دارای حق چاپ برای آموزش مدل های هوش مصنوعی خود، با یک سند داخلی که آن را به عنوان "بزرگترین سرقت نیروی کار در تاریخ بشر" توصیف می کند، ابراز نگرانی کردند.
اسنادی که روز پنجشنبه بدون مهر و موم نشده اند، نشان می دهند که برنت هشت، مدیر علوم کاربردی مایکروسافت، این عمل را یک "سرقت شگفت انگیز با ابعاد بی سابقه" توصیف می کند و هشدار می دهد که می تواند یک "حلقه عذاب" ایجاد کند که در نهایت کیفیت مدل های زبانی بزرگ را تضعیف می کند.
Hecht همچنین هشدار داد که OpenAI ممکن است در هنگام تلاش برای شناسایی محتوای نیویورک تایمز و سایر ناشرانی که در این دعوی دخیل بودند، در یک "پوشش تصادفی" شرکت داشته باشد.
الکس هاورک، سخنگوی مایکروسافت گفت که یادداشتهای داخلی Hecht بیانگر دیدگاههای شرکت نیست.
سند 2023 میگوید: «میلیونها نفر در سراسر جهان به زودی مدلهای بزرگی را که تمام کارشان را «هواپیمکننده» میکنند بهعنوان یک سرقت حیرتانگیز با ابعاد بیسابقه در نظر خواهند گرفت.
مدیران OpenAI همچنین ابراز نگرانی کردند که ChatGPT می تواند کاربران را از منابع خبری سنتی منحرف کند.
نیک تورلی، که تیم توسعهدهنده ChatGPT را رهبری میکرد، در یادداشتی در ژوئن ۲۰۲۳ نوشت که هوش مصنوعی یک «تهدید وجودی» برای ناشران است. در یادداشت فوریه 2024، او گفت که محصولات هوش مصنوعی "هرچه بهتر شوند جایگزین های بیشتری خواهند داشت."
یک مهندس OpenAI به طور مشابه در یک سند دادگاه اذعان کرد که "هرچقدر هم که لینک ها را برجسته نشان دهیم، کاربران کلیک نمی کنند."
OpenAI از زمان راه اندازی ChatGPT در سال 2022، قراردادهای مجوز با ناشران خبری متعددی امضا کرده است، اما نگرانی ها در مورد اینکه آیا هوش مصنوعی مولد می تواند ترافیک وب سایت های خبری را کاهش دهد، وجود دارد.
اسناد دادگاه همچنین نشان میدهد که گرگ براکمن، رئیس OpenAI، پس از اینکه یکی از کارکنان به ایجاد «هک» برای دور زدن دیوار پرداخت نیویورک تایمز اشاره کرد، «آه خوب» پاسخ داد.
ساتیا نادلا، مدیر عامل مایکروسافت، در بیانیهای گفت که محتوای paywalled «باید مجوز داشته باشد» و اضافه کرد که اگر میدانست که مدلهای آن بر روی مواد paywalled آموزش دیدهاند، از OpenAI میخواهد که دوباره آموزش دهد.
پرونده نقض مالکیت معنوی توسط نیویورک تایمز علیه OpenAI و مایکروسافت در اواخر سال 2023 تشکیل شد و 11 ناشر دیگر بعدا به این شکایت پیوستند.
سیدنی اچ. استاین، قاضی منطقه ای ایالات متحده، در حال بررسی درخواست هایی برای قضاوت اجمالی است، در حالی که اسناد اضافی به تدریج در حال باز شدن است.
ناشران OpenAI و مایکروسافت را به نقض قانون کپی رایت با استفاده از میلیون ها مقاله برای آموزش سیستم های هوش مصنوعی بدون اجازه یا پرداخت متهم می کنند.
این شرکتها استدلال میکنند که استفاده آنها از مواد با استفاده منصفانه محافظت میشود، و معتقدند که هوش مصنوعی محتوا را به جای تولید مجدد یا جایگزینی مقالات اصلی به آثار جدید تبدیل میکند.
متن اصلی (انگلیسی)
OpenAI AI training called 'astonishing theft' in unsealed documents
Internal Microsoft and OpenAI memos raise concerns over AI’s 'existential threat' to news publishers