پرش به محتوای اصلی

خواندن خط‌مشی‌های حفظ حریم خصوصی در LLM‌های برتر بیش از 20 دقیقه طول می‌کشد، بنابراین شاید جای تعجب نباشد که مردم زندگی خود را به ChatGPT و دیگران امضا کنند.

تک‌رادار۱۴۰۵ مهر ۱, چهارشنبه، ساعت ۲۰:۳۵حدود 3 دقیقه مطالعه

اصطلاحات فنی و حقوقی، سیاست های حفظ حریم خصوصی LLM ها و چت ربات های آنها را برای اکثر مردم تقریبا غیرقابل خواندن می کند.

خواندن خط‌مشی‌های حفظ حریم خصوصی بسیار دشوار است و در دنیای LLM‌ها غیرقابل نفوذ و طولانی هستند.

خط مشی Meta’s Muse Spark بیش از 14000 کلمه است که خواندن آن تقریبا یک ساعت طول می کشد.

شرکت امنیت سایبری Bridewell این مطالعه را انجام داد و سیاست های حفظ حریم خصوصی 20 LLM محبوب را ارزیابی کرد. وقتی داده‌ها را در یک چت ربات هوش مصنوعی وارد می‌کنید، انتظار دارید که کلمات یا اعداد را تفسیر و پردازش کند تا در وقت شما صرفه‌جویی کند. اما با این داده ها چه می کند؟ می‌توانید خط‌مشی رازداری را بررسی کنید تا متوجه شوید - با این فرض که زمان لازم برای انجام این کار را دارید.

یک مطالعه جدید نشان داده است که میانگین زمان لازم برای خواندن یک خط مشی حفظ حریم خصوصی برای یک LLM 20 دقیقه است - و برخی از آنها بسیار طولانی تر خوانده می شوند.

با توجه به اینکه حدود 75 درصد از مردم حداقل یک بار در ماه به استفاده از ربات چت هوش مصنوعی اعتراف می کنند، درک اینکه سوالات و پرس و جوهای داده به کجا می روند و نحوه استفاده از آنها اهمیت فزاینده ای دارد.

سهولت در خواندن

خط‌مشی‌های حفظ حریم خصوصی این درک را فراهم می‌کنند، اما آیا خواندن آنها آسان است؟ مطالعه ای که توسط کارشناسان امنیت سایبری Bridewell انجام شده است، نشان می دهد که بسیاری از آنها امتیاز سهولت خواندن Fleisch ضعیفی دارند، به این معنی که به زبان ساده، این اسناد بسیار غیرقابل نفوذ هستند.

مطالعه Bridewell خط‌مشی‌های حفظ حریم خصوصی را از 20 مدل زبان بزرگ (LLM) ارزیابی کرد و نشان داد که میانگین زمان خواندن یک زبان 20 دقیقه است. میانگین تعداد کلمات 4603 است، اما چالش واقعی درک اطلاعات است.

Flesch Reading Ease Score معیاری برای خوانایی است که توسط رودولف فلش در سال 1948 ابداع شد و به طور گسترده برای امتیاز دادن به متون استفاده می شود. نمره بالای 60 خوب است، در حالی که نمره زیر آن خوب نیست. میانگین امتیاز فلش برای این خط‌مشی‌های حفظ حریم خصوصی 40.2 است که نشان‌دهنده درجه‌ای از تراکم بر اساس اصطلاحات است که اکثر مردم آن را درک نمی‌کنند.

پس چگونه عموم مردم با آگاهی کامل از نحوه استفاده از اطلاعات وارد شده از یک ربات چت LLM مانند ChatGPT یا Google Gemini استفاده می کنند؟

آموزش ورودی ها

در ارزیابی LLM ها، بریدول دریافت که 13 مورد از 20 مورد از ورودی ها و خروجی ها برای آموزش مدل های خود استفاده می کنند. برخی از LLM ها گزینه انصراف از آموزش را ارائه می دهند، اما برخی دیگر این کار را نمی کنند. حتی در مواردی که امکان انصراف وجود دارد، همیشه مشخص نیست که چگونه آن را انجام دهید.

کریس لینل، مدیر بخش حریم خصوصی داده در Bridewell، خاطرنشان کرد: «برای کاربران ضروری است که به طور کامل درک کنند که داده‌هایشان توسط LLMها پردازش می‌شود، و کسب‌وکارها به راهنمایی‌های داخلی واضح در مورد اینکه چه چیزی را می‌توان و چه چیزی را نمی‌توان به اشتراک گذاشت، و حساب‌های سازمانی ایده‌آل با حفاظت‌های مناسب نیاز دارند.» LLMs.”

فقط یک خطر شخصی ناشی از ورود داده ها به یک هوش مصنوعی وجود ندارد. کارکنان باید از نحوه استفاده از فناوری برای کار آگاه باشند.

به عنوان یک قاعده کلی، هرچه LLM پیچیده‌تر باشد (مثلا Meta's Muse Spark یا Moonshot AI Kimi K)، خواندن خط‌مشی رازداری بیشتر طول می‌کشد.

خواندن متن کامل در تک‌راداربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Privacy policies on top LLMs take over 20 minutes to read, so perhaps it no wonder people are signing their lives over to ChatGPT and others

Technical and legal jargon make privacy policies for LLMs and their chatbots almost unreadable for most people.

همه‌ی اخبار فناوری