خواندن خطمشیهای حفظ حریم خصوصی در LLMهای برتر بیش از 20 دقیقه طول میکشد، بنابراین شاید جای تعجب نباشد که مردم زندگی خود را به ChatGPT و دیگران امضا کنند.
اصطلاحات فنی و حقوقی، سیاست های حفظ حریم خصوصی LLM ها و چت ربات های آنها را برای اکثر مردم تقریبا غیرقابل خواندن می کند.
خواندن خطمشیهای حفظ حریم خصوصی بسیار دشوار است و در دنیای LLMها غیرقابل نفوذ و طولانی هستند.
خط مشی Meta’s Muse Spark بیش از 14000 کلمه است که خواندن آن تقریبا یک ساعت طول می کشد.
شرکت امنیت سایبری Bridewell این مطالعه را انجام داد و سیاست های حفظ حریم خصوصی 20 LLM محبوب را ارزیابی کرد. وقتی دادهها را در یک چت ربات هوش مصنوعی وارد میکنید، انتظار دارید که کلمات یا اعداد را تفسیر و پردازش کند تا در وقت شما صرفهجویی کند. اما با این داده ها چه می کند؟ میتوانید خطمشی رازداری را بررسی کنید تا متوجه شوید - با این فرض که زمان لازم برای انجام این کار را دارید.
یک مطالعه جدید نشان داده است که میانگین زمان لازم برای خواندن یک خط مشی حفظ حریم خصوصی برای یک LLM 20 دقیقه است - و برخی از آنها بسیار طولانی تر خوانده می شوند.
با توجه به اینکه حدود 75 درصد از مردم حداقل یک بار در ماه به استفاده از ربات چت هوش مصنوعی اعتراف می کنند، درک اینکه سوالات و پرس و جوهای داده به کجا می روند و نحوه استفاده از آنها اهمیت فزاینده ای دارد.
سهولت در خواندن
خطمشیهای حفظ حریم خصوصی این درک را فراهم میکنند، اما آیا خواندن آنها آسان است؟ مطالعه ای که توسط کارشناسان امنیت سایبری Bridewell انجام شده است، نشان می دهد که بسیاری از آنها امتیاز سهولت خواندن Fleisch ضعیفی دارند، به این معنی که به زبان ساده، این اسناد بسیار غیرقابل نفوذ هستند.
مطالعه Bridewell خطمشیهای حفظ حریم خصوصی را از 20 مدل زبان بزرگ (LLM) ارزیابی کرد و نشان داد که میانگین زمان خواندن یک زبان 20 دقیقه است. میانگین تعداد کلمات 4603 است، اما چالش واقعی درک اطلاعات است.
Flesch Reading Ease Score معیاری برای خوانایی است که توسط رودولف فلش در سال 1948 ابداع شد و به طور گسترده برای امتیاز دادن به متون استفاده می شود. نمره بالای 60 خوب است، در حالی که نمره زیر آن خوب نیست. میانگین امتیاز فلش برای این خطمشیهای حفظ حریم خصوصی 40.2 است که نشاندهنده درجهای از تراکم بر اساس اصطلاحات است که اکثر مردم آن را درک نمیکنند.
پس چگونه عموم مردم با آگاهی کامل از نحوه استفاده از اطلاعات وارد شده از یک ربات چت LLM مانند ChatGPT یا Google Gemini استفاده می کنند؟
آموزش ورودی ها
در ارزیابی LLM ها، بریدول دریافت که 13 مورد از 20 مورد از ورودی ها و خروجی ها برای آموزش مدل های خود استفاده می کنند. برخی از LLM ها گزینه انصراف از آموزش را ارائه می دهند، اما برخی دیگر این کار را نمی کنند. حتی در مواردی که امکان انصراف وجود دارد، همیشه مشخص نیست که چگونه آن را انجام دهید.
کریس لینل، مدیر بخش حریم خصوصی داده در Bridewell، خاطرنشان کرد: «برای کاربران ضروری است که به طور کامل درک کنند که دادههایشان توسط LLMها پردازش میشود، و کسبوکارها به راهنماییهای داخلی واضح در مورد اینکه چه چیزی را میتوان و چه چیزی را نمیتوان به اشتراک گذاشت، و حسابهای سازمانی ایدهآل با حفاظتهای مناسب نیاز دارند.» LLMs.”
فقط یک خطر شخصی ناشی از ورود داده ها به یک هوش مصنوعی وجود ندارد. کارکنان باید از نحوه استفاده از فناوری برای کار آگاه باشند.
به عنوان یک قاعده کلی، هرچه LLM پیچیدهتر باشد (مثلا Meta's Muse Spark یا Moonshot AI Kimi K)، خواندن خطمشی رازداری بیشتر طول میکشد.
متن اصلی (انگلیسی)
Privacy policies on top LLMs take over 20 minutes to read, so perhaps it no wonder people are signing their lives over to ChatGPT and others
Technical and legal jargon make privacy policies for LLMs and their chatbots almost unreadable for most people.