پرش به محتوای اصلی

OpenAI برای متن هوش مصنوعی، واترمارک سس ضعیفی ارائه می کند

دِ رجیستر۱۴۰۵ مهر ۱۴, سه‌شنبه، ساعت ۰۹:۳۲حدود 3 دقیقه مطالعه

انطباق، ما در مورد آن شنیده ایم

OpenAI اکنون به مشتریان API این گزینه را ارائه می دهد که خروجی برخی از مدل ها را واترمارک کنند تا با قانون هوش مصنوعی اروپا مطابقت داشته باشند. و ظرف چند هفته، بیز قصد دارد شکلی از واترمارک دیجیتال را - چه بخواهیم چه نخواهی - برای خروجی متن ChatGPT و Codex واجد شرایط در اتحادیه اروپا اعمال کند. اما برخلاف رقیب آنتروپیک، از تکنیک واترمارکینگ خود برای محتوای تولید شده در خارج از اروپا استفاده نمی کند، اگرچه مشتریان API می توانند انتخاب کنند که این علامت ها برای محتوا در هر جایی اعمال شود.

علاوه بر این، OpenAI از فناوری استفاده می‌کند که تعداد زیادی از نمونه‌های متن تولید شده توسط هوش مصنوعی را از دست می‌دهد و به راحتی می‌توان آن را فریب داد. قانون هوش مصنوعی اتحادیه اروپا، ارائه دهندگان خدمات هوش مصنوعی مولد را ملزم می کند تا خروجی مدل را به گونه ای قابل شناسایی کنند که توسط ماشین ها قابل خواندن باشد. Anthropic اولین شرکت بزرگ هوش مصنوعی بود که رویکرد خود را برای انطباق با قانون AI اعلام کرد که شامل استفاده از الگوریتم SynthID-Text گوگل است. این کار را در سطح جهانی انجام می دهد.

مایکروسافت و متا روی فناوری مشابهی برای هوش مصنوعی مبتنی بر تصویر کار می‌کنند زیرا اتحادیه اروپا تنها بازاری نیست که مردم در آن نگرانی‌هایی را در مورد منشأ محتوا و پتانسیل استفاده از محتوای تولید شده توسط هوش مصنوعی برای تولید اطلاعات نادرست مطرح کرده‌اند. OpenAI قبلا سیگنال‌های منشأ محتوای دیگری را برای تصاویر، صدا و ویدیوی تولید شده توسط هوش مصنوعی اعمال می‌کند. مطابق با قانون هوش مصنوعی، OpenAI اکنون یک رویکرد واترمارکینگ متنی به نام textGrain [PDF] ارائه می‌کند که «یک سیگنال آماری نامرئی را به انتخاب‌های کلمه مدل اضافه می‌کند.

آشکارساز ما به دنبال آن سیگنال است تا ارزیابی کند که آیا یک متن دارای علامت OpenAI است." واگرایی واژگان این نظریه است، اما در عمل نتایج متفاوت است.

نرخ خطای هدف یک درصد است، اما در قسمت‌های کوتاه 200 کلمه‌ای، آشکارساز ممکن است تنها 80 درصد از واترمارک‌ها را علامت‌گذاری کند، در حالی که این میزان در متن 400 کلمه‌ای 95 درصد است. نتایج همچنین در متون کاربردی بدتر هستند، مانند قسمت‌هایی در مورد ریاضی یا کد، زیرا جایگزینی احتمال بیشتری برای ایجاد خطا دارد. مقاله textGrain به این احتمال اشاره نمی کند که یک انتخاب کلمه از نظر آماری تغییر یافته ممکن است معنای یک قطعه داده شده را تغییر دهد. اگر الگوریتم بخواهد برخی واقعیت یا شکل های برجسته را تغییر دهد، این امکان وجود دارد.

رویکرد Anthropic که با استفاده از الگوریتم متفاوتی جایگزین کلمات خروجی خاصی نیز می شود، خطرات مشابهی را به همراه دارد. در هر صورت، واترمارک OpenAI به راحتی با جایگزینی کلمه شکست می خورد. در آزمایش‌هایی که روی قسمت‌های 400 نشانه‌ای انجام شد، تعویض 10 درصد از کلمات با مترادف، تشخیص واترمارک را از 92 درصد به 66 درصد کاهش داد. و هنگام جایگزینی 25 درصد از کلمات، سیگنال واترمارک تنها در 17 درصد موارد قابل تشخیص است. اکنون شاهد قدرت شلیک این آشکارساز هوش مصنوعی به سختی کافی اما سازگار باشید... ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI rolls out weak sauce watermarking for AI text

Compliance, we've heard of it

همه‌ی اخبار فناوری