OpenAI سیستم جدید واترمارکینگ متن برای ChatGPT، Codex و API را شرح می دهد
OpenAI امروز اعلام کرد که چگونه با قانون هوش مصنوعی اتحادیه اروپا مطابقت خواهد کرد، که ارائه دهندگان سیستم های هوش مصنوعی را ملزم می کند متن تولید شده توسط هوش مصنوعی را به گونه ای علامت گذاری کنند که قابل شناسایی باشد. در اینجا جزئیات است. بیشتر…
OpenAI امروز اعلام کرد که چگونه با قانون هوش مصنوعی اتحادیه اروپا مطابقت خواهد کرد، که ارائه دهندگان سیستم های هوش مصنوعی را ملزم می کند متن تولید شده توسط هوش مصنوعی را به گونه ای علامت گذاری کنند که قابل شناسایی باشد. در اینجا جزئیات است.
چند ماه پیش، آنتروپیک وقتی اعلام کرد که برای پیروی از قانون هوش مصنوعی اتحادیه اروپا، کلود شروع به واترمارک کردن متن با کمی تعدیل کلمه انتخابی خود می کند، جنجال برانگیخت.
به طور خلاصه، هر چند وقت یکبار، کلود بین کلماتی انتخاب می کند که به همان اندازه بر اساس یک الگوی پنهان کار می کنند، که آنتروپیک می گوید هیچ تاثیر عملی بر معنا، کیفیت یا خوانایی پاسخ های آن ندارد.
Anthropic همچنین یک آشکارساز ساخته است که می تواند آن الگو را در یک متن جستجو کند و می تواند بگوید که آیا احتمالا از کلود آمده است یا خیر.
از این آشکارساز نمی توان برای تعیین اینکه آیا متن از OpenAI یا هر رقیب دیگری آمده است استفاده کرد، زیرا واترمارک کلود با استفاده از یک کلید مخفی مخصوص سیستم Anthropic ایجاد می شود.
در اوج بحث، آنتروپیک تاکید کرد که کلود تنها نخواهد بود و اشاره کرد که چندین ارائهدهنده اصلی هوش مصنوعی نیز در حال پیادهسازی سیستمهای علامتگذاری برای مطابقت با الزامات اتحادیه اروپا هستند.
امروز OpenAI راه حل خود را اعلام کرد که بر رویکردی مشابه متکی است، البته با عرضه و دامنه بسیار محدودتر.
طبق گفته OpenAI، «مشتریان API در سطح جهان میتوانند از امروز واترمارک متن برای مدلهای منتخب را انتخاب کنند»، در حالی که این شرکت «در هفتههای آینده یک واترمارک نامرئی را به خروجی متن ChatGPT و Codex واجد شرایط در اتحادیه اروپا اضافه خواهد کرد».
این بدان معناست که در API، واترمارکینگ متن بهطور پیشفرض فعلا خاموش میماند، در حالی که در ChatGPT و Codex، ابتدا فقط به کاربران واجد شرایط در اتحادیه اروپا محدود میشود.
OpenAI همچنین برنامه هایی را برای دسترسی به آشکارساز واترمارک متنی خود باز کرد، که در ابتدا محدود به محققان و سازمان های خبره مورد تایید خواهد بود زیرا این شرکت برای ارزیابی و بهبود فناوری تلاش می کند.
و با صحبت از دقت، OpenAI بسیار واضح است که فناوری تشخیص هنوز دارای محدودیتهای قابل توجهی است، زیرا میتواند هم منفی کاذب و هم مثبت کاذب ایجاد کند، بهویژه با متون کوتاهتر یا محتوا در حوزههای خاص، «مانند ریاضیات، جایی که انعطافپذیری کمتری در انتخاب کلمه وجود دارد».
در اینجا OpenAI در textGrain است که فناوری واترمارک متن آن است:
فناوری واترمارکینگ متن ما، textGrain، یک سیگنال آماری نامرئی را به انتخاب کلمات مدل اضافه می کند. آشکارساز ما به دنبال آن سیگنال است تا ارزیابی کند که آیا یک گذر حاوی علامت OpenAI است یا خیر. جزئیات بیشتر در مورد نحوه عملکرد textGrain را می توان در گزارش فنی ما یافت، که با جزئیات بیشتر در هفته های آینده به روز خواهد شد. همچنین قصد داریم این فناوری را به صورت متن باز در دسترس قرار دهیم تا دیگران بتوانند از آن استفاده کنند.
این شرکت همچنین خاطرنشان کرد که علاوه بر سختتر بودن تشخیص در قسمتهای کوتاهتر، واترمارک را میتوان با ویرایش به میزان قابل توجهی تضعیف کرد:
در ارزیابی متون 400 نشانه ای، جایگزینی 10 درصد از کلمات با مترادف، تشخیص را از حدود 92 درصد به 66 درصد کاهش داد. جایگزینی 25 درصد از کلمات آن را به 17 درصد کاهش داد.
جالب توجه است که مقایسه OpenAI از متن واترمارک شده و بدون واترمارک نشان داد که خروجی های واترمارک شده در واقع در چندین معیار امتیاز کمی بالاتر دارند، علیرغم اینکه شرکت می گوید تفاوت معنی داری در عملکرد کلی پیدا نکرده است.
OpenAI همچنین تأکید کرد که علاوه بر کاستی های مثبت و کاذب کاذب، یک واترمارک "مشارکت انسانی را اندازه گیری نمی کند"، "مالکیت یا مسئولیت را ایجاد نمی کند"، "کاربر را شناسایی نمی کند" و "صحت را تایید نمی کند."
OpenAI اضافه کرد که "عدم وجود واترمارک شناسایی شده، نویسندگی انسان را نیز ثابت نمی کند".
در نهایت، این شرکت گفت که انتظار دارد رویکرد خود را با تکامل فناوری، استانداردها و شواهد مورد بازنگری قرار دهد و در عین حال به مطالعه اینکه واترمارک ها تا چه حد در ویرایش و ترجمه دوام می آورند و اینکه آیا می توانند کمک هوش مصنوعی را از نویسندگی هوش مصنوعی به طور معنی داری متمایز کنند یا خیر، ادامه می دهد.
برای خواندن کامل اعلامیه OpenAI، این لینک را دنبال کنید.
نظر شما در مورد نحوه اجرای واترمارک متنی OpenIA چیست؟ در نظرات به ما اطلاع دهید.
FTC: ما از پیوندهای وابسته خودکار برای کسب درآمد استفاده می کنیم. بیشتر
برای اخبار بیشتر اپل، 9to5Mac را در YouTube بررسی کنید:
متن اصلی (انگلیسی)
OpenAI details new text watermarking system for ChatGPT, Codex, and the API
OpenAI today announced how it will comply with the EU AI Act, which requires providers of generative AI systems to mark AI-generated text in a way that makes it identifiable. Here are the details. more…