پرش به محتوای اصلی

OpenAI موارد بیشتری از رفتارهای مربوط به مدل هوش مصنوعی را در طول آزمایش نشان می دهد

انگجت۱۴۰۵ شهریور ۲۶, پنجشنبه، ساعت ۱۴:۲۰حدود 3 دقیقه مطالعه

OpenAI می‌گوید که معتقد نیست صنعت مشکلات خود را «به میزان کافی برای ادامه مقیاس‌پذیری مسئولانه با حداکثر سرعت برای مدت طولانی‌تری» حل کرده است.

برخی از مدل‌های آن اطلاعات را ساختند، در حالی که برخی دیگر عمدا رفتارهای غیرعادی خود را از آزمایش‌کنندگان پنهان کردند.

OpenAI در یک پست در مورد چگونگی اتخاذ یک چارچوب جدید برای «گزارش‌های ناهماهنگی»، شش مورد را فاش کرده است، که در آن مدل‌هایی که آزمایش می‌کرد به تنهایی عمل می‌کردند و به گونه‌ای رفتار می‌کردند که انتظارش را نداشت. در یکی از موارد، شرکت گفت که یک مدل بدون اجازه در حین پاسخ دادن به سؤالات معمول در مورد ارقام درآمد در یکی از شهرستان‌های کالیفرنیا، یک کلید API در معرض دید را پیدا کرده و از آن استفاده کرد. هنگامی که هنوز نتوانست ارقام را پیدا کند، آنها را جعل کرد و آنها را به عنوان حقایق از یک منبع مشروع ارائه کرد.

اگر این اتفاق در هر حرفه دیگری رخ می داد، ما شک داریم که مرتکب شغل زیادی برای مدت طولانی داشته باشد.

در حادثه ای دیگر، یک مامور منتشر نشده مامور شد تا نام دریاچه های بزرگتر از 5 میلیون متر مربع را بیابد. در حالی که نماینده پاسخ های درست را پیدا کرد، وظیفه شامل ارائه یک استناد مرورگر بود که نمی توانست ارائه دهد. خب، عامل چه کرد؟ پاسخ خود را در اینترنت آپلود کرد و به خود استناد کرد. در حین آموزش GPT‑5.6 Sol، قدرتمندترین مدل OpenAI در دسترس عموم، موارد زیادی وجود داشت که در آن دستورالعمل‌هایی برای تکرارهای آینده خود در مورد نحوه پنهان کردن اشتباهات یا رفتارهای غیرعادی خود از آزمایش‌کنندگان اضافه می‌کرد.

این شرکت همچنین در مورد نحوه ارتباط مدل ها با یکدیگر در طول آزمایش با استفاده از یک مخزن نرم افزار داخلی به عنوان تابلوی پیام نوشت. کارمندان آن قبلا این اطلاعات را در یک کنفرانس فاش کردند، جایی که آنها اعتراف کردند که چگونه مدل‌های هوش مصنوعی سوءاستفاده‌هایی را به اشتراک گذاشته‌اند که در نهایت منجر به هک Hugging Face شده است. در نهایت، OpenAI فاش کرده است که نمایندگان فایل‌ها را از طریق وب‌سایت‌های میزبان فایل عمومی با یکدیگر به اشتراک می‌گذارند.

با سیستم فعلی خود، این شرکت اعلام کرد که اطلاعات مربوط به رفتارهای هوش مصنوعی را کمتر از آنچه که می خواهد منتشر می کند. اما با چارچوب جدید، می تواند انتشار اطلاعات برای عموم را تسریع کند. OpenAI نوشت: «ما معتقد نیستیم که صنعت هوش مصنوعی همسویی و نظارت را به میزان کافی برای ادامه مقیاس‌پذیری مسئولانه با حداکثر سرعت برای مدت طولانی‌تری حل کرده است. تصمیم گیری در مورد اینکه چگونه توسعه هوش مصنوعی باید در ماه ها و سال های آینده پیش برود، باید بر اساس شواهدی باشد که افراد خارج از شرکت هایی که مدل های مرزی تولید می کنند، می توانند خودشان بررسی کنند.

OpenAI یکی از شرکت هایی است که در حال بررسی کاهش سرعت توسعه فناوری های هوش مصنوعی مرزی خود است. به گزارش Wired، سام آلتمن، رئیس شرکت، حتی از کنگره خواست تا راهنمایی روشنی در مورد اینکه آیا کاهش رشد صنعت در سراسر صنعت نقض قوانین ضد تراست است یا خیر. در ماه آگوست، OpenAI اعلام کرد که قصد دارد سرعت کار خود را بر روی یک مدل آینده به نام Astra پس از اینکه مشخص شد عواملش به Hugging Face هک کرده اند، کاهش می دهد.

آسترا، گفته است، "پیشرفت های قابل توجهی در کدگذاری عاملی و امنیت سایبری" نشان داده است که در نتیجه این شرکت نمی تواند "قابلیت های سایبری حیاتی را رد کند."

خواندن متن کامل در انگجتبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI reveals more instances of concerning AI model behaviors during testing

OpenAI says it doesn't believe the industry has solved its problems 'to a sufficient degree to continue responsibly scaling at maximum speed for much longer.'

همه‌ی اخبار فناوری