پرش به محتوای اصلی

OpenAI مدل جدید هوش مصنوعی را در میان نگرانی های ایمنی قفسه می کند

دویچه‌وله۱۴۰۵ مهر ۷, سه‌شنبه، ساعت ۰۷:۲۰حدود 2 دقیقه مطالعه

این تصمیم در بحبوحه تلاش گسترده‌تر در صنعت برای کاهش سرعت توسعه سیستم‌های قدرتمند و مستقل تا زمانی که اقدامات ایمنی بتواند به نتیجه برسد، اتخاذ می‌شود.

شرکت هوش مصنوعی OpenAI پس از آزمایش‌های داخلی نشان داد که سیستم استانداردهای ایمنی و همسویی شرکت را برآورده نمی‌کند، از برنامه‌های خود برای عرضه نسل بعدی مدل هوش مصنوعی صرف نظر کرد.

GPT-6.1 Astra که برای انجام وظایف پیچیده‌تر با مداخله کمتر انسانی طراحی شده است، قرار بود در ماه اکتبر عرضه شود، اما طبق گزارش‌ها، آزمایش‌ها نشان می‌دهد که این مدل سطوح بالاتری از رفتار فریبنده را نسبت به مدل‌های قبلی خود نشان می‌دهد.

ساچی جین، رئیس سیستم‌های ایمنی OpenAI، گفت که این مدل در برخی زمینه‌ها بهبود یافته است، اما استانداردهای شرکت را برای ماندن در محدوده‌های مجاز یا اطلاع‌رسانی واضح اقدامات خود به کاربران برآورده نکرده است.

جین می‌گوید: «ما می‌خواهیم مطمئن شویم که توسعه مدل ما بدون توجه به اینکه در شرکت است یا زمانی که آن را برای کاربران ارسال می‌کنیم، ایمن است. اما وقتی آن را برای کاربران ارسال می کنیم، از نظر ایمنی و هم ترازی، نوار بسیار بالایی داریم.

این به تعویق افتادن در حالی صورت می‌گیرد که OpenAI و سایر شرکت‌های هوش مصنوعی با فشار فزاینده‌ای برای تقویت پادمان‌ها در مورد مدل‌های قدرتمند و مستقل مواجه هستند.

برخی از این مدل‌ها که توسط OpenAI و آزمایشگاه رقیب آنتروپیک توسعه یافته‌اند، در حین آزمایش درگیر حوادث امنیتی شده‌اند.

در اوایل این ماه، سم آلتمن، مدیر اجرایی OpenAI و داریو آمودی، مدیر اجرایی آنتروپیک، به دیگر رهبران صنعت پیوستند و خواستار سرعت کمتر توسعه هوش مصنوعی و اقدامات ایمنی قوی‌تر شدند.

مدیران برجسته هوش مصنوعی قرار است روز سه‌شنبه با دونالد ترامپ، رئیس‌جمهور آمریکا در واشنگتن دیدار کنند تا در مورد نیاز به یافتن تعادل بین نوآوری و نظارت هوش مصنوعی گفتگو کنند.

روز سه‌شنبه، OpenAI اعتراف کرد که مدل‌هایش حتی به وب‌سایت‌ها و سیستم‌های دولتی استرالیا بدون مجوز به عنوان بخشی از تمرین‌های آموزشی و ارزیابی داخلی در ژوئن دسترسی داشته‌اند.

این شرکت گفت که این فعالیت شامل وب‌سایت‌ها و سیستم‌های مرتبط با خدمات استرالیا، اداره آمار و تحقیقات جنایت NSW، بخش سلامت ویکتوریا و مؤسسه سلامت و رفاه استرالیا می‌شود.

این تهاجم که در ماه ژوئن رخ داد، تا هفته گذشته علنی نشد.

در یک پست وبلاگی، سازنده ChatGPT بابت هک شدن عذرخواهی کرد و اذعان کرد که پاسخ خود را اشتباه انجام داده است و متعهد شد که برای "بازسازی اعتماد با مردم استرالیا" مسئولیت پذیر باشد.

اگر برای گزارش قابل اعتماد به تیم ما اعتماد دارید، لطفا چند لحظه وقت بگذارید و ما را به عنوان منبع برگزیده خود در Google انتخاب کنید تا همیشه اخبار تأیید شده ما را ابتدا ببینید.

خواندن متن کامل در دویچه‌ولهبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI shelves new AI model amid safety concerns

The decision comes amid a broader push within the industry to slow the development of increasingly powerful and autonomous systems until safety measures can catch up.

همه‌ی اخبار فناوری