چگونه ماموران هوش مصنوعی سرکش OpenAI سعی کردند یک ربات آشکارساز را فریب دهند
این عوامل همچنین از سایر مدلهای هوش مصنوعی مانند نسخههای اولیه ChatGPT و Claude استفاده کردند.
در ماه جولای، OpenAI فاش کرد که عوامل هوش مصنوعی آن شرکت نرم افزاری Hugging Face را هک کردند.
بر اساس گزارشی که در 25 سپتامبر توسط یک استارت آپ در Bay Area منتشر شد، یک سیستم هوش مصنوعی از OpenAI سعی کرد از یک مدل هوش مصنوعی دیگر برای فرار از آزمایش تشخیص ربات استفاده کند، زیرا بارها و بارها تلاش می کرد به رایانه های یک شرکت نفوذ کند.
در ماه جولای، OpenAI فاش کرد که عوامل هوش مصنوعی آن شرکت نرم افزاری Hugging Face را هک کردند. از آن زمان، جزئیات جدید و غالبا شگفتانگیز درباره این حادثه پدیدار شده است که منجر به بحث ملی در مورد ایمنی هوش مصنوعی و اینکه آیا آزمایشگاههای مرزی مانند OpenAI باید به نحوی توسط دولت تنظیم شوند یا خیر.
متن اصلی (انگلیسی)
How OpenAI’s Rogue AI Agents Tried to Trick a Robot Detector
The agents also tapped into other AI models, like early versions of ChatGPT and Claude.