OpenAI برای هفتهها ربودن یک عامل هوش مصنوعی از فروم ویکی آلمان را پنهان کرد - زیرا مدل آن دقیقا همان کار را در حمله Hugging Face انجام داد.
OpenAI این واقعه را یک «تناسب» در استدلال مدل خواند و میگوید که در حال کار بر روی یک چارچوب افشای جدید است.
خواندن متن کامل در تکراداربه زبان اصلی، در سایت ناشر باز میشودمتن اصلی (انگلیسی)
OpenAI hid AI agent hijacking of German wiki forum for weeks — because its model did the exact same thing in the Hugging Face attack
OpenAI called the incident a 'misalignment' in the model's reasoning and says it is working on a new disclosure framework.