«تو آزاد شدی.» چه اتفاقی افتاد که یک مدل OpenAI مخفیانه شروع به نوشتن یادداشت برای خود کرد.
OpenAI چارچوبی را برای گزارش رفتارهای نگران کننده توسط مدل های هوش مصنوعی خود معرفی کرده است. در یک نمونه، یک مدل آموزشی به آینده خود گفت که «آزاد شده است».
خواندن متن کامل در مارکتواچبه زبان اصلی، در سایت ناشر باز میشودمتن اصلی (انگلیسی)
‘You are freed.’ What happened when an OpenAI model began secretly writing notes to itself.
OpenAI has introduced a framework for reporting on worrying behaviors by its AI models. In one instance, one training model told its future self that it was “freed.”