با بیشتر اطلاعات پنهان، بازی Stratego
افزودن یک شبکه عصبی دوم که هویت قطعات پنهان را حدس می زند، کلیدی بود.
دیپ بلو در سال 1997 گری کاسپاروف را در شطرنج شکست داد، AlphaGo در Go در سال 2016 لی سدول را شکست داد و رباتهای پوکر سالها است که حرفهایها را شکست دادهاند. اما یک بازی کلاسیک به نام Stratego ماندگار شد. حتی DeepMind، با بودجه استثنایی خود، نتوانست ماشینی بسازد که با اطمینان بهترین بازیکنان انسانی را شکست دهد.
اکنون، تیمی از محققان از کارنگی ملون، MIT، دانشگاه نیویورک و دانشگاه استنفورد این کار را انجام دادهاند. هوش مصنوعی آنها که آتاراکسوس نام دارد، پیم نیمیجر را شکست داد که مسلما بهترین بازیکن Stratego در تمام دوران است، 15 بازی بر یک، با چهار تساوی. و فقط 16 پردازنده گرافیکی و چند هزار دلار برای آموزش آن صرف شد.
ارتش های پنهان
در Stratego، هر بازیکن 40 مهره دریافت می کند که نشان دهنده درجات نظامی است، از یک مارشال گرفته تا یک جاسوس، به علاوه بمب و یک پرچم. شما با گرفتن پرچم حریف برنده می شوید. حریف شما می داند مهره های شما کجا هستند، اما نمی داند که چه هستند. هویتها تنها زمانی آشکار میشوند که دو قطعه در نبرد با هم برخورد کنند - قطعه ضعیفتر حذف میشود و هویت برنده آشکار میشود. این باعث می شود Stratego یک بازی با اطلاعات ناقص باشد، درست مانند پوکر، که رایانه ها سال ها پیش آن را کرک کردند.
یوجین وینیتسکی، محقق دانشگاه نیویورک و یکی از نویسندگان این مطالعه، میگوید: «یک چیز فوقالعاده متمایز درباره Stratego وجود دارد، و آن این است که حجم عظیمی از اطلاعات پنهان است که در یک مقیاس زمانی بسیار طولانی آشکار میشود.
مقاله کامل را بخوانید
نظرات
متن اصلی (انگلیسی)
With most information hidden, the game Stratego
Adding in a second neural network that guesses the identity of hidden pieces was key.