Из-за того, что большая часть информации скрыта, игра Stratego ставила ИИ в тупик — до сих пор
В 1997 году Deep Blue победил Гарри Каспарова в шахматах, в 2016 году AlphaGo одолел Ли Седоля в го, а покерные боты уже много лет обыгрывают профессионалов. Но одна классическая игра под названием Stratego не сдавалась. Даже DeepMind, располагавшая исключительным бюджетом, не смогла создать машину, которая бы стабильно побеждала лучших игроков-людей.
Теперь команда исследователей из Университета Карнеги — Меллона, Массачусетского технологического института, Нью-Йоркского университета и Стэнфордского университета добилась этого. Их ИИ под названием Ataraxos победил Пима Нимейера, вероятно, лучшего игрока в Stratego за всю историю, со счётом 15:1, при четырёх ничьих. И для его обучения потребовалось всего 16 графических процессоров и несколько тысяч долларов.
Скрытые армии
В Stratego каждый игрок получает 40 фигур, представляющих воинские звания — от маршала до шпиона, — а также бомбы и флаг. Победа достигается захватом флага противника. Соперник знает, где находятся ваши фигуры, но не знает, каковы они. Их принадлежность раскрывается только тогда, когда две фигуры сталкиваются в бою: более слабая удаляется, а принадлежность победившей фигуры становится известна. Это делает Stratego игрой с неполной информацией, как и покер, который компьютеры освоили много лет назад. «В Stratego есть одна чрезвычайно отличительная особенность: огромное количество скрытой информации раскрывается на протяжении очень длительного времени», — сказал Юджин Виницки, исследователь из Нью-Йоркского университета и соавтор исследования.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.