ИИ впервые обыграл сильнейшего в истории игрока в настольную игру Stratego

Алгоритм впервые обыграл сильнейшего за всю историю игрока в Stratego — настольную игру, где фигуры соперника закрыты и их ранг до столкновения неизвестен. Именно скрытая информация держала эту игру недоступной для ИИ дольше шахмат и го: там позиция видна целиком, здесь приходится делать выводы о том, чего не видишь.
По описанию Ars Technica, результат получен без гигантских вычислений — бюджет по меркам крупных лабораторий скромный. В обсуждении упирают на то же: выигрыш дала не мощность, а способ работы с неопределённостью.
Что говорят
smokelHacker News
Это хорошо высвечивает статью 2022 года «Mastering the Game of Stratego with Model-Free Multiagent Reinforcement Learning»: судя по всему, тогдашнее «мастерство» было ещё не вполне мастерством. Четыре года спустя новый подход действительно обыгрывает людей.
gavinlillyHacker News
Интересно, как нынешние ИИ справятся с вариантом Stratego «тихая защита»? В статье сказано, что сложность — в высокой неопределённости, а там защищающийся не раскрывает номер своей фигуры, так что неопределённость ещё выше.
smokelHacker News
Такой подход работает и для Hanabi — очень интересной игры, где ты не видишь свои карты, а другие игроки видят. Купил её после того, как о ней упомянули в подкасте по обучению с подкреплением, и не раз сыграл.