AI '아타락소스', 스트라테고 최강자 압도

뉴스편집: dezhoupuke.org
AI '아타락소스', 스트라테고 최강자 압도

AI 시스템 '아타락소스'가 스트라테고Stratego 세계 최정상 선수와의 맞대결에서 15승 1패 4무로 압도했다고 전해졌다.

아타락소스(Ataraxos)라는 인공지능 시스템이 전략 보드게임 스트라테고에서 최강 인간 플레이어 중 한 명을 상대로 압도적인 결과를 냈다. 스트라테고는 군사 테마의 숨겨진 정보 게임으로 블러프가 핵심이다. 보도된 경기 결과는 시리즈 전체에서 AI가 15승 1패 4무를 기록한 것이다.

이 결과가 의미하는 것

스트라테고는 체스나 바둑처럼 완전정보 게임이 아니다. 양쪽 플레이어는 상대에게 정체가 숨겨진 말을 배치하고, 말이 충돌할 때에야 비로소 정보가 드러난다. 이런 구조 때문에 스트라테고는 계획, 추리, 심리전이 뒤섞인 게임이 되었고, 바로 이 조합이 지금까지 강력한 보드게임 AI가 이 종목에 접근하지 못하게 만든 이유였다.

따라서 15승 1패 4무라는 성적은 단순한 흥밋거리라기보다 하나의 신호로 보는 게 맞다. 숨겨진 정보 게임에서 AI는 모든 것이 보이는 상황에서 승리 경로를 계산하는 것만으로는 부족하다. 상대가 무엇을 들고 있을지 추론하고, 위험과 보상을 저울질하며, 가치 있는 말을 충돌에 투입할지 말지 판단해야 한다. 그 충돌이 이길지 질지는 아무도 모른다.

숨겨진 정보가 기계에게 어려운 이유

포커 같은 게임에서 AI의 발전은 게임이론적 균형 계산과 대규모 자기대국(self-play)의 결합에서 나왔다. 스트라테고도 이런 특성을 일부 공유한다. 플레이어는 불확실한 상황에서 행동하고, 정보는 상호작용을 통해서만 드러나며, 기만은 실질적인 가치를 가진다. 차이라면 스트라테고에는 넓은 공간 보드와 특정 이동·전투 규칙을 가진 고정된 말 종류가 있어서 탐색 공간의 구조가 카드 게임과 다르다는 점이다.

이런 환경에서 좋은 성적을 내는 시스템은 보통 최소 세 가지 능력을 갖춰야 한다.

  • 상대의 가능한 배치와 의도를 모델링하는 능력
  • 수를 고를 때 물질적 이득뿐 아니라 정보의 가치를 평가하는 방법
  • 자신의 전략을 예측 불가능하게 만들기 위해 전략을 섞는 능력

어느 하나도 만만하지 않고, 이걸 하나의 에이전트에 통합하는 것은 공학적으로나 연구적으로나 상당한 도전이다.

숫자를 신중하게 읽는 법

15승 1무 4패라는 기록은 분명 강력한 결과지만, 단일 경기에는 늘 붙는 신중한 시선을 함께 적용해야 한다. 경기 수가 제한적이고, 사용 가능한 보고서에 경기 조건이 충분히 설명되어 있지 않으며, 한 번의 시리즈만으로 AI가 모든 인간 플레이어보다 강하다고 단정할 수는 없다. 다만 이 결과가 시사하는 바는, 전통적으로 기계가 강세를 보이지 못했던 종목에서 아타락소스가 최상위 수준에서 충분히 경쟁력이 있다는 점이다.

헤드라인과 실제 주장을 분리해서 볼 필요도 있다. 보고된 결과는 엘리트 스트라테고 선수 전체가 아니라 한 명의 최상위 플레이어를 상대로 한 것이다. 더 넓은 결론을 내리려면 반복 경기, 다양한 상대, 투명한 경기 조건이 뒷받침되어야 한다.

보통 이다음에 벌어지는 일

AI가 이런 결과를 내면 연구 커뮤니티의 전형적인 다음 수순은 뻔하다. 개발진은 사용한 방법론을 더 자세히 공개하고, 다른 상대와 추가 경기를 치르고, 시스템이 여전히 실수하는 지점을 살핀다. 플레이어 입장에서 흥미로운 질문은 AI가 이기는지 여부만이 아니라 어떻게 이기는가다. 어떤 판단이 진짜 전략적 이해에서 나온 것이고, 어떤 판단이 기계 연산 특유의 강점에서 나온 것인지 따져봐야 한다.

스트라테고는 배짱과 추론의 게임으로 오랜 역사를 가진다. 아타락소스가 이 수준의 성적을 유지한다면, AI가 완전정보 퍼즐뿐 아니라 불확실성과 기만까지 다룰 수 있다는 증거에 또 하나의 데이터 포인트가 추가되는 셈이다. 일단 지금으로서는 보고된 15승 1무 4패가 단일 시리즈에서 나온 인상적인 결과로 남고, 이 시스템이 어떻게 발전하는지 지켜볼 이유가 된다.