반응형

https://deepmind.google/blog/from-atari-to-eve-online-building-on-15-years-of-ai-research-in-games

2026.8.21
[From Atari to EVE Online: Building on 15 Years of AI Research in Games]

이 문서는 구글 딥마인드가 지난 15년 동안 게임 환경을 인공지능 발전의 핵심 동력으로 활용해 온 여정과 미래 비전을 제시합니다. 아타리 게임부터 알파고에 이르기까지 복잡한 가상 세계에서 얻은 통찰은 단순한 게임 승리를 넘어 단백질 구조 예측과 같은 과학적 혁신으로 이어졌으며, 이제는 사용자와 실시간으로 소통하는 범용 에이전트인 SIMA 2를 통해 새로운 국면을 맞이하고 있습니다. 특히 이브 온라인의 개발사 펜리스 크리에이션즈와의 파트너십을 통해 인공지능이 지속적인 학습과 장기적 계획 수립이 필요한 복합적인 사회적 생태계에서 어떻게 진화할 수 있는지 탐구합니다. 결과적으로 이 글은 게임을 인간 지능을 이해하는 거울이자 실제 세상의 난제를 해결하기 위한 최첨단 실험장으로 정의하며, 개발자들과의 협력을 통해 인류에게 유익한 기술적 돌파구를 마련하겠다는 의지를 강조합니다.

 

도입부 — 게임은 GDM의 뿌리

DeepMind가 2010년 설립된 이후, 제약이 있으면서도 풍부한 게임이라는 세계는 지능을 이해하는 데 핵심적인 역할을 해왔으며, Atari 정복부터 단백질 구조 예측 문제 해결에 이르기까지 DeepMind의 가장 큰 AI 돌파구들을 이끌어왔다. DeepMind 공동창립자인 데미스 하사비스 역시 과거 게임 개발자였으며, GDM 팀 다수도 게임 개발 경력을 갖고 있다. 이번 글은 EVE 유니버스를 만든 Fenris Creations와의 새로운 연구 파트너십, 그리고 Hello Games·Coffee Stain Studios·Foulball Hangover 등과의 협업을 배경으로 시작한다.

 

1장. Games as the engine of AI research (게임: AI 연구의 엔진)

DeepMind의 여정은 작은 팀이 딥 뉴럴 네트워크(DQN)를 훈련시켜 픽셀만으로 49종의 아타리 2600 게임을 플레이하게 만든 데서 시작되었고, 이 성과를 담은 2015년 Nature 논문이 현대 딥강화학습 시대를 촉발했다.

이후 이어진 마일스톤들:

  • AlphaGo가 2016년 세계 챔피언을 꺾었고, 이는 많은 전문가들이 최소 10년은 더 걸릴 것이라 예상했던 성과였다. [보완 내용 — 아래 참고]
  • AlphaGo Zero는 인간 데이터 없이 오직 자가 대국만으로 학습해 이전 모든 버전을 능가했다.
  • AlphaZero는 이 접근법을 체스·쇼기·바둑까지 하나의 알고리즘으로 일반화했고, MuZero는 규칙조차 모른 채 플레이를 학습했다.
  • 2019년 AlphaStar는 실시간성과 불완전 정보를 다루며 스타크래프트 II에서 그랜드마스터 등급에 도달했다.

AlphaGo의 유명한 '수 37'은 프로 해설자들이 처음엔 실수로 여길 만큼 파격적이었고, 바둑의 오랜 정설을 뒤엎으며 새로운 전략 탐구를 촉발했다. 이런 탐색 정신은 다른 AI 시스템에도 영향을 미쳐, AlphaFold가 50년 묵은 단백질 구조 예측 난제 해결에 이 토대를 적용했고 이는 2024년 노벨 화학상으로 인정받았다.

 

2장. From mastering games to understanding them (정복에서 이해로 — SIMA)

기존 연구는 명확한 목표와 충분한 훈련만 있으면 AI가 어떤 게임이든 마스터할 수 있음을 보여줬지만, 현실 세계엔 점수나 규칙집이 없다는 점에서 '어떤 게임 세계든 사람처럼 이해하고 상호작용할 수 있는가'라는 질문으로 이어졌다.

이 질문에 대한 답이 SIMA(Scalable Instructable Multiworld Agent)다. SIMA는 고득점을 최적화하는 대신, 화면을 사람처럼 '보고', 자연어 지시를 이해하며, API나 소스코드 접근 없이 일반 키보드·마우스 조작만으로 행동하는 범용 에이전트다. Gemini 기반의 SIMA 2는 실시간 추론과 대화가 가능한 인터랙티브 동반자로서, No Man's Sky·Valheim·Hydroneer 등 복잡한 3D 환경에서 인간과 유사한 플레이를 구현한다.

게임 개발자 관점의 의미:

  • 게임 코드 수정 없이도 작동하는 범용 에이전트는 게임 세계를 진짜로 이해하는 AI 동반자나, 스크립트로는 불가능한 방식으로 적응·반응하는 NPC 같은 완전히 새로운 게임플레이를 열 수 있다.
  • 개발 중에는 매 커밋마다 게임이 바뀌어도 견고한 QA 테스트를, 출시 후에는 새 콘텐츠나 예측 불가능한 플레이어 행동에 재스크립팅 없이 실시간으로 적응하는 데 쓰일 수 있다.

 

3장. 게임 개발자와의 파트너십을 통한 새로운 지평 탐구 — Fenris Creations & EVE 유니버스

GDM은 프론티어 AI 기술과 게임 개발 배경을, 스튜디오는 전문적 제작 역량과 방대한 게임 세계·플레이어 이해를 결합해 AI 없이는 불가능했던 '돌파구형 게임 경험'을 함께 찾는다는 '쇼, 돈트 텔(show, don't tell)' 방식으로 협업한다.

EVE 유니버스가 특별한 이유: 2003년 출시된 EVE Online은 수천 명이 20년 넘게 이어져 온 하나의 우주를 공유하는 대규모 우주 시뮬레이션이며, 수천 개 성계를 잇는 실제 수요-공급 기반 플레이어 주도 경제와, 동맹·분쟁·외교로 형성되는 인간 상호작용 중심의 세계를 갖고 있다.

이 환경이 요구하는 4가지 프론티어 AI 역량:

  1. 지속 학습(Continual learning) — 끊임없이 변하는 세계에서 이전 지식을 잊지 않으면서 새 기술을 습득하는 능력
  2. 메모리(Memory) — 오늘날 모델의 컨텍스트 윈도우를 훨씬 넘어서는 시간대에 걸쳐 지식을 축적·회수하는 능력
  3. 장기 계획(Long-horizon planning) — 몇 주, 몇 달, 심지어 몇 년에 걸친 추론
  4. 복잡한 다중 에이전트 역학 — 대규모의 협력·경쟁·협상·경제·창발적 사회 행동을 다루는 능력

Fenris Creations CEO Hilmar Pétursson은 EVE Online이 처음부터 플레이어가 만들어가는, 지속적 결과가 남는 샌드박스로 구상되었으며, 이번 협업이 어떤 게임 환경도 요구한 적 없는 시간 척도에서 AI가 학습·적응·기억하는 미개척 영역이라고 언급했다.

세 가지 EVE 환경의 역할 분담:

  • EVE Online은 대규모 단일 샤드 지속형 우주를 제공
  • EVE Vanguard는 1인칭 시점에서 지상 레벨의 빠른 전술적 의사결정을 더해, 순간 전술부터 은하 규모 전략까지 여러 추상화 수준에서 에이전트를 연구할 기회를 만든다
  • EVE Frontier는 프로그래밍 가능한 'Smart Assemblies'와 개방·확장형 아키텍처로, 세계의 규칙 자체가 바뀔 수 있는 개방형 환경을 제공해 완전히 새로운 게임 메커닉에 적응하는 에이전트를 요구한다

이미 나온 성과: Aura Guidance 시스템은 Gemini를 활용해 실제 신규 플레이어 지원(Rookie Help) 질문·답변을 기반으로 한 플레이어 생성 지식을 신규 파일럿에게 전달한다.

연구 로드맵(단계적 접근): 라이브 플레이어와 분리된 안전한 샌드박스인 EVE Online 오프라인 인스턴스에서 시작해, 인간과 에이전트가 지속적이고 개방적인 세계에서 공존하는 법을 연구하는 EVE Frontier로 진행하며, 역량이 충분히 성숙했을 때만 실제 인간 플레이를 풍부하게 하는 목적으로 EVE Online과 EVE Vanguard에 적용을 고려한다.

 

4장. The road ahead (앞으로의 길)

게임은 항상 지능을 비추는 거울이었고, 게임이 더 복잡하고 지속적이며 개방적으로 진화할수록 이를 다루는 AI 시스템도 함께 진화한다. DeepMind의 궁극적 목표는 변함없이 AI를 대체재가 아닌 촉매로 삼는 것이며, 장기적으로는 돌파구적 게임 경험을 열고, 게임을 더 접근하기 쉽고 개인화되게 만들며, AlphaGo에서 AlphaFold로 이어진 것처럼 게임에서 배운 것을 현실 문제와 과학적 발견에 적용하는 것이다.

 

[보완 내용] — 원문에 없거나 배경 이해에 도움이 되는 부분 (출처 기반)

1) Fenris Creations의 정체 — 사실은 'CCP Games'의 새 이름
원문은 Fenris Creations를 "EVE Universe를 만든 독립 스튜디오"로만 소개하지만, 이는 2003년부터 EVE Online을 만들어 온 CCP Games가 2026년 5월 리브랜딩한 이름이다. Fenris Creations(과거 명칭 CCP Games, Crowd Control Productions의 약자)는 아이슬란드 레이캬비크에 본사를 둔 게임 개발사로, 2018년 9월 한국의 Pearl Abyss에 2억 2,500만 달러에 인수되었다가 2026년 5월 1일 1억 2,000만 달러에 경영진에게 재매각됐다. Hilmar Veigar Pétursson CEO에 따르면, 회사명이 중국 공산당(CCP)과 혼동을 일으킬 수 있다는 점이 미중 지정학적 긴장 속에서 더 부각되어 개명 이유 중 하나로 작용했다.

 

2) Google DeepMind의 지분 투자 — 단순 연구 파트너십 이상
원문은 "연구 파트너십"이라고만 언급하지만, Google DeepMind는 이번 전환의 일환으로 Fenris Creations에 소수 지분을 투자한 것으로 알려졌다. 파트너십 범위는 장기 지평 계획(long-horizon planning), 메모리, 지속 학습 등을 EVE Online이라는 독특하게 풍부한 환경에서 탐구하는 것으로 설명된다.

 

3) 리브랜딩이 게임 운영에 미치는 영향 — "변화 없음"
Fenris Creations
의 리더십·스튜디오·제품·개발 계획은 그대로 유지되며, 아이슬란드 본사(Vatnsmýrin)와 런던·상하이 스튜디오도 그대로 운영되고, 구조조정이나 인력감축은 없다고 밝혔다.

 

728x90
반응형
Posted by Mr. Slumber
,