Tech Meridian ← К ЛЕНТЕ
PROМОЙ MERIDIAN EN

ИССЛЕДОВАНИЕ · RESEARCH · #1352

Атараксос (CMU/NYU/Stanford/MIT) обыграл лучшего игрока в Stratego Пима Ниемейера

Исследователи из Carnegie Mellon, NYU, Stanford и MIT в статье в Nature представили Ataraxos — ИИ, который, по мнению авторов, впервые достиг сверхчеловеческого уровня в Stratego; в официальной серии из 20 партий он обыграл Пима Ниемейера со счётом 15–1–4. Система обучается методом самоигр, использует сеть для предсказания скрытых фигур и регуляризацию для поддержания разнообразия стратегий; обучение заняло около недели на 16 Nvidia H100 (плюс четыре дня на четырёх GPU для belief-сети) с оценочным бюджетом ниже $8,000 (цены 2025 года).

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. Исследователи из Carnegie Mellon, NYU, Stanford и MIT в статье в Nature представили Ataraxos — ИИ, который, по мнению авторов, впервые достиг сверхчеловеческого уровня в Stratego; в официальной серии из 20 партий он обыграл Пима Ниемейера со счётом 15–1–4.
  2. Система обучается методом самоигр, использует сеть для предсказания скрытых фигур и регуляризацию для поддержания разнообразия стратегий; обучение заняло около недели на 16 Nvidia H100 (плюс четыре дня на четырёх GPU для belief-сети) с оценочным бюджетом ниже $8,000 (цены 2025 года).
  3. Важно потому, что это демонстрирует практичный, экономный по выборкам метод для игры с неполной информацией — сверхчеловеческий уровень в Stratego при существенно меньших вычислительных затратах по сравнению с DeepNash/DeepMind.

ПОЧЕМУ ЭТО ВАЖНО

Важно потому, что это демонстрирует практичный, экономный по выборкам метод для игры с неполной информацией — сверхчеловеческий уровень в Stratego при существенно меньших вычислительных затратах по сравнению с DeepNash/DeepMind.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1