Нейросеть за 8000 долларов обыграла чемпиона мира по Stratego
Система Ataraxos от исследователей Carnegie Mellon, NYU, Stanford и MIT обыграла сильнейшего в истории игрока в Stratego, потратив на обучение меньше 8000 долларов.

Система Ataraxos — проект исследователей Carnegie Mellon, NYU, Stanford и MIT — в серии из 20 партий обыграла Пима Нимейера, которого называют сильнейшим игроком в Stratego за всю историю, со счётом 15 побед при одном поражении и четырёх ничьих. На обучение ушло меньше 8000 долларов: неделя на шестнадцати видеокартах Nvidia H100 и ещё четыре дня на отдельной сети, которая оценивает, какие фигуры прячет противник. В 2023 году DeepMind пытался решить ту же задачу системой DeepNash с бюджетом в 3-4,5 миллиона долларов и больше тысячи TPU, но против лучших игроков, включая того же Нимейера, проиграл.
Для меня это прежде всего история про бюджет: небольшая команда потратила неделю на шестнадцати H100, а DeepMind — несколько месяцев работы тысячи с лишним TPU, и результат всё равно оказался хуже. В своей работе с агентами я постоянно вижу похожее: разница в качестве чаще зависит от того, как построена задача и какая модель её решает, а не от того, сколько железа за ней стоит. Прямого отношения к написанию кода это не имеет, но сигнал обнадёживающий.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →
Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи