DeepSeek выпустил V4.1-Flash: меньше памяти для агентов, лучше кода
DeepSeek выпустил V4.1-Flash: 552 млрд параметров, 16 млрд активных, KV-кэш сократился вчетверо. Обошла Opus 5 и GPT-5.6 Sol на DeepSWE, лицензия MIT.
DeepSeek выпустил V4.1-Flash — мультимодальную модель с 552 миллиардами параметров, из которых в каждый момент активны лишь 16 миллиардов. Расход KV-кэша — оперативной памяти модели при генерации — сократился вчетверо по сравнению с предшественником. На кодинговом бенчмарке DeepSWE модель обошла Opus 5 и GPT-5.6 Sol и вышла под открытой лицензией MIT.
Чем меньше памяти нужно модели во время работы, тем дешевле запускать сотни агентов параллельно. V4.1-Flash прямо прицелен в агентные сценарии: открытый код плюс компактный активный слой делают его реальным конкурентом дорогим проприетарным моделям.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
MD, PhD · Руководитель ИИ-трансформации
Статьи · Свежие статьи