DeepSeek: мультимодальная Flash-модель от DeepSeek обходит Claude Opus 4.8 в агентных задачах
DeepSeek представляет V4-Flash-Vision-Exp: мультимодальную модель, которая не уступает Claude Opus 4.8 от Anthropic в агентных задачах (то есть решает задачи последовательно и самостоятельно) и способна обрабатывать до 600 изображений за один запрос.
V4-Flash-Vision-Exp — это модель, которая разбирает изображения, скриншоты и графики. Она показывает результаты, близкие к Claude Opus 4.8 от Anthropic, в агентных задачах и способна обрабатывать до 600 изображений за один запрос — и всё это за ту же цену, что и стандартная V4-Flash (которая работает только с текстом).
Ещё год назад такие мультимодальные модели считались бы дорогими и труднодоступными. С этим новым релизом от DeepSeek мы продолжаем наблюдать, как эта технология становится всё доступнее. Это будет и дальше усиливать давление на OpenAI и Anthropic.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →
Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи