Alibaba выпускает Qwen3.8-Flash-Next: обходит Claude при цене в девять раз ниже
Китайские лаборатории продолжают опускать цену западных больших языковых моделей. Гонка вооружений в стоимости инференса уже заставила OpenAI и Anthropic пересмотреть свои модели ценообразования. И это только начало.
Alibaba объявила о выпуске Qwen3.8-Flash-Next — MoE-модели на 125 миллиардов параметров, которая стоит $0,16 за миллион входных токенов и по большинству бенчмарков обходит DeepSeek-V4-Flash и Claude Opus 4.6.
Qwen3.8-Flash-Next — это модель типа mixture of experts на 125 миллиардов параметров, из которых на каждый токен активируется всего 6 миллиардов. По большинству бенчмарков она обходит DeepSeek-V4-Flash и Claude Opus 4.6, стоимость инференса через API составляет $0,16 за миллион входных токенов, а обучена она была в девять раз дешевле, чем предыдущая модель, Qwen3.7-Plus. Её результат на SWE-bench Pro (для кода) — 62,5, а на GPQA Diamond (для научных рассуждений) — 91,7.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи