DiffusionGemma: Google конвертировала LLM в диффузионную без переобучения
Google DeepMind превратила Gemma 4 в диффузионную модель, потратив менее 10% бюджета. Результат: 1 500 токенов/с, параллельная генерация блоков по 256 токенов.
Google DeepMind взяла готовую Gemma 4 на 26 млрд параметров и за менее чем 10% исходного бюджета обучения превратила её в диффузионную модель. DiffusionGemma генерирует 256 токенов одновременно — не по одному, как обычный LLM, — и выдаёт около 1 500 токенов в секунду на Nvidia H100. Качество чуть ниже оригинала, зато задачи с рассуждением улучшились на 10 пунктов, а судоку решаются в 85% случаев — против нуля у базовой модели.
До сих пор диффузионные текстовые модели требовали обучения с нуля — это отпугивало всех, кроме крупнейших игроков. Теперь, когда любую готовую модель можно перепрофилировать за долю бюджета, специализированные варианты станут дешевле и разнообразнее. Это меняет экономику гонки за эффективностью генерации.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи