← Все новости·2026-08-09·3 мин чтения

DiffusionGemma: Google конвертировала LLM в диффузионную без переобучения

Google DeepMind превратила Gemma 4 в диффузионную модель, потратив менее 10% бюджета. Результат: 1 500 токенов/с, параллельная генерация блоков по 256 токенов.

airesearchgooglediffusionllm

Google DeepMind взяла готовую Gemma 4 на 26 млрд параметров и за менее чем 10% исходного бюджета обучения превратила её в диффузионную модель. DiffusionGemma генерирует 256 токенов одновременно — не по одному, как обычный LLM, — и выдаёт около 1 500 токенов в секунду на Nvidia H100. Качество чуть ниже оригинала, зато задачи с рассуждением улучшились на 10 пунктов, а судоку решаются в 85% случаев — против нуля у базовой модели.

До сих пор диффузионные текстовые модели требовали обучения с нуля — это отпугивало всех, кроме крупнейших игроков. Теперь, когда любую готовую модель можно перепрофилировать за долю бюджета, специализированные варианты станут дешевле и разнообразнее. Это меняет экономику гонки за эффективностью генерации.

Источник: the-decoder.com

Бесплатный курс

Хватит читать про ИИ — начни строить с ним

Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.

Начать →
ЕАЕвгений Арсентьев

Автор

Евгений Арсентьев

PhD · CEO, digital health