AMD купила стартап, прошивающий AI-модели прямо в чип
AMD купила стартап Taalas: их чипы запекают веса нейросети прямо в кремний и достигают 16 000 токенов/с на Llama 3.1-8B — в разы быстрее обычных GPU.
AMD купила канадский стартап Taalas, который запекает веса нейросети прямо в кремний — так чип запускает Llama 3.1-8B со скоростью более 16 000 токенов в секунду на пользователя, что в разы быстрее обычных GPU. Сумма сделки не раскрыта; AMD интегрирует технологию в линейку ускорителей Instinct. Google параллельно идёт тем же путём с Gemini.
У каждого такого чипа одна прошитая модель — сменить нельзя, но для сервисов с фиксированной задачей (модерация, синтез речи, встроенные ассистенты) скорость 16 000 токенов/с на пользователя полностью меняет экономику. Это сигнал: рынок движется к специализированным чипам под конкретную нейросеть.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →
Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи