GitHub-радар
Qwen 27B у себя на маке: помещается в 8.6 ГБ
Команда Prism ML сжала модель Qwen3.8-27B от Alibaba до 8.6 ГБ - теперь она работает на любом Mac с Apple Silicon.
Команда Prism ML сжала модель Qwen3.8-27B от Alibaba с помощью нового метода сжатия весов. Итоговый файл занимает 8.60 ГБ на диске и запускается нативно на Apple Silicon. По данным авторов, сохраняется 98.2% от исходного качества. Модель понимает картинки наряду с текстом, пишет и объясняет код, ведёт длинные разговоры и умеет вызывать внешние инструменты в агентном режиме. На Apple M5 Max выдаёт около 47 токенов в секунду. Работает только на Mac с Apple M-чипами.
Зачем это вайб-кодеру
Авторы описывают модель как рассчитанную на обычные ноутбуки при размере 8.60 ГБ на диске. Большинство моделей этого уровня требуют 32 ГБ памяти или выделенного GPU. Для задач вроде ответов на вопросы, написания кода, анализа изображений или работы в роли локального агента - это одна из немногих 27-миллиардных моделей, которая помещается на MacBook с 16 ГБ. Работает без интернета и без платной подписки.
Как поставить
Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:
Установи мне модель Qwen от Alibaba в сжатой версии для Mac: https://huggingface.co/prism-ml/Ternary-Bonsai-2-27B-mlx-2bit - следуй инструкции из README, установи зависимости и запусти тестовый диалог.
Mac с Apple M-чипом от 16 ГБ памяти - в 2-битной версии модель занимает 8.60 ГБ на диске. На Mac без Apple Silicon не запустится.
Открыть на Hugging Face▌ Ещё находки