GitHub-радар
Splash: 27B-модель локально на Mac без облака
Inco AI выпустили движок, который запускает 27-миллиардную модель прямо на Mac без облака — через API, совместимый с Claude и OpenAI.
Inco AI сделали локальный движок для Apple Silicon, который запускает 27-миллиардные модели полностью на устройстве без облака. Он поднимает Qwen3.8-27B (17,4 ГБ) и Qwen3.6-35B (20,9 ГБ) через API, совместимые с OpenAI и Anthropic, — агенты подключаются без перенастройки. На M5 Pro с 48 ГБ памяти скорость вдвое выше ближайшего аналога, время до первого токена при кэше 32K — 282 мс. Поддерживаются стриминг, вызов инструментов, JSON Schema, изображения и встроенные PDF. Переключить Claude Code, Codex или OpenCode на локальный движок — одна команда: `splash claude`, `splash codex` или `splash opencode`. Ставится через Homebrew.
Зачем это вайб-кодеру
Если есть мощный Mac на M-чипе, рутинные задачи агента — форматирование файлов, написание тестов, лёгкий code review — можно переключить на локальную 27B-модель вместо API. Честно про качество: оно заметно ниже фронтирных моделей вроде Opus 5 или Fable 5.1, поэтому это для повторяющихся простых задач, где порог достаточности изначально низкий.
Как поставить
Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:
Установи Splash (движок для локального запуска ИИ-моделей) на мой Mac отсюда: https://github.com/incoai/splash — действуй по README, поставь через Homebrew (`brew install incoai/tap/splash`), запусти `splash serve --model incoai/Qwen3.8-27B-Splash` и `splash claude`, спроси меня если нужны разрешения
Нужен Mac M3 или новее с минимум 36 ГБ оперативной памяти — это Pro-чипы и выше, не Air.
Открыть на GitHub▌ Ещё находки