GitHub-радар

NeoHorse-1-4B: Qwen3.5-4B заточенный под агентные задачи

TokenRhythm доработал базовую модель Alibaba Qwen3.5-4B для агентных сценариев — +10 баллов на тестах агентного планирования и кода, запускается на обычном ноутбуке.

01TokenRhythm/NeoHorse-1-4B 1.8k9.5k загрузок/мес4.2B параметровtext-generation

TokenRhythm доработал базовую модель Alibaba Qwen3.5-4B методом agentic post-training с маршрутизирующей обвязкой — системой обучения, заточенной на агентные сценарии: работу с инструментами, планирование задач, написание и отладку кода. Прирост составил +5.93 балла в среднем по десяти бенчмаркам относительно исходной Qwen3.5-4B, с особенно заметным ростом на агентных задачах: +9.79 на WorkBuddy Bench, +6.21 на QwenClawBench, +9.75 на HumanEval. Контекстное окно — 262 144 токена. Параметров 4.2 миллиарда; в 4-битной версии занимает около 2.5 ГБ. Готовая GGUF-версия от mradermacher доступна на https://huggingface.co/mradermacher/NeoHorse-1-4B-GGUF для запуска через LM Studio или Ollama.

Зачем это вайб-кодеру

Если нужна локальная модель для простых агентных задач — повторяющиеся скрипты, лёгкая генерация кода, офлайн-автоматизация — это более заточенная отправная точка, чем базовая Qwen3.5-4B. Честно: 4B это 4B, и разрыв в качестве по сравнению с фронтирными моделями вроде Claude реальный и ощутимый. Подходит для простых повторяющихся задач или ситуаций, когда платная подписка не нужна.

Как поставить

Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:

Поставь мне модель NeoHorse-1-4B в GGUF-версии: https://huggingface.co/mradermacher/NeoHorse-1-4B-GGUF — подбери квантование под мой компьютер, запусти через LM Studio или Ollama и покажи, как к ней обратиться.

Обычный ноутбук от 8 ГБ оперативки — в 4-битной версии модель занимает около 2.5 ГБ.

Открыть на Hugging Face