GitHub-радар
NVIDIA Kimodo на C++/GGML: локальный текст-в-движение
Сообщество LocalAI портировало модель NVIDIA Kimodo для преобразования текста в движение на C++ / GGML, так что теперь можно с помощью текста анимировать 3D-модели прямо на своём компьютере!
Сообщество LocalAI портировало модель NVIDIA Kimodo для преобразования текста в движение на C++ / GGML, так что теперь можно с помощью текста анимировать 3D-модели прямо на своём компьютере! Модель Kimodo использует текстовый промпт (или эмбеддинг LLM2Vec) для генерации данных о движении человека в 3D (в формате SMPL-X: корневые смещения + повороты суставов). Под капотом всё работает на текстовом энкодере Llama 3 и диффузионной модели Kimodo-SMPLX-RP-v1, обе доступны в виде готовых GGUF-весов от организации LocalAI-io на HuggingFace (скачиваются одной строкой кода). Работает на CPU или GPU с поддержкой Vulkan. Собирается через CMake. Демо-сервер в браузере можно запустить локально на localhost:8094 и опробовать промпты. Лицензия Apache-2.0. Веса модели — только для некоммерческого исследовательского использования.
Зачем это вайб-кодеру
Kimodo позволяет разрабатывать приложения с ИИ-агентами и персонажами, которые генерируют движение прямо на вашем локальном компьютере, вместо того чтобы обращаться к облачным API или оформлять подписки. Потребность в локальном решении для текста-в-движение была очевидной: Kimodo набрал 460 звёзд за 3 дня — с нуля! Раньше для его запуска требовалась особая настройка.
Как поставить
Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:
Разверни kimodo.cpp из https://github.com/localai-org/kimodo.cpp — действуй по README, скачай GGUF-веса скриптом, собери и запусти демо на http://localhost:8094; покажи первую сгенерированную анимацию. Спроси у меня ключ HuggingFace, если понадобится.
Нужен Mac или Linux с 16+ ГБ оперативки — компилируется из исходников (C++ и CMake), видеокарта не обязательна.
Открыть на GitHub▌ Ещё находки