GitHub-радар
Распознавай речь локально на телефоне или ноутбуке без интернета
Whistle — крошечная модель распознавания речи весом меньше 17 МБ, которая превращает голос в текст прямо на устройстве, без сервера и видеокарты.
Это ИИ-модель, которая слушает аудио и выдаёт текст с точным временем каждого слова.
Когда пригодится
Пригодится для голосового ассистента, диктофона или умного устройства на английском и 6 других языках; не подходит, если нужен русский.
Плюсы
- Весит всего 16,9 МБ — один файл
- Работает офлайн, без сервера и GPU
- Даёт тайм-коды каждого слова
- Бесплатная лицензия Apache 2.0 для любых целей
Минусы
- Не поддерживает русский язык
- Точность не подтверждена цифрами, только графики
Как поставить — по шагам
- 1Открой ИИ-агента (Claude Code или Codex) в папке своего проекта.
- 2Отправь агенту текст из блока ниже.
- 3Дождись, пока агент поставит пакет cactus-needle и скачает модель с huggingface.co/Cactus-Compute/whistle.
- 4Проверь, что агент вывел распознанный текст и тайм-коды каждого слова.
- 5Протестируй свою запись на английском, немецком, французском, испанском, итальянском, голландском или польском.
Текст для агента
Текст для шага с агентом — скопируй и отправь (Claude Code, Codex, любой):
Поставь мне модель распознавания речи Whistle от Cactus-Compute: https://huggingface.co/Cactus-Compute/whistle — установи пакет, распознай тестовую голосовую запись на английском и покажи текст с таймингом каждого слова.
Любой обычный ноутбук или даже телефон — видеокарта не нужна, вся модель весит меньше 17 мегабайт.
Открыть на Hugging Face▌ Ещё находки