GitHub-радар

Распознавай речь локально на телефоне или ноутбуке без интернета

Whistle — крошечная модель распознавания речи весом меньше 17 МБ, которая превращает голос в текст прямо на устройстве, без сервера и видеокарты.

01Cactus-Compute/whistle 2105.6k загрузок/месautomatic-speech-recognition

Это ИИ-модель, которая слушает аудио и выдаёт текст с точным временем каждого слова.

Когда пригодится

Пригодится для голосового ассистента, диктофона или умного устройства на английском и 6 других языках; не подходит, если нужен русский.

Плюсы

  • Весит всего 16,9 МБ — один файл
  • Работает офлайн, без сервера и GPU
  • Даёт тайм-коды каждого слова
  • Бесплатная лицензия Apache 2.0 для любых целей

Минусы

  • Не поддерживает русский язык
  • Точность не подтверждена цифрами, только графики

Как поставить — по шагам

  1. 1Открой ИИ-агента (Claude Code или Codex) в папке своего проекта.
  2. 2Отправь агенту текст из блока ниже.
  3. 3Дождись, пока агент поставит пакет cactus-needle и скачает модель с huggingface.co/Cactus-Compute/whistle.
  4. 4Проверь, что агент вывел распознанный текст и тайм-коды каждого слова.
  5. 5Протестируй свою запись на английском, немецком, французском, испанском, итальянском, голландском или польском.

Текст для агента

Текст для шага с агентом — скопируй и отправь (Claude Code, Codex, любой):

Поставь мне модель распознавания речи Whistle от Cactus-Compute: https://huggingface.co/Cactus-Compute/whistle — установи пакет, распознай тестовую голосовую запись на английском и покажи текст с таймингом каждого слова.

Любой обычный ноутбук или даже телефон — видеокарта не нужна, вся модель весит меньше 17 мегабайт.

Открыть на Hugging Face