GitHub-радар
Audio8 TTS: синтез речи с клонированием голоса
Audio8_TTS — модель озвучки на 0.6 млрд параметров от команды Audio8 с клонированием голоса по короткому образцу. Поддерживает 11 языков, включая русский, и запускается на одной видеокарте.
Audio8_TTS — модель синтеза речи от команды Audio8 на 0.6 млрд параметров с поддержкой 11 языков, включая русский, китайский и японский. Умеет клонировать голос по короткому образцу — никакой отдельной базы записей не нужно. Модель и веса опубликованы на Hugging Face под лицензией Apache 2.0.
Зачем это вайб-кодеру
Если ты хочешь, чтобы агент или приложение звучали определённым голосом — твоим, персонажа или фирменным — Audio8_TTS справится с этим по одной короткой записи, без мощного сервера.
▌ Ещё находки