Компактная модель синтеза речи на 0,6 млрд параметров с клонированием голоса по короткому образцу на 11 языках.
Audio8-TTS — модель для превращения текста в речь, которая умеет копировать чужой голос по короткой аудиозаписи без дополнительного обучения (zero-shot). Это предварительная (preview) версия с поддержкой английского, китайского, японского, корейского, немецкого, французского и ещё нескольких языков. В репозитории выложены веса модели, код для запуска через Hugging Face и отдельный пайплайн для дообучения.
Описание автора:SOTA-Class TTS at Compact Scale
Python★ 1 475создан 29 июля 2026форков 144Apache-2.0