Локальный веб-интерфейс для быстрой расшифровки аудио и видео в текст с разделением реплик по говорящим.
Moss-Transcribe-WebUI превращает аудио или видео в текст, SRT или JSON с точными таймкодами и разделением реплик по говорящим (диаризация). Работает локально с ускорением на GPU — 4 минуты записи распознаются примерно за 10 секунд. Подходит тем, кому нужно расшифровывать интервью, лекции или звонки без облачных сервисов.
Описание автора:A local high-performance speech transcription WebUI based on transcribe.cpp + Moss-Transcribe-Diarize.
Python★ 7создан 16 сентября 2026форков 0Apache-2.0