Модель распознавания речи от OpenAI, которая переводит и расшифровывает аудио на разных языках.
Whisper — открытая модель для распознавания и перевода речи, обученная на большом объёме разноязычного аудио. Она умеет транскрибировать разговорную речь, переводить её на другой язык и определять язык записи, заменяя собой несколько отдельных инструментов. Подходит разработчикам и компаниям, которым нужна автоматическая расшифровка аудио и видео без ручного труда.
Описание автора:Robust Speech Recognition via Large-Scale Weak Supervision
Python★ 109 178создан 16 сентября 2022форков 13 232MIT