Экспериментальное приложение для управления браузером голосом — ИИ понимает команду и действует ещё до конца фразы.
voice-browser распознаёт речь по словам через Web Speech API и на каждом промежуточном фрагменте отправляет запрос модели Jev, которая определяет намерение, целевой элемент на странице и завершённость команды. Управляемый браузер на движке Playwright выполняет действие через 250-350 миллисекунд после распознавания. Модель не генерирует текст сама — только выбирает из вариантов, извлечённых кодом из речи.
Описание автора:Control a real browser by voice. Jev (TypeSafe System One) decides intent + target in ~300 ms per spoken word; Playwright acts — often before you finish the sentence.