Moonshine Voice — распознавание речи на устройстве
★ 11.2K
Moonshine Voice — это открытый набор инструментов для разработчиков голосовых агентов и приложений; распознавание речи в реальном времени целиком работает на устройстве. Берут, когда нужен голосовой помощник, который реагирует, пока человек ещё говорит, когда аудио нельзя отправлять в облако, когда распознавание надо запустить на Raspberry Pi или мобильном без интернета, когда Whisper слишком тяжёл. Ключей API и аккаунта не требуется. Внутри: модели распознавания речи, обученные с нуля — от точности выше Whisper Large V3 до крошечных моделей на 1 МБ; потоковая работа, при которой обработка идёт во время речи. Одна библиотека для Python, JavaScript/WASM, iOS, Android, macOS, Linux, Windows и Raspberry Pi; быстрый старт — pip install moonshine-voice и moonshine-voice mic --language en. Синтез речи и разговорные агенты описаны в разделе документации «Using the Library». Лицензия MIT, модели тоже MIT, кроме старых непотоковых моделей для языков кроме английского — они под некоммерческой Moonshine Community License. Направление — прежде всего речь в текст; по описанию репозитория есть также распознавание намерений и синтез речи. Подойдёт голосовым интерфейсам; для коммерческого использования проверьте лицензию нужной модели.
- #Library