Websocket-based server for speech recognition streaming processing based on Kaldi and Vosk library.
100K+
A websocket server based on Kaldi and Vosk library.
For details see https://github.com/alphacep/vosk-server
Usage:
Start the server for English
docker run -d -p 2700:2700 alphacep/kaldi-en:latest
for other languages try kaldi-cn, kaldi-ru, kaldi-de
Check the sample code from https://github.com/alphacep/vosk-server/blob/master/test.py, run
./test.py test.wav
You can try with any wav file which has proper format - 8khz 16bit mono PCM. Other formats has to be converted before decoding.
For client samples in other programming languages see https://github.com/alphacep/vosk-server/tree/master/client-samples
Content type
Image
Digest
sha256:381024347…
Size
271.8 MB
Last updated
over 3 years ago
docker pull alphacep/kaldi-vosk-server