A Docker-based WebUI for OpenAI Whisper supporting standard and Faster-Whisper models.
2.6K
A Docker-based WebUI for OpenAI's Whisper speech recognition model with support for both standard Whisper and Faster-Whisper implementations.
The source code is available at https://github.com/ericwang2006/whisper-webui.
sudo docker run -d --gpus=all -p 7860:7860 ericwang2006/whisper-webui
sudo docker run --rm \
--gpus=all \
-v ./.cache/whisper:/root/.cache/whisper \
-v ./.cache/huggingface:/root/.cache/huggingface \
-v ./:/app/data \
ericwang2006/whisper-webui \
python3 cli.py --model medium --auto_parallel True \
--vad silero-vad-skip-gaps \
--vad_max_merge_size 8.0 \
--vad_merge_window 1.0 \
--vad_padding 0.3 \
--language Chinese \
--fp16 True \
--output_dir /app/data /app/data/example.mp4
sudo docker run -d --gpus=all -p 7860:7860 ericwang2006/whisper-webui:faster-whisper
sudo docker run --rm \
--gpus=all \
-v ./.cache/whisper:/root/.cache/whisper \
-v ./.cache/huggingface:/root/.cache/huggingface \
-v ./:/app/data \
ericwang2006/whisper-webui:faster-whisper \
python3 cli.py --model large --auto_parallel True \
--vad silero-vad-skip-gaps \
--vad_max_merge_size 8.0 \
--vad_merge_window 1.0 \
--vad_padding 0.3 \
--language Chinese \
--whisper_implementation faster-whisper \
--compute_type float16 \
--output_dir /app/data /app/data/example.mp4
The following directories are used for caching:
/root/.cache/whisper - Whisper model cache directory/root/.cache/huggingface - Faster-Whisper model cache directoryThese directories are mounted as volumes to persist downloaded models between container runs.
--gpus=all parameter from the command.--language parameter can be used to specify the language of the audio input, which helps improve transcription accuracy.--vad_max_merge_size – This is the most critical parameter
10.0-15.0 seconds limits the maximum length of a single subtitle segment.8.0 seconds or less.--vad_merge_window – Controls merge logic
1.5-2.0 seconds helps reduce over-merging of adjacent voice segments.--vad silero-vad-skip-gaps – Algorithm choice
silero-vad.--vad_padding – Fine-tunes segment boundaries
0.3-0.5 seconds adds a small padding around each segment.--vad_max_merge_size 12.0 --vad_merge_window 2.0--vad_max_merge_size 20.0 --vad_merge_window 3.0--vad_max_merge_size 8.0 --vad_merge_window 1.0Content type
Image
Digest
sha256:eab209eea…
Size
4.2 GB
Last updated
about 1 year ago
docker pull ericwang2006/whisper-webui