transcribe cualquier audio, mp3, mp4
162
Este es un contenedor de Docker para ejecutar un servicio basado en Whisper de OpenAI con soporte para procesamiento de audio. La imagen está basada en Python 3.9 Slim Bullseye e incluye ffmpeg para el manejo de archivos multimedia.
docker runPara ejecutar esta imagen directamente con docker run, sigue estos pasos:
mediaCrea un directorio media en tu máquina local donde quieras almacenar los archivos de audio que serán procesados:
mkdir media
docker run --rm --name whisper-audio -v "$(pwd)/media:/usr/src/app/media" crzek/whisper-audio:1.0
version: "3.8"
services:
whisper-audio:
image: crzek/whisper-audio:1.0
container_name: whisper_audio_service
volumes:
- ./media:/usr/src/app/media
command: ["python3", "main.py"]
docker-compose up
# parar y eliminar contenedores
docker-compose down
Es obligatorio Crear un volumen en (media) y poner los archivos de audio(mp3, mp4) para poder procesar información
Content type
Image
Digest
sha256:ab7872fb1…
Size
2.8 GB
Last updated
almost 2 years ago
docker pull crzek/whisper-audio:2.0