/root/.ollama : Directory for persistent storage of Ollama Models11434 : Ollama API Port8501 : RAG-GPT Web-UI Portdocker run -d --name RAG-GPT --gpus all -p 11434:11434 -p 8501:8501 -v /root/.ollama-rag-gpt:/root/.ollama call518/rag-gpt
docker run -d --name RAG-GPT -p 11434:11434 -p 8501:8501 -v /root/.ollama-rag-gpt:/root/.ollama call518/rag-gpt
# cat docker-compose.yml
version: '3.8'
services:
rag-gpt:
image: call518/rag-gpt
volumes:
- /root/.ollama-rag-gpt:/root/.ollama
environment:
OLLAMA_HOST: 0.0.0.0
ports:
- 11434:11434
- 8501:8501
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities: [gpu]
# docker compose up -d
[+] Running 2/2
⠿ Network rag-gpt-docker_default Created 0.0s
⠿ Container rag-gpt-docker-mysql-1 Started
# docker ps
CONTAINER ID IMAGE COMMAND CREATED STATUS PORTS NAMES
7621fcdbd3e1 call518/rag-gpt "/usr/bin/supervisord" 15 seconds ago Up 14 seconds 0.0.0.0:8501->8501/tcp, 0.0.0.0:11434->11434/tcp rag-gpt-docker-rag-gpt-1
# docker compose ps
NAME IMAGE COMMAND SERVICE CREATED STATUS PORTS
rag-gpt-docker-rag-gpt-1 call518/rag-gpt "/usr/bin/supervisord" rag-gpt 33 seconds ago Up 31 seconds 0.0.0.0:8501->8501/tcp, 0.0.0.0:11434->11434/tcp
# docker exec -it RAG-GPT /bin/bash
root@29b6c0017902:/opt/RAG-GPT-Source# tail -F /var/log/ollama-std*
==> /var/log/ollama-stderr.log <==
time=2024-03-31T05:07:16.327Z level=INFO source=payload_common.go:113 msg="Extracting dynamic libraries to /tmp/ollama684798444/runners ..."
time=2024-03-31T05:07:19.085Z level=INFO source=payload_common.go:140 msg="Dynamic LLM libraries [rocm_v60002 cuda_v11 cpu_avx cpu_avx2 cpu]"
time=2024-03-31T05:07:19.085Z level=INFO source=gpu.go:115 msg="Detecting GPU type"
time=2024-03-31T05:07:19.085Z level=INFO source=gpu.go:265 msg="Searching for GPU management library libcudart.so*"
time=2024-03-31T05:07:19.086Z level=INFO source=gpu.go:311 msg="Discovered GPU libraries: [/tmp/ollama684798444/runners/cuda_v11/libcudart.so.11.0]"
time=2024-03-31T05:07:19.089Z level=INFO source=gpu.go:340 msg="Unable to load cudart CUDA management library /tmp/ollama684798444/runners/cuda_v11/libcudart.so.11.0: cudart init failure: 35"
time=2024-03-31T05:07:19.089Z level=INFO source=gpu.go:265 msg="Searching for GPU management library libnvidia-ml.so"
time=2024-03-31T05:07:19.089Z level=INFO source=gpu.go:311 msg="Discovered GPU libraries: []"
time=2024-03-31T05:07:19.089Z level=INFO source=cpu_common.go:11 msg="CPU has AVX2"
time=2024-03-31T05:07:19.089Z level=INFO source=routes.go:1139 msg="no GPU detected"
root@29b6c0017902:/opt/RAG-GPT-Source# tail -F /var/log/streamlit-std*
==> /var/log/streamlit-stderr.log <==
==> /var/log/streamlit-stdout.log <==
Collecting usage statistics. To deactivate, set browser.gatherUsageStats to False.
You can now view your Streamlit app in your browser.
Network URL: http://172.17.0.3:8501
External URL: http://59.15.235.186:8501
Apache License 2.0
Content type
Image
Digest
sha256:a67648178…
Size
7 GB
Last updated
over 2 years ago
docker pull call518/rag-gpt